推理与编程
可作为复杂推理、仓库级软件工程、代码生成、审查和调试任务的候选模型。
Ox Alpha 的定位包括长程软件工程、复杂推理和真实生产使用。其标示的上下文窗口为 1M tokens,并支持文本、图像和视频输入。
可作为复杂推理、仓库级软件工程、代码生成、审查和调试任务的候选模型。
使用具有明确结束条件和应用级验证的代表性任务,评估持续智能体工作。
在当前已启用的集成与账户访问范围内,可结合文本、图像和视频输入。
Ox Alpha 面向推理深度、持续执行和生产验证都很重要的工作负载。
请创建服务端 TokenRa 密钥,在控制台确认 Ox Alpha 的准确模型标识和支持的输入格式,再进行低风险测试。不要根据本页推断账户访问权限或提供商专属参数。
确认 Ox Alpha 已为你的账户启用,并查看当前模型标识和输入能力。
使用代表性的编程、推理或视觉上下文输入,并在应用中验证响应。
在导入生产流量前,设置明确的超时、有限重试、请求追踪和工作负载限制。
Ox Alpha 通过 TokenRa 按用量计费:每 100 万输入 tokens $0.14,每 100 万输出 tokens $0.52,每 100 万缓存读取 tokens $0.04。价格不代表无限访问、永久提供或不存在账户级限制;请在 TokenRa 控制台确认当前可用性和适用限制。
Ox Alpha 是 GLM-5.3-Flash(官方名称) 的预览代号,由智谱 AI(Z.ai)开发和运营。TokenRa 负责路由请求,但不是该模型的开发者、所有者或提供商。
提示词和补全内容会由提供商保留,但不会用于训练。在发送敏感或受监管信息前,请审查适用的提供商和 TokenRa 条款。
Ox Alpha 是一款面向编程、持续智能体工作、复杂推理和生产负载的推理模型。
该模型由智谱 AI(Z.ai)开发和运营,Ox Alpha 是 GLM-5.3-Flash 的预览代号。TokenRa 是路由层,不是开发者、所有者或提供商。
通过 TokenRa 使用时,每 100 万输入 tokens 为 $0.14,每 100 万输出 tokens 为 $0.52,每 100 万缓存读取 tokens 为 $0.04。请在 TokenRa 控制台确认当前访问权限和适用限制。
其标示能力包括文本、图像和视频输入,具体以当前已启用的集成为准。
这些内容会由提供商保留,但不会用于训练。
Ox Alpha 是 GLM-5.3-Flash 的预览代号,由智谱 AI(Z.ai)开发。提供方及相关名称属于其各自权利人;TokenRa 不应被视为该模型的开发者或所有者。