TokenRa模型广场
GLM-5.3-Flash 预览代号 · 通过 TokenRa 按用量计费

Ox Alpha

Ox Alpha 是一款面向编程、持续智能体工作和生产负载的推理模型,适合长程软件工程、复杂推理,以及结合文本与视觉上下文的工作流。

面向编程和持续智能体工作

Ox Alpha 的定位包括长程软件工程、复杂推理和真实生产使用。其标示的上下文窗口为 1M tokens,并支持文本、图像和视频输入。

01

推理与编程

可作为复杂推理、仓库级软件工程、代码生成、审查和调试任务的候选模型。

02

智能体工作流

使用具有明确结束条件和应用级验证的代表性任务,评估持续智能体工作。

03

视觉上下文

在当前已启用的集成与账户访问范围内,可结合文本、图像和视频输入。

适用场景

Ox Alpha 面向推理深度、持续执行和生产验证都很重要的工作负载。

  • 长程软件工程与编程任务。
  • 需要结构化评估的复杂推理。
  • 结合规划、工具与应用检查的智能体工作流。
  • 需要用代表性质量、延迟、错误和使用量进行验证的生产负载。

从当前启用的 TokenRa 集成开始

请创建服务端 TokenRa 密钥,在控制台确认 Ox Alpha 的准确模型标识和支持的输入格式,再进行低风险测试。不要根据本页推断账户访问权限或提供商专属参数。

1

确认访问权限

确认 Ox Alpha 已为你的账户启用,并查看当前模型标识和输入能力。

2

测试真实工作负载

使用代表性的编程、推理或视觉上下文输入,并在应用中验证响应。

3

加入运行控制

在导入生产流量前,设置明确的超时、有限重试、请求追踪和工作负载限制。

价格与提供方说明

Ox Alpha 通过 TokenRa 按用量计费:每 100 万输入 tokens $0.14,每 100 万输出 tokens $0.52,每 100 万缓存读取 tokens $0.04。价格不代表无限访问、永久提供或不存在账户级限制;请在 TokenRa 控制台确认当前可用性和适用限制。

智谱 AI(Z.ai)

Ox Alpha 是 GLM-5.3-Flash(官方名称) 的预览代号,由智谱 AI(Z.ai)开发和运营。TokenRa 负责路由请求,但不是该模型的开发者、所有者或提供商。

本次预览说明的数据处理

提示词和补全内容会由提供商保留,但不会用于训练。在发送敏感或受监管信息前,请审查适用的提供商和 TokenRa 条款。

常见问题

Ox Alpha 是什么?

Ox Alpha 是一款面向编程、持续智能体工作、复杂推理和生产负载的推理模型。

谁开发和运营 Ox Alpha?

该模型由智谱 AI(Z.ai)开发和运营,Ox Alpha 是 GLM-5.3-Flash 的预览代号。TokenRa 是路由层,不是开发者、所有者或提供商。

Ox Alpha 的价格是多少?

通过 TokenRa 使用时,每 100 万输入 tokens 为 $0.14,每 100 万输出 tokens 为 $0.52,每 100 万缓存读取 tokens 为 $0.04。请在 TokenRa 控制台确认当前访问权限和适用限制。

Ox Alpha 支持哪些输入?

其标示能力包括文本、图像和视频输入,具体以当前已启用的集成为准。

提示词和补全内容会用于训练吗?

这些内容会由提供商保留,但不会用于训练。

Ox Alpha 是 GLM-5.3-Flash 的预览代号,由智谱 AI(Z.ai)开发。提供方及相关名称属于其各自权利人;TokenRa 不应被视为该模型的开发者或所有者。