TokenRa模型广场
Omen Alpha 2.0 · 通过 TokenRa 接入的推理模型

Omen Alpha API - 输入 $0.13/M,1M 上下文

使用 Omen Alpha API 构建编程、持续智能体工作和复杂推理应用。按用量透明计费,输入低至每 100 万 tokens $0.13。按照下面的快速指南获取 API Key 并发送第一个请求。

$0.13 输入每 100 万输入 tokens。
$0.5 输出每 100 万输出 tokens。
$0.03 缓存每 100 万缓存读取 tokens。

面向编程和持续智能体工作

Omen Alpha面向编程、复杂推理和智能体类生产场景,提供 1M tokens 的上下文窗口。

01

推理与编程

适用于复杂推理、仓库级软件工程、代码生成、代码审查和调试。

02

智能体工作流

用具有代表性的任务、明确的终止条件和应用层校验来评估持续智能体工作。

03

视觉上下文

Omen Alpha 在已启用的集成上支持文本和图像输入,视频行为高度匹配。请在 TokenRa 控制台确认当前能力。

适用场景

Omen Alpha 适合对推理深度、持续执行能力和生产级评估有要求的负载。

  • 长周期的软件工程与编程任务。
  • 适合结构化评估的复杂推理任务。
  • 结合规划、工具调用和应用校验的智能体工作流。
  • 需要在质量、延迟、错误率和用量上做代表性测试的生产负载。

如何获取 Omen Alpha API Key

注册 TokenRa 账号,打开控制台,创建 API Key,确认账号已启用 Omen Alpha,然后从服务端发送兼容 OpenAI 的请求。请妥善保管 Key,并在投入生产前核对线上的模型标识符。

1

注册 TokenRa 账号

完成注册后打开 TokenRa 控制台。

2

创建 API Key

进入 API Key 或令牌页面创建 Key,并保存在服务端。

3

发送测试请求

确认已启用的模型 ID,用代表性负载测试,并补充生产环境控制措施。

curl https://tokenra.io/zen/go/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"omen-alpha","messages":[{"role":"user","content":"介绍一下 Omen Alpha 的架构"}]}'

Omen Alpha 价格:按用量透明计费

Omen Alpha 在 TokenRa 上是付费模型,开始使用无需绑定信用卡。访问权限取决于账号资格、提供方可用性和相应的速率限制;投入生产前请在 TokenRa 控制台核对线上信息。

输入

$0.13 / 100 万 tokens

Omen Alpha 的标准输入价格。

输出

$0.5 / 100 万 tokens

Omen Alpha 的生成输出价格。

缓存读取

$0.03 / 100 万 tokens

通过 TokenRa 的缓存输入读取价格。

提供方尚未公开确认

Omen Alpha 的开发方尚未公开确认;有观点推测对应智谱 AI 的 glm-5.3-highspeed,但尚未获得证实。TokenRa 提供 API 网关服务,不是该模型的开发者或所有者。

Omen Alpha 与 GLM-5.3-Flash 对比

Omen Alpha 和 GLM-5.3-Flash 是两个不同的模型。下表对比两者已公开的信息,未获官方确认的条目已如实标注。

项目GLM-5.3-FlashOmen Alpha
开发商智谱 AI(Z.ai)公开确认未公开(OpenCode 数据路径指向 zhipu,模型有时自称 GLM;部分用户称已确认非智谱)
参数规模320B 总参数 / 18B 激活(MoE)未公开
架构原生多模态 MoE + 稀疏/线性混合注意力高度匹配(tokenizer、视觉/视频行为几乎一致)
上下文长度1M tokens官方未披露;社区常说 50 万,实测 ≥96.9 万(接近 1M)
最大输出约 128K tokens社区报告约 12.8 万
输入模态文本 + 图像 + 视频文本 + 图像(支持视频行为匹配)
推理能力支持(effort: low/high/max)支持推理
开源情况是(MIT 协议,Hugging Face 可下载)否(仅 API)
可用性广泛(Z.ai、Together、自托管等)通过 TokenRa 提供接入

已确认的规格参见 GLM-5.3-Flash 模型介绍。

本次预览说明的数据处理

提示词和生成结果会被提供方留存,但不用于训练。在发送敏感或受监管的信息前,请先阅读提供方和 TokenRa 的相关条款。

生产环境检查清单

  • API Key 只保存在服务端,并按环境隔离凭据。
  • 在依赖 1M tokens 上下文和各类输入模态之前,先在线上集成中确认。
  • 用代表性的编程、智能体、推理和视觉上下文负载做评估。
  • 设置明确的超时、有上限的重试、链路追踪和应用侧预算。
  • 结合自身场景审阅数据处理方式、提供方条款、隐私要求和产出物权利。

Omen Alpha API 常见问题

什么是 Omen Alpha API?

Omen Alpha API 以兼容 OpenAI 的方式提供 Omen Alpha 的访问能力。该模型面向编程、持续智能体工作、复杂推理和生产负载。

如何获取 Omen Alpha API Key?

注册 TokenRa 账号,打开控制台,创建 API Key,确认已启用 Omen Alpha,然后在服务端集成中使用该 Key。

Omen Alpha API 的价格是多少?

通过 TokenRa 使用时,每 100 万输入 tokens 为 $0.13,每 100 万输出 tokens 为 $0.5,每 100 万缓存读取 tokens 为 $0.03。请在控制台确认当前费率和额度限制。

Omen Alpha 由谁开发?

Omen Alpha 的开发方尚未公开确认;有观点推测对应智谱 AI 的 glm-5.3-highspeed,但尚未获得证实。TokenRa 提供 API 网关服务,不是该模型的开发者或所有者。

Omen Alpha 支持哪些输入?

Omen Alpha 在已启用的集成上支持文本和图像输入,视频行为高度匹配。请在 TokenRa 控制台确认当前能力。

提示词和生成结果会被用于训练吗?

会被提供方留存,但不用于训练。

Omen Alpha 的开发方尚未公开确认。文中提及的名称归各自权利人所有。TokenRa 是独立的 API 网关,不是该模型的开发者或所有者。