DataLearner 标志
OX

Ox Alpha

预览版推理大模型编程大模型

Ox Alpha

发布时间: 2026-08-20更新于: 2026-08-26 11:19:12.0600
在线体验GitHubHugging FaceCompare
模型参数
未披露
上下文长度
1M
中文支持
不支持
推理能力

Ox Alpha 是 2026 年 8 月 20 日出现在 OpenRouter 上的匿名「stealth」模型,提供方拒绝公开身份。社区通过分词器探针、报错字符串与视频 token 计费等指纹强烈指向智谱 AI 的 GLM-5 家族,并普遍猜测它是尚未发布的 GLM-5.3 Flash(或 GLM-5.5 的中间产物),但截至 2026 年 8 月 26 日厂商未做任何确认,本条目的机构归属仅为社区推断。已公开的规格为 100 万 token 上下文、13.1 万 token 最大输出,支持文本、图像与视频输入,首周免费。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Ox Alpha

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
1M tokens
最大输出长度
128K tokens
模型类型
推理大模型
输入/输出模态
文本、图像、视频 → 文本
发布时间
2026-08-20
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不涉及
知识截止
暂无数据
Ox Alpha

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无GitHub开源地址
Hugging Face
暂无开源HuggingFace地址
在线体验
暂无在线体验地址
Ox Alpha

官方介绍与博客

DataLearnerAI博客
暂无介绍博客
Ox Alpha

API接口信息

接口速度
3/5
暂无公开的 API 定价信息。
Ox Alpha

评测结果

当前尚无可展示的评测数据。

和其他模型对比

暂时没有为该模型整理的相关对比页面。

想自定义其他组合?打开对比工具

Ox Alpha

发布机构

Ox Alpha

模型解读

模型身份与收录说明

Ox Alpha 是一个「stealth」(匿名预览)模型:模型本身可以使用,但研发方身份未公开。2026 年 8 月 20 日,它以 stealth/ox-alpha 的 ID 出现在 OpenRouter 上,页面仅说明该模型「由选择保持匿名的第三方提供方开发和运营」,并将其定位为「面向编程、长周期智能体任务与生产负载的推理模型」。上线后它在 LMArena 与社区评测中表现突出,迅速引发对其出处的大规模讨论。

截至 2026 年 8 月 26 日,没有任何厂商公开认领该模型。DataLearner 将机构字段暂记为智谱 AI,依据是下文列出的社区指纹证据;这属于推断而非官方确认,也因此本条目暂不挂接 GLM 系列或基座模型关系。若后续官方披露真实身份或正式命名,本条目将整体修订。

已公开的规格

  • 上下文窗口:1,048,576 token(1M)
  • 最大输出:131,072 token
  • 输入模态:文本、图像、视频(这是匿名预览模型中首次带视频输入的一例)
  • 输出模态:文本
  • 能力定位:推理、工具调用、智能体编程
  • 计费:上线首周免费开放,之后的正式价格未公布;社区观测到的生成速度约为 56 token/秒

参数规模、架构、训练数据与许可协议均未公布,因此结构化字段中的参数量记为 0。

指向智谱 GLM 家族的社区证据

多个独立方向的指纹测试指向 Z.ai(智谱 AI)的 GLM-5 家族:

  • 分词器探针:在 95 项探针 / 25 条测试 prompt 上,Ox Alpha 的 token 计数与 GLM-5.3 完全一致,仅相差一个恒定的封装偏移。分词行为不经重新训练难以伪装,被认为是其中最难造假的信号。
  • 报错字符串:返回的错误码与文案与 Z.ai API 的写法一致。
  • 视频 token 计费:四组样本上的视频 token 消耗与 GLM-5V-Turbo 完全一致。
  • 输出风格与知识截止:代码风格指纹相近,emoji 密度约为每千字符 1.3 个,知识截止时间指向 2025 年 11 月,与 GLM-5.3 吻合。

由此产生的主流猜测是:Ox Alpha 是 GLM-5 家族中一个尚未发布的成员,最常见的说法是「GLM-5.3 Flash」——即在 2026 年 8 月 14 日发布的 GLM-5.3 之外,一个更强调效率或多模态的衍生版本。需要强调的是,「GLM-5.3 Flash」目前只是社区给出的候选名称,智谱从未发布过这一型号。分析者 teortaxesTex 另提出一种推测:Ox Alpha 可能是进一步训练后用于更强的「GLM-5.5」的主力底座。这一说法同样没有官方依据。

其它出处猜测

讨论早期还有几种竞争性假设,目前证据支持度较低:

  • OpenAI:认为它是 GPT-5.1 或某个更快的 GPT-5 变体的早期测试,理由主要是发布时机与传闻中的夏末更新吻合。
  • Google DeepMind:以「Ox」与 Gemini 星象符号的双关做联想,且 DeepMind 确有在 LMArena 匿名测试模型的先例;但 Ox Alpha 在 Gemini 系列通常能通过的视觉测试上失败,服务端特征也不像 Google 基础设施,一度被误认作 Gemini 3.5 Pro 的说法基本被指纹证据推翻。
  • Microsoft MAI:少数讨论认为是微软未发布的 MAI 版本,缺少技术证据支撑。

社区实测与评测处理

社区自测(非官方、非榜单口径)给出的成绩包括:DeepSWE 全量 113 题约 63% Pass@1,量级接近 GPT-5.6 Sol 的中档配置;Kingbench 87.5,低于 GLM-5.3 的 91.25。上线数小时内即有 Nous Research、Zed 编辑器等团队在真实场景中试用。

由于这些分数来自社区自行运行、测试条件不可控,且模型身份未定,DataLearner 暂不为该模型录入结构化评测行,也不录入 API 价格(首周免费不构成可比的计价规则)。待官方发布正式模型卡、价格页与 benchmark 表后再按更新流程补录。

信息来源

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码