Ox-Alpha,一个仅被标记为“stealth/ox-alpha”的无名模型,于 2026 年 8 月 20 日出现在 OpenRouter 上。它提供 1,048,576 个 token 的上下文窗口、视频输入功能,以及截止至 8 月 27 日的免费预览期,邀请开发者测试其在单次请求中即可“吞噬”整个代码库或多部小说的能力。
OpenRouter 已成为各种实验性模型的枢纽,这些模型在发布时往往没有企业背书,通常被标记为“stealth”(隐身)。该平台低门槛的发布流程允许研究人员和实验室使用通用标签发布原型,从而绕过常规的品牌化和支持结构。Ox-Alpha 也遵循这一模式,加入了早先的匿名发布模型,如 Pony Alpha 和 Hunter Alpha,后者后来被追溯到中国的研究实验室。
为什么 token 窗口如此重要
大多数商业大语言模型 (LLM) 的上下文限制在 8k token 左右。百万级 token 窗口将可输入模型的内容规模提升了一个数量级。在实践中,开发者可以:
- 粘贴整个软件仓库并要求进行跨文件重构,
- 输入整部手稿并要求按章节进行总结,
- 结合文本和视频帧来对 UI 设计或视觉缺陷进行推理。
该模型还将视频作为一等公民输入(first-class input),这一特性在通常依赖静态图像或独立视频专用网络的 LLM 中仍然较为罕见。
早期性能信号
一位运行了 DeepSWE 基准测试(一套评估多种语言编程能力的测试集)的研究人员记录到了 80% 的得分。该基准测试并未将 Ox-Alpha 与 GPT-5.6 或 Claude Opus 5 等成熟模型进行直接对比,但这一结果表明其在编程任务中具有很强的能力。
在另一项智能体工作流(agentic workflow)测试中,该模型执行了 69 次工具调用,仅产生了一个错误。该测试衡量了在编排外部 API 时的可靠性,这是需要在无需人工监督的情况下进行动作链式调用的自主助手的关键指标。
幕后推手可能有哪些?
目前尚无任何机构声称拥有所有权,但技术取证指向其可能与智谱 AI (Zhipu AI) 尚未发布的 GLM-5.x 系列有关。线索包括:
- 视频编码模式与已知的 GLM 模型相匹配,
- tokenizer 行为与 GLM-5.3 的 token 集合一致,
- 在之前的 GLM 版本中可见的独特 emoji 使用风格。
如果归属判断正确,Ox-Alpha 将代表从智谱内部原型到公开可用服务的飞跃,这与早先那些最终揭示了中国背景的“stealth”发布如出一辙。
开发者可以获得什么
- 大规模代码分析 – 在无需切分输入的情况下,对数千个文件进行静态分析或重构。
- 视觉上下文编程 – 将视频帧与代码生成相结合,用于 UI 自动化或视频编辑脚本。
- 长上下文工作流 – 构建在长时间交互中仍能保持记忆的智能体,适用于研究助手或叙事生成。
风险与未知数
- 缺乏文档 – 该模型缺少官方指南,使得集成过程变成了一个试错过程。
- 无支持或服务等级协议 (SLA) – 任何停机或异常行为的风险均由用户承担。
- 定价 – 模型在预览期内免费,预览期将于 8 月 27 日结束。
总结
Ox-Alpha 表明,强大的长上下文 AI 能力可以一夜之间出现,绕过传统的品牌化和支持结构。对于开发者而言,该模型为以前需要定制流水线的任务提供了一个诱人的捷径,但由于缺乏来源透明度、文档和保障服务,仍需谨慎对待。接下来的这一周将揭示 Ox-Alpha 背后的谜团究竟会演变成一个可持续使用的工具,还是仅仅是一个转瞬即逝的实验。
