Back to News

Anonymous model Ox Alpha goes viral on OpenRouter, code skills near top models

#ox-alpha#openrouter#anonymous-model#code-model

An anonymous model named Ox Alpha appeared on OpenRouter on August 20, offering a 1.0486M-token context, multimodal input, and free access via OpenCode Go. Developer tests on DeepSWE tasks showed it completing 80% of a 10-task subset, outperforming several top models, though a second test on a different subset yielded around 63%. The model's identity is widely speculated to be Zhipu's unreleased GLM-5.3 Flash or a multimodal variant, based on tokenizer and video encoding similarities, with some also suggesting Google DeepMind.

Coverage timeline

  1. 机器之心机器之心

    编辑|杨文、山辉 大模型圈流行「挂马甲」测试。 近日,一款名为 Ox Alpha 的匿名模型突然出现在 OpenRouter。Ox 本身就是「牛」的意思,国内网友很快给它起了一个更接地气的名字: 「牛来」大模型。 根据 OpenRouter 披露的信息,Ox Alpha 拥有 100 万 token 上下文,支持文本、图片和视频输入,可以调用工具,目前完全免费。 上线后不久,开发者就把它接入编码 Agent,扔进真实代码仓库进行测试。 初步测试结果显示,这款来历不明的「牛来」大模型,能力已逼近当前顶级代码模型。 与此同时,有网友爆料,一款名为 korrine 的匿名模型正在 Code Arena 上进行 测试。有人猜它是 Kimi K3.1,也有人将其指向 Qwen 和 MiMo,说啥的都有。 8 月的大模型圈,突然变成了一场大型猜谜游戏。 「牛来」大模型表现抢眼 Ox Alpha 真正引发关注,靠的是代码能力。 开发者 Ben Davis 从 DeepSWE 中抽取 10 项任务进行测试,Ox Alpha 完成了其中 8 项,通过率达到 80%。其公布的对比结果中,Fable 5 Max 为 65%,GLM-5.3 Max 和 Grok 4.6 xhigh 均为 62%,GPT-5.6 Sol Max 为 52%。 DeepSWE 考察真实软件工程能力。模型需要阅读代码仓库,定位问题,修改代码,运行测试,再根据报错继续修复。相比单轮编程题,它更接近编码 Agent 的实际工作。 不过,10 项任务的样本很小。随后,其他开发者在另一组 DeepSWE 子集上测试,给出的结果约为 63%。两次测试的任务范围和运行配置并不完全相同,暂时无法据此确定 Ox Alpha 的准确排名。 不过这些结果初步显示,这款匿名模型已经表现出很强的长程编码潜力,能力逼近当前头部模型。 「牛来」大模型到底是谁家的? 「牛来」大模型的身份,目前流传最广的说法是智谱尚未发布的 GLM-5.3 Flash,或 GLM-5.3 的多模态版本。 有人还专门写了个博客进行分析: 1. 最强证据来自视频编码器。四段不同帧率、时长和分辨率的视频中,Ox Alpha 消耗的视觉 token 与 GLM-5V-Turbo 完全一致。MiMo、Qwen 和 GLM-4.6V 都呈现出明显不同的结果。 2. 文本

  2. Techmeme

    Rohail Saleem / Wccftech : Ox Alpha, a “stealth model” from an unknown AI lab with a 1M-token multimodal context and capacity for 100T tokens/day, goes viral after launching on OpenRouter — When an unknown AI lab drops an anonymous model - Ox Alpha - for free, while declaring that they have the capacity …

  3. 量子位量子位

    匿名牛来大模型被扒出智谱血缘,也有人怀疑Cursor拿开源GLM训的 衡宇 2026-08-23 17:56:12 来源: 量子位 Tokenizer、视频编码、API报错全扒一遍 衡宇 发自 凹非寺 量子位 | 公众号 QbitAI 全世界刷屏的“牛来大模型”,到底是谁家的牛? 这两天,AI圈已经快把它扒了个底朝天。 目前 讨论度最高的模型厂商候选人,一是智谱,二是谷歌。 猜智谱的人已经开始验Tokenizer、测视频token消耗、找API报错,恨不得给模型做一套数字DNA鉴定。 猜谷歌的人则主要盯着DeepMind员工最近的发言,以及那个迟迟没有正式露面的Gemini 3.5 Pro。 牛来大模型其实叫 Ox Alpha 。 因为Ox就是“牛”,又正赶上最近《牛来》梗火遍互联网,国内网友干脆给它起了个亲切的名字叫“牛来大模型”。 8月20日,它突然以匿名模型的身份出现在OpenRouter上,OpenRouter只说它来自一家暂时保持匿名的第三方提供商。 它有104.86万token上下文,单次最多吐出13.1万token,能读文本、图片和视频,专门盯着代码、长周期Agent和复杂推理。 而且OpenCode随后宣布,Ox Alpha上线OpenCode Go, 连续数天几乎不限量免费使用,而且不计入用户原本的Go额度 (公开讨论中甚至出现了每天100万亿token级别服务容量的说法)。 于是开发者们拿着代码库、终端和各种刁钻任务,一拥而上去给它出题。 然后纷纷猜测: 牛来啊牛来,你到底是谁家的大模型? 为啥猜是这两家的? 大家之所以猜牛来大模型是智谱或谷歌的,是因为它在中文深度理解、超长上下文处理或多模态融合上展现出了这两家公司的模型特色。 而且在底层工程细节上暴露出了相似的技术指纹。 为啥猜是智谱的? 智谱是这场猜谜游戏中的领先大热门。 网友已经从牛来大模型的分词器、视频编码方式一路扒到了API服务层。 先来看tokenizer。 tokenizer负责把输入内容切成模型能够处理的token。不同模型家族往往采用不同的词表和切分逻辑,所以面对一些刻意设计的文本时,token数量会留下较稳定的“指纹”。 有测试者拿不同Prompt对Ox Alpha和多款模型进行比较,结果发现,Ox Alpha与GLM-5.3的token计数呈现高度一致的关系。 一组流传较广