据量子位报道,一个名为Ox Alpha的匿名大模型于8月20日出现在OpenRouter平台上,因名称“Ox”与近期网络热梗《牛来》相关,被网友称为“牛来大模型”。该模型拥有104.86万token上下文窗口、单次最大输出13.1万token,支持文本、图片和视频输入,并专注于代码、长周期Agent和复杂推理任务。OpenCode随后宣布Ox Alpha上线其Go服务,连续数天几乎不限量免费使用,据称服务容量可达每日100万亿token级别。开发者纷纷使用代码库和终端测试该模型,其开发者身份成为焦点。
目前社区讨论最集中的两个候选是智谱和谷歌。支持智谱的一方从技术细节入手,对Ox Alpha进行了“数字DNA鉴定”。有测试者发现,Ox Alpha与智谱GLM-5.3的Tokenizer在相同输入下呈现高度一致的token计数关系,仅存在固定偏移,该偏移可由一段附加的隐藏System Prompt解释。在多模态方面,用受控视频对比后,Ox Alpha与GLM-5V-Turbo在视频采样策略、每秒token消耗增长率以及分辨率缩放方式上高度相似,额外token预算甚至逐项吻合。此外,有用户向Ox Alpha传入异常参数时捕捉到“[1210] The temperature parameter is illegal”的错误信息,被认为与智谱相关服务相似。另有社区截图显示模型中存在“trained by Z.ai”的残留信息,但该说法主要来自二手转述,证据等级较低。
一个背景是,今年2月OpenRouter曾上线另一款匿名模型Pony Alpha,后来被揭晓为GLM-5的早期测试版本,因此“智谱说”在社区中有一定基础。不过谷歌也成为热门候选:Ox Alpha的1M级上下文、原生图像和视频输入、面向长期Agent等特性与Gemini系列方向吻合;谷歌预告的Gemini 3.5 Pro迟迟未发布;Google DeepMind研究员Evan Otero在相关讨论中发布“Gemini”并称“如果Ox Alpha就是我们一路遇到的朋友呢”,被社区解读为暗示。但暂无公开证据支持这一猜测。
Ox Alpha的实际表现存在争议。据量子位报道,OpenCode公开数据显示,该模型累计使用量已达250B token级别,拥有约8500名独立用户和超过11万次完成会话。Stripe CEO Patrick Collison试用后表示“It's very impressive.”一项包含10个真实软件工程任务的社区测试中,Ox Alpha完成8个(80%),优于Fable 5(65%)、GLM-5.3(62%)和GPT-5.6 Sol(52%)。但该测试仅为小样本非官方结果。同时,Abacus.AI CEO Bindu Reddy称其测试发现Ox Alpha表现低于预期,部分指标仅相当于较早一代模型;沃顿商学院教授Ethan Mollick也认为其惊艳程度一般;还有开发者认为它在低推理强度下表现一般,视觉任务弱于Gemini系列。
目前,Ox Alpha的真实身份尚未揭晓。有网友调侃称,也可能是Cursor拿智谱模型自己训练后套了个“牛头”。按照OpenRouter以往Alpha模型的惯例,匿名期结束后开发商会公布答案。