一款"身份成谜"的大模型,正在用真实流量搅动全球AI格局。近日,代号Ox Alpha(中文社区戏称"牛来")的匿名模型现身OpenRouter与OpenCode平台,以免费开放的姿态提供超过百万Token的上下文窗口,并支持文本、图片、视频输入。上线后它迅速冲上OpenRouter榜首,刷新单日模型用量纪录,仅Hermes Agent、Claude Code等前五大接入方的累计调用就超过4万亿Token,同时终结了DeepSeek此前连续56天霸榜的纪录。8月26日前后免费窗口即将结束,厂商身份却仍未正式认领,G2AI周报确认其背后是智谱具备视觉语言能力的GLM-5.3,正在业绩发布前做真实流量压力测试。一场"隐身测试"引发的行业震荡,正在揭示中国大模型生态的新变量。
Ox Alpha的走红路径堪称教科书级。它以"隐身"身份出现在OpenRouter上,不披露任何厂商信息,仅标注为"选择匿名的第三方",却以免费开放、百万级上下文、多模态输入三个卖点迅速吸引全球开发者涌入。中文社区因其谐音"牛来"而热度飙升,开发者们一边调用一边猜测其真实身份:分词器指纹与GLM-5.3高度吻合的猜测、指向小米新一代MiMo的传言、谷歌DeepMind研究员的暗示,让这场"猜谜游戏"充满了话题性。
登顶的背后是实打实的性能表现。社区小样本测试显示,Ox Alpha在10道DeepSWE编程任务上的通过率约为80%,高于Claude Fable 5、GLM-5.3、Grok 4.6和GPT-5.6 Sol。G2AI周报进一步确认,Ox Alpha实为智谱GLM-5.3,该模型一周处理4.54万亿Token、环比增长128%,对OpenAI GPT-5.6 Luna的领先超过十比一。用一款尚未官宣的模型做真实流量压力测试,既验证了系统承载能力,也提前检验了产品在真实世界的表现,这种"先跑量后官宣"的打法在大模型行业并不多见。
Ox Alpha现象只是冰山一角,它背后是中国大模型生态的整体崛起。数据显示,中国大模型的周调用量已连续17周超过美国,稳居全球首位。这一领先并非偶然:国产模型在推理效率、中文能力、开源生态上的持续投入,叠加国内互联网场景的巨大需求,形成了"能力提升、成本下降、调用量爆发"的正向循环。从DeepSeek到智谱GLM,从阿里Qwen到小米MiMo,国产模型正在用真实流量证明自己的市场价值。
调用量领先的意义远超商业层面。Token调用量是衡量模型真实使用强度的核心指标,它反映了开发者和企业的实际选择,比任何实验室跑分都更有说服力。当全球开发者涌入OpenRouter调用Ox Alpha,当Hermes Agent、Claude Code等头部智能体框架把国产模型接入生产流程,中国大模型的国际竞争力已经从"能不能打"进化到"大家都在用"的阶段。17周的连续领先,意味着这种优势并非昙花一现,而是有真实需求支撑的稳定格局。
如果G2AI周报的确认属实,智谱选择让GLM-5.3以匿名身份进行压力测试,背后是一套精心设计的商业逻辑。首先,真实流量测试能暴露实验室环境无法发现的问题:高并发下的稳定性、长上下文的推理延迟、多模态输入的处理瓶颈,这些数据对模型迭代至关重要;其次,匿名测试能获取最真实的用户反馈,避免了品牌预期对评测结果的影响;最后,若模型在匿名状态下就能登顶,官宣时的声量效应将被成倍放大。
这种打法也折射出大模型竞争的深层变化:当参数竞赛的边际效益递减,厂商开始比拼工程能力与生态运营。用真实业务场景打磨模型、用开发者生态验证价值、用流量数据反哺迭代,正在成为头部玩家的共同选择。对行业而言,Ox Alpha的登顶意味着大模型的竞争已经进入"口碑+流量"的新阶段,谁能持续赢得真实用户的调用,谁就能在下一轮格局洗牌中占据主动。
Ox Alpha的免费窗口预计在8月26日前后结束,届时厂商是否认领身份、模型是否转为付费,都将成为行业关注的焦点。无论结局如何,这次事件至少留下三点启示:其一,开源与免费依然是国产大模型获取开发者心智最有效的武器;其二,真实流量数据正在成为比榜单跑分更重要的竞争标尺;其三,中国大模型的整体竞争力已经进入全球第一梯队,17周连续领跑的调用量就是最直接的证据。
对普通用户和开发者而言,Ox Alpha现象还意味着一个更实际的机会:在厂商身份揭晓之前,任何人都能免费体验这款头部级模型的完整能力,而开发者也可以借机测试自家应用在千万级并发下的真实表现。当免费窗口关闭,国产大模型的价格战与品质战或许还将继续,而中国AI生态在全球格局中的分量,正在这一次次"牛来"式的惊喜中不断加重。