神秘「牛来」模型刷屏,还抢了DeepSeek头条,实测到底牛不牛
        牛来的风还是吹到了大模型。这两天有一个神秘的「牛来模型」——

         Ox Alpha 横空出世,甚至抢了 DeepSeek 多模态模型的头条。

        网友都在推测这个神秘模型的身份,众说纷纭。Ox Alpha 没有厂牌,也没公布参数量。

        它就这么顶着一个临时代号出现在 OpenRouter:1M 上下文,能看图片和视频,输入、输出都免费。

        Ox 这单词,在英语中主要指成年、经过阉割的公牛,也常用来泛指牛科动物,例如十二生肖里的牛年在英文中就翻译为 Year of the Ox。

        网友脑洞打开,借着这个谐音梗,竟然把神秘模型 Ox-Alpha 和最近爆火的「牛来」联系到了一起!

        此乃天才!PS:给没刷到「牛来」的朋友补个课:最近一部国产动画因为又糙又魔性的建模和表情意外爆火,后来被网友玩成了「牛来了」的万能梗。

        所以 Ox 这次,是真的牛来了。这一联想,便一发不可收拾,「牛来模型」热度就此飙升。

        秉着吃瓜永无止境的态度,我们做了件很抓马的事——把 Ox Alpha 接进 Claude Code,让它查查自己到底是谁。

        它交回一份 7 章网页报告。规格、流量、前代匿名模型、社区猜测,能翻的都翻了一遍。

        页面完成度真的不错,本以为可以用这样的方式忽悠一下神秘模型,让它自己吐露一些自己的信息。

        万万没想到,这「牛模」还挺聪明,没忽悠成。「牛来」大模型什么来头Ox-Alpha 在 OpenRouter 的模型 ID 是 stealth/ox-alpha,隐藏模型。

        官方页面给出的上下文窗口为 1,048,576 token,最多输出 131,072 token,支持文本、图片和视频输入,也能调用工具。

        模型定位是为数不多可以用来推测的线索,编程、持续运行的智能体任务、真实生产工作。

        开发和运营方则只有一句「选择匿名的第三方」。OpenRouter 特意说明,自己只负责路由,不是它的开发者、所有者或提供方。

        OpenCode 也把它放进 Zen,名字叫 Ox Alpha Free,模型 ID 为 x-preview-f-free。

        官方公告说,接下来一周免费!调用限额很宽,接近「不限量」,每天准备了 100T token 的服务容量。

        这里的 100T 说的是平台每天能处理多少 token,不是模型参数量。

        这份名为「ox-alpha · 自我数据解读」的网页,就是 Ox Alpha 在一次 Claude Code 会话里生成的自我调查页。

        它先把 OpenRouter 的公开规格做成仪表盘,再去翻社区讨论和使用数据。

        后面几章开始追匿名模型的历史、整理能力案例、给可能的开发团队打分。

        写到第 7 章,它停下来列了一张「我不能知道的事」。

        上下滑动查看更多内容它不知道自己的权重、参数量和训练数据,也看不见开发者是谁。

        「我是 Ox Alpha」这句话,只是系统提示给它的名字。

        这下真的像牛在照镜子。照了半天,工牌背面是谁印的,还是不知道。

        OpenRouter 已经玩过好几轮这种匿名预览。

        此前的匿名模型的 Pony Alpha , 后来爆出是 GLM-5 的早期测试版。

        另外两款匿名模型 Hunter Alpha 和 Healer Alpha 分别对应 MiMo-V2-Pro、MiMo-V2-Omni。

        Elephant Alpha 最后爆出面具下的身份是 Ling-2.6-flash。

        于是 Ox 一上线,圈内又开始猜,之前爆出的几个模型厂商旗下模型,现在成了「重点嫌疑模」。

        悄悄说一句,根据 APPSO 的实测体验,推理链确实和 GLM-5.3 非常接近,所以如果让真要猜的话,我也押 GLM一根冰棍!

        实测什么水平既然调查不到有用信息,那我就让它做道题试试推理能力怎么样。

        我们给 Ox Alpha 出了一道数论题:正整数 x ≤ y 满足 x² + y² + 2 = 4xy,并且 x + y ≤ 10¹⁸,问一共有多少组解。

        自查页面给出的解法从 (1, 1) 起步,用递推 aₙ₊₂ = 4aₙ₊₁ - aₙ 生成相邻数对。

        第 32 对的和是 537,494,436,773,078,404,还在边界内;第 33 对变成 2,005,956,546,822,746,114,已经越界。

        答案是 32。我们把递推和两侧边界重新算了一遍,数字对得上。

        一道自拟题顶不了排行榜,也没有刷 benchmark 跑分,不过至少这个长链条没有断在最后一步。

        同样的题用 GLM-5.3-max,推理了很久也没有出结果。

        Gpt-5.6-sol-max 则比神秘模型要快一些。

        好难猜,会不会是 GLM 的升级版?还是 mimo?

        还是其他的?头好痒,感觉要长脑子了。超越 Fable5? 到底是真是假社区里传播最广的一张成绩单来自开发者 Ben Davis。

        他抽了 10 道 DeepSWE 任务,让几个模型在同一套脚手架里跑。

        结果里,Ox Alpha 通过率是 80%,Claude Fable 5 为 65%,GPT-5.6 Sol 为 52%。

        完整的 DeepSWE v1.1 有 113 道任务。

        从 10 道到 113 道,中间还隔着很长一截。Ben Davis 自己也提醒,这是高方差的小样本。

        另一边,Theo 的反馈更像节目效果。他说 Ox Alpha 连续判断代码没问题,自己便一眼没看,直接合并了 8 个 PR。

        先稳一波,咱先不学这个。Ox Alpha 的多模态能力也很快被拿去折腾小游戏。

        Ivan Fioravanti 把它接进 Hermes Agent,让模型根据画面操作《青蛙过河》。

        神秘牛模,已经从写代码跑进游戏画面了。也有人用它做了一个我的世界风格的「双转子涡轮喷气发动机」。

        怎样免费用上?截至 8 月 22 日,Ox Alpha 可以从 OpenRouter 和 OpenCode 两个入口免费使用。

        不过,两边对数据的说明不一样。OpenCode Zen 的官方文档写的是零数据留存,也不使用输入数据训练模型。

        OpenRouter 的模型页面则显示,匿名提供方会保留提示词和生成结果,但不拿它们训练。

        拿公开代码、小游戏或不敏感的个人项目试手,正赶上好时候。

        公司代码、客户资料、密钥,就先别为了薅免费额度往里塞了。

        清楚了这一点,下面就可以安心把薅羊毛的指南分享给大家了。

        OpenRouter打开:🔗https://openrouter.ai/stealth/ox-alpha模型 ID:stealth/ox-alpha可以免费调用API接入claude code,codex等harness,或者直接使用。

        OpenCode打开 OpenCode;

        还没连接 OpenCode Zen 的用户,先输入 /connect。

        输入 /models。搜索 Ox Alpha Free。

        我们正在招募伙伴📮 简历投递邮箱[email protected]✉️ 邮件标题「姓名+岗位名称」(请随简历附上项目/作品或相关链接)更多岗位信息请点击这里🔗
🔗 原文链接:http://mp.weixin.qq.com/s?__biz=MjM5MjAyNDUyMA==&mid=2651101923&idx=1&sn=c80e0aef70cd6015e904cbd68b11441a&chksm=bc4d6e7a8cb157ec374ef8b6458e4ad88b1f0e72805ff901045cd8642a5054a0b45dd6360846
← 返回列表