【天顺财经】8 月 24 日消息,近日,一款代号为 Ox Alpha 的匿名 AI 模型在 OpenRouter 悄然上线,短时间内调用量迅速攀升,成功冲至平台榜首,并刷新了该平台的单日模型用量纪录。
因其代号 「Ox」 意为公牛,加上近期一部名为 《牛来》 的抽象电影走红网络,国内网友便为其取了接地气的昵称——「牛来」 大模型。
OpenRouter 最新数据显示,仅 Hermes Agent、Claude Code 等前五大应用对 「牛来」 大模型的累计调用就已超过 4 万亿 Token。在代码评测平台 OpenCode 上,该模型还终结了 DeepSeek 连续 56 天占据榜首的局面。
从更宏观的周调用量数据来看,在上周 (8 月 17 日至 8 月 23 日) 全球 AI 大模型总调用量达 93.3 万亿 Token 的背景下,中国 AI 大模型周调用量连续十七周超过美国,稳居全球首位。其中,Ox Alpha 冲进了全球周调用量前二,周调用量达 11.6 万亿 Token。
平台资料显示,Ox Alpha 被定义为一款面向代码生成、长周期 Agent 任务及真实生产场景打造的前沿模型。其上下文窗口约为 104.8 万 Token,最大输出长度为 13.1 万 Token,完整支持文本、图像、视频的多模态输入,并在预览阶段向开发者免费开放调用。
独立研究员本·戴维斯选取软件工程基准 DeepSWE 中的 10 个子任务进行测试,Ox Alpha 的通过率约为 80%,高于 Claude Fable 5 的 65%、GLM-5.3 的 62% 以及 GPT-5.6 Sol 的 52%。

值得一提的是,尽管表现惊艳,但 Ox Alpha 背后的开发主体至今仍未揭晓。
目前社区通过技术指纹比对,发现其多项特征指向智谱 GLM 系列。有研究者通过视频编码器、文本分词器等多维度测试,发现 Ox Alpha 与 GLM 系列模型高度吻合。
与此同时,多名谷歌 DeepMind 研究员发帖暗示其可能是 Gemini 的新版本。截至目前,尚无任何厂商正式出面认领该模型。
对此,有网友指出,「没必要急着破案,匿名上线恰恰是最干净的测试方式,没有先入为主的偏见,没有粉丝滤镜,好用就是好用,不好用立马被弃。」
厂商选择先隐身再亮相,大概率也是在观察真实用户反馈,避免过早被架到舆论火上烤。人工智能赛道竞争激烈,未来能赢的,不是嗓门最大的那个,而是最能干活、最懂开发者痛点的那个。
你怎么看呢?
【天顺财经】8 月 24 日消息,近日,一款代号为 Ox Alpha 的匿名 AI 模型在 OpenRouter 悄然上线,短时间内调用量迅速攀升,成功冲至平台榜首,并刷新了该平台的单日模型用量纪录。
因其代号 「Ox」 意为公牛,加上近期一部名为 《牛来》 的抽象电影走红网络,国内网友便为其取了接地气的昵称——「牛来」 大模型。
OpenRouter 最新数据显示,仅 Hermes Agent、Claude Code 等前五大应用对 「牛来」 大模型的累计调用就已超过 4 万亿 Token。在代码评测平台 OpenCode 上,该模型还终结了 DeepSeek 连续 56 天占据榜首的局面。
从更宏观的周调用量数据来看,在上周 (8 月 17 日至 8 月 23 日) 全球 AI 大模型总调用量达 93.3 万亿 Token 的背景下,中国 AI 大模型周调用量连续十七周超过美国,稳居全球首位。其中,Ox Alpha 冲进了全球周调用量前二,周调用量达 11.6 万亿 Token。
平台资料显示,Ox Alpha 被定义为一款面向代码生成、长周期 Agent 任务及真实生产场景打造的前沿模型。其上下文窗口约为 104.8 万 Token,最大输出长度为 13.1 万 Token,完整支持文本、图像、视频的多模态输入,并在预览阶段向开发者免费开放调用。
独立研究员本·戴维斯选取软件工程基准 DeepSWE 中的 10 个子任务进行测试,Ox Alpha 的通过率约为 80%,高于 Claude Fable 5 的 65%、GLM-5.3 的 62% 以及 GPT-5.6 Sol 的 52%。

值得一提的是,尽管表现惊艳,但 Ox Alpha 背后的开发主体至今仍未揭晓。
目前社区通过技术指纹比对,发现其多项特征指向智谱 GLM 系列。有研究者通过视频编码器、文本分词器等多维度测试,发现 Ox Alpha 与 GLM 系列模型高度吻合。
与此同时,多名谷歌 DeepMind 研究员发帖暗示其可能是 Gemini 的新版本。截至目前,尚无任何厂商正式出面认领该模型。
对此,有网友指出,「没必要急着破案,匿名上线恰恰是最干净的测试方式,没有先入为主的偏见,没有粉丝滤镜,好用就是好用,不好用立马被弃。」
厂商选择先隐身再亮相,大概率也是在观察真实用户反馈,避免过早被架到舆论火上烤。人工智能赛道竞争激烈,未来能赢的,不是嗓门最大的那个,而是最能干活、最懂开发者痛点的那个。
你怎么看呢?
【天顺财经】8 月 24 日消息,近日,一款代号为 Ox Alpha 的匿名 AI 模型在 OpenRouter 悄然上线,短时间内调用量迅速攀升,成功冲至平台榜首,并刷新了该平台的单日模型用量纪录。
因其代号 「Ox」 意为公牛,加上近期一部名为 《牛来》 的抽象电影走红网络,国内网友便为其取了接地气的昵称——「牛来」 大模型。
OpenRouter 最新数据显示,仅 Hermes Agent、Claude Code 等前五大应用对 「牛来」 大模型的累计调用就已超过 4 万亿 Token。在代码评测平台 OpenCode 上,该模型还终结了 DeepSeek 连续 56 天占据榜首的局面。
从更宏观的周调用量数据来看,在上周 (8 月 17 日至 8 月 23 日) 全球 AI 大模型总调用量达 93.3 万亿 Token 的背景下,中国 AI 大模型周调用量连续十七周超过美国,稳居全球首位。其中,Ox Alpha 冲进了全球周调用量前二,周调用量达 11.6 万亿 Token。
平台资料显示,Ox Alpha 被定义为一款面向代码生成、长周期 Agent 任务及真实生产场景打造的前沿模型。其上下文窗口约为 104.8 万 Token,最大输出长度为 13.1 万 Token,完整支持文本、图像、视频的多模态输入,并在预览阶段向开发者免费开放调用。
独立研究员本·戴维斯选取软件工程基准 DeepSWE 中的 10 个子任务进行测试,Ox Alpha 的通过率约为 80%,高于 Claude Fable 5 的 65%、GLM-5.3 的 62% 以及 GPT-5.6 Sol 的 52%。

值得一提的是,尽管表现惊艳,但 Ox Alpha 背后的开发主体至今仍未揭晓。
目前社区通过技术指纹比对,发现其多项特征指向智谱 GLM 系列。有研究者通过视频编码器、文本分词器等多维度测试,发现 Ox Alpha 与 GLM 系列模型高度吻合。
与此同时,多名谷歌 DeepMind 研究员发帖暗示其可能是 Gemini 的新版本。截至目前,尚无任何厂商正式出面认领该模型。
对此,有网友指出,「没必要急着破案,匿名上线恰恰是最干净的测试方式,没有先入为主的偏见,没有粉丝滤镜,好用就是好用,不好用立马被弃。」
厂商选择先隐身再亮相,大概率也是在观察真实用户反馈,避免过早被架到舆论火上烤。人工智能赛道竞争激烈,未来能赢的,不是嗓门最大的那个,而是最能干活、最懂开发者痛点的那个。
你怎么看呢?
【天顺财经】8 月 24 日消息,近日,一款代号为 Ox Alpha 的匿名 AI 模型在 OpenRouter 悄然上线,短时间内调用量迅速攀升,成功冲至平台榜首,并刷新了该平台的单日模型用量纪录。
因其代号 「Ox」 意为公牛,加上近期一部名为 《牛来》 的抽象电影走红网络,国内网友便为其取了接地气的昵称——「牛来」 大模型。
OpenRouter 最新数据显示,仅 Hermes Agent、Claude Code 等前五大应用对 「牛来」 大模型的累计调用就已超过 4 万亿 Token。在代码评测平台 OpenCode 上,该模型还终结了 DeepSeek 连续 56 天占据榜首的局面。
从更宏观的周调用量数据来看,在上周 (8 月 17 日至 8 月 23 日) 全球 AI 大模型总调用量达 93.3 万亿 Token 的背景下,中国 AI 大模型周调用量连续十七周超过美国,稳居全球首位。其中,Ox Alpha 冲进了全球周调用量前二,周调用量达 11.6 万亿 Token。
平台资料显示,Ox Alpha 被定义为一款面向代码生成、长周期 Agent 任务及真实生产场景打造的前沿模型。其上下文窗口约为 104.8 万 Token,最大输出长度为 13.1 万 Token,完整支持文本、图像、视频的多模态输入,并在预览阶段向开发者免费开放调用。
独立研究员本·戴维斯选取软件工程基准 DeepSWE 中的 10 个子任务进行测试,Ox Alpha 的通过率约为 80%,高于 Claude Fable 5 的 65%、GLM-5.3 的 62% 以及 GPT-5.6 Sol 的 52%。

值得一提的是,尽管表现惊艳,但 Ox Alpha 背后的开发主体至今仍未揭晓。
目前社区通过技术指纹比对,发现其多项特征指向智谱 GLM 系列。有研究者通过视频编码器、文本分词器等多维度测试,发现 Ox Alpha 与 GLM 系列模型高度吻合。
与此同时,多名谷歌 DeepMind 研究员发帖暗示其可能是 Gemini 的新版本。截至目前,尚无任何厂商正式出面认领该模型。
对此,有网友指出,「没必要急着破案,匿名上线恰恰是最干净的测试方式,没有先入为主的偏见,没有粉丝滤镜,好用就是好用,不好用立马被弃。」
厂商选择先隐身再亮相,大概率也是在观察真实用户反馈,避免过早被架到舆论火上烤。人工智能赛道竞争激烈,未来能赢的,不是嗓门最大的那个,而是最能干活、最懂开发者痛点的那个。
你怎么看呢?















