Full text · 原文
2,341 字
鹭羽 发自 凹非寺<br>
量子位 | 公众号 QbitAI<br>
好家伙!龙虾老吃家还得看中国。<br>
全民“养虾”热潮直接带动国产大模型喜迎黄金周。<br>
根据OpenRouter最新数据,上周中国大模型的周调用总量飙升至4.19万亿Token。<br>
这是继今年2月首度反超美国后,中国大模型再度强势登顶,重回全球榜首。<br>
OpenClaw继续霸榜热门应用第一,其中本月最受养虾人青睐的算力搭子中,国产大模型依旧遥遥领先。<br>
榜单前三分别是Kimi K2.5、Step 3.5 Flash和MiniMax M2.5,均超1T tokens。<br>
果然在吃这回事上,国产玩家真夯!喝完奶茶吃龙虾,妙哉妙哉~(doge)<br>
爱吃中国大模型<br>
整体来讲,上周3月2日-8日,中美大模型活跃度出现明显分化,具体调用总量情况如下:<br>
中国:4.19T tokens(↑34.9%)<br>
美国:3.63T tokens(↓8.5%)<br>
中国大模型周调用总量激增,其中不乏OpenClaw影响。反观美国大模型呈现短期收缩态势,总量及增速被中国市场反超。<br>
上一次出现类似情况还是2月份。<br>
9日至15日期间,中国模型调用总量高达4.12万亿Token,实现对美(2.94万亿)首次超越。<br>
随后的16日-22日当周,国产模型热度持续爆表,数字刷新至5.16万亿Token,三周内增幅为127%;同期美国模型则进一步萎缩至2.7万亿Token,二者差距持续拉大。<br>
2月最后一周,随着谷歌对Gemini 3 Flash进行价格优化和OpenClaw官方版本更迭,中国模型调用量来到阶段性回调。<br>
直到3月初,Step 3.5 Flash正式接入OpenClaw并登顶榜首,重新将中国大模型阵营拉回4T梯队。<br>
具体看排名情况,上周全球大模型调用量Top 5中,中国产品占据三席。<br>
MiniMax M2.5表现稳健,继续蝉联全球榜首;DeepSeek V3.2持续保持增长趋势;Step 3.5 Flash成为上周最大黑马,成功跻身全球前五。<br>
再看近几个月市场份额,MiniMax从1月底陆续发布MiniMax Music 2.5、MiniMax M2.5等多款模型后,市场占比实现跨越式增长。<br>
在16日-22日这周,更是一举超越谷歌,成为全球第一。在上周中,MiniMax继续保持第三的成绩,稳固占据全球大模型市场第一梯队。<br>
而编程(包括代码生成、调试、开发)使用情况,上周前三分别是MiniMax M2.5、Kimi K2.5、Claude Opus 4.6。<br>
出乎意料的是,中国大模型上周不仅在中文市场火爆,在英文语境下同样也表现亮眼,直接包揽全球前三名。<br>
足以证明,国产模型在全球开发者生态的地位日益增长。<br>
至于不同上下文长度的token消耗情况,则存在显著差异:<br>
在1K-10K tokens中,海外主流模型占据上风,如GPT-oss-120b、Gemini 2.5 Flash等。<br>
而在10K-100K tokens任务里,MiniMax M2.5和DeepSeek V3.2成为了更多人的选择。<br>
更长的100K-1M tokens上下文里,MiniMax M2.5优势明显。<br>
其余的榜单,如工具使用情况,MiniMax依旧一骑绝尘。<br>
但在图像生成上,Gemini 2.5 Flash Lite更受青睐,上榜的国产大模型则为Qwen 3 VL 235B,一款旗舰级多模态大模型。<br>
至于热门应用排行榜,龙虾无疑稳坐全球头把交椅。从一月起,狂吞全球9.16T tokens,成为了当之无愧的算力“黑洞”。<br>
其中本月OpenClaw使用最多的模型,依旧是Kimi K2.5。紧随其后的是Step 3.5 Flash和MiniMax M2.5。<br>
三个国产大模型均超过了1T tokens,呈现出三足鼎立的格局。<br>
而上个月第三的Gemini 3 Flash Preview则跌至月度排名第五。<br>
中国大模型也好吃<br>
但要说哪个模型更适合OpenClaw,还得结合龙虾之父最近推荐的PinchBench榜单综合来看。<br>
该榜单专为龙虾而生,从成功率、速度、价格等多维度评估全球大模型对OpenClaw的适配程度。<br>
首先是成功率,claude-opus-4.6目前位居第一,国产大模型位于榜单前列的分别是Kimi K2.5、MiniMax M2.1、Qwen3-Coder-Next,得分均超过79%。<br>
速度方面,国产大模型还有待提高,除了千问,其余模型排名均较为靠后。<br>
截至目前,Kimi K2.5位于榜单第20名,MiniMax M2.1是23名、MiniMax M2.5是26名。<br>
价格上,除了谷歌和OpenAI,千问、DeepSeek和智谱也榜上有名,具备性价比优势。<br>
综合两份榜单来说,国产大模型目前颇受全球养虾人欢迎,呈现出MiniMax、DeepSeek、月之暗面、阶跃百花齐放的态势。<br>
在调用量和实际应用中已实现局部领先,但在极致的响应速度和价格方面仍有待提升。<br>
So你家这只“龙虾”,用的是啥?<br>
参考链接:[1]https://openrouter.ai/rankings[2]https://m.ithome.com/html/927345.htm[3]https://x.com/jasonthomasmba/status/2030670237259944189[4]https://mp.weixin.qq.com/s/Gwd733hGD4ikpZ4LyZA9Gg[5]https://mp.weixin.qq.com/s/9QTE6YYEkM0vOHz1E9cB5Q[6]https://pinchbench.com/?view=speed