根据OpenRouter的最新数据显示,9月28日至10月4日这一周,全球AI大模型的调用总量达到了166万亿Token,环比增长了13.69%。在这之中,中国的AI大模型周调用量为57.46万亿Token,而美国的AI大模型调用量则为16.2万亿Token,连续二十三周,中国的调用量都超过了美国,稳居世界第一。
在全球前五名的AI大模型中,中国的模型占据了四个席位。DeepSeek V4.1 Flash位列第二,周调用量为25.6万亿Token,增长了31%;智谱GLM 5.3 Flash排名第三,周调用量为9.73万亿Token,下降了40%;小米的MiMo-V2.6-Flash排在第四,周调用量达到9.63万亿Token,增长了75%;而腾讯的Hy4 preview排名第五,周调用量为6.51万亿Token,环比下降32%。特别值得一提的是,匿名模型Space Bunny Alpha成功登顶,周调用量为38.7万亿Token,环比增长高达179%。该模型于9月23日上线,主打快速推理和编程,支持文本、图像和视频输入,具有可调的推理强度和工具调用能力。
目前,虽然Space Bunny Alpha的确切身份尚未确认,但有测试显示该模型与MiniMax系列的token计数一致,表明其可能与MiniMax有关。该模型的火爆反映了全球开发者对Flash模型的持续兴趣,国内外公司正在加大对Flash的开发投入。谷歌在六周内已更新Flash系列三次,而DeepSeek V4.1 Flash、智谱GLM 5.3 Flash和小米MiMo-V2.6-Flash也相继投入竞争。厂商们的发力点逐渐趋同,集中在提升编程能力、智能代理和多模态能力的同时,也更加注重响应速度和使用成本,以满足高频和大规模任务的需求。此外,曾排名第九的DeepSeek V4 Flash 0423(预览版)在这一周跌出了榜单。
发表评论