首页 > 新闻中心 > 财汇

中国模型包揽全球调用周榜前四,DeepSeek新版本登顶|高性价比与能力成增长关键词

来源: 紫牛新闻

2026-08-12 07:58:00

8月11日,记者梳理全球模型API聚合平台OpenRouter实时周榜发现,中国公司开发的模型包揽调用量前四。DeepSeek-V4-Flash-0731以9.39万亿Token居首,腾讯Hy3以8.94万亿Token排名第二,DeepSeek-V4-Flash-0423和小米MiMo-V2.5分列第三、第四。

榜单前十中,中国模型占据六席,合计约35.58万亿Token,并已连续15周超过美国模型。

榜单前十中,中国模型占据六席

DeepSeek三款模型进入前十

7月31日,DeepSeek宣布V4-Flash正式版API进入公测。官方介绍,新版本通过重新训练强化代码理解、工具调用和长程任务能力。

DeepSeek旧版Flash排名第三,V4 Pro位居第七。

全球模型API聚合平台OpenRouter实时周榜

开发者:同样预算下,国产模型可以完成更多步骤

一家AI编程工具公司的技术负责人告诉扬子晚报/紫牛新闻记者,其团队正测试使用DeepSeek处理代码分析和报错修复。

“编程Agent调用轮次远多于普通问答。选择模型不只看价格,还要看工具调用和长任务稳定性。高性价比的意义,是同样预算下能完成更多步骤。”

DeepSeek官网显示,V4 Flash每百万输出Token为 1.9 元。

高性价比和能力成增长关键词

业内人士:价格低只是进入生产环境的条件之一,能力也很重要

一家模型API服务商负责人表示,客户对中国模型的测试有所增加,部分客户开始将其纳入多模型路工作流。

“低价能帮助模型进入测试名单,进入生产环境还要看稳定性和任务完成效果。”

OpenRouter此前披露,智能体工作负载的单次请求平均Token消耗量约为普通人机交互的15倍。随着Agent应用增加,单位Token价格对总体成本的影响随之上升。

国内人工智能领域的一位专家表示,OpenRouter不能代表全球全部调用,但可反映开发者的模型选择。后续还需关注请求量、付费金额和客户留存。

图文/视频:朱君贤