主页 > 互联网 > 正文

DeepSeek-V4-Flash登顶全球调用量榜首,国产大模型包揽前五

2026-08-04 09:25:06来源:Techweb编辑:李川峰

扫一扫

分享文章到微信

扫一扫

关注豌豆财经网微信公众号

  8月4日消息,7月31日,DeepSeek正式开放V4-Flash正式版API公测。短短一周之内,这款国产大模型便在全球AI开发者市场掀起了一场风暴。

  发布即登顶

  根据全球最大模型聚合平台OpenRouter的最新数据,上周(7月28日至8月3日),DeepSeek-V4-Flash以7.1万亿Token的周调用量登顶全球大模型调用量榜首。排名第二至第五位均为中国产品:小米MiMo-V2.5以5.4万亿Token位列第二,腾讯Hy3以4.89万亿Token位居第三,DeepSeek-V4-Pro以3.1万亿Token排在第四,智谱GLM-5.2以2.87万亿Token位列第五。7月31日最新发布的DeepSeek-V4-Flash正式版(DeepSeek-V4-Flash 0731版)以2.33万亿Token的调用量强势登上榜单第八。

  DeepSeek-V4-Flash 0423版和DeepSeek-V4-Flash 0731版合计调用量断层领先。

  仅8月3日一天,DeepSeek-V4-Flash 0731版的调用量就达到1.02万亿Token,超过此前霸榜的DeepSeek-V4-Flash 0423版。

  更令人瞩目的是,OpenCode平台的数据显示,仅8月1日一天,DeepSeek V4 Flash在其平台上的Token处理量就达到了8万亿,其中5万亿为免费试用额度,3万亿为付费调用。

  综合测算,上周全球AI大模型总调用量为56.8万亿Token,中国AI大模型周调用量达28.13万亿Token,已连续十四周超过美国,稳居全球首位。在全球十大热门模型榜单中,中国模型占据了九个席位。

  Agent能力暴涨、性价比碾压

  DeepSeek-V4-Flash正式版与预览版模型结构、参数规模完全一致,采用MoE架构,总参数量2840亿,实际激活参数约130亿,支持100万Token上下文窗口。底层基座未做改动,仅完成新一轮后训练优化。

  正是这轮“后训练”,带来了Agent能力的飞跃。在Agent智能体终极测试中,V4-Flash正式版得分达25.2分,接近Claude Opus-4.8的25.7分,远高于V4-Pro预览版的15.8分。在Terminal Bench 2.1基准测试中,正式版拿下82.7分,而预览版仅为61.8分。测评机构Artificial Analysis的Intelligence Index智能指数中,V4 Flash获得50分,比预览版提升10分,追平了Gemini 3.6 Flash。

  价格方面,V4-Flash的竞争力几乎无人能敌。每百万输入Token定价0.14美元,每百万输出Token定价0.28美元。美国研究机构Artificial Analysis的加权测试显示,V4-Flash单任务平均成本仅3美分,而Kimi K3为86美分,GPT-5.6 Sol高达1.86美元,Claude Fable 5更是达到3.15美元。其运行成本不到Anthropic旗舰模型Claude Fable 5的百分之一。换算成人民币,V4-Flash每百万未命中缓存输入Token仅1元,输出Token 2元,缓存命中输入成本更低至2分钱。

  有海外开发者反馈,单次任务调用成本甚至低至0.0005美元。

  海外开发者集体沸腾

  DeepSeek V4-Flash正式版上线后,海外开发者社区的反应堪称热烈。X平台上,有开发者直言“马斯克需要亲自试试V4 Flash。它就像魔法一样”。随后,网友发现埃隆·马斯克真的关注了DeepSeek官方账号。这一细节迅速引爆海外社区讨论,有人调侃“下一代编程模型可能会基于DeepSeek构建”,更有网友直接调侃Grok:“你的爹要给你买个小弟弟吗?”

  玩笑背后是真实的市场转向。据报道,DeepSeek的访问流量中,美国、欧洲开发者占比接近半数,大量Agent自动化项目、代码辅助工具、长文本处理应用主动将默认模型切换至DeepSeek。多名海外AI初创创始人在X平台公开复盘,团队全线迁移至DeepSeek之后,月度推理成本下降60%至85%。对于尚未盈利、现金流紧绷的小微AI公司,这样的成本差异足以决定项目能否继续。

  日本科技媒体Gizmodo Japan也发文称V4-Flash为“爆安Gemini级AI”,指出其性能与价格“完全颠覆”。研究机构Artificial Analysis更直言,DeepSeek-V4-Flash已成为全球知名模型中运行成本最低的一款。

  行业分析认为,DeepSeek在全球开发者市场划出的是一条清晰的“斩杀线”,不是单纯的性能分水岭,而是性能与价格的平衡临界值:同一能力梯队中,定价显著高于DeepSeek的模型将持续流失中小开发者;性能弱于DeepSeek、成本却更高的产品,生存空间将快速萎缩。很长一段时间,全球大模型市场规则由硅谷巨头书写,OpenAI、Anthropic、谷歌划定性能标尺并牢牢掌控定价话语权。如今,这条“斩杀线”正由中国AI划定。

  与此同时,海外闭源头部模型的市场份额持续收缩,Claude主流版本、Gemini旗舰模型调用增速持续放缓。OpenAI也感受到了压力,GPT-5.6 Luna上线不到三周便宣布价格下调80%。有分析指出,中国开源模型快速迭代,模型差距不断缩小,价格差距却逐渐拉大,美国头部模型也不得不重新思考性价比。

  从7月31日API公测到8月3日登顶全球调用量榜首,DeepSeek-V4-Flash仅用了不到一周时间。这款不堆参数、不靠发布会PPT的“小杯”模型,正在用实打实的调用量改写全球AI市场的竞争规则。

     投稿邮箱:lukejiwang@163.com   详情访问豌豆财经网:http://www.wdyxw.com.cn

相关推荐
存储价格暴涨挤压利润,2026上半年全球手机SoC出 存储价格暴涨挤压利润,2026上半年全球手机SoC出

市场调研机构Counterpoint Research近日发布的《全球智能手机SoC出货量初步报告》显

互联网2026-08-03

DeepSeek-V4-Flash正式API上线!Agent能力暴涨6倍,价格 DeepSeek-V4-Flash正式API上线!Agent能力暴涨6倍,价格

8月1日消息,AI圈又炸了。DeepSeek悄然上线了V4-Flash正式版API,一个“廉价版”模

互联网2026-08-01

2026年《财富》世界500强出炉:亚马逊首次登顶 2026年《财富》世界500强出炉:亚马逊首次登顶

快科技7月28日消息,今日,财富中文网与全球同步发布2026年《财富》世界500强

互联网2026-07-28

用友网络递交港股上市申请 推进全球拓展策略 用友网络递交港股上市申请 推进全球拓展策略

7月28日消息,中国最大的企业软件及服务供应商用友网络科技股份有限公司(以

互联网2026-07-28

Kimi K3正式开源:2.8万亿参数MoE模型开放权重,全 Kimi K3正式开源:2.8万亿参数MoE模型开放权重,全

7月28日消息,月之暗面27日深夜正式发布Kimi K3模型权重、技术报告,并同步开源

互联网2026-07-28

全球首款“机器人手机”定档8月12日:荣耀Robo 全球首款“机器人手机”定档8月12日:荣耀Robo

荣耀近日正式宣布,备受期待的全球首款“机器人手机”——荣耀Robot Phone将于

互联网2026-07-27

Kimi K3今晚正式开源:全球首个3万亿参数级超级模 Kimi K3今晚正式开源:全球首个3万亿参数级超级模

国产大模型独角兽月之暗面宣布,其于本月16日发布的新一代旗舰大模型Kimi K

互联网2026-07-27

中国AI大模型包揽全球前五,小米MiMo-V2.5周调用量 中国AI大模型包揽全球前五,小米MiMo-V2.5周调用量

7月27日,在小米汽车澎程系列SUV正式官宣7月30日技术发布之外,小米集团在人工

互联网2026-07-27

长鑫科技半日成交1221亿,暴涨531%登顶A股“新一 长鑫科技半日成交1221亿,暴涨531%登顶A股“新一

7月27日,A股市场迎来了历史性的一刻。随着国内存储龙头长鑫科技正式登陆科

互联网2026-07-27

华为20.6%登顶2026上半年国内手机市场,五年首度 华为20.6%登顶2026上半年国内手机市场,五年首度

综合多家权威市调机构发布的半年度报告及资深数码博主渠道交叉核对的数据,

互联网2026-07-27