当前位置:首页>文章>使用指南>谁在被开发者疯狂调用?本周大模型调用榜前十出炉

谁在被开发者疯狂调用?本周大模型调用榜前十出炉

文本是《AI咨询(共122篇)》专题的第 122 篇。阅读本文前,建议先阅读前面的文章:

全球大模型调用周榜:DeepSeek V4 Flash 领跑,Claude Opus 5 增速最猛

截至 2026 年 8 月 18 日,OpenRouter 近 7 天榜单显示:DeepSeek V4 Flash 0731 以 11.3T tokens 位列第一,腾讯 Hy3 以 9.83T tokens 紧随其后。

先说结论

这不是一张“谁最聪明”的榜单,而是一张“谁被真实调用得最多”的榜单。OpenRouter 的 This Week 窗口覆盖最近 7 天,按 UTC 完整日桶汇总 prompt、completion 和 reasoning tokens;私有请求不计入,模型变体分开排名。

本周最值得关注的有三件事:

  1. DeepSeek V4 Flash 0731 以 11.3T tokens 登顶,领先第二名 Hy3 约 1.47T tokens。
  2. 前四名合计约 32.39T tokens,占前十合计 52.2T tokens 的约 62.0%。
  3. Claude Opus 5 的绝对调用量暂居第九,但页面显示周环比上升 89%,是前十中增速最醒目的模型。

01|本周榜单

排名 模型 厂商 调用量 页面显示周环比
1 DeepSeek V4 Flash 0731 DeepSeek 11.3T +12%
2 Hy3 Tencent 9.83T +4%
3 GPT-5.6 Luna OpenAI 5.80T +19%
4 MiMo-V2.5 Xiaomi 5.46T +9%
5 DeepSeek V4 Flash 0423 DeepSeek 4.78T -13%
6 GLM 5.2 Z.ai 4.34T +18%
7 Gemini 3.6 Flash Google 2.75T +12%
8 Nemotron 3 Ultra(免费) NVIDIA 2.69T +20%
9 Claude Opus 5 Anthropic 2.68T +89%
10 DeepSeek V4 Pro 0423 DeepSeek 2.57T +1%

02|榜单背后的三个信号

头部集中,但不是一家独大

DeepSeek 以三个模型进入前十,合计约 18.65T tokens,占前十榜单约 35.7%。但腾讯、OpenAI、小米、Z.ai、Google、NVIDIA 和 Anthropic 也都进入了头部,说明开发者实际使用的是多家模型的组合,而非单一赢家通吃。

Flash 模型正在承担大规模日常流量

DeepSeek V4 Flash 0731、DeepSeek V4 Flash 0423 和 Gemini 3.6 Flash 都在前十。这里的共同点不是“参数最大”,而是更适合高并发、低延迟和成本敏感的工作负载。这个判断是基于模型命名与榜单结构的推测,不等同于 OpenRouter 对单个模型定位的官方结论。

高增长不等于高绝对量

Claude Opus 5 的周环比增幅明显高于其他头部模型,但绝对调用量仍低于前八。对产品团队来说,这意味着“增长最快”和“规模最大”是两套指标:前者更像新品扩张信号,后者更像现有生产流量信号。

03|综合对比:调用热度、任务结构与能力榜要分开看

OpenRouter 页面把几类信息拆成不同模块:Top Models 看 tokens,Top models by task 看不同任务的 spend share,Benchmarks 则单独引用 Artificial Analysis Intelligence Index 等能力指标。把它们放在一起,才能得到更完整的判断。

观察维度 适合回答的问题 本周读法
调用量(tokens) 谁被真实使用得最多? DeepSeek V4 Flash 0731、Hy3 形成第一梯队。
周环比 谁在加速? Claude Opus 5 +89%,GLM 5.2 +18%,GPT-5.6 Luna +19%。
任务 spend share 哪些模型在特定任务更受欢迎? 不能用总调用量替代,要看 General、Agent、Code、Data 等任务分区。
Intelligence Index / benchmark 谁更强? 这是能力问题,不应从调用量直接推导。
能力榜(Artificial Analysis Intelligence Index) 谁更强? Claude Opus 5、Claude Fable 5、Grok 4.6、GPT-5.6 Sol 位居前列。
价格与延迟 谁更适合生产? 需要结合模型价格、路由、缓存、上下文和 SLA 单独评估。

OpenRouter 同页的能力榜给出了另一种答案:Claude Opus 5(63.1)位列第一,Claude Fable 5(62.1)第二,Grok 4.6 与 GPT-5.6 Sol 同为 60.9。调用榜第一的 DeepSeek V4 Flash 0731 并未出现在这份能力榜前十。热度与能力不是同一个排行榜。

任务维度:Agent 与 Code 是最值得盯的两块

OpenRouter 的任务 spend share 汇总显示,General 占 32.7%,Agent 占 29.6%,Code 占 28.9%,Data 占 8.8%。在页面当前选中的 Classification 任务中,Claude Opus 5 以 6.4% 排名第一,GPT-5.6 Sol 6.0% 第二,GPT-5.5 5.3% 第三。

这意味着:总调用量更像“平台级流量”,任务榜更像“场景级偏好”。做产品选型时,后者通常比总榜更接近真实决策。

一个更实用的选型框架

  1. 高并发、成本敏感:先看 Flash、免费或低价路由,再用真实业务样本做质量门槛测试。
  2. 复杂推理、长链路 Agent:不要只看周榜,重点补看 benchmark、工具调用成功率和长上下文稳定性。
  3. 代码与研发协作:把代码生成、调试、文件操作和 Shell 执行拆开测,避免用一个总分覆盖所有工程任务。
  4. 面向终端用户的产品:除模型能力外,还要看延迟、峰值并发、失败重试、区域可用性和供应商锁定风险。

04|这张榜单不能说明什么

OpenRouter 明确提醒:这是一张 adoption 榜,而不是全市场份额榜。它只描述经过 OpenRouter 的流量,不包含模型厂商自有 API、私有部署或其他聚合平台的调用。tokens 也不是请求数、用户数或花费;不同模型的输出长度和 tokenization 不同,所以 token 总量不能直接当作偏好度。

换句话说,DeepSeek V4 Flash 0731 排名第一,最稳妥的表述是:它在 OpenRouter 这条公开可见的开发者流量上最活跃。不宜写成“全球所有 API 调用第一”或“能力第一”。

05|给产品和开发者的启示

关注“组合”,不要迷信单榜冠军

真实生产环境往往是路由组合:便宜快速的模型处理大多数请求,强模型处理难例、升级路径和人工兜底。周榜更适合用来发现默认路由候选,而不是直接决定唯一模型。

把增长榜当作新品雷达

Claude Opus 5 的高环比、Nemotron 3 Ultra(免费)的高调用增速,都说明新品或低门槛模型可以快速获得试用流量。下一步要验证的不是“涨得快不快”,而是留存、复购、任务成功率和单位成本。

每周记录同一口径,才看得出趋势

建议固定记录四列:榜单日期、模型、tokens、周环比;再加三列业务指标:平均延迟、成功率、单位成本。连续四周之后,才有资格讨论“趋势”,而不是被某一天的热点带着走。

结语|调用量是现实投票,但不是终审判决

本周的答案很清楚:DeepSeek V4 Flash 0731 领跑,Hy3 紧随其后,OpenAI、Xiaomi、Z.ai、Google、NVIDIA 和 Anthropic 共同构成了多极竞争格局。

真正值得长期跟踪的,不是某个模型今天排第几,而是它能否在质量、价格、速度和稳定性之间,持续给出可复用的生产价值。

数据与口径

  • 数据主源:OpenRouter AI Model Rankings,筛选为 Text / All models / This Week。
  • 最新完整数据桶:2026 年 8 月 18 日。
  • 统计口径:最近 7 个完整 UTC 日桶;prompt、completion、reasoning tokens 合计;私有请求排除;模型变体分开统计。
  • 版权与复用:OpenRouter 页面标注 rankings data 以 CC BY 4.0 授权,转载时保留来源与口径说明。
  • 交叉阅读:OpenRouter Benchmarks 模块与 Artificial Analysis Intelligence Index;本文不把能力指标与调用量混为一谈。

欢迎关注 一步API,我们还会持续分享更多 AI 资讯、AI 工具、实战经验、踩坑记录,助力你高效玩转 AI 开发、避开行业弯路。

谁在被开发者疯狂调用?本周大模型调用榜前十出炉

想了解更多细节、获取专属支持,可添加客服微信:xuexiv5876 / YibuDev,随时咨询交流~

如果这篇文章对你有帮助,欢迎点赞、在看、转发三连。

给TA打赏
共{{data.count}}人
人已打赏
使用指南

DeepSeek V5 Flash架构、Agent 与成本,能否一起跃迁?

2026-8-18 16:43:14

工具配置

Zed 轻量级现代代码编辑器:性能、协作与 AI 集成

2025-7-26 22:46:07

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索