DeepSeek V4 智能体 token 份额持续增长
DeepSeek V4 Is Earning Agentic Token Share
DeepSeek 于4月24日发布新一代旗舰模型 V4 系列。OpenRouter 数据显示,V4 发布后其 token 份额从年初的9%增长至6月初的18%,自5月中旬起成为 OpenRouter 最受欢迎模型。V4 是首个足以胜任智能体工作负载的 DeepSeek 模型,到5月底 V4-Flash 已占 DeepSeek 智能体 token 流量的70%。V4-Flash 最便宜端点价格为每百万 token 输入 $0.09、输出 $0.18,远低于 GPT-5.5 的 $5/$30。中国模型整体 token 份额于6月初超过美国模型,DeepSeek 是主要驱动力。
OpenRouter 独家数据展示了代际转折:DeepSeek V4 靠性价比吃下代理负载,中国模型 token 份额首次超过美国,这个信号比任何 benchmark 排名都真实,做应用选型的人该重新算账了。

DeepSeek,这家对许多人来说仍等同于开源大语言模型的公司,于 4 月 24 日发布了其新的旗舰 V4 模型。
V4 重置了发展轨迹。在六个月内,DeepSeek 在 OpenRouter 上的 token 份额大约翻了一倍,而智能体工作负载推动了这一增长的大部分。
如今推动 token 使用量的模型作者

年初时,DeepSeek 在 OpenRouter 上每周的 token 流量中仅占不到 10%。随着智能体工作在 2 月和 3 月开始站稳脚跟,以前所未有的速度推高 token 使用量,DeepSeek 实际上跌至总 token 的 5%。该公司受到了来自上方专有模型和下方一波其他开源大语言模型的双重挤压。
V4 模型系列的发布产生了立竿见影的积极影响。到 6 月初,DeepSeek 已获得近 20% 的 token 份额,并且自 5 月中旬以来一直是 OpenRouter 上排名第一的模型。

对 2026 年 1 月与 6 月的直接对比显示,模型作者之间的偏好变化可以有多快。DeepSeek 在此期间实际上将其 token 份额翻了一倍(从 9% 到 18%),但许多其他模型提供商经历了命运的大幅波动。
包括小米、Minimax 和腾讯在内的一组中国开源模型,在过去 6 个月里 token 份额均有所上升。这似乎是以几家领先的美国模型公司为代价的,尤其是 Google 和 OpenAI。

DeepSeek 的翻倍增长并不局限于某一类用户。截至 6 月初,各类公司和个人都在使用越来越多的 DeepSeek token。爱好者用户(他们通常通过角色扮演、通用聊天、个人智能体等面向消费者的应用类别产生大量使用量)现在将其全部 token 的近三分之一路由至 DeepSeek 模型。
即便是在 AI 原生公司或大型组织的用户中——这两类用户本被认为会优先选用前沿闭源模型——他们在 6 月初发送给 DeepSeek 的 token 流量也远高于年初。

DeepSeek V4 Flash 在最便宜的端点上,每百万 token 输入收费 $0.09 / 输出收费 $0.18。作为对比,GPT-5.5 目前定价为每百万 token 输入 $5 / 输出 $30。
因此,V4 的 token 量突然激增并未带来支出份额的同等飙升,这并不令人意外。V4 的性价比与输出质量之比在同级别中最佳——事实上,它已经足够好,以至于各种规模的组织都开始放心地将真正的智能体工作交给 DeepSeek。
V4 是首个足以胜任智能体工作负载的 DeepSeek 模型

我们在 API key 层面将 token 流量分为三个主要类别(智能体、混合、人类)。这些类别根据一个包含 7 个信号的加权综合评分来划分,该评分纳入的输入包括工具调用率、轮次数、间隔时序等。
众所周知,智能体工作消耗的 token 比普通人类使用 AI 时更多(根据 OpenRouter 的数据,每次请求大约多出 15 倍)。但值得记住的是,智能体 token 的这种爆发式增长是 2026 年才出现的现象,直到今年 2 月初才真正开始大规模兴起。
不过,对某些模型厂商来说,即便如此也仍是夸大之词。

智能体工作负载所使用的 token 大约在 2 月 1 日前后超过了人类使用的 token。起初,智能体工作仅集中在少数几家模型厂商,而这一小群厂商中并不包括 DeepSeek。
V4 的发布标志着 DeepSeek 正式加入了智能体工作流的竞争。

并非所有工作负载都会同时切换到最新模型。上图展示了 DeepSeek token 使用量中的人类活动在今年前 5 个月里如何一直与 DeepSeek V3.2 绑定。
然而,智能体工作负载已将 V4 作为首选模型。到 5 月底,即发布仅一个月后,V4-Flash 就占据了 DeepSeek 使用量中智能体 token 流量的 70%。
DeepSeek 与中国模型的崛起

Token 流向由两个国家创建的大语言模型:美国和中国(另有少量其他国家体现在那一小块米色区域中)。2026 年 token 量出现了爆发式增长,但这种增长并未扩展到其他国家的 LLM。

2025 年是美国 token 之年,来自美国的模型贡献了约四分之三的 token 使用量。到了 2026 年,竞争激烈得多,截至 6 月初,中国模型在 token 份额上实际上已经超过了美国模型。

毫不意外,自 4 月底 V4 发布以来,DeepSeek 一直是中国模型中的领跑者。过去 6 周里,几家美国头部厂商的 token 使用量趋于平稳,而随着 6 月的到来,多家中国竞争对手的 token 用量则大幅飙升。
随着高性价比的 token 使用成为今夏的热门话题,我们预计这些更便宜但依然强大的开源模型将持续吸引更多 token。正如《华尔街日报》在这篇近期报道中(引用了 OpenRouter 的数据)所提到的:“初创公司和科技巨头都在混搭不同的 AI 模型,以避开高昂的价格。”
DeepSeek V4 必然会成为这一组合中的一员。
方法论说明
关于我们如何汇总这些数据,有几点说明:
- 来源:OpenRouter 的请求日志。
- 样本规模:2026 年 1 月 1 日至 2026 年 6 月 14 日期间的超过 450 万亿 token。
- 份额指标:所有“份额”数字均指 token 用量份额(输入与输出合计),而非支出份额。正如定价部分所述,对于 V4 这类低成本模型,两者可能差异极大。
- 活动类型:我们在 API key 层面将 token 流量划分为三大类(智能体、混合、人类)。这些分类依据一个 7 信号加权综合评分来分配,该评分包含工具调用率、轮次数、间隔时序等输入项。由于划分发生在 key 层面,一个同时进行混合工作的单一 key 会按其主导模式分类,而非按每个请求分类。
来源:OpenRouter:Announcements(RSS) · openrouter.ai