一句话结论
本周四款轻量级国产模型周词元用量破10万亿,DeepSeek两款模型与腾讯混元合计占据近半市场份额。
关键要点
- 周期内(2026年9月12日至18日)词元用量超10万亿tokens的四款模型均为轻量级(Flash或类Flash)架构,分别为DeepSeek V4 Flash(14.59万亿)、DeepSeek V4.1 Flash(12.93万亿)、腾讯Hy4 preview(12.01万亿)、智谱AI GLM 5.3 Flash(11.62万亿)。
- 市场份额数据显示,DeepSeek V4 Flash份额为18.88%,DeepSeek V4.1 Flash为16.73%,腾讯Hy4 preview为15.54%,智谱AI GLM 5.3 Flash为15.04%,四款模型合计约占中国大模型词元用量的66%,处于第一梯队。
- 头部集聚态势显著,前三名模型贡献了近一半的用量份额,前五位模型占比超过四分之三;上海创智学院Nex-N2.5 Pro与阿里巴巴Qwen3.8 Flash首次跻身Top 15。
- 价格区间方面,当期Top 15大模型每百万tokens最高价与最低价相差38.75元,最低为小米MiMo-V2.5(1.25元/百万tokens),最高为月之暗面Kimi K3(40元/百万tokens),价差与上期持平。
- 性价比排名中,腾讯Hy3基准任务成本最低,为0.308元/基准任务;DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash紧随其后,同处“经济好用”区间;腾讯Hy4 preview性价比位次与上期持平。
背景与事实
智能经济30人论坛AGI测评中心于2026年9月22日发布最新一期《AGI市场观察》,追踪周期为2026年9月12日至18日。该报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为基础,对国产大语言模型进行周度量化追踪,围绕用量、份额、集中度、价格与性价比五个维度展开分析。该论坛由中国(深圳)综合开发研究院等机构联合发起,汇聚全国人工智能、数字经济领域的专家学者与企业家。
在用量增长方面,深度求索(DeepSeek)于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价,后者周用量随之增长483.62%,位次由第9名升至第2名。腾讯Hy4 preview以12.01万亿tokens位列第三,份额15.54%。值得注意的是,本周期内词元用量超过10万亿tokens的模型全部为轻量级架构,表明当前市场主流消耗场景仍集中在低成本、高吞吐的Flash类模型上。
在集中度方面,前三名模型(DeepSeek V4 Flash、DeepSeek V4.1 Flash、腾讯Hy4 preview)贡献了近一半的用量份额,前五位占比超过四分之三。这意味着国产大模型市场头部集聚态势并未改变,资源向少数高性能轻量模型集中的趋势延续。首次跻身Top 15的上海创智学院Nex-N2.5 Pro与阿里巴巴Qwen3.8 Flash,则显示第二梯队厂商正在通过差异化定位切入市场。
在价格与性价比方面,当期Top 15模型每百万tokens价格区间为1.25元至40元,价差38.75元与上期持平。基准任务成本中,腾讯Hy3以0.308元/基准任务位居最低,DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash处于相近的“经济好用”区间。腾讯Hy4 preview的性价比位次与上期持平,表明其定价策略未做调整。
影响分析
从开发者与企业应用角度看,四款模型均处于“经济好用”区间,意味着轻量级任务(分类、摘要、检索增强生成等)的边际成本进一步下降,开发者在选型时可优先考虑这些高性价比模型以降低整体推理支出。这是基于报告数据的判断。对于需要处理长上下文或复杂推理的场景,最高价40元/百万tokens的月之暗面Kimi K3与最低价之间近32倍的价差,提示团队需根据任务复杂度分层选用模型,避免统一使用高价模型造成成本浪费。
适用边界
本报告的结论基于OpenRouter平台的词元消耗数据、厂商官方披露价格及Arena基准测评,若某厂商未通过OpenRouter提供API、或官方定价未如实披露,则其实际用量与价格可能未被准确统计。此外,基准任务成本受具体测试任务类型、上下文长度及并发策略影响,不能直接外推为生产环境下的单次调用成本。本报告结论适用于通过OpenRouter接入的国产大模型市场,对于私有化部署或海外模型不适用。
孤本观察
轻量级模型包揽全部超10万亿tokens用量席位,而最高价模型Kimi K3单价达40元/百万tokens,说明市场消费结构呈“量价双极”分化。这是基于本期数据的编辑判断:用量集中于低成本轻量模型,而价格上限由高端模型撑起,开发者需在成本与能力之间做明确取舍。






![]()
![]()
![]()
![]()
![]()

![]()

常见问题
2026年9月12日至18日周期内词元用量超10万亿tokens的模型有哪些及具体用量?
包括DeepSeek V4 Flash(14.59万亿)、DeepSeek V4.1 Flash(12.93万亿)、腾讯Hy4 preview(12.01万亿)、智谱AI GLM 5.3 Flash(11.62万亿)。
当期Top 15大模型的价格区间及最高最低价格模型分别是多少?
价差为38.75元,最低为小米MiMo-V2.5(1.25元/百万tokens),最高为月之暗面Kimi K3(40元/百万tokens)。
DeepSeek V4.1 Flash在9月10日调价后的周用量变化及排名位次有何变动?
周用量增长483.62%,位次由第9名升至第2名。
腾讯Hy3的基准任务成本是多少,在性价比排名中处于什么位置?
基准任务成本为0.308元,位居最低,在性价比排名中第一。
本次《AGI市场观察》报告的数据来源和适用边界是什么?
基于OpenRouter词元消耗、厂商官方价格及Arena基准测评;适用于OpenRouter接入的国产模型,私有化部署或海外模型不适用。
来源:雷峰网