据雷峰网报道,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日至18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为依据,对国产大语言模型进行周度量化追踪。本期数据显示,周期内词元用量超过10万亿tokens的模型均为轻量级(Flash或类Flash),头部模型集中度继续处于高位。
具体来看,DeepSeek V4 Flash周用量为14.59万亿tokens,DeepSeek V4.1 Flash为12.93万亿tokens,腾讯Hy4 preview为12.01万亿tokens,智谱AI GLM 5.3 Flash为11.62万亿tokens。深度求索于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价后,V4.1 Flash周用量增长483.62%,位次由第9升至第2。腾讯Hy4 preview以12.01万亿tokens位列第三,份额为15.54%,性价比位次与上期持平。此外,上海创智学院Nex-N2.5 Pro和阿里巴巴Qwen3.8 Flash首次进入Top 15。
市场份额方面,DeepSeek V4 Flash份额为18.88%,DeepSeek V4.1 Flash为16.73%,腾讯Hy4 preview为15.54%,智谱AI GLM 5.3 Flash为15.04%。报告称,四款模型在中国大模型中的词元用量份额同处“第一梯队”,四强合计约占66%。头部集聚态势不变,前三位模型贡献了近一半的用量份额,前五位占比超过四分之三。
价格与性价比方面,当期Top15大模型每百万tokens最高价与最低价相差38.75元,与上期持平。其中最低为小米MiMo-V2.5的1.25元,最高为月之暗面Kimi K3的40元。在基准任务成本中,腾讯Hy3最低,低至0.308元/基准任务;其次为DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash,同处于“经济好用”区间。
公开信息显示,智能经济30人论坛由中国(深圳)综合开发研究院等机构联合发起,汇聚全国人工智能、数字经济领域的专家学者与企业家,共同推动智库交流与合作。