橘猫新闻 综合报道 2026年8月,国产大模型DeepSeek V4 Flash在OpenCode平台单日处理Token量达到8万亿,这一数字并非资金消耗,而是实际处理的文本数据量。该数据已超越聚合400多款模型的头部平台OpenRouter的全平台日均处理量(约6.6万亿Token),引发行业对AI竞争新阶段的讨论。

据相关数据,8万亿Token中约5万亿来自开发者免费试用额度,3万亿为付费商用调用。按官方定价(输入1元/百万Token,输出2元/百万Token)估算,3万亿付费Token对应的日流水约600万元。这一体量相当于约5600万本《三体》三部曲的文字量,或4万部完整电影剧本的体量。
DeepSeek V4 Flash凭借极致性价比吸引大量开发者,单任务成本比竞品低约60%。面对冲击,OpenAI紧急将GPT-5.6 Luna降价80%,但开发者反应冷淡,有评论直言“只想要DeepSeek的价格”。
业内分析认为,8万亿Token标志着AI竞争从“拼参数、拼榜单”转向“拼经济性”——谁能用最低成本完成长任务,谁就胜出。目前,全球调用量前五的模型均为国产大模型,且已连续14周霸榜。低成本背后是MoE架构(2840亿参数仅激活130亿)和高达98%的缓存命中折扣,将单位算力成本压至较低水平。
此次事件凸显了国产大模型在性价比方面的竞争力,也预示着AI行业定价权的转移。



