APP

下载通川客户端

新闻热线:0818-6086866 通川新闻网违法和不良信息举报电话:0818-6086866 邮箱: 2087245553@qq.com

8万亿Token背后的“水电煤”逻辑丨唐探

川观新闻 2026-08-06 16:14 738

川观新闻记者 唐泽文

7月31日,DeepSeek V4 Flash正式版悄然上线,没有盛大的发布会,没有用词劲爆的演讲。取而代之的是更有冲击力的数据——编程平台OpenCode的数据显示,这个模型单日处理了8万亿Token。这是一个什么概念?非常粗略地算,如果每个Token对应一个汉字,相当于一天之内处理了8万亿字的文本。

在OpenRouter这个全球最大的模型聚合平台上,DeepSeek V4 Flash也以7.22万亿Token的周调用量(7月27日至8月2日)登顶榜首。

更令人震撼的是DeepSeek V4 Flash的价格。输出定价每百万Token仅2元人民币,而Anthropic的Claude Opus 4.8完成同样任务需要约170元人民币。

这不是一个简单的“便宜”故事。它的背后,是中国大模型行业正在走出一条与硅谷截然不同的路径:把AI变成真正意义上的“水电煤”——廉价、稳定、无处不在的基础设施。

2025年5月4日,人们在浙江省杭州市文三数字生活街区的AI黑科技市集上体验DeepSeek的人工智能大模型。新华社发(龙巍 摄)

有人把DeepSeek的策略简单归结为“价格战”。个人认为,这是一种误读。价格战的前提是产品同质化,而DeepSeek V4 Flash的竞争力恰恰来自技术层面的结构性突破。

它的总参数只有284B,同类中比是个“弟弟”。但经过精细化强化学习和高质量数据重训后,这个“弟弟”在代码修复基准DeepSWE上,得分从7.3暴涨至54.4,涨幅超过640%,综合智能体得分25.2,逼近Claude Opus 4.8。更关键的是,它原生支持100万Token超长上下文,但算力消耗只有前代V3.2的27%,显存占用降至原先的10%。

这意味着什么?

意味着DeepSeek不是在“亏本赚吆喝”,而是通过架构创新、训练方法优化和推理效率提升,把成本实实在在地打了下来。这时,低价就不再是策略,而是结果。换句话说,DeepSeek正在用技术效率,把大模型从“精英玩具”变成“平民工具”。

压力之下,美国模型厂商已经开始调整价格策略。

过去两年,全球AI行业陷入了一场参数规模的军备竞赛,万亿参数、十万亿参数,数字越飙越高,仿佛参数越大就越先进。

但DeepSeek V4 Flash传递出一个新的信号:AI的竞争正在从“更大”转向“更精”。

更值得关注的是,DeepSeek全部核心算子基于Triton自研,脱离了英伟达CUDA生态。这意味着国产GPU、通用算力卡无需厂商定制适配即可直接部署——不再被英伟达“卡脖子”,定价权回到了自己手里。

个人预判,未来的行业走向,可能有三个维度:

第一,模型能力将不再是唯一壁垒。成本打下来之后,模型本身会像自来水一样普及。真正的竞争将转向应用层——谁把模型能力封装成解决具体问题的产品,谁就胜出。就像电力普及后,赢家不是发电厂,而是发明了电灯、冰箱、洗衣机的企业。

第二,中国模型将加速“技术出海”。低价高性能的组合,天然适合新兴市场和中小开发者。DeepSeek同时兼容OpenAI和Anthropic双API接口,各大云厂商一键接入,这种“零迁移成本”的策略,可能把中国模型变成全球开发者的默认选项。

第三,开源与闭源的边界将更加模糊。DeepSeek用数据证明了,开源模型加上精细化训练,完全可以匹敌甚至超越闭源旗舰。这会让更多企业重新思考自己的技术路线——与其花天价购买闭源模型的API,不如基于开源模型做垂直领域的深度定制。

总的来说,个人认为,AI正在经历一场“平权运动”。

当AI的成本降到足够低时,它就不是少数科技巨头的特权,而会成为每个创业者、每个普通人都能触及的生产力工具。这才是中国模型给这个行业带来的真正改变:不是打败了谁,而是让更多人站上了起跑线。

换句话说,其实未来已来,只是分布得还不够均匀。而DeepSeek V4 Flash正在做的,就是让这种分布,变得更均匀一些。

评论 0

  • 还没有添加任何评论,快去APP中抢沙发吧!

我要评论

猜你喜欢

去APP中参与热议吧