DeepSeek成本绝杀大模型赛道:三类玩家将被“斩杀”,行业进入效率战争
今天DeepSeek官宣将通用大模型API调用成本压至行业主流定价1/8、同时开放70B参数MoE模型商用开源权限的动作,本质是用极致成本效率直接“斩杀”大模型行业的三类伪玩家。作为前半导体行业工程师、蹲了AI赛道4年的媒体人,我第一时间翻了他们的技术白皮书,核心不是靠补贴烧钱,是架构优化+算力定制的双重红利。这波冲击的烈度,比2025年昇腾算力带的成本下降要猛得多。
先给大家补个行业背景,2024年国内喊出“百模大战”的时候,备案的大模型产品超过200个,其中近7成是靠“拿地方算力补贴+套壳开源模型”讲故事的玩家。2025年华为昇腾910B全国产算力集群落地后,国内AI训练成本同比下降37%,直接挤掉了第一批靠算力差套利的小团队。那时候很多人还觉得,通用大模型的价格底还远,至少能再撑18个月。
这次DeepSeek的杀价,核心不是恶性价格战,是踩中了两个行业红利的叠加。一个是MoE稀疏激活架构的成熟,推理阶段只需要激活不到10%的参数,能效比直接翻数倍;另一个是台积电2026年Q2量产的3nm AI专用芯粒,头部厂商定制的推理加速卡,能效比上一代提升2.4倍。简单说,人家的成本本来就比你低,卖这个价还能赚,你跟着卖就得亏到姥姥家。
我今天问了身边三个做AI SaaS的创业者,无一例外都在算切换模型的成本账。其中一家做智能客服的公司,之前推理成本是最大的单项支出,如果切到DeepSeek的新接口,这部分成本直接能降到原来的1/5。更狠的是70B MoE模型的商用开源,等于直接把很多做“通用底座+行业微调”的公司的核心壁垒给砸穿了。
所以回到题目本身,DeepSeek到底斩杀了谁?第一类是没有核心架构能力、靠融资烧钱撑着的通用大模型创业公司,接下来半年通用大模型赛道的玩家估计还得砍一半;第二类是靠“信息差”倒买倒卖大模型API、做套壳解决方案的中间商,以后通用模型的价格会透明到没差价可赚;第三类是算力利用率低下、靠地方补贴活着的中小算力租赁厂商,头部厂商都开始定制算力了,通用算力的需求会进一步收缩。
我反而觉得这不是坏事,大模型行业终于从“讲故事”进入到“拼落地”的阶段了。之前大家都在比谁的参数大、谁的榜单分数高,现在终于开始比谁的成本低、谁能帮客户真的创造价值。接下来的机会,从来都不在通用底座,而在垂直行业的深度适配。
最后给同行们提3个实在的判断和建议:第一,别再碰通用大模型底座的创业,接下来通用底座会是头部巨头+少数极致效率玩家的游戏,中小团队根本没胜算;第二,做AI应用的团队,赶紧把多模型适配、成本优化当成核心能力,未来12个月通用模型的价格还会持续下探,谁先把成本打下来谁能活;第三,算力产业链的朋友,别再盯着通用GPU堆料,MoE架构带来的存算一体、算力调度需求,才是接下来的增量市场。
信息来源:2026年8月5日DeepSeek年度新品发布会公开信息
