DeepSeek让硅谷大佬集体“失态”:马斯克搞双倍促销,谷歌布林急换高管,AI圈直言“它是异类”

文 | 《硅谷观察》郑峻
就在昨天,全球AI行业传出了三大重要新闻。
DeepSeek低调发布了V4 Pro的正式版,把API文档里的版本号改成了0813;SpaceX旗下的xAI发布了Grok 4.6,马斯克非常兴奋地在X上置顶推广,他为了抢开发者,甚至搞起了首周双倍额度的促销;外媒披露谷歌AI部门高层大换血背后的真正原因是创始人布林要进行整改,尤其不满Gemini最新模型的研发进展落后于对手。
一个不出声,一个很亢奋,一个很焦躁。
同一天时间,三条新闻体现出三位AI行业领袖截然不同的精神状态。这种戏剧性本身就是2026年AI格局的一张快照。
在更多的美国AI人士看来,DeepSeek 并非不需要传播,而是他们的传播模式是自下而上的。极低的价格、极其强大的开源能力,导致全球的开发者、科技博主,甚至硅谷同行(如 OpenAI、Meta 的研究员)自发地为他们发声和做解读,形成了口碑的爆发式传播。而在一举成名之后,面对媒体采访,DeepSeek 团队态度非常克制,研究人员极少接受商业化专访,绝大多数时间都在闭门写代码和叠算力。
美国AI圈:DeepSeek是个异类
其实DeepSeek早在4月底就发布了V4 Pro,但那是预览版。在跑了三个半月之后,昨天OpenRouter的模型页面上出现了标记为正式版的0813构建,DeepSeek自己的API文档和定价页面同步把版本号改成了DeepSeek-V4-Pro-0813。这意味着,正式版终于发布了。
没有发布会,还是监测账号先发现的,媒体才跟进。一家能让全球芯片股剧烈波动的公司,正式版发布靠的是改了一行文档。这种发布方式是梁文锋的惯例,他们的一举一动都是全球科技媒体的焦点。
与预览版相比,正式版的规格没变:1.6万亿总参数的MoE架构,每个token激活490亿,预训练超过32万亿token,100万上下文窗口,最大输出38.4万token,MIT许可。价格也没变,还是那么亲民(和美国头部模型相比):输入每百万token仅为0.435美元,缓存命中0.003625美元,输出0.87美元。
但真正强大的是模型本身。DeepSeek随发布放出的基准表显示,0813相比预览版的提升相当惊人:Terminal Bench 2.1从72.1涨到87.9,DSBench-FullStack从41.8涨到71.1,而DeepSWE从12.8直接跳到62.7,翻了近五倍。架构没动,涨幅全部来自后训练。
虽然梁文锋刻意保持着低调,但真正让硅谷坐不住的,是V4 Pro正式版和闭源头部模型的对比。对Anthropic的Opus 4.8,V4 Pro在Terminal Bench 2.1、Cybergym、DeepSWE、AutomationBench四项上反超,Agents‘ Last Exam打平;Opus则在HLE、NL2Repo、Toolathlon-Verified等项目上保持领先。
对比A社最强的Fable 5,有媒体统计了九项双方都有成绩的智能体基准:Fable 5平均领先5.3%,剔除差距最大的几项后,缩窄到约2.8%。而在Terminal Bench 2.1上,两者几乎持平——87.9对88.0。这意味着两者的差距已经微乎其微。
算入不同的成绩对比,平均分差也只有五个百分点,而价格差却是几十倍。如果按缓存token计算智能体任务的实际成本,有开发者算出的倍数高达275倍。在这巨大的成本差异面前,Fable 5的那点优势显得已经微不足道了。即便DeepSeek已经预告近期将对API价格进行“大幅上调”,但依然会留有巨大的价格优势。
在更多的美国AI人士看来,在极其注重包装、声势和商业公关的大模型行业里,DeepSeek是个异类。他们不仅几乎从来不举办线下发布会,而且也极少主动联系科技媒体进行商业宣发或付费推广。从早期版本,到大火的 DeepSeek-V3、R1,再到后续的 V4 系列,DeepSeek的产品发布总是简单低调:深夜或清晨直接上线,附带技术论文、开源权重和 API 接口链接。
创始人梁文锋的性格决定了DeepSeek的企业文化。这位1985年出生于广东湛江吴川一个乡村的创业者,走的路和硅谷所有人都不一样。他在浙江大学读完本科和硕士,硕士论文做的是基于低成本云台摄像机的目标跟踪算法。2015年,他和两位同学一起创办了幻方量化,用数学和机器学习做交易,到2021年管理规模一度达到千亿人民币量级。