登录

DeepSeek下一波大模型被指即将问世:3万亿参数性能超GPT


速读:即将发布,时间窗口是9月份。
DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-6 Astra

DeepSeek下一波大模型被指即将问世:3万亿参数 性能超GPT-6 Astra

2026年09月13日 22:5

快科技9月13日消息,本周DeepSeek发布了V4.1 Flash,这个大模型架构变化之大,完全可以称得上是V5了,但DeepSeek很低调地没换大版本号。

Pro系列的新品确定了是V4.1 Pro,具体升级还没公布,如果是V4到V4.1这样的提升幅度,那V4.1 Pro性能上限也会很高,但考虑到之前V4 Pro-0813正式版的不及预期,大家期待值不要拉太高。

后续还有一波大模型,爆料者称它叫做DeepSeek Code 2.0,即将发布,时间窗口是9月份, 预计性能会击败Mythos 5.1和GPT-6 Astra,这是当前最强大的两个前沿级大模型。

其他方面,DeepSeek Code 2.0预计会继续保持开源开放,设计重点是Computer Use,也就是电脑控制,AI替代你操作电脑完成很多工作,Astra目前很多让人惊讶的使用就来自这一方面。

这个Code 2.0拥有高达3万亿以上的参数量,显然这也是它提高性能的关键, 这方面国内目前最强的是K3大模型的2.8万亿,千问的Qwen 3.8 Max是2.4万亿参数量,DeepSeek V4 Pro是1.6万亿参数。

从V4.1 Flash换用新结构使得参数量翻倍来看,这个Code 2.0从当前1.6万亿提升到3万亿参数的可信度是有的,想跟Mythos 5.1及Astra这样的大模型竞争就需要这个级别的参数量,不然性能上限是很难提升的。

这个爆料的可信度不好说,DeepSeek过去的23-24年倒是推出过三款名字带Code的大模型,不过那时候表现平平, 这次要是重推偏向代码/逻辑的Code大模型, 作为旗舰级产品倒也不失为一个方向,就让V4.1 Pro及Flash面向通用Agent任务即可。

【本文结束】如需转载请务必注明出处:

新浪众测

新浪众测

新浪科技公众号

新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

除了腾讯,还有谁愿意为燧原科技买单?

苹果把iPhone折起来,顺手补交了AI答卷

苹果华为小米72小时对决:万元旗舰扎堆登场,手机迎涨价潮拐点

赛车起火被质疑救援不利!多个车队宣布永久退出中国GT所有比赛

曝比亚迪再订10艘汽车运输船!全球第二大运输船同款 一船能拉9200辆

暴雪《星际争霸》开放世界射击新作官宣!2030年发售 首支CG预告公布

印尼载有243人客轮海上遭遇恶劣天气凌晨2点失联,船龄27年,已有54人获救其中1人死亡

特斯拉新车发布会官宣!终于来了

于东来公布新用工方案:新员工实行四年合同制,到期不续签

光耀新生|华硕灵耀x Intel首登北京时装周T台,大“秀”时尚精品美学

受害者称网红“铁头”团伙敲诈勒索案宣判后有人辱骂法庭 律师:或涉嫌扰乱法庭秩序罪被追责

奥尔特曼确认:OpenAI 今年不会上市

著名主持人敬一丹去世,曾在成都开讲“媒体持续记录的价值” 白岩松追忆:再不会有这么好的搭档

主题:即将