登录

Mozilla报告:中美AI模型能力差距缩短至4.4个月


速读:Mozilla报告:中美AI模型能力差距缩短至4.4个月2026年09月16日16:11IT之家IT之家9月16日消息,Mozilla昨日(9月15日)发布第二版《开源AI现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型,能力差距已缩至4.4个月。
2026年09月16日 16:1

IT之家 9 月 16 日消息,Mozilla 昨日(9 月 15 日)发布第二版《开源 AI 现状》报告,报道称中国公司最佳开放权重模型与美国科技公司的前沿闭源模型, 能力差距已缩至 4.4 个月。

相比较今年 7 月发布的第一版《开源 AI 现状》报告,第二版报告把宏观判断进一步落到了具体模型、具体任务时长和单任务成本上。

第二版报告重点提及了月之暗面的 Kimi K3 模型,在 Artificial Analysis 智能指数上的得分仅比 Anthropic 的 Fable 5 低三分,而成本却仅为后者的约 30%。

在能力范围方面,METR 以模型可靠完成任务的时长衡量“时间范围”,可靠成功率标准为 50%。目前,最佳闭源模型可完成的任务时长,是最佳开放模型的 1.7 倍。开放模型可处理 7 小时任务,闭源模型可处理约 12 小时任务。

Mozilla 首席技术官 Raffi Krikorian 将这一差异定性为取决于具体任务场景:闭源模型的溢价主要体现在需要 8 到 12 小时才能完成的专业型任务上,而开源模型则能以极低的价格处理日常工作。

Krikorian 称,4 个月后开放模型可处理 12 小时任务,闭源模型可处理约 20 小时任务。目前,8 至 12 小时任务通常仍是闭源模型可完成、开放模型尚难处理的区间。

这一转变已经开始重塑企业的使用行为。DoorDash 目前已采用 Kimi 处理日常任务,同时将 Fable 保留用于更复杂的工作。2026 年 8 月,路由平台 OpenRouter 上按 token 用量排名前十的模型中,有八个为开源模型。

IT之家附上参考地址

新浪众测

新浪众测

新浪科技公众号

新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

A社“AI末日”资本黑手被揪出,炒作焦虑为IPO圈钱!难怪仇视DeepSeek开源

中银基金换帅:风控“守门”,难破“偏科”

除了腾讯,还有谁愿意为燧原科技买单?

上半年净利润暴跌近100%!携程发财报:坚决落实在线酒店预订行业合规要求

美国农场抢着要!中国老头乐在北美爆发:半年狂赚27亿

鸿蒙智行官宣:即日起问界体系由赛力斯主导 华为终端参与赋能

尼泊尔亿万富豪比诺德·乔达里订购仰望 王传福亲自交车

知情人士谈华为赛力斯合作模式调整:问界不会脱离鸿蒙智行 利好其余四界

消息称华为 Mate 90 系列手机“大杯”都有双层 OLED 屏幕,支持万级高亮度

一针3000元、原料来自死人皮肤!韩国“尸皮针”爆火引争议

商业火箭实现一箭十星

一发10颗 千帆星座增至248颗

天玑 9600 Pro 初体验: 性能提升功耗大降 2nm的天玑来了

女子改嫁小叔生子后离家30余年,儿子务工身亡获赔118万元,她现身起诉分割赔偿金!判了

男子找到遗忘30年的1万元一年定期存单 起诉银行要求按存单利率支付本息 法院判了

市民呼吁老头乐上牌方便接娃买菜!网友疯狂反对 武汉交管回应

白色 OSMO Pocket 4P 到手 这个颜色真的很难拒绝

骗子的骗术又升级了!接到陌生来电请沉默三秒

一箭9星!引力一号遥三运载火箭发射成功 创海上发射载荷、轨道高度新纪录

阶跃全新发布 StepAudio 3:语音大模型进入“听说想做”阶段

DeepSeek 刘胜与 《我不得不把才华埋葬在昨天》文章引热议,回应称不代表公司立场

DeepSeek工程师发长文引爆网络:未来可能要必须转业

鸿蒙智行官宣:即日起问界体系由赛力斯主导 华为终端参与赋能

主题:闭源模型可