登录

硅谷大模型不装了:Claude卷价格,GPT学豆包


速读:Google动手最早,旗舰Gemini3.1Pro(输入2美元、输出12美元),小模型是Flash家族,免费端为Flash-Lite。
2026年10月10日 11:13

10美分的Claude、0元的GPT,美国AI也搞起“百亿补贴”。

过去两年,说起大模型的“价格屠夫”,没人会想到Claude。  DeepSeek把百万tokens的价格打到几毛钱,逼着国内厂商一轮轮跟降,让“大模型用不起”成了旧闻,便宜也几乎成了国产模型的集体人设。Claude则一直站在价格表的另一头,上一代Haiku 4.5每百万tokens输入1美元、输出5美元,在不少开发者眼里,属于好用但不便宜的那一档。  10月8日凌晨,位置换过来了。Anthropic推出了一款主打日常简单任务、走低价路线的轻量级模型Claude Haiku 5.5,10万tokens以内的请求每百万tokens输入0.10美元、输出0.50美元,单价只有上一代的1/10,甚至比国内同为小模型的DeepSeek-V4.1-Flash还便宜。  几乎同一时间,OpenAI宣布GPT-6全量上线,付费用户可使用GPT-6 Sol,免费用户也能用上GPT-6 Luna。有网友调侃,OpenAI这是要“变豆包”了。  一家降到地板价,一家直接免费,海外两大巨头同时对价格动了手。它们图什么?0.1美元的Claude、免费的GPT真的好用吗?当便宜不再是国产大模型的专属,DeepSeek们手里还剩什么牌?  01.Claude比DeepSeek还便宜,是真的 本轮模型厂商的价格战重心,集中在小模型身上。  旗舰模型通常承担着模型厂商的品牌与技术上限,定价不宜大改。而小模型以有限的推理成本承接高并发、轻量化任务,是争夺开发者的入口,也最适合拿来打价格战。  小模型中,当前最具可比性的三个样本是DeepSeek-V4.1-Flash、Claude Haiku 5.5与GPT-6 Luna。AI软件工程师覃相告诉「AIX财经」,三者在设计理念、目标场景与成本结构上高度相似,适合直接对比。  先看定价。  API方面,Claude Haiku 5.5与GPT-6 Luna同价:输入在10万以内,每百万tokens输入0.10美元、输出0.50美元。横向对比DeepSeek-V4.1-Flash,两家海外厂商在输入与输出端均价格更低,即便以后者五折后的非高峰档计算,结论依然成立。 GPT-6 Luna在此基础上更进一步,OpenAI已将其下放至ChatGPT免费层,C端用户可零成本使用。  需要说明的是,Haiku 5.5的低价有一个前提,每次发送的内容不超过10万tokens。超过这条线,输入输出价格均涨为原来的五倍(0.50/2.50美元)。DeepSeek-V4.1-Flash则是一百万tokens容量内统一计价,不分长短。  如果同一份材料要反复使用,DeepSeek-V4.1-Flash的缓存价0.003美元也低于Haiku 5.5的0.01美元。  我们以一份4万tokens的产品文档为例,置顶后连续追问,每轮新增提问500tokens、回答300tokens,均按非高峰价计算。  第一轮,文档要写入缓存。按Anthropic的缓存写入价(保留5分钟为0.125美元/百万tokens),加上回答,Claude合计约0.52美分;DeepSeek无写入溢价,约0.63美分。Claude花费更低。  从第二轮起,双方的文档部分都进入缓存价,这时DeepSeek更便宜。同样一轮,Haiku5.5约0.06美分,DeepSeek约0.04美分,每轮便宜约0.02美分。首轮攒下的优势,追问几轮就被追平了。  也就是说,如果是轻度使用,随手问几次,Claude是便宜的。如果是重度复用,把文档当知识库反复查,DeepSeek的缓存价会更有优势。 账算清楚了,剩下的问题是:这么便宜,好用吗?  Haiku 5.5的定位是执行层模型,摘要、压缩、分类、数据库查询,以及作为大模型的子代理执行子任务,均在其设计范围内。按Anthropic公布的基准,其各项维度的表现均强于同级别的GPT-6 Luna。  DeepSeek-V4.1-Flash的发布基准则集中在另一个方向,DeepSWE v1.1(多文件软件工程)74.2、Terminal-Bench 2.1(终端任务)90.6,官方称在其选定的Agent基准上超过了自家上一代旗舰V4-Pro。  需要注意的是,这些成绩都是厂商自报,DeepSeek的成绩基于最高推理强度,两家用的也不是同一套测试,三家之间目前没有可以直接横向比较的官方数据。但大模型从业者云中江树做过简单任务的实测,他的感受是,三家小模型水平相似,拉不开差距,能感知的差别在复杂指令上。  综合现有信息,可以下一个结论,三家小模型能力差距不大,均能胜任其目标场景。价格上,在“短上下文、API裸价”口径下,Haiku 5.5与Luna的价格确实降至DeepSeek之下,且Luna对C端免费。 值得一提的是,Anthropic为这一低价设定的适用范围,恰好是其过往请求分布的主体,按官方口径,约90%的Haiku请求发送内容不超过10万tokens。也就是说,绝大多数日常用量都落在优惠区里,0.10美元是Anthropic算过账的入口价。至于入口之外从哪里赚钱,就要从它的整张价格表来找答案。  02.把价格打到0,图啥? 同一张价格表上,一家公司最便宜和最贵的模型,跨度巨大。OpenAI的GPT-6分三档,最贵的Astra输入10美元,比Luna贵出百倍。Anthropic也类似,旗舰Fable 5.1输入10美元,主力档Opus 5.5输入4美元,均比Haiku 5.5高出不少。0.1美元与10美元之间,卖的是不同的东西。  先看Anthropic。  第一笔是入门价,不求赚钱。覃相的判断是,小模型这一档大概率是微利或保本,但它不是亏钱引流的工具,而是整个商业生态的流量引擎与生态构建抓手。单次调用可以不赚钱,但只要调用量足够大、开发者足够多,用户就留在这个生态里,后面订阅、长文、企业服务这些更贵的收入,才有机会发生。0.1美元/百万tokens的输入价格,买的是这张入场券。  第二笔才是收入。入门价让出去的部分,要靠更贵的档位赚回来。Haiku 5.5超10万tokens后,输出价涨为原来的五倍;Opus一档的输入单价是Haiku低价档的40倍,承接的是长文档、复杂任务这些账单膨胀的场景。  同一天,Anthropic还宣布Sonnet5.5的缓存读取价从0.20美元砍至0.10美元。这一刀“砍下去”,主要是为了留存,Claude Code等Agent应用中,系统提示、工具定义与历史上下文每轮均需重复读取,缓存读取占输入的大头。对靠它写代码的团队来说,Agent每跑一轮,这些固定内容都要重新读一遍,一个月下来,缓存读取往往超过新增内容本身。这次砍的正是账单里占比最大的那块。低价吸进来的新客要接住,已在付费的老客也要留住。  Anthropic敢这么降,是因为它的基本盘不在token差价上。它的收入主要是Claude Code带动的开发者订阅与企业席位,入门档就算不赚钱,也能用存量账户补回来。  OpenAI的账,算法不同。 它是真免费,但有条件。ChatGPT的免费版从来都有,过去跑的是上一代模型,旗舰升级、免费层接旧型号。而这一次,免费用户拿到的是与旗舰同代发布的Luna,免费与付费的代际差被抹平了。但成本是可控的,免费层有次数限制,跑的又是小模型,成本压在低位,却能拉来用户。同时,Luna API照收0.10美元的输入价,说明免费只限于C端,免费用户消耗的算力,OpenAI可以记在获客成本里。  这套分层定价,已经成了海外大模型公司的共识。Google动手最早,旗舰Gemini 3.1 Pro(输入2美元、输出12美元),小模型是Flash家族,免费端为Flash-Lite。也正因为有这套多层结构托底,各家才不怕0.1美元的API不赚钱。  国内的情况不太一样。“国内旗舰虽然也不是完全不收钱,GLM、Kimi这些也卖会员(每月几十块),但付费渗透率很低,撑不起营收主体。C端订阅只是零花钱,主要收入是API与ToB。”覃相表示。

主题:便宜|DeepSeek-V4.1-Flash|GPT-6Luna|输出0.50美元