大模型“一周三更”:DeepSeek涨价、阿里云开源、智谱“不换药”
大模型“一周三更”:DeepSeek涨价、阿里云开源、智谱“不换药”
2026年08月16日 20:03
8月的第二周,中国大模型行业密集变阵。8月13日,DeepSeek确认DeepSeek-V4-Flash和DeepSeek-V4-Pro将在8月17日上调价格,执行峰谷计价,同时发布Harness(工具框架)开发者预览版。一天后 智谱 发布GLM-5.3,该版本基于和GLM-5.2一样的基座模型,仅靠后训练将编程能力提升50%,同日阿里千问正式开源Qwen3.8系列模型,全 新开源 的270亿参数规模模型Qwen3.8-27B,家用显卡也能跑。
从“谁更便宜”转向“谁更不可替代”。DeepSeek用Harness对冲涨价可能出现的用户流失风险, 智谱 押注后训练撬动性能杠杆,阿里云继续开源模型拉动云生态。绕不开算力等硬性成本时,路线就成了战场,AI模型聚合平台OpenRouter最新数据给出了大模型客户的选择,本周全球模型调用量排名前十的模型中,6个均是国产模型。
左手模型右手Harness
一个蓝鲸鱼一个黑鲸鱼,DeepSeek和DeepSeek Harness用颜色区分了官方微信公众号头像,并在同一天发布内容,对于数月更新一次的DeepSeek实属罕见。
DeepSeek账号最新文章的题目是“DeepSeek-V4-Pro正式版上线”,“DeepSeek Harness团队”的题目是“DeepSeek Harness开发者预览版上线”。
模型预览版转正是DeepSeek预告过的动作,上线Harnees也有蛛丝马迹,但依然让这两篇博文的阅读量迅速达到10万+。
所谓Harness,在当下的AI语境下指的是一套智能体管控系统。过去人类和AI的交互是线性的:你提问,它回答。现在进入了Agent(智能体)时代。Agent要能自主拆解任务、调用工具,甚至自我修正。在这个过程中,模型本身的“智商”固然重要,但运行的“环境和约束”决定了它是否可靠。Harness就是从对话到系统的跃迁。
Nextie(明日新程)创始人、“小冰之父”李笛向北京商报记者具体解释,“三年以前,人们往往认为只要模型能力足够强,就自然可以得到完美的效果。但Claude Code的模型能力足够强,依然需要数十万行代码的Harness,才能让其在具体的应用中发挥端到端的表现。此次DeepSeek的Harness,也是类似的具体行动”。
回到具体的产品,DeepSeek Harness的设计思路是“一切皆插件”,采用插件式开放架构来构建 Agent Harness,即模型、工具、技能、会话、沙箱、存储、循环、调度、UI(用户界面)等所有Agent能力均由插件组合而成,可自由替换、灵活重组。DeepSeek Harness方面进一步介绍:开发者无需改动 DeepSeek Harness 的源码本身,就能以插件的方式独立选择、替换或扩展其中的任一能力。
按照这个逻辑,DeepSeek的模型只是DeepSeekHarness 的插件之一。开发者不仅可以接入DeepSeek的模型,理论上也可以对接市面上其他主流大模型。北京商报记者就此通过用户身份给DeepSeek Harness团队留言,截至发稿暂未得到回复。
新技术与旧商业模式
如果将模型涨价和发布Harness拼在一起,业内人士透过技术看到了商业化的焦虑。
8月17日,DeepSeek将采用最新价位收费,且峰谷不同价。届时DeepSeek-V4-Flash,空闲时段百万Tokens输入(缓存命中)价格为0.05元,百万Tokens输入(缓存未命中)价格为1.5元,百万Tokens输出价格4.5元。高峰时段,上述价格均上涨1倍,分别是0.1元、3元、9元。
DeepSeek-V4-Pro空闲时段,百万Tokens输入(缓存命中)价格为0.15元,百万Tokens输入(缓存未命中)价格为4.5元,百万Tokens输出价格为13.5元。高峰时段,上述价格上涨1倍,分别是0.3元、9元、27元。
“基础大模型涨价是大模型从跑马圈地到进入商业化深水区的大趋势,也逐渐成为行业共识”,李笛告诉北京商报记者,“模型有商业价值不等于有合理的商业模式,涨价是模型厂商不断感知社会接受度、调整商业模式、最终达到供需平衡的过程”。
早期模型厂商的价格战甚至免费的价格体系,一再拉低用户对大模型价格的心理区间,“在这种情况下模型厂商单纯调价,往往在短期内表现为阵痛,造成用户流失”,基于此,李笛认为,“模型企业往往不能只调价,还必须同时提供比过去更深入的服务,Harness就是提质手段之一。大模型时代的今天,我们使用的是最新的技术,但商业模式却是非常陈旧的,是过去三十年来,以边际成本递减为基本前提所奠定的商业模式。但大模型时代并不适用于这一前提”。
站在整个行业的角度,即使有些厂商没有涨价,也在回答同一个问题:模型之外,还能靠什么挣钱?
整个8月,阿里云从算力、模型到产品都有新动态。当月至今,阿里云瓴羊企业级智能分析产品Quick BI完成AI原生架构升级,发布全新版本;视频生成模型Wan3.0启动公测;上线一站式AI语音生产力平台CosyVoice Studio; AI应用 创作平台Meoo(秒悟)正式上线团队版;阿里云灵骏真武M890超节点实例正式上线,首批在乌兰察布地域开售;正式开源Qwen3.8系列模型。
不换基座,换打法
“圈地”的方式不止开源和涨价两种。 智谱 选择了一条更省成本的路:不换基座,聚焦后训练。
8月14日,智谱发布GLM-5.3,与GLM-5.2相比,基座模型没变,通过后训练Scaling(规模化)提高了模型的智能上限。在编程方面,GLM-5.3在内部自建体感评测中较GLM-5.2提升50%,在包括TerminalBench 3.0、Agents' Last Exam(CLI)在内的公开基准测试中取得开源第一。在 网络安全 能力方面,在白盒代码审查与漏洞发现等安全任务中的表现,GLM-5.3的表现与Mythos 5持平,展现出面向 网络安全 防御场景的强大潜力。
据智谱介绍,上述全部提升都来自后训练。基于IndexShare、SAO以及持续演进的新一代Slime框架,智谱在与GLM-5.2完全相同的基座上高效推进强化学习。“可能我们还远未开发出这个基座的智能上限。”智谱把这句话标亮加粗。
效果如何?当天, 金山办公 旗下AI办公智能体灵犀专业版即接入智谱GLM-5.3模型。在推荐这次合作时, 金山办公 提到了GLM-5.3的代码和 网络安全 能力。值得注意的是,灵犀在前一天也接入了DeepSeek-V4-Pro正式版,同样提到了代码能力。
这不是巧合,Agent时代,能对话只是门槛,能写代码才是模型撬开客户钱包的硬指标。
文渊智库创始人王超向北京商报记者表示:“模型厂商的商业模式远没有确定,到底是靠C(用户)端,还是靠B(企业)或生态,都没确定。”在他看来,“和海外同行相比,国内大模型的算力成本更低,但是推出的模型效果比同样成本的模型更好”。从某种程度看,智谱的策略正是这一判断的注脚。
OpenRouter 最新数据显示,本周,全球AI大模型调用量前五名中除GPT-5.6 Luna之外,均是中国模型,前十名中有6家是国产模型,分别是DeepSeek-V4-Flash-0731、Hy3、DeepSeek-V4-Flash-0423、GLM-5.2、Mimo-V2.5、DeepSeek-V4-Pro。
(文章来源:北京商报)