10月8日凌晨,Anthropic把Claude Haiku 5.5的小模型价格砍到了每百万输入0.1美元、输出0.5美元——这价不仅比自己上一代低10倍,还比国内DeepSeek的小模型Flash还便宜。几乎同一时间,OpenAI直接把GPT-6的小模型Luna下放去了ChatGPT免费层,不用花钱也能用上。两家海外巨头,同时对着小模型动了价格的“蛋糕”。
小模型价格战,算清三家的账
本轮比拼的三个核心选手是DeepSeek-V4.1-Flash、Claude Haiku5.5、GPT-6 Luna,定位都是轻量任务,比如摘要、分类、简单查询。按API裸价算,10万token以内的请求,Claude和GPT免费版同价;DeepSeek是百万token统一计价,缓存价0.003美元,比另外两家更低。
举个例子:一份4万token的产品文档,每轮新增500token提问、300token回答。第一轮,Claude要算缓存写入费,合计约0.52美分;DeepSeek无写入溢价,约0.63美分,Claude占优。从第二轮起,双方都走缓存价,Claude每轮约0.06美分,DeepSeek约0.04美分,DeepSeek反超,每轮差0.02美分。
官方数据说,Anthropic约90%的Claude请求都在10万token以内,等于这个低价是按日常用量算的“入口价”。至于能力,三家差距不大,都能应付轻量任务,复杂指令的差别才会体现,但不影响日常用。
巨头砍到地板价,图的不是token赚差价
两家海外巨头的定价逻辑,核心不是小模型本身赚钱,而是靠小模型拉流量,赚后面的钱。Anthropic的价格表跨度很大,旗舰Fable输入10美元,是Haiku低价档的100倍;OpenAI的GPT-6也分三档,最贵的Astra输入10美元,比免费的Luna贵百倍。
Anthropic的小模型是生态入口,单次调用微利甚至保本,但能把开发者、企业用户留在自己的盘子里,后续的Claude Code订阅、企业席位、长文服务才是大头。OpenAI的免费层看似亏,但只给C端用户,API版Luna还按0.1美元收,免费只算获客成本。Google更早玩这套,旗舰、小模型、免费端三层结构托底,不怕小模型不赚钱。
国内厂商的“门槛”,缺的不是价格是结构
海外降价对国内的影响分两块:国内市场DeepSeek的位置短时间稳,因为中文优势、国内没Claude服务、企业要私有化部署;海外市场会分流部分开发者,但DeepSeek的开源权重、私有化能力是闭源API比不了的。
国内厂商要补的不是价格,是“收钱的结构”。比如Kimi缺低价小模型,DeepSeek缺C端收费故事,智谱的免费端规模不如豆包。但国内C端难收费是痛点——免费是用户默认预期,海外用户有订阅习惯,国内厂商先免费再收费,难度大。
当海外把小模型做成“流量门票”,国内厂商能不能不用价格战,靠中文、私有化、开源这些牌,守住自己的基本盘?
素材来源:钛媒体 · AI情报、大模型
查看报道原文

发表第一条评论吧