Anthropic发布低价小模型Claude Haiku 5.5,OpenAI则将GPT-6 Luna下放至免费层,硅谷大模型厂商集体开打价格战。当低价不再是国产大模型独有的标签,海外巨头正依靠多层定价和生态变现重塑行业竞争格局。
过去两年,谈起大模型的“价格屠夫”,公众往往最先想到国内厂商。DeepSeek曾将每百万Token的调用成本降至极低区间,迫使国内同行相继跟进,低价一度成为国产大模型的显著标签。而Anthropic旗下的Claude因单价偏高,此前一直被视为好用但不便宜的选择。
这一竞争格局正在发生改变。Anthropic近期推出了主打日常高频、轻量任务的小模型Claude Haiku 5.5。针对10万Token以内的请求,其每百万Token输入仅需0.10美元、输出0.50美元,单价降至上一代产品的十分之一,甚至低于同级别国产小模型。几乎在同一时间,OpenAI宣布GPT-6全量上线,其中轻量模型GPT-6 Luna直接下放给免费用户使用。
海外两大头部AI厂商同时在定价策略上发力,标志着大模型行业的价格战战火已经蔓延至全球小模型生态。
本轮模型厂商价格竞争的焦点集中在小模型。旗舰模型代表着厂商的技术上限与品牌溢价,定价相对坚挺;而小模型推理成本可控、高并发承载力强,是吸引开发者留存的核心入口,也是价格调整的首选阵地。

在API调用定价上,Claude Haiku 5.5与GPT-6 Luna保持一致:在10万Token以内,每百万Token输入0.10美元、输出0.50美元。在短文本和裸调用口径下,这一价格比DeepSeek-V4.1-Flash更为激进。不过,各家在具体计费规则上有所差异:
从能力来看,三款小模型在日常摘要、轻量分类和通用Agent子任务上均能良好胜任,常规任务并未拉开明显差距。低门槛的价格,本质上是海外厂商针对高频调用市场精心计算后的引流方案。
将API降至极低甚至免费,海外大模型厂商的底气源于其成熟的分层变现体系。OpenAI与Anthropic的商业模型并非单纯依赖单次Token的差价,而是由多档位构成的商业生态。

首先是低价入口保生态。小模型微利甚至保本,核心目标是绑定开发者、做大调用规模,将其圈定在自身的工具链和工作流内。
其次是高阶能力补利润。Anthropic将高难任务留给单价高出数十倍的高阶模型;同时下调常用缓存读取单价,精准扶持Claude Code等高频次编程Agent应用。对于Anthropic而言,企业席位与开发者工具的订阅费才是基本盘,低价小模型是获取高价值客户的敲门砖。
OpenAI则走通了另一条路径:在ChatGPT端将GPT-6 Luna直接免费,通过控制小模型的算力成本,将免费额度列为获客支出;而在API侧依然收费,形成了清晰的C端获客、B端变现的分工。
面对海外厂商的主动降价,国内市场的反应呈现出内外分化的态势。
在国内市场,海外大模型的低价冲击相对有限。DeepSeek等本土模型在中文理解、接入合规性以及私有化部署支持上具有天然护城河,综合使用成本和交付稳定性仍占优。此外,通义千问在开源生态上的成熟工具链、豆包在C端庞大的流量入口、Kimi的长文本心智以及智谱在政企客户的私有化交付,都构成了各自的防御屏障。
但在海外开发者群体中,Haiku 5.5等低价高质模型的出现确实会分流一部分原本倾向开源低价模型的调用量。
行业共识在于,单纯跟进单价战意义有限,国内厂商更需要补齐的是商业层级结构:
当低价门槛被硅谷巨头抹平,大模型下半场的竞争正加速转向全链条商业闭环与生态黏性的比拼。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断