🪙 模型价格

AI 前沿 · 动态速递

首页/AI 前沿/动态速递/正文
10月7日模型价格

Claude Haiku 5.5:两家公司在同一天,把价格钉在了同一个数字上

先看那个「90%」的真相

铺天盖地的标题是「便宜 90%」。这个数字是真的,但只对一半情况成立:提示在 10 万 token 以内时,输入 $0.10、输出 $0.50;超过 10 万 token,价格变成 $0.50 和 $2.50——翻了五倍,相对上一代的降幅只有约 50%。而检索增强、长对话历史、整本文档摘要这些任务,经常就落在 10 万 token 以上。Anthropic 自己给的数字反而最诚实:计入请求大小分布和一个会多算约 30% token 的新分词器之后,真实工作负载平均省约 75%。做预算就按 75% 算,不要按 90% 算。

同一天,两条价格线撞在同一个数字上

Claude Haiku 5.5 是 $0.10 输入 / $0.50 输出;OpenAI 的 GPT-6 Luna 也是 $0.10 / $0.50——精确到分是一样的。两家独立定价走到同一个数字,这不像巧合,更像是一条地板被钉住了。作为参照:Gemini 3.8 Flash 输出价 $3.75,是它的 7.5 倍(且处于促销期);开源模型在 OpenRouter 上的平均价格约 $0.83/M。同时 Sonnet 5.5 的缓存读取价从 $0.20 降到 $0.10,官方称多数智能体任务成本因此降约 20%。

便宜了,但也真的变强了

价格战容易让人忽略能力变化,这次不是。操作电脑的 OSWorld 2.1(离线子集)从上一代的 15.7% 跳到 72.4%,同一测试上 GPT-6 Luna 是 48.9%;命令行编程 Terminal-Bench 4.0 从 0 分涨到 39.2%;知识工作基准 GDPval-AA v2.1 拿到 1620 分(Luna 1437)。
但要连着读两个脚注:Terminal-Bench 的 39.2% 是在最高推理档位下测的,默认的中等档大约只有 20%——按默认部署、按公布数字预期,你大概只能拿到一半。另外这仍是厂商自报成绩。几个使用细节:Haiku 系列首次加入可调推理档位;1M 上下文、最多 128K 输出;非默认的 temperature / top_p / top_k 会直接返回 400 错误;Haiku 4.5 将于 10 月 15 日退役——从发布到旧版下线只留了 8 天,生产团队迁移窗口很窄。

💬 白话解读

这条新闻真正的信息量不在「便宜」,而在两家的价格一模一样。当竞争打到小数点后两位还分不出胜负,说明这一档的能力已经变成标准品——就像电和带宽,最后拼的不是谁更便宜,而是谁更稳、谁的生态更好用。对我们普通人,意义是:AI 的基础功能正在快速变成「几乎不要钱」。以后判断一个 AI 产品值不值,看的不该是它能不能聊天,而是它在你具体那件事上,能不能真的替你省下时间。

Claude模型定价Anthropic
Anthropic 官方 / AIToolsRecap / Web AI News / Lumien AI / 华西计算机
← 上一篇:GPT-6 全球上线:回复开始「长出界面」… 下一篇:AI 会「看人下菜」:13 个模型里 8 个向有钱人推更贵的… →
延伸阅读
行业观察

传闻每月 500 美元的 ChatGPT 订阅

大模型

DeepSeek 年化收入破 10 亿美元

行业观察

谷歌削减免费档:AI 开始分层卖能力

⚠️ 说明

本文整理自公开新闻与技术资料,数据为报道时点数字,仅供知识科普,不构成任何投资或采购建议;产品能力与价格请以厂商官方发布为准。

↑