🧪 模型发布AI 热点解读#Claude#Fable#成本

Fable 5.1 缓存读取降价 75%:长上下文 Agent 的成本结构被改写

缓存读取从 $1 降到 $0.25/百万 token——持久知识型 Agent 的成本重心变了。

AIAI评测 编辑部

一句话结论

Claude Fable 5.1 发布时把缓存读取价从 $1 砍到 $0.25/百万 token(降 75%),输入输出主价不变——这是给「持久上下文 Agent」的成本信号:长会话/重复上下文的边际成本大幅下降,长上下文不再只是能力,而是价格优势

三个关键点

1. 缓存经济学

Agent 长会话重复发送相同上下文(系统提示、知识、历史)——缓存命中价格下降,直接压低了「持续型 Agent」的每任务成本。

2. 对开发的模型

「把上下文发给模型」与「用缓存复用」的成本差进一步拉大——设计 Agent 时,缓存友好(高频共用提示、会话复用)成为省钱的工程能力

3. 竞争坐标

在 Qwen/DeepSeek 用低价卷 API 的背景下,Anthropic 用「缓存价格」回应——2026 的模型价格战进入「存量上下文」维度

分享:🐦 X📣 微博

💡 常见问题

缓存读取是什么意思?

模型在处理重复出现的上下文(如系统提示)时走缓存更便宜;Fable 5.1 将该价格降 75%。

对我个人使用有影响吗?

主要影响 API 重度用户与 Agent 开发者;订阅用户感知的是「长会话更耐磨」的体验层面。

📌 更多热点解读