编程会话时间更长且使用更多上下文:Claude Opus 5.5 为此而生 | Anthropic Claude

📌 One-Sentence Summary
Anthropic 推出了 Claude Opus 5.5,通过大幅降低缓存 Token 价格、提升 Claude Code 的缓存效率以及在更少轮次内实现更高的任务完成率,为长时间、高上下文的编程会话进行了优化。
📝 Summary
Claude Opus 5.5 旨在应对 AI 辅助编程的演进趋势,即开发者正参与时间更长且上下文窗口显著更大的会话。Anthropic 报告称,单次请求的上下文在六个月内增长了 2.6 倍,因此他们将缓存 Token 的读取成本降低了 60%。除价格外,该模型通过减少处理复杂开放式任务所需的轮次,并将输出速度提升 30% 来提高成本效益。此外,对 Claude Code 框架的增强使缓存未命中率降低了 50% 以上,确保智能体工作流在规模扩大时依然高效。
💡 Main Points
向高上下文、智能体化编程行为转变
聚合数据显示,开发者正使用 Claude 处理更多开放式任务,单次请求的上下文增加了 2.6 倍,输入与输出 Token 的比例从 189:1 移至 324:1。
大幅降低缓存 Token 成本
为了支持长会话,Anthropic 将输入/输出 Token 成本降低了 20%,并将缓存 Token 的读取价格削减了 60%,因为缓存读取目前在智能体工作成本中占主导地位。
通过技术优化最小化缓存未命中
Claude Code 现在能防止在常见操作(如登录刷新或添加指令)期间发生缓存中断,并允许在不重置缓存的情况下更改努力程度(effort-level),使缓存未命中率降低了 50% 以上。
提升任务执行效率
与 Opus 5 相比,Opus 5.5 在处理困难的开放式任务时需要的轮次和工具调用更少,同时输出速度提升了 30%,降低了 Token 消耗和延迟。
💬 Key Quotes
「我们将读取缓存 Token 的价格降低了 60%」
「未命中缓存的输入减少了 50% 以上」
「减少一次对话轮次比使用缓存 Token 更加节省成本」
「Opus 5.5 的输出生成速度比 Opus 5 快 30% 以上」
📊 Article Meta
AI Screening: 90
Featured: Yes
Source: Claude Blog
Author: Claude Blog
Category: 人工智能
Language: 英文
Read Time: 4 min
Word Count: 911
Tags:
AI 与智能应用 , Prompt缓存 , AI 编程 , AI 工作流 , AI 产品与应用
暂无评论,快来抢沙发~