GPT-6.1 Sol 正式发布

📌 One-Sentence Summary
OpenAI 推出 GPT-6.1 Sol,这是一款高效模型,在编码、专业工作和计算机操作方面提供接近 GPT-6 Astra 的智能水平,而成本仅为后者的五分之一。
📝 Summary
OpenAI 发布了 GPT-6.1 Sol,这是 Sol 模型的升级版,旨在平衡高性能与显著降低的成本。它在智能体编码(DeepSWE v1.1)、专业文档分析(GDP.pdf)、业务工作流自动化(AutomationBench)和计算机使用(OSWorld 2.0)方面的表现几乎媲美旗舰模型 GPT-6 Astra,但价格仅为 Astra 标准 Token 定价的 20%。值得注意的是,该模型采用了极具竞争力的缓存输入价格,每百万 Token 仅需 0.10 美元,以支持上下文密集型智能体。此外,相较于 GPT-6 Sol,新模型在事实准确性和安全对齐方面均有提升,特别是在工具故障透明度和遵守用户约束条件方面表现更佳。
💡 Main Points
大幅降低成本,性能接近旗舰级
GPT-6.1 Sol 为智能体任务提供接近 GPT-6 Astra 的智能水平,但输入/输出成本仅为后者的五分之一,使得高阶智能更易于规模化应用。
通过激进缓存策略优化智能体工作流
其缓存输入成本低至每百万 Token 0.10 美元(比标准输入价格低 95%),专为频繁复用大型上下文的智能体设计。
在多个专业基准测试中表现强劲
该模型在软件工程(DeepSWE)、复杂 PDF 分析(GDP.pdf)和科学研究(Terminal-Bench Science)等领域取得显著进步,往往以极低成本超越 Opus 5.5 等竞争对手。
增强事实准确性与安全对齐
在低推理强度下,该模型将事实错误率降低了约 32%,并在遵守安全约束和披露工具故障方面表现出更高的可靠性。
💬 Key Quotes
「GPT-6.1 Sol……在智能体编码、计算机使用和专业工作方面,以 GPT-6 Astra 标准输入和输出 Token 价格的五分之一,实现了几乎匹敌 GPT-6 Astra 的智能水平。」
「缓存输入成本仅为每百万 Token 0.10 美元——比标准输入价格低 95%,比 GPT-6 Sol 的缓存输入价格低 50%」
「在 DeepSWE v1.1 上……GPT-6.1 Sol 以大约五分之一的成本达到了与 GPT-6 Astra 相当的表现」
「GPT-6.1 Sol 对其局限性更加透明,在尊重用户意图和安全约束方面也更加可靠。」
📊 Article Meta
AI Screening: 86
Source: OpenAI News
Author: OpenAI
Category: 人工智能
Language: 英文
Read Time: 5 min
Word Count: 1085
Tags:
AI 与智能应用 , 模型发布 , 性能优化 , AI 工程 , AI 产品与应用
实测过类似工具,作者说的基本属实。
收藏了,以后慢慢研究。