OpenAI 发布 GPT-6.1 Sol:以 Astra 五分之一价格接近其编码与计算机操作水平

📌 One-Sentence Summary
OpenAI 发布了 GPT-6.1 Sol,这款中端模型在编码与计算机操作性能上接近 GPT-6 Astra,而 token 价格仅为其五分之一,缓存输入低至每百万 token 0.10 美元。
📝 Summary
OpenAI 发布了 GPT-6.1 Sol,这是对中端模型 GPT-6 Sol 的升级,在 GPT-6 产品线中定位于 Astra 与 Luna 之间。其定价为每百万输入 token 2 美元、输出 10 美元、缓存输入 0.10 美元——约为 Astra 标准费率的五分之一,缓存成本为 GPT-6 Sol 的一半。OpenAI 表示,Sol 在 DeepSWE v1.1 编码测试上与 Astra 持平,成本约为其五分之一;在 GDP.pdf 和 AutomationBench 上以更低的单任务成本击败 Claude Opus 5.5;在 OSWorld 2.0 计算机操作评分上比 GPT-6 Sol 提升 7 分。该模型提供 1,050,000 token 上下文窗口、128K 最大输出、五档推理强度,可通过 API、ChatGPT Work 和 Codex 使用。它为闭源权重,Astra 仍在最难的科研任务上保持领先。
💡 Main Points
GPT-6.1 Sol 以五分之一 token 价格实现接近 Astra 的编码与计算机操作性能
OpenAI 表示,Sol 在 DeepSWE v1.1 上与 GPT-6 Astra 持平,成本约为其五分之一;在 OSWorld 2.0 上比 GPT-6 Sol 提升 7 分,而单任务成本约为 Astra 的七分之一,将差距缩小至 2.1 分。
激进的缓存输入定价让长时间运行的智能体工作流更经济
缓存输入定价为每百万 token 0.10 美元,是未缓存输入费率的 5%,也是 GPT-6 Sol 缓存成本的一半。由于智能体在每一步都会重新发送系统提示词、工具 schema 和对话历史,这直接降低了持久化智能体循环的成本。
Sol 在专业工作基准上以更低单任务成本击败 Claude Opus 5.5
在 GDP.pdf 上,Sol 以不到一半的单任务成本击败了带 fallback 的 Claude Opus 5.5;在 AutomationBench 1.0.6 上,它以约三分之一的成本在中等推理强度下高出 2.2 分。不过,OpenAI 的基准测试对比的是 Opus 5.5,而非定价相同的 Sonnet 5.5。
该模型提供 1.05M token 上下文窗口和五档推理强度,但为闭源权重
API 细节包括 1,050,000 token 上下文、128K 最大输出、知识截止日期为 2026 年 4 月 30 日、支持文本和图像输入,以及从 low 到 max 的 reasoning.effort 设置。超过 272K 输入 token 的提示词将按 2 倍输入和缓存费率、1.5 倍输出费率计费。它仅提供 API,不支持微调。
Astra 仍是完成最难科研任务的首选
在 Terminal-Bench Science 0.1 上,Astra 仍以 68.1% 领先,OpenAI 建议将其用于最困难的研究。Sol 在该测试中的平均单任务成本为 5.47 美元,而 Opus 5.5 为 23.21 美元,Astra 为 23.80 美元。
💬 Key Quotes
GPT-6.1 Sol 在 DeepSWE v1.1 上与 GPT-6 Astra 持平,成本约为其五分之一。
缓存读取费用为未缓存输入费率的 5%,低于 GPT-6 Sol 的 10%。
在 AutomationBench 上,它以约三分之一的成本比 Claude Opus 5.5 高出 2.2 分。
它仅提供 API 且为闭源权重;Astra 仍在最难的科研任务上领先。
📊 Article Meta
AI Screening: 85
Source: AIHOT — 精选
Author: noreply@aihot.news (MarkTechPost(RSS))
Category: 人工智能
Language: 英文
Read Time: 8 min
Word Count: 1938
Tags:
AI 与智能应用 , 模型发布 , AI 编程 , 科技新闻 , AI Agent
内容翔实,正好需要,先收藏再看。