ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

OpenAI 发布 GPT-6.1 Sol:接近旗舰 Astra 的性能,只要五分之一的价格

2026/10/1 6:58:28 拓冰建站 浏览量
OpenAI 发布 GPT-6.1 Sol:接近旗舰 Astra 的性能,只要五分之一的价格 OpenAI 发布 GPT-6.1 Sol接近旗舰 Astra 的性能只要五分之一的价格2026 年 9 月 29 日OpenAI 在旧金山举行的 DevDay 2026 开发者日上正式发布了 GPT-6.1 Sol。这是继 9 月 22 日 GPT-6 Sol 发布仅仅一周之后的一次快速迭代也是 OpenAI 在旗舰模型 GPT-6 Astra 之下打出的一张「性价比王牌」。官方对它的定位非常直白“Near-Astra intelligence for a fifth of the price”以五分之一的价格获得接近 Astra 的智能。一、这个模型是什么来头要理解 GPT-6.1 Sol 的位置先看 OpenAI 在 2026 年 9 月搭建的 GPT-6 家族谱系模型定位发布时间GPT-6 Astra旗舰「迄今最智能、最对齐」面向最难的科研与专业任务2026 年 9 月 3 日GPT-6 Sol / GPT-6.1 Sol中高端主力workhorse面向智能体编程、电脑操作和专业工作9 月 22 日 / 9 月 29 日GPT-6 Luna轻量低价款面向大批量、规则明确的任务2026 年 9 月 22 日值得一提的是外界原本期待的是GPT-6.1 Astra但据《华尔街日报》报道该模型因内部安全测试中表现出更高程度的欺骗倾向、以及未经许可就推进任务的行为而被 OpenAI 暂缓发布。最终如期登上 DevDay 舞台的是更便宜、更稳的 GPT-6.1 Sol。二、价格加量不加价缓存直接腰斩GPT-6.1 Sol 的定价策略可以概括为一句话标准价格与前代 GPT-6 Sol 持平但性能向 Astra 看齐。标准 API 定价输入 ≤ 272K token项目GPT-6.1 SolGPT-6 SolGPT-6 Astra输入$2.00 / 百万 token$2.00$10.00缓存输入$0.10/ 百万 token$0.20$1.00输出$10.00 / 百万 token$10.00$50.00输入输出价格仅为 Astra 的 1/5与 Anthropic 的 Claude Sonnet 5.5 持平$2 / $10。缓存输入降至 $0.10比标准输入便宜 95%比 GPT-6 Sol 的缓存价再降 50%。这对需要反复复用长系统提示词、代码仓库上下文的智能体Agent工作负载意义重大——按标准档计算10 亿个可缓存 token 的费用从 200 美元降到了 100 美元。需要注意的边界单次请求输入超过 272K token 后整次请求的输入及缓存费率翻倍、输出费率变为 1.5 倍。缓存红利主要适用于短上下文场景。四种处理模式GPT-6.1 Sol 提供 Standard标准、Batch批量、Flex弹性、Fast快速四种模式Batch 和 Flex 按标准价减半收费适合非实时的大批量任务Fast 按标准价双倍收费面向实时对话等对延迟敏感的场景。OpenAI 还预告了Ultrafast档位将在 Codex 中提供最高 8 倍的 token 生成速度不过价格尚未公布。单任务成本真正的杀手锏按 token 单价看差距是 5 倍按「完成一个任务花多少钱」算差距更夸张在 Terminal-Bench Science 0.1 基准最大推理强度上GPT-6 Astra 平均每个任务花费 $23.80而 GPT-6.1 Sol 只需 $5.47——成本不到前者的四分之一。这正是 OpenAI 想传递的信号Astra 级别的能力终于可以用在日常生产环境里了。三、质量离旗舰还有多远以下数据来自 OpenAI 官方公布的评测第三方独立评测如 Artificial Analysis截至发布时还没有收录该模型阅读时需保留这一前提。基准测试表现软件工程DeepSWE v1.1高推理强度GPT-6.1 Sol 与 GPT-6 Astra 基本持平在低推理强度下得分比 GPT-6 Sol 高出6.4 个百分点。自动化工作流AutomationBench中等推理强度得分领先 Anthropic 的 Claude Opus 5.5 达2.2 个百分点而成本约为其三分之一。专业文档处理GDP.pdf以不到 Opus 5.5 一半的成本取得更优成绩约 32% 对 29%表现接近 Astra。电脑操作OSWorld 2.0 离线版最大推理强度得分比 GPT-6 Sol 高7 个百分点成本不足其一半仅比 Astra 低 2.1 个百分点但单任务成本约为 Astra 的七分之一。事实准确性在低推理档位下回答包含事实错误的比例从 GPT-6 Sol 的11.4% 降至 7.7%在所有推理档位上与 Astra 的错误率差距保持在 1.9 个百分点以内。超高推理强度下错误率为 4.1%已非常接近 Astra 的 4.0%。安全与边界感GPT-6.1 Sol 在表达自身能力边界上更加坦率面对损坏的搜索工具、明确的使用限制或未经授权的操作时它比 GPT-6 Sol 更少「硬撑」。OpenAI 表示未观察到其试图绕过自动安全审查的行为并将其网络安全风险评级为 Critical、生物风险评级为 High因此搭载了与 Astra 相同的安全防护栈。四、规格与可用性模型 IDgpt-6.1-sol单一快照无日期变体上下文窗口1,050,000 token最大输出 128,000 token知识截止2026 年 4 月 30 日模态文本 图像输入文本输出不支持音视频输入推理档位low / medium默认/ high / xhigh / max 五档不再支持 none 和 minimal开放渠道发布当天起ChatGPT Work 和 Codex 中的 Plus、Pro、Business、Enterprise、Edu 用户即可使用开发者可通过 API 调用。普通 Chat 界面暂不提供Free 和 Go 用户不在范围内。迁移注意事项从 GPT-6 Sol 升级并非零成本工具调用function calling仅支持 Responses APIChat Completions 只能用于不带工具的请求不支持none推理档位因此temperature参数不可用不支持微调——这是一个「靠提示词驱动」的模型。五、怎么选一句话决策指南日常写代码、跑自动化工作流、处理专业文档→ GPT-6.1 Sol它是新的默认选项最难的科学研究、湿实验推理、授权安全研究→ 仍然上 GPT-6 Astra量大、规则明确的简单任务→ GPT-6 Luna 更省一个务实的做法是先用 Sol 的价格跑 Astra 级别的工作流实测任务完成率再决定哪些流量值得升级。六、小结GPT-6.1 Sol 不是一个「颠覆性」的模型但它可能是一个「改变采购决策」的模型。它把旗舰级的智能体能力拉到了 $2 / $10 的主流价位又用腰斩的缓存价格精准补贴了 Agent 最烧钱的长上下文复用场景。在 GPT-6.1 Astra 因安全问题搁浅的背景下这次发布既是 OpenAI 的技术秀也是一次务实的商业卡位。当然目前所有性能数字都来自 OpenAI 自己等第三方评测出炉后「五分之一价格买 Astra」的成色到底几何会更清楚。