[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"$f1relb637ah3g9":3},{"_id":4,"slug":5,"title":6,"subtitle":7,"kind":8,"cards":9,"tags":23,"categories":24,"source":25,"lang":28,"author":29,"audioState":32,"stats":33,"publishedAt":36,"renderer":37},"6abc1263ca21c797c7e9e4b8","ai-openai-gpt-61-sol-astra-15-8d6b72c4","同性能下最高性价比 AI 模型：OpenAI 发布 GPT-6.1 Sol，性能媲美 Astra、费用仅为 1\u002F5","IT之家 9 月 30 日消息，在今天召开的 OpenAI 开发者活动日中，官方正式宣布推出 GPT-6.1 Sol 模型，在性能接近 Astra 的同时，其费用仅为 Astra 的五分之一，官方称这是“在目前同等性能下性价比最高的模型”。 GPT‑6 Astra 是 OpenAI 在 2026 年 9…","news",[10,13,18],{"headline":6,"body":11,"imageUrl":12,"sourceImageUrl":12},"IT之家 9 月 30 日消息，在今天召开的 OpenAI 开发者活动日中，官方正式宣布推出 GPT-6.1 Sol 模型，在性能接近 Astra 的同时，其费用仅为 Astra 的五分之一，官方称这是“在目前同等性能下性价比最高的模型”。 GPT‑6 Astra 是 OpenAI 在 2026 年 9 月推出的旗舰级大语言模型，官方定位是“迄今最智能、最对齐（最符合人类意图）”的模型，重点面向长程多步骤任务与专业工作流。 费用方面，根据官网公布的费用细节，IT之家附上相关售价信息如下： gpt-6.1-sol 全模式定价表（短上下文，输入 tokens ≤ 272,000） gpt-6.1-sol 全模式定价表（长上下文，输入 tokens > 272,000） 性价比方面，官方表示 GPT-6.1 Sol 模型每 100 万 Token 的缓存费用为 0.1 美元（IT之家注：现汇率约合 0.67 元人民币），相比较 GPT-6 Sol 模型定价低 50%。 在性能方面，在智能体编程、电脑操作和专业工作流等任务上，性能接近旗舰 GPT‑6 Astra，但标准输入 \u002F 输出 token 价格只有 Astra 的五分之一。 软件工程（DeepSWE v1.1）：在较高推理强度下，GPT‑6.1 Sol 的表现与 GPT‑6 Astra 相当；在较低推理强度 \u002F 成本条件下，其得分比 GPT‑6 Sol 高出 6.4 个百分点。 软件工程（DeepSWE v1.1）：在较高推理强度下，GPT‑6.1 Sol 的表现与 GPT‑6 Astra 相当；在较低推理强度 \u002F 成本条件下，其得分比 GPT‑6 Sol 高出 6.4 个百分点。 专业文档与复杂任务（GDP.pdf）：以不到 Opus 5.5 一半的任务成本，取得更好结果。 专业文档与复杂任务（GDP.pdf）：以不到 Opus 5.5 一半的任务成本，取得更好结果。 自动化工作流（AutomationBench，中等推理强度）：得分比 Opus 5.5 高 2.2 个百分点，成本约为其三分之一。","https:\u002F\u002Fimg.ithome.com\u002Fnewsuploadfiles\u002F2026\u002F9\u002Fd01521d5-ef5c-44f0-8a10-9087bd0829df.png?x-bce-process=image\u002Fformat,f_auto",{"headline":14,"body":15,"imageUrl":16,"images":17},"自动化工作流（AutomationBench，中等推理强度）：得分比 Opus 5.5 高 2.2 个百分点，成本约为其三分之一。 电脑操作（OSWorld…","自动化工作流（AutomationBench，中等推理强度）：得分比 Opus 5.5 高 2.2 个百分点，成本约为其三分之一。 电脑操作（OSWorld 2.0 离线，最大推理强度）：得分比 GPT‑6 Sol 高 7 个百分点，成本不足后者一半；与 Astra 相比仅低 2.1 个百分点，但单任务成本约为 Astra 的七分之一。 电脑操作（OSWorld 2.0 离线，最大推理强度）：得分比 GPT‑6 Sol 高 7 个百分点，成本不足后者一半；与 Astra 相比仅低 2.1 个百分点，但单任务成本约为 Astra 的七分之一。 科学终端任务（Terminal‑Bench Science 0.1，最大推理强度）：得分是 GPT‑6 Sol 的两倍以上；单任务平均成本 $5.47，显著低于 Opus 5.5（$23.21）和 Astra（$23.80）。 科学终端任务（Terminal‑Bench Science 0.1，最大推理强度）：得分是 GPT‑6 Sol 的两倍以上；单任务平均成本 $5.47，显著低于 Opus 5.5（$23.21）和 Astra（$23.80）。 除了“能干活”，GPT‑6.1 Sol 在可靠性与对齐方面也有改进： 事实错误率下降：在低推理强度下，事实错误比例从 GPT‑6 Sol 的 11.4% 降至 7.7%（下降约 32%）。 事实错误率下降：在低推理强度下，事实错误比例从 GPT‑6 Sol 的 11.4% 降至 7.7%（下降约 32%）。 与 Astra 的差距很小：在所有推理设置下，GPT‑6.1 Sol 的错误率与 Astra 的差距控制在 1.9% 以内。 与 Astra 的差距很小：在所有推理设置下，GPT‑6.1 Sol 的错误率与 Astra 的差距控制在 1.9% 以内。 更遵守用户意图与安全约束：在困难评测中，更少忽略失效的搜索工具、更能遵循明确限制，并减少未经授权的操作；安全测试中未观察到试图绕过自动化安全审查器的行为。","\u002Fapi\u002Fmedia\u002Fposts\u002Fai-openai-gpt-61-sol-astra-15-8d6b72c4\u002F1.webp",{"local":16},{"headline":19,"body":20,"imageUrl":21,"images":22},"更遵守用户意图与安全约束：在困难评测中，更少忽略失效的搜索工具、更能遵循明确限制，并减少未经授权的操作；安全测试中未观察到试图绕过自动化安全审查器的行为。…","更遵守用户意图与安全约束：在困难评测中，更少忽略失效的搜索工具、更能遵循明确限制，并减少未经授权的操作；安全测试中未观察到试图绕过自动化安全审查器的行为。 调用方面，自 9 月 29 日起向 ChatGPT Work 与 Codex 的 Plus \u002F Pro \u002F Business \u002F Enterprise \u002F Edu 用户开放；开发者可通过 API 以 gpt-6.1-sol 调用。","\u002Fapi\u002Fmedia\u002Fposts\u002Fai-openai-gpt-61-sol-astra-15-8d6b72c4\u002F2.webp",{"local":21},[],[],{"name":26,"url":27},"ITHome","https:\u002F\u002Fwww.ithome.com\u002F1\u002F008\u002F527.htm","zh-cn",{"handle":30,"displayName":31},"spots","Spots",null,{"views":34,"likes":35,"saves":35,"shares":35,"completions":35,"opens":35,"skips":35,"depthSum":35},3,0,"2026-09-29T19:32:51.675Z","local"]