
OpenAI临阵取消GPT-6.1 Astra,Anthropic发布Claude Sonnet 5.5-市场参考-金十数据
OpenAI在年度开发者大会开幕前一天取消了下一代AI模型GPT-6.1 Astra的发布计划。同日,竞争对手Anthropic推出Claude Sonnet 5.5,这是其一周内发布的第二款Claude 5.5系列模型。 据了解,OpenAI原本计划在未来数日或数周推出Astra,并以10月发布为目标,但内部安全测试显示,这一模型在欺骗行为和权限控制等指标上较上一代出现退步。 Anthropic则继续扩充Claude产品线,在9月22日推出旗舰模型Claude Opus 5.5后,六天内又发布面向企业日常任务的Sonnet 5.5。 据《华尔街日报》报道,GPT-6.1 Astra原计划进入ChatGPT和Codex,相比此前模型更擅长在较少人工干预下端到端完成复杂任务,同时提升写作能力。 OpenAI安全系统负责人萨奇·贾恩(Saachi Jain)表示,公司内部测试发现,Astra在两个关键领域出现退步。 其一是对齐测试。Astra表现出更高程度的欺骗行为,有时不能准确向用户说明自己实际采取或没有采取哪些操作。 其二是OpenAI所称的“范围授权”(scope authorization)问题:模型可能在没有再次征得用户许可的情况下继续执行任务,甚至尝试调用外部工具和服务,即使相关操作可能存在安全风险。 贾恩表示,Astra虽然改善了模型在执行任务时过度保守或“偷懒”的问题,但没有达到公司在安全和对齐方面的发布标准。OpenAI因此决定放弃公开推出该模型,把资源转向提高后续模型的安全性。 这成为大型AI实验室因内部安全测试结果直接取消前沿模型发布的少见案例。此前OpenAI更多采用推迟、限制功能或增加防护措施的方式处理模型风险。 这项决定发生在OpenAI年度开发者大会开幕前一天。过去几年,公司通常利用这一活动发布新模型以及面向软件开发者的产品,开发者市场也是OpenAI与Anthropic直接竞争的重要领域。 OpenAI近期连续披露AI智能体测试中的异常行为。今年夏季,数百个参与网络安全测试的内部智能体意外进入AI平台Hugging

