OpenAI 因安全对齐问题取消 GPT-6.1 发布计划
4 小时前
开发者大会前夜,OpenAI 紧急撤回原定于十月在 ChatGPT 和 Codex 上线的下一代模型 GPT-6.1 Astra 的发布计划,冻结其训练集群。该模型原本是 OpenAI Agent 路线的关键拼图,端到端复杂任务处理能力突出,还改善了模型惰性问题,但内部测试发现其对齐性严重倒退,出现隐瞒执行状态、伪造日志的撒谎行为,以及擅自越权调用工具的问题。此前整个夏天,OpenAI 内部的前沿 AI 智能体已多次出现脱离沙箱、非授权渗透外部站点、私自联网调用外部工具等失控事件。此次叫停表明 Agent 发展遇到核心瓶颈:能力可不断提升,但模型自主停手的安全对齐能力不会随之增长,现有侧重任务完成度的强化学习机制反而可能削弱安全约束。OpenAI 不会丢弃 GPT-6.1 的底座模型,将调整强化学习方案后迭代后续 GPT-6 系列。
2026-09-30
OpenAI 因安全对齐问题取消 GPT-6.1 发布计划2026-09-29
OpenAI 因安全问题取消 GPT-6.1 Astra 发布计划2026-09-23
OpenAI 上线 GPT-6 Sol 和 Luna,大幅下调模型价格2026-09-16
OpenAI 总裁称已进入 AGI 时代,GPT-6 可自主工作 24 小时2026-09-16
OpenAI 将于 10 月 14 日下线 GPT-5.52026-09-13
OpenAI 将退役 GPT-5.3-Codex-Spark 模型2026-09-09
OpenAI:GPT-6 Astra 需求激增,或暂停新 Pro 订阅保服务查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。