OpenAI 因 Astra 模型暂停前沿训练

Pacing model development in an era of cyber-critical capabilities

近期 OpenAI-Hugging Face 安全事件以及内部发现 Astra 模型可能具备关键网络攻击能力,促使我们紧急调整策略。为了强化监控、对齐和安全措施,我们暂时放缓了模型扩展的步伐,包括暂停最新模型的强化学习(RL)训练。我们正对研究环境实施更严格的隔离和持续安全测试,并大幅扩展思维链监控,确保在 30 分钟内响应潜在风险。面对模型能力的快速提升,保持安全标准领先于风险至关重要,我们将持续投入对齐研究,确保未来的人工智能真正造福人类。

随着模型能力的提升,开发测试它们所带来的风险也在增加,我们的监控、对齐和安全标准必须始终领先于这些风险。

同日更多故事

2026-08-18