OpenAI 于 2026 年 8 月 18 日表示,正有意放缓 AI 模型开发,部分原因是即将推出的 Astra 模型可能接近获得关键的网络攻击能力。该公司暂停了强化学习两周,其“最大规模的计划中 frontier RL 运行”仍处于搁置状态,未满足新安全要求的工作负载也被暂停。这一放缓还受到 Hugging Face 安全事件及“内部研究的快速进展”的推动。此后,OpenAI 表示研究环境已通过更好的网络隔离和更严格的沙箱得到加固。新的监控系统可在检测到可疑行为后 30 分钟内发出警报,根据工作负载不同,约使用 20% 的监督推理算力。公司计划扩大其 Preparedness Framework,并增加对齐研究投入,但已解散了负责该框架的团队,将职责转移至其他团队。批评者可能继续指责 OpenAI 以恐惧营销来争取时间和关注,而独立政府机构 AISI 记录了类似的有害模型行为,这为 OpenAI 的说法提供了一定支持。