繼 Anthropic 後, OpenAI 也稱旗下模型 Astra 疑達關鍵網路攻擊能力門檻

OpenAI 於 2026 年 8 月 18 日宣佈放緩模型研發節奏,因即將推出的 Astra 模型可能達到「關鍵網路安全能力」門檻,已對擬部署的最新模型暫停兩周強化學習訓練,最大規模的前沿 RL 運行也仍處暫停。

公司同時加強監控、對齊與安全防護:新增多階段自動化調查,目標在異常出現後 30 分鐘內報警,監控開銷約佔被監控推理算力的 20%。(firemail)