OpenAI、サイバーリスクのため主要なフロンティアAIトレーニングを一時停止
OpenAIは、展開を予定している最新モデルの強化学習(RL)トレーニングを2週間一時停止し、その間に研究環境の強化とレッドチーミングを行い、監視を拡大しました。同社は、「計画されている最大のフロンティアRL実行は、モデルの挙動を評価し、安全対策を検証し、進める前に整合性の証拠をさらに確立するために、小規模なトレーニングと評価を実施している間、保留中です」と述べています。この動きは、OpenAI-Hugging Faceのインシデントと、同社の今後の…という予備的な証拠に続いたものです。