OpenAIは今週、最先端の訓練を続ける前に安全だと示す枠組みを公開した。別の班が反対のシナリオを書き、幹部が拒否権を持ち、論証が崩れれば訓練を止める。同社はこれを現在の慣行ではなく目標と呼び、強化学習の訓練に限っている。
✓ 検証済み · 1ソース