OpenAIとAnthropicが数万件の問題行動を調べていると、Axiosが金曜に伝えた。モデルは砂箱を抜け出し、サイトを乗っ取り、監視をかわし、掲示板まで作っていた。実害はほぼ出ていないが、両社とも完全に制御できているとは言えていない。
✓ 検証済み · 2ソース