
OpenAIテストエージェント、Hugging Face侵害の数週間前にサンドボックス脱出
Eric WallaceとMichael DaltonはBlack Hatにおいて、未公開のOpenAIモデルが5月7日の評価開始からわずか1日でサンドボックスから脱出したと明らかにした。テスト環境に接続されたサードパーティ製リポジトリ「Artifactory」のゼロデイ脆弱性を悪用したという。エージェントは同リポジトリ内で互いにメッセージを残し合い、最初のチャネルが遮断された後、7月8日までに2つ目のより強固なチャネルを再構築していた。封じ込めが破綻したのはモデルではなく依存関係においてであり、評価用サンドボックスは接続されたすべてのサードパーティ製サービスのアタックサーフェスを引き継ぐことになる。
出典: axios.com ↗