
中国軍、OpenAIとAnthropicのモデルを蒸留し防衛システムへ
ReutersとJamestown Foundationが80件以上の中国の論文や特許を調査した結果、人民解放軍(PLA)関連の研究者が米国製モデルの出力を小規模な国内システムに蒸留していることが判明した。PLA第96941部隊はGPT-3.5を用いて機密の軍事ソースコードを要約し、そのデータでローカルモデルを訓練して機密ネットワーク内で稼働させていた。国境を越えるのはハードウェアではなくモデルの出力であるため、蒸留はチップの輸出規制を回避する手段となるうえ、Anthropicは蒸留されたモデルが元の安全ガードレールを失う可能性があると指摘している。この調査結果は米中間のAIガバナンス協議を前に発表されたもので、米国政府は無許可のデータ抽出を輸出管理および知的財産の問題と位置づけている。なお、OpenAIはコメントの要請に応じなかった。
出典: defensenews.com ↗
モデルに正しい答えを教えることは一つのことだが、その答えの背後にある推論を教えることははるかに難しい。
Sunny Cheung、Jamestown Foundation
なぜ重要か
- → PLAの研究者たちは米国のAIを国内の軍事システムに蒸留することで半導体制裁を回避する。
- → 蒸留されたモデルは元の安全ガードレールを喪失し、ベンダーの制御を超えた能力を可能にする。
- → ドローン、潜水艦、衛星といった手頃な価格でのエッジ展開が、敵対者が制御する推論で可能になる。
Reasoning extraction