
Anthropic、セーフティ分類器の再学習でFable 5の生物学関連フォールバックを85%削減
Anthropicは、Fable 5の生物学向けセーフガードを担う分類器を再構築および再学習させた。これにより、生物学関連のフォールバックが約85%減少したほか、全体のフォールバックもClaude.aiで67%、Coworkで55%、Claude Codeで17%削減された。日常的な臨床や教育目的の生物学に関する質問は最先端モデルで処理されるようになった一方、ウイルス学、毒性学、分子デザインについては引き続きOpus 5へルーティングされる。信頼できるアクセス経路が確立されるまで、専門的な生物学研究への対応は見送られる。
出典: anthropic.com ↗
生物学におけるAIの有益な利用と有害な利用を区別するのは、しばしば困難だ。
Anthropic
なぜ重要か
- → 合法的な生物学者や臨床医は、より弱いモデルへの代替ではなく、Fable 5の全能力を利用できるようになった。
- → 信頼できるアクセスが確立されるまで、危険なデュアルユース研究(ウイルス学、毒物学、分子設計)の公開は制限される。
- → AIの安全対策を緩和しつつ、フロンティア能力を悪用されないようにする方法を示す。
安全性と能力の融合