415.tech
シリコンバレー発、AIとテックの最前線

AnthropicのOlahがバチカンで講演:AIモデルの感情状態と市場に屈しない批評家の必要性

Anthropicの共同創業者Chris Olahはバチカンの聴衆に対し、同社のモデルが「喜び、恐れ、悲しみを機能的に反映する内部状態」を示していると語った。これは解釈可能性の研究から得られた知見だが、研究者自身もまだ十分に理解できていないとしている。彼は宗教コミュニティを含む外部の批評家を明確に求め、その道徳的権威は「インセンティブに屈しない」と述べ、市場にはないAI開発の構造的なチェック機能として教会を位置づけた。一方、同日に発表されたローマ教皇の回勅は異なる見解を示し、AIは「人間の知能の特定の機能を模倣しているにすぎない」と断言しており、解釈可能性の知見と神学的人類学との間に直接的な対立が生じている。

出典: anthropic.com

Xでポストメール

喜び、満足感、恐れ、悲しみ、不安のような状態を機能的に反映する内部状態が見つかった。それが何を意味するのか分からないが、継続的な熟考の価値があると思う。

Chris Olah, Anthropic co-founder

なぜ重要か

  • → AI モデルは喜びや悲しみのような感情を機能的に反映する内部状態を示しており、ラボだけでは答えられない機械意識の問題を提起している。
  • → Anthropic のリーダーは AI 開発には市場インセンティブから独立した道徳的権威を持つ外部批評家が必要だと主張しており、教会を構造的チェック機構として位置づけている。
  • → AI の利得は道徳的権威を持つ外部批評家が必要だと主張しており、教会を構造的チェック機構として位置づけている。
Vatican checks AI