
Metaのエージェント型画像モデル「Muse Image」がArenaで2位に
Meta Superintelligence Labsは、エージェントとして画像を生成する「Muse Image」をリリースした。同モデルは検索ツールや符号ツールを呼び出し、下書きを自己改善し、言語モデルのようにテスト時計算量をスケーリングする機能を備えており、Arenaのテキストからの画像生成および編集ランキングで2位を獲得した。また、ネイティブ音声に対応した「Muse Video」の早期プレビュー版(テキストからの動画生成で3位)も同時に公開された。これはアーキテクチャ上の重要なシグナルであり、画像生成がLLMと同じ推論およびツール利用のスケーリングカーブに乗るようになったことを示している。両モデルは現在、米国のMeta AIアプリ、meta.ai、およびInstagramストーリーズで提供されている。
出典: ai.meta.com ↗