
IBM、512KコンテキストのGranite 4.2(3B/8B/30B)をApache 2.0でリリース
IBMは、Apache 2.0ライセンスの下で3B、8B、30BサイズのGranite 4.2をリリースした。同モデルは約15兆トークンを用いてゼロからトレーニングされており、最大512,000トークンのコンテキストウィンドウと、思考モードと非思考モードの切り替え機能を備えている。8Bおよび30Bモデルは、ツールを使用し、符号を実行し、Web検索を行うサンドボックス環境でエージェント強化学習を経ている。また、すべてのモデルがvLLMまたはSGLang上でのOpenAIフォーマットの道具呼び出しをサポートしている。同社は重みとともに完全なトレーニングレシピを公開した。これにより、エージェントの事後トレーニング手法がブラックボックスにならず再現可能となっており、この規模のモデルとしては異例である。
出典: the-decoder.com ↗
8Bおよび30Bモデルは、IBMが「agentic RL」学習と呼ぶものも受ける。この学習では、実際のサンドボックス環境でツールを使用し、コードを書き実行し、ウェブを検索することを学ぶ。
IBM
なぜ重要か
- → 再現可能な学習が可能なオープンウェイトの自律型モデル—30B規模では珍しい
- → 512Kのコンテキストとツール利用の学習が複雑な自律型ワークフローを可能にする
- → Apache 2.0ライセンスが本番環境への展開の障壁を取り除く
オープンウェイト・エージェント