415.tech
シリコンバレー発、AIとテックの最前線
最新のエディション · 2026年9月8日(火)
Inception、毎秒1,107トークン・26万コンテキストの拡散LLM「Mercury 2.5」をリリース

Inception、毎秒1,107トークン・26万コンテキストの拡散LLM「Mercury 2.5」をリリース

Inceptionは、広く普及しているNVIDIA GPU上で毎秒1,107トークンを達成し、26万トークンのコンテキストを備えた拡散言語モデル「Mercury 2.5」をリリースした。価格は100万入力/出力トークンあたりそれぞれ0.20ドルと0.75ドルで、リリース時は80%割引で提供される。40%の知能向上という主張よりも、本番環境での実績の方が重要だ。Augment Codeはコンテキスト圧縮のレイテンシを約150秒から27秒へと82%短縮し、コストを90%削減した。また、OpenCallのP99の音声応答時間は数分から約1秒へと短縮されている。拡散モデルは現在、呼び出しごとのレイテンシが蓄積しやすい検索、音声、コーディングエージェント内での高頻度な補助的呼び出しを処理できるほど、高速かつ安価になっている。

inceptionlabs.ai →