
Inception、毎秒1,107トークン・26万コンテキストの拡散LLM「Mercury 2.5」をリリース
Inceptionは、広く普及しているNVIDIA GPU上で毎秒1,107トークンを達成し、26万トークンのコンテキストを備えた拡散言語モデル「Mercury 2.5」をリリースした。価格は100万入力/出力トークンあたりそれぞれ0.20ドルと0.75ドルで、リリース時は80%割引で提供される。40%の知能向上という主張よりも、本番環境での実績の方が重要だ。Augment Codeはコンテキスト圧縮のレイテンシを約150秒から27秒へと82%短縮し、コストを90%削減した。また、OpenCallのP99の音声応答時間は数分から約1秒へと短縮されている。拡散モデルは現在、呼び出しごとのレイテンシが蓄積しやすい検索、音声、コーディングエージェント内での高頻度な補助的呼び出しを処理できるほど、高速かつ安価になっている。
inceptionlabs.ai →- 02
Anthropic、情報窃取マルウェアによるClaudeトークン枠の不正消費を警告Anthropicは影響を受けたユーザーに対し、悪意のある攻撃者が一般的な情報窃取マルウェアを用いてPCからClaudeのログインセッションを盗み出し、窃取したアカウントの有料トークンを消費していると通知した。ある事例では、侵害されたセッションキーから不正なClaude CodeのOAuthトークンが生成されていた。同社はユーザーを強制的にサインアウトさせ、認証を無効化して一部返金を行ったが、アカウントサポートは総使用量のみを記録しており、項目別の内訳は提供していない。この検知のギャップが開発者側の課題となっている。ローカルマシン上の情報窃取マルウェアはサーバー側のあらゆる制御をすり抜ける上、何が利用枠を消費しているかを示すツールが存在しないため、不正利用が数ヶ月間気づかれない可能性がある。
techcrunch.com → - 03
OpenAIがChatGPT Images 2.5をリリース、生成レイテンシを50%削減OpenAIは「Images 2」から5ヶ月ぶりに「ChatGPT Images 2.5」をリリースした。生成レイテンシを最大50%削減したほか、描画リファレンス用の「Sketch」、フォーマットテンプレート、プロンプト共有機能を追加している。同時に2つのAPIモデルも提供開始された。デフォルトの「GPT-Image-2.5 Flare」と、編集時の詳細な制御が可能な「Sunburst」である。これにより、ビジュアル製品を構築する開発者は、単一の画像モデルで妥協するのではなく、スループットと編集の忠実度のどちらかを選択できるようになった。スピードの向上が具体的な変更点であり、それ以外は漸進的な品質向上をパッケージ化したものと言える。
9to5mac.com → - 04
Meta、旅行予約やLink by Stripe決済対応のエージェント「Muse」を発表Metaの新たな米国向けパーソナルAIエージェントは、メール、カレンダー、決済、ヘルスケア、スマートホームアプリと連携し、メール送信、旅行予約、Link by Stripe経由での決済を行う。Web、iOS、Android、WhatsAppで動作し、無料で利用できるほか、20ドルの「Power」プランと100ドルの「Maximum」プランが用意されている。同社によると、Museは独自のブラウザを備えた専用のセキュアVM内で実行され、システムから隔離されたSentinelエージェントによって監視されており、そのデータが同社の広告システムに渡ることは決してないという。これらの主張は、180億ドル規模の複数州との和解から2週間後に行われたものであり、今後セキュリティ研究者による検証が待たれる。
techcrunch.com → - 05
ASMLとTSMC、High NA EUVを12インチマスクへ移行、2031年にパイロットラインASMLとTSMCは、High NA EUVリソグラフィを6インチから12インチのフォトマスクへ移行する業界イニシアチブを立ち上げた。2031年のマスクパイロットライン稼働と2033年の量産対応システムの実現を目標としており、これは製品の出荷能力を示すものではなく、ロードマップ上のコミットメントである。TSMCは依然として2030年に6インチマスクでHigh NAの量産を開始するため、短期的な最先端プロセスの経済性に変化はない。ASMLのChristophe Fouquetは、この大型フォーマットによってスキャナーの生産性向上とスティッチングの制約解消がもたらされると期待しており、エコシステム全体のマスクサプライヤーは開発に向けた明確な期限付きの目標を得ることになった。
asml.com → - 06
Google CloudとAccentureが共同部門設立、Gemini導入エンジニア1,000人を育成Google CloudとAccentureは「Accenture Gemini Enterprise Business Group」を設立する。Googleは最大1,000人のAccentureの導入エンジニアをトレーニングし、顧客企業内でGemini Enterpriseを活用したカスタムアプリケーションを構築できるようにする。Rampの8月のデータによると、米国のエンタープライズAI支出においてAnthropicが43.5%、OpenAIが39.7%を占めるのに対し、Googleは約6%にとどまっている(Googleは大規模な戦略的契約が含まれていないと反論している)。現在、ハイパースケーラー各社は、8110億ドルに上るAlphabetの購入コミットメントをエンタープライズ収益に転換するためのチャネルとして、コンサルティング人員の確保に動いている。
techcrunch.com → - 07
米エネルギー省、Googleデータセンター向け原発再稼働でNextEraに19億ドル融資米エネルギー省は、2020年の嵐の被害で休止していたアイオワ州のDuane Arnold原子力発電所(出力615メガワット)を再稼働させるため、NextEra Energyへの19億ドルの融資を承認した。2029年の電力供給開始を目指しており、Googleが近隣に最大6カ所のデータセンターを計画していると報じられている。スリーマイル島原発向けにConstellationへ実施された10億ドルに続く2例目の連邦融資であり、AIの電力需要に対する政府の有力な解決策として原発再稼働が位置付けられていることを示している。ただし、地元の協同組合に割り当てられるのはわずか50メガワット(2021年以降のアイオワ州の需要増加分の18%)にとどまるため、データセンターの負荷と比較すると住民への恩恵は限定的である。
techcrunch.com → - 08
Mistral、評価額210億ユーロで30億ユーロ調達、欧州テック最大ラウンドMistralは、Samsung Electronicsが主導し、EQTのScaleup Europe FundとPSG Equityが共同でリードするラウンドで、評価額(ポストマネー)210億ユーロ超にて30億ユーロを調達した。このラウンドには、既存投資家のa16z、Nvidia、ASMLに加え、BlackRock、Advent、ルクセンブルク大公国も参加している。調達資金は、2030年までに欧州で1GWの計算資源を確保することと、現在20カ国で展開されているソブリンAIの推進に充てられる。これは、「非米国発」であることが単なる政治的なスローガンではなく、価値ある商業的資産になったことの証明である。キャップテーブルは依然として国際的であり、ここでの「ソブリン」とは欧州資本のみを意味するのではなく、顧客がモデルと地域をコントロールできることを意味している。
techcrunch.com → - 09
- 10
中国、2030年にAI計算能力9,800エクサフロップス目標、6月の4倍中国工業情報化部(MIIT)は、2026年から2030年にかけてインテリジェントコンピューティング能力を6月時点の2,185エクサフロップスから9,800エクサフロップスへ引き上げる目標を設定した。これは累計3兆8000億元(5320億ドル)のインフラ投資と、1万枚または10万枚以上のアクセラレータカードを稼働させるクラスターによって裏付けられている。同計画ではこのインフラを国産チップに適応させることを求めており、インフラ構築自体が国産アクセラレータの確実な需要基盤となる。すでに1万枚以上のカードを搭載した施設が52カ所建設され、計算能力が前年比177%増となっている現状を踏まえると、今回の4倍という飛躍は新たな取り組みの始まりではなく、既存の成長曲線の延長線上にある。
scmp.com →
![[EN] Buckmaster and Alpöge post three AI-assisted fluid blowup proofs, dispute OpenAI's approach](/img?key=35d6cef3d7e82150e0b42bbb2b647ffd.webp&v=a51f58ea)