
Inception 发布 Mercury 2.5:支持 260K 上下文的 diffusion LLM,速度达 1,107 tokens/sec
Inception 发布了 diffusion 语言模型 Mercury 2.5,在广泛使用的 Nvidia GPU 上实现了 1,107 tokens/sec 的速度与 260K token 上下文。其输入和输出定价分别为每百万 token $0.20 和 $0.75,首发期提供 80% 折扣。相比官方宣称的 40% 智能提升,实际生产数据更具说服力:Augment Code 将上下文压缩延迟降低了 82%(从约 150 秒降至 27 秒),成本降低 90%;而 OpenCall 的 P99 语音响应时间从数分钟骤降至约 1 秒。Diffusion 模型如今已足够快速且廉价,足以处理搜索、语音和编程 agent 内部的高频辅助调用,解决单次调用延迟不断叠加的问题。
inceptionlabs.ai →- 02
Anthropic 警告:infostealer 恶意软件正在耗尽 Claude 订阅用户的 token 额度Anthropic 告知受影响用户,恶意攻击者正利用常见的 infostealer 恶意软件窃取电脑上的 Claude 登录会话,进而消耗被盗账户的付费 token、在某案例中,攻击者甚至利用泄露的会话密钥生成了未经授权的 Claude Code OAuth token。Anthropic 已强制用户登出、撤销授权并提供部分退款,但其账户系统仅追踪总使用量,从不提供消耗明细。这一检测盲区正是开发者端面临的难题:本地机器上的 infostealer 能绕过所有服务端控制,且目前没有任何工具能显示 token 额度的具体去向,导致此类盗用行为可能持续数月而不被察觉。
techcrunch.com → - 03
OpenAI 发布 ChatGPT Images 2.5,生成延迟降低 50%在 Images 2 发布五个月后,OpenAI 推出了 ChatGPT Images 2.5,将生成延迟最高降低 50%,并新增了用于绘图参考的 Sketch 功能、格式模板以及 prompt 共享。两款 API 模型也同步上线:作为默认模型的 GPT-Image-2.5 Flare,以及在编辑过程中提供更精细控制的 Sunburst。因此,开发视觉产品的开发者现在可以在吞吐量和编辑保真度之间做出选择,而无需局限于单一图像模型。速度提升是实质性的改变,其余更新则是对渐进式质量提升的包装。
9to5mac.com → - 04
Meta 推出 Muse:一款可预订行程并通过 Link by Stripe 购物的 agentMeta 这款面向美国市场的全新个人 AI agent 可连接邮箱、日历、支付、健康及智能家居应用,能够发送邮件、预订行程并通过 Link by Stripe 完成结账。该 agent 支持 web、iOS、Android 和 WhatsApp,提供免费版,以及 $20 的 Power 和 $100 的 Maximum 档位。Meta 表示,Muse 在配备独立浏览器的专用安全 VM 中执行,由系统隔离的 Sentinel agent 负责监控,且其数据绝不会流入 Meta 的广告系统。这些声明发表于一项 $18B 的多州和解协议达成两周后,仍有待安全研究人员的审查。
techcrunch.com → - 05
ASML与TSMC推动High NA EUV采用12英寸光罩,2031年启动试产线ASML与TSMC发起行业倡议,计划将High NA EUV光刻技术从6英寸光罩升级至12英寸,目标于2031年建立光罩试产线,并在2033年推出可量产系统、这是路线图承诺,而非当前交付能力。TSMC仍将于2030年基于6英寸光罩启动High NA的大规模量产,因此短期内的前沿制程经济效益保持不变;ASML的Christophe Fouquet预计,更大尺寸的光罩将提升扫描光刻机的生产率并消除拼接限制,整个生态系统的光罩供应商也由此获得了明确的研发时间表。
asml.com → - 06
Google Cloud 与 Accenture 成立联合部门,培训 1000 名 Gemini 部署工程师Google Cloud 与 Accenture 正联合组建 Accenture Gemini Enterprise Business Group,Google 将培训多达 1000 名 Accenture 前线部署工程师,帮助客户在内部基于 Gemini Enterprise 构建定制应用。Ramp 8 月数据显示,在其客户的美国企业 AI 支出中,Google 占比约 6%,而 Anthropic 和 OpenAI 分别为 43.5% 和 39.7%(Google 对此差距提出异议,称该数据遗漏了大型战略订单)。如今,咨询团队规模已成为超大规模云厂商重金购买的渠道,旨在将 Alphabet 价值 $811B 的采购承诺转化为实际的企业营收。
techcrunch.com → - 07
DOE向NextEra提供19亿美元贷款重启爱荷华州核电站,为Google数据中心供电美国能源部批准向NextEra Energy提供19亿美元贷款,用于重启爱荷华州615兆瓦的Duane Arnold核电站。该核电站自2020年因风暴受损后一直处于封存状态,预计将于2029年恢复供电,据报道Google计划在附近建设多达六个数据中心。这是继向Constellation提供10亿美元重启Three Mile Island之后的第二笔此类联邦贷款,标志着重启核电已成为政府应对AI电力需求的首选方案。该项目仅有50兆瓦预留给当地电力合作社(相当于爱荷华州自2021年以来电力需求增长的18%),因此与庞大的数据中心负载相比,当地居民获得的电网收益微乎其微。
techcrunch.com → - 08
Mistral完成欧洲最大规模科技融资,筹集30亿欧元,估值达210亿欧元Mistral完成30亿欧元融资,投后估值超过210亿欧元。本轮由Samsung Electronics领投,EQT的Scaleup Europe Fund与PSG Equity联合领投,BlackRock、Advent及卢森堡大公国加入a16z、Nvidia和ASML的行列共同参投。这笔资金将用于在2030年前建设1 GW的欧洲算力,并推动其目前已在20个国家销售的主权AI方案、这证明非美国背景已成为被市场定价的商业资产,而不仅仅是政治口号。其股权结构依然保持高度国际化,因此这里的“主权”意味着客户对模型和区域的控制权,而非纯欧洲资本。
techcrunch.com → - 09
- 10
中国计划到2030年实现9,800 exaflops AI算力,较6月水平翻两番中国工信部设定了2026-2030年实现9,800 exaflops智能算力的目标,远超6月份的2,185 exaflops。该目标由3.8万亿元人民币($532 billion)的累计基础设施投资,以及万卡或十万卡级加速器集群提供支持。该计划要求将这些基础设施适配国产芯片,使此次扩建成为国产加速器的需求底座。目前已建成52个万卡级设施,算力规模同比增长177%,因此这一四倍的增长是现有增长曲线的延续,而非从零起步。
scmp.com →
![[EN] Buckmaster and Alpöge post three AI-assisted fluid blowup proofs, dispute OpenAI's approach](/img?key=35d6cef3d7e82150e0b42bbb2b647ffd.webp&v=a51f58ea)