
Inception lanza Mercury 2.5, un LLM de difusión a 1.107 tokens/seg con un contexto de 260K
Inception lanzó Mercury 2.5, un modelo de lenguaje de difusión que alcanza 1.107 tokens por segundo en GPUs Nvidia ampliamente disponibles con un contexto de 260K tokens, con un precio de lista de $0.20 y $0.75 por millón de tokens de entrada y salida, con un descuento del 80% por lanzamiento. Las cifras en producción tienen más peso que la mejora de inteligencia del 40% declarada: Augment Code redujo la latencia de compactación de contexto en un 82%, de aproximadamente 150 segundos a 27, y el costo en un 90%, mientras que la respuesta de voz P99 de OpenCall cayó de varios minutos a aproximadamente un segundo. Los modelos de difusión ahora son lo suficientemente rápidos y económicos como para absorber las llamadas de soporte de alta frecuencia dentro de los agentes de búsqueda, voz y programación, donde la latencia por llamada se acumula.
inceptionlabs.ai →- 02
Anthropic advierte que malware infostealer agota las cuotas de tokens de los suscriptores de ClaudeAnthropic informó a los usuarios afectados que un actor malicioso está extrayendo sesiones de Claude de sus computadoras con malware infostealer común, para luego gastar los tokens pagados de las cuentas robadas, y en un caso generó tokens OAuth de Claude Code no autorizados a partir de una clave de sesión comprometida. Anthropic cerró la sesión de los usuarios, invalidó las autorizaciones y emitió reembolsos parciales, pero el soporte de la cuenta solo registra el uso total, nunca un desglose detallado. Esa brecha de detección es el problema del lado del desarrollador: un infostealer local en la máquina elude todos los controles del lado del servidor, y no existe ninguna herramienta para mostrar qué está consumiendo la cuota, por lo que el robo puede pasar desapercibido durante meses.
techcrunch.com → - 03
OpenAI lanza ChatGPT Images 2.5 con una latencia de generación 50% menorOpenAI lanzó ChatGPT Images 2.5 cinco meses después de Images 2, reduciendo la latencia de generación hasta en un 50% y añadiendo Sketch para referencias de dibujo, plantillas de formato y la opción de compartir prompts. Dos modelos de API se lanzan en conjunto: GPT-Image-2.5 Flare como opción predeterminada y Sunburst para un control más estricto durante las ediciones, de modo que los desarrolladores de productos visuales ahora pueden elegir entre rendimiento y fidelidad de edición en lugar de conformarse con un único modelo de imagen. El aumento de velocidad es el cambio concreto; el resto es presentación en torno a una mejora incremental de calidad.
9to5mac.com → - 04
Meta lanza Muse, un agente que reserva viajes y compra a través de Link by StripeEl nuevo agente personal de IA de Meta en EE. UU. se conecta a aplicaciones de correo electrónico, calendario, pagos, salud y hogar inteligente para enviar correos, reservar viajes y pagar mediante Link by Stripe, funcionando en web, iOS, Android y WhatsApp, de forma gratuita, con niveles Power de $20 y Maximum de $100. Meta afirma que Muse se ejecuta dentro de una VM segura dedicada con su propio navegador, supervisada por un agente Sentinel aislado del sistema, y que sus datos nunca llegan a los sistemas publicitarios de Meta; estas afirmaciones llegan dos semanas después de un acuerdo multiestatal de $18B y esperan el escrutinio de los investigadores de seguridad.
techcrunch.com → - 05
ASML y TSMC llevan High NA EUV a fotomáscaras de 12 pulgadas con una línea piloto para 2031ASML y TSMC lanzaron una iniciativa en la industria para migrar la litografía High NA EUV de fotomáscaras de 6 pulgadas a 12 pulgadas, con el objetivo de establecer una línea piloto de máscaras en 2031 y sistemas listos para producción en 2033: un compromiso de hoja de ruta, no una capacidad ya disponible. TSMC todavía iniciará la fabricación de alto volumen con High NA en máscaras de 6 pulgadas en 2030, por lo que la economía de vanguardia a corto plazo se mantiene sin cambios. El formato más grande es donde Christophe Fouquet de ASML espera que se reflejen las mejoras de productividad de los escáneres y el fin de las limitaciones de stitching, y los proveedores de máscaras de todo el ecosistema ahora tienen una meta con fecha para orientar su desarrollo.
asml.com → - 06
Google Cloud y Accenture forman una unidad conjunta para capacitar a 1000 ingenieros de despliegue en GeminiGoogle Cloud y Accenture están estableciendo el Accenture Gemini Enterprise Business Group, donde Google capacitará hasta 1000 ingenieros de despliegue de Accenture para desarrollar aplicaciones personalizadas sobre Gemini Enterprise dentro de las organizaciones de los clientes. Los datos de agosto de Ramp sitúan a Google en aproximadamente el 6% del gasto empresarial en IA en EE. UU. entre sus clientes, frente al 43.5% de Anthropic y el 39.7% de OpenAI, una brecha que Google cuestiona por omitir grandes acuerdos estratégicos. El personal de consultoría es ahora el canal que los hyperscalers están adquiriendo para convertir los $811B en compromisos de compra de Alphabet en ingresos empresariales.
techcrunch.com → - 07
El DOE presta $1.900 millones USD a NextEra para reactivar una planta nuclear en Iowa destinada a data centers de GoogleEl Departamento de Energía aprobó un préstamo de $1.900 millones USD a NextEra Energy para reactivar la planta Duane Arnold de 615 megavatios en Iowa, inactiva por daños de una tormenta en 2020, con el objetivo de suministrar energía para 2029 y con reportes de que Google planea hasta seis data centers en la zona. Este es el segundo préstamo federal de su tipo tras los $1.000 millones USD otorgados a Constellation para Three Mile Island, consolidando la reactivación nuclear como la respuesta preferida del gobierno ante la demanda energética de la IA. Solo 50 megavatios se reservarán para la cooperativa local, un 18% del crecimiento de la demanda en Iowa desde 2021, por lo que el beneficio de la red para los residentes es marginal frente a la carga de los data centers.
techcrunch.com → - 08
Mistral recauda 3.000 millones de euros con una valoración de 21.000 millones en la mayor ronda tecnológica de EuropaMistral recaudó 3.000 millones de euros con una valoración post-money superior a los 21.000 millones de euros, en una ronda liderada por Samsung Electronics con Scaleup Europe Fund de EQT y PSG Equity como colíderes, además de BlackRock, Advent y el Gran Ducado de Luxemburgo, que se unen a a16z, Nvidia y ASML. El dinero financiará 1 GW de compute europeo para 2030 y una propuesta de IA soberana que ya se vende en 20 países, prueba de que el origen no estadounidense se ha convertido en un activo comercial cotizado, no solo en un argumento político. El cap table se mantiene firmemente internacional, por lo que el término soberano significa aquí el control del cliente sobre el modelo y la región, no un capital exclusivamente europeo.
techcrunch.com → - 09
- 10
China proyecta 9800 exaflops de cómputo de IA para 2030, cuadruplicando el nivel de junioEl MIIT de China fijó un objetivo para el período 2026-2030 de 9800 exaflops de capacidad de cómputo inteligente, un aumento frente a los 2185 exaflops de junio, respaldado por 3,8 billones de yuanes (532.000 millones de USD) en inversión acumulada en infraestructura y clústeres que operan con 10.000 o más de 100.000 tarjetas aceleradoras. El plan contempla adaptar dicha infraestructura a chips de desarrollo nacional, lo que convierte esta expansión en una base de demanda para los aceleradores locales, y con 52 instalaciones de más de 10.000 tarjetas ya construidas y una capacidad que creció un 177% interanual, este aumento de cuatro veces prolonga una curva en lugar de iniciarla.
scmp.com →
![[EN] Buckmaster and Alpöge post three AI-assisted fluid blowup proofs, dispute OpenAI's approach](/img?key=35d6cef3d7e82150e0b42bbb2b647ffd.webp&v=a51f58ea)