
HydraFusion de GitHub reduce el costo en los tres benchmarks e iguala la calidad de Opus 5 en uno
Project HydraFusion de GitHub crea una estrategia de ejecución por solicitud: un modelo, cascada hacia uno más potente o crítica independiente, en lugar de enrutar cada tarea a un solo modelo. Frente a Claude Opus 5, redujo el costo estimado en los tres benchmarks, hasta un 67%, pero superó a Opus 5 en calidad en solo uno (+4.9 puntos en TerminalBench 2.1). Está activo en todos los planes de Copilot bajo el flag /experimental a tarifas de tokens estándar, solo para prompts de primer turno: una palanca de costos que un desarrollador puede activar hoy, no una mejora de calidad.
Fuente: venturebeat.com ↗
También en esta edición
- Artificial Analysis duplica los datos privados reservados al 40% de su Intelligence Index en la v4.2
- OpenAI revisó los resultados de los benchmarks de GPT-6 Astra tras su lanzamiento, reduciendo las puntuaciones de sus rivales
- OpenAI lanza GPT-6 Astra en los planes superiores de ChatGPT con la mitad del límite de mensajes de GPT-5.6 Sol