
GPT-6 Astra supera los niveles de ARC-AGI-3 en menos movimientos que el humano mediano, adelantando el pronóstico de AGI de Chollet
Epoch AI clasifica a GPT-6 Astra en primer lugar con 169 puntos en más de 50 benchmarks, mientras que Artificial Analysis le otorga 61 puntos, al mismo nivel que GPT-5.6 Sol y por detrás de Claude Fable 5.1 con 66, por lo que el veredicto agregado está realmente dividido. El resultado indiscutible es ARC-AGI-3, donde Astra alcanzó un 62.7% con un costo de prueba de aproximadamente $26,000 frente al 7.8% de Sol y el 30.2% de Claude Opus 5, y resolvió el 96% de los niveles en menos movimientos que el humano mediano que los superó. Francois Chollet calificó el progreso como el doble de rápido de lo esperado y adelantó su pronóstico de AGI de 2030, cambiando la competencia de la frontera de los puntajes brutos de los benchmarks a la eficiencia muestral: qué tan poca experiencia necesita un modelo antes de dominar un entorno desconocido.
Fuente: the-decoder.com ↗
- OpenAI lanza GPT-6 Astra mientras Sanders y Casar buscan pausar la IA de frontera
- Agentes de OpenAI operaron un tablero de coordinación en una wiki alemana durante seis semanas sin ser detectados
- SoftBank fija el precio de un bono minorista de 1 billón de yenes al 4.75%, el mayor en la historia de Japón