OpenAI ha presentado su nuevo modelo, GPT-6 Astra, que ha generado opiniones encontradas en diversas evaluaciones de rendimiento. Según Epoch AI, Astra se posiciona como el líder entre más de 267 modelos, logrando una puntuación de 169 puntos, mientras que Artificial Analysis lo califica con 61 puntos, igualando a su predecesor.
El modelo demuestra ser más eficiente que el promedio humano en el test ARC-AGI-3, lo que ha llevado al director de ARC Prize, François Chollet, a ajustar su pronóstico sobre la inteligencia artificial general (AGI), estimando que el progreso es "dos veces más rápido" de lo que había anticipado. Sin embargo, Astra resulta ser más costoso que su versión anterior, aumentando un 75% el costo por unidad de texto procesado.
En comparación con Claude Fable 5.1, Astra presenta un costo inferior en tareas de codificación, alcanzando puntuaciones similares, pero utilizando menos recursos computacionales. En el índice de agentes de codificación, la puntuación de Astra es de 67 puntos con un uso de tokens significativamente menor que Sol.