OpenAI ha presentado un avance significativo con el lanzamiento de su nuevo modo "Ultrafast", que permite a su modelo insignia, GPT-5.6 Sol, generar hasta 750 tokens de salida por segundo. Esta aceleración en la inferencia se logra gracias a una asociación de diez mil millones de dólares con Cerebras, establecida a principios de año. Inicialmente, el servicio estará disponible únicamente a través de la API de OpenAI para un grupo selecto de clientes, aunque la compañía planea ampliar el acceso de manera gradual.
El modo Ultrafast está diseñado para combinar la velocidad de modelos más pequeños con las capacidades completas de un modelo grande, lo que permite un trabajo más útil por segundo. OpenAI menciona aplicaciones en diversas áreas, como la respuesta a incidentes, donde los ingenieros pueden analizar datos en tiempo real durante cortes de servicio. Además, en finanzas, el modelo puede evaluar señales del mercado y detectar transacciones sospechosas rápidamente.
En el ámbito del soporte al cliente, Ultrafast facilita la resolución de consultas complejas, mientras que en comercio electrónico, puede responder preguntas sobre productos y personalizar recomendaciones para evitar que los clientes abandonen sus carritos. OpenAI también destaca que este avance permitirá transformar experimentos, que antes tardaban toda la noche, en sesiones interactivas, mejorando la colaboración en equipos de investigación.