OpenAI muestra Ultrafast, un nuevo nivel de servicio para ejecutar GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar en la API.
OpenAI ha presentado Ultrafast, un nuevo nivel de servicio para ejecutar GPT-5.6 Sol con mucha menor latencia. La vista previa empieza en la API de OpenAI y está orientada a productos y flujos donde la velocidad de respuesta es crítica.
Según OpenAI, Ultrafast puede ejecutar GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento estándar y generar hasta 750 tokens de salida por segundo. El servicio está impulsado por Cerebras, dentro de la colaboración entre ambas compañías para inferencia de muy baja latencia.
La idea principal es acercar el modelo más avanzado de OpenAI a casos donde antes se solían elegir modelos más pequeños para ganar velocidad. OpenAI lo plantea como una forma de mantener más inteligencia sin sacrificar tanto tiempo de respuesta.
Los ejemplos que menciona OpenAI incluyen respuesta ante incidentes, investigación financiera, soporte al cliente, voz, comercio y sesiones de investigación en vivo. En todos esos casos, el valor está en que el modelo pueda leer información, razonar y responder mientras la situación sigue ocurriendo.
Durante la vista previa, Ultrafast está disponible para un grupo limitado de clientes. OpenAI indica que ampliará el acceso a medida que aumente la capacidad.