OpenAI ha hecho oficial un adelanto de Ultrafast, lo que será un nivel de servicio que ejecutará el más reciente modelo GPT-5.6 Sol hasta 14 veces más rápido que el procesamiento normal. Se lanzará en exclusiva en la API de OpenAI. Está impulsado por la plataforma Cerebras y puede generar hasta 750 tokens de salida por segundo. Prácticamente es el modelo por excelencia, ya que es más eficiente por cada capa que forma parte de su arquitectura. Es un reto constante por ofrecer velocidad en tiempo real; esto es posible normalmente con un modelo más pequeño o especializado, pero OpenAI se apunta otro hito al poder tener una velocidad ultrarrápida, más trabajo útil por cada segundo.
La marca indica que cuando la velocidad ya no exige sacrificar la inteligencia, el modelo puede integrarse en áreas más críticas si se considera a una empresa. Algunos empleados de OpenAI ya habían dado señales de que estaban ejecutando pruebas preliminares con algunos clientes. Este modo es posible gracias a Wafer-Scale Engine de Cerebras, utilizando 44 GB de SRAM integrada en el chip; esto es lo que ayuda a reducir los cuellos de botella en el movimiento de datos que normalmente se ven limitados en velocidad en los sistemas basados en GPU. GPT-5.6 Sol Ultrafast es hasta 11 veces más rápido que Fable 5 y hasta cinco veces más rápido que Opus 4.8. En una prueba de Hymanity's Last Exam, este modelo procesó 2.500 preguntas en 11 horas y 11 minutos, gran diferencia con las 78 horas y 27 minutos de Fable 5.
OpenAI supera por mucho el concepto de una IA ultrarrápida
El modelo responderá a todo tipo de incidentes y está dedicado a solucionar problemas empresariales. OpenAI pone de ejemplo investigaciones financieras, atención al cliente, apps de voz, comercio electrónico, programación, flujos de trabajo de investigación. Y lo mejor es que la propia gente de Sam Altman lo utiliza en el día a día para poder mejorar sus labores de investigación, analizar registros y actualizarse.
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed.
— OpenAI (@OpenAI) August 13, 2026
Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ
Este modelo estará de cierta forma limitado debido a que OpenAI tiene esta capacidad limitada en Cerebras, por lo que evaluará a sus clientes de acuerdo con su carga de trabajo y la disponibilidad para poder otorgarles el acceso correspondiente. De momento, los clientes pueden completar un formulario para que puedan recibir la notificación de acceso para todos los interesados. Será un periodo de prueba con un grupo inicial de clientes para seguir comprendiendo el funcionamiento en torno a la velocidad. Las primeras conclusiones son positivas; lo definen como impresionante desde el punto de vista de que pueden utilizarse los modelos y que todos los integrantes de un equipo trabajen de forma productiva y rápida. En cuanto a clientes, lo han definido como no solo una mejora de la experiencia del usuario, sino que cambia todo el panorama, en especial con aplicaciones prácticas.
