OpenAI ha fet oficial un avançament d'Ultrafast, el que serà un nivell de servei que executarà el més recent model GPT-5.6 Sol fins a 14 vegades més ràpid que el processament normal. Es llançarà en exclusiva a l'API d'OpenAI. Està impulsat per la plataforma Cerebras i pot generar fins a 750 tokens de sortida per segon. Pràcticament és el model per excel·lència, ja que és més eficient per cada capa que forma part de la seva arquitectura. És un repte constant per oferir velocitat en temps real; això és possible normalment amb un model més petit o especialitzat, però OpenAI s'apunta una altra fita en poder tenir una velocitat ultraràpida, més feina útil per cada segon.
La marca indica que quan la velocitat ja no exigeix sacrificar la intel·ligència, el model pot integrar-se en àrees més crítiques si es considera una empresa. Alguns empleats d'OpenAI ja havien donat senyals que estaven executant proves preliminars amb alguns clients. Aquest mode és possible gràcies a Wafer-Scale Engine de Cerebras, utilitzant 44 GB de SRAM integrada al xip; això és el que ajuda a reduir els colls d'ampolla en el moviment de dades que normalment es veuen limitats en velocitat en els sistemes basats en GPU. GPT-5.6 Sol Ultrafast és fins a 11 vegades més ràpid que Fable 5 i fins a cinc vegades més ràpid que Opus 4.8. En una prova de Hymanity's Last Exam, aquest model va processar 2.500 preguntes en 11 hores i 11 minuts, gran diferència amb les 78 hores i 27 minuts de Fable 5.
OpenAI supera de molt el concepte d'una IA ultraràpida
El model respondrà a tota mena d'incidents i està dedicat a solucionar problemes empresarials. OpenAI posa d'exemple investigacions financeres, atenció al client, apps de veu, comerç electrònic, programació, fluxos de treball d'investigació. I el millor és que la pròpia gent de Sam Altman el utilitza en el dia a dia per poder millorar les seves tasques d'investigació, analitzar registres i actualitzar-se.
Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed.
— OpenAI (@OpenAI) August 13, 2026
Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ
Aquest model estarà d'una certa forma limitat a causa que OpenAI té aquesta capacitat limitada a Cerebras, per la qual cosa avaluarà els seus clients d'acord amb la seva càrrega de treball i la disponibilitat per poder atorgar-los l'accés corresponent. De moment, els clients poden completar un formulari perquè puguin rebre la notificació d'accés per a tots els interessats. Serà un període de prova amb un grup inicial de clients per continuar comprenent el funcionament al voltant de la velocitat. Les primeres conclusions són positives; el defineixen com a impressionant des del punt de vista que es poden utilitzar els models i que tots els integrants d'un equip treballin de forma productiva i ràpida. Quant a clients, l'han definit com no només una millora de l'experiència de l'usuari, sinó que canvia tot el panorama, especialment amb aplicacions pràctiques.