Het verhaal
OpenAI deelt een vroege blik op Ultrafast, een service-tier die GPT-5.6 Sol tot 14 keer sneller dan Standard zou laten lopen. De infrastructuur komt van Cerebras. OpenAI claimt tot 750 output-tokens per seconde, zodat het vlaggenschipmodel in workflows past waar elke seconde telt. Tot nu toe betekende realtime-snelheid volgens het bedrijf meestal een kleiner of specialistischer model.
De preview is beperkt tot een selecte groep klanten via de OpenAI API. Toegang zou groeien naarmate de capaciteit toeneemt. OpenAI noemt toepassingen als incident response, klantenservice, financiële analyse en e-commerce. Intern gebruikt het bedrijf Ultrafast onder meer voor het lezen van logs en het verkorten van de cyclus tussen signaal, hypothese en actie.
Ultrafast is geen apart model, maar een snelheidslaag bovenop GPT-5.6 Sol. Het is daarmee iets anders dan bestaande Fast-modes. Prijzen, capaciteitsgaranties en operationele limieten van de preview zijn in de aankondiging niet bekendgemaakt. Tijdens de preview testen klanten het in productie voor coding, commerce, financial research en support.