de.wedoany.com-Bericht: Am 13. August begann OpenAI damit, einer kleinen Anzahl von Kunden eine Vorschau auf den Hochgeschwindigkeits-Inferenzmodus namens Ultrafast zu geben, um die Ausgabegeschwindigkeit des Flaggschiffmodells GPT-5.6 Sol zu beschleunigen. Dieser Modus befindet sich derzeit in einer kleinskaligen Testphase und ist noch nicht für alle ChatGPT- oder API-Nutzer verfügbar.

Der Bericht zitiert OpenAI mit der Aussage, dass die Verarbeitungsgeschwindigkeit von Ultrafast bis zu 14-mal höher sein kann als im Standardmodus, mit einem Ausgabedurchsatz von bis zu 750 Token pro Sekunde. Das Hauptziel besteht darin, die Reaktionsgeschwindigkeit komplexer Modelle in Echtzeit-Geschäftsszenarien zu verbessern, ohne auf kleinere Modelle umschalten zu müssen.
Es ist wichtig zu unterscheiden, dass 750 Token pro Sekunde hauptsächlich den Ausgabedurchsatz bei der Texterzeugung des Modells widerspiegeln und nicht bedeutet, dass alle Aufgaben, einschließlich Inferenz, Tool-Aufrufen, Dateiverarbeitung und Websuche, auf ein Vierzehntel der ursprünglichen Zeit verkürzt werden können. Die End-to-End-Geschwindigkeit verschiedener Aufgaben wird weiterhin von der Inferenzintensität, der Kontextlänge und der Ausführungszeit der Tools beeinflusst.
TechCrunch berichtet, dass die Ultrafast-Vorschau durch eine Zusammenarbeit zwischen OpenAI und dem KI-Chip-Unternehmen Cerebras unterstützt wird. Zu den anfänglichen Anwendungsbereichen gehören sicherheitsrelevante Ereignisreaktionen, Kundenservice, Finanzmarktanalysen und E-Commerce – Unternehmensworkflows, die empfindlich auf Antwortlatenz reagieren. OpenAI plant, den Zugriffsumfang mit zunehmender Rechenkapazität schrittweise zu erweitern.
Die offiziellen Modelldokumente von OpenAI zeigen, dass GPT-5.6 Sol das Flaggschiffmodell der GPT-5.6-Serie ist und für komplexe Programmierung, Forschung, Computeroperationen und professionelle Arbeiten konzipiert wurde. Das Modell unterstützt ein Kontextfenster von 1,05 Millionen Token, eine Ausgabe von bis zu 128.000 Token sowie mehrstufige Inferenzintensitäten von „none" bis „max". Ultrafast ist kein eigenständiges neues Modell, sondern ein Betriebsmodus für die Inferenzdienstgeschwindigkeit von GPT-5.6 Sol.
Bis zum 14. August sind auf der GPT-5.6-Sol-Modellseite in den OpenAI Docs sowie in der offiziellen Produktupdate-Zusammenfassung vom 10. bis 14. August noch keine Angaben zu Preisen, API-Aufrufmethode, Service-Level, regionaler Verfügbarkeit und konkreter Freigabeliste für Ultrafast aufgeführt.





















