The Rundown AI · 2026-08-14T10:11:05+00:00

OpenAI zeigt Ultrafast‑Tier: GPT‑5.6 wird bis zu 14× schneller

OpenAI hat eine Vorschau auf ein neues „Ultrafast“-API‑Tier präsentiert, das in Zusammenarbeit mit Cerebras deutlich höhere Antwortgeschwindigkeiten für das Modell GPT‑5.6 Sol liefert. Erste Tests zeigen enorme Beschleunigungen, die Arbeitsabläufe und Agentenanwendungen verändern könnten. Zugang ist vorerst nur per Einladung und Preise sind noch offen.

OpenAI hat eine Vorschau auf ein neues, sehr schnelles API‑Angebot namens „Ultrafast“ vorgestellt, das das Flaggschiffmodell GPT‑5.6 Sol deutlich beschleunigen soll. Die Beschleunigung basiert auf spezieller Hardware und einer jüngeren Partnerschaft mit dem Chip‑Hersteller Cerebras.

Technisch verspricht Ultrafast im Spitzenfall etwa 750 Tokens pro Sekunde und damit bis zu rund 14‑mal höhere Antwortgeschwindigkeiten gegenüber dem bisherigen Betrieb. OpenAI und Cerebras hatten zuvor bereits eine Vereinbarung angekündigt, große Mengen an rechenintensiver, auf Geschwindigkeit ausgerichteter Infrastruktur bereitzustellen.

In einem internen Benchmark absolvierte Sol mit dem Ultrafast‑Tier einen 2500‑Fragen‑Test deutlich schneller als das Vergleichsmodell Fable — ein Hinweis darauf, dass die Beschleunigung nicht nur bei kurzen Antworten, sondern auch bei umfangreichen Aufgaben Wirkung zeigt. Mitarbeitende berichteten, dass sich Workflows spürbar verändert hätten; manche Vorgänge, die früher Stunden brauchten, dauerten nun Minuten.

Derzeit läuft Ultrafast als Einladungsvorschau; OpenAI nennt weder einen Listenpreis noch einen konkreten Zeitplan für eine breite Verfügbarkeit. Die Erweiterung des Zugangs soll schrittweise erfolgen, sobald mehr Cerebras‑Kapazitäten online gehen.

Die Bedeutung dieser Entwicklung liegt weniger in einer reinen Leistungskennzahl als in den praktischen Folgen: Schnellere Modelle können Echtzeit‑Agenten, interaktive Anwendungen und automatisierte Prüfungen wesentlich effizienter machen und neue Produktivitätsparadigmen ermöglichen.

Gleichzeitig bleiben Fragen offen, etwa zu Kosten, Energieverbrauch, Sicherheit und Governance bei deutlich erhöhten Antwortfrequenzen. Unternehmen und Entwickler müssen daher abwägen, in welchen Szenarien die Geschwindigkeit den Aufwand rechtfertigt und wie sich Qualität, Robustheit und Kontrollmechanismen skalieren lassen.

Originalquelle oeffnen