Frontier Intelligence in Echtzeit: GPT-5.6 Sol lässt sich über OpenAIs neue Ultrafast-Stufe künftig deutlich schneller nutzen. Laut OpenAI erreicht das Modell damit bis zu 750 Output Tokens pro Sekunde und arbeitet bis zu 14-mal schneller als mit Standard Processing. Das dürfte vor allem bei Anwendungen einen Unterschied machen, in denen ein KI-Dienst nahezu in Echtzeit reagieren muss.
OpenAI hat zudem eine weitere Neuerung für die Arbeit mit ChatGPT und Codex angekündigt: Mit Computer History sollen beide Dienste auf Wunsch mehr Kontext aus der bisherigen Arbeit eines Users erhalten. Die neue Opt-in-Funktion für den Mac greift dafür auf Informationen aus jüngsten Arbeitsabläufen zurück. So können ChatGPT und Codex bestehende Aufgaben leichter fortsetzen und wiederkehrende Abläufe erkennen.
14-mal schneller: GPT-5.6 Sol bekommt Ultrafast
Bislang mussten Entwickler:innen für besonders schnelle Tasks oft auf kleinere oder spezialisierte Modelle ausweichen. Mit Ultrafast ändert sich das: GPT-5.6 Sol soll trotz hoher Modellleistung mit besonders niedriger Latenz arbeiten. Dafür setzt OpenAI auf Cerebras. Das US-Unternehmen ist auf KI-Recheninfrastruktur spezialisiert und beschleunigt die Modellausgabe mit seiner Wafer-Scale-Architektur.
In einem LinkedIn Post nennt OpenAI unter anderem Voice-Anwendungen, Customer Support, Commerce, Coding sowie Finanz- und Sicherheitsanalysen als Einsatzfelder.
Für diese Tasks ist Ultrafast gemacht
Der Vorteil zeigt sich vor allem dort, wo eine gute Antwort nur dann etwas bringt, wenn sie im richtigen Moment kommt:
- Customer Support und Voice: Während eines laufenden Gesprächs fallen selbst kurze Pausen auf. Muss ein KI-Dienst für eine Antwort mehrere Schritte durchlaufen oder verschiedene Systeme einbeziehen, kann mehr Tempo verhindern, dass der Austausch ins Stocken gerät. Bei Voice Anwendungen entscheidet die Latenz damit direkt darüber, wie flüssig sich die Unterhaltung anfühlt.
- E-Commerce: Beim Shopping ist das Zeitfenster oft klein. Fragen zu Produkten, Verfügbarkeiten oder Alternativen müssen beantwortet werden, solange der User noch über den Kauf entscheidet. Dasselbe gilt im Checkout: Hilfe kommt zu spät, wenn der Warenkorb bereits aufgegeben wurde.
- Security und Incident Response: Bei einer laufenden Störung verändert sich die Informationslage ständig. Logs, Code-Änderungen und Meldungen aus dem Team müssen schnell zusammengeführt werden. Ein Modell kann dabei helfen, mögliche Ursachen einzugrenzen und die nächsten Checks vorzubereiten, während der Incident noch läuft.
- Finanzanalysen: Marktdaten haben eine kurze Halbwertszeit. Eine Analyse kann fachlich richtig sein und trotzdem an Wert verlieren, wenn sich Kurse oder andere Signale inzwischen verändert haben. Hier zählt deshalb neben der Qualität auch, wann das Ergebnis vorliegt.
- Forschung und Experimente: Analysen, die bisher über Nacht liefen, könnten stärker in den Arbeitstag rücken. Teams können Ergebnisse prüfen, ihren Ansatz anpassen und den nächsten Durchlauf starten, ohne bis zum nächsten Morgen zu warten. So werden mehrere Iterationen an einem Tag möglich.
OpenAI testet Ultrafast selbst unter anderem bei technischen Störungen und in der Forschung. Der entscheidende Unterschied liegt damit nicht nur in einer schnelleren Textausgabe: Wenn das Modell schneller mit einem laufenden Prozess mithalten kann, verkürzt sich im besten Fall auch der Weg vom Problem zur nächsten Entscheidung.
GPT-5.6 ist da
– doch OpenAI, Anthropic und Google stehen vor großen Herausforderungen

ChatGPT erinnert sich jetzt an das, woran du gearbeitet hast
Mit Computer History können ChatGPT und der Coding Agent Codex auf Wunsch mehr von dem berücksichtigen, was User zuvor am Mac gemacht haben. Dafür erstellt die Opt-in-Funktion aus ausgewählten Aktivitäten eine Timeline und Erinnerungen. Eine unterbrochene Aufgabe lässt sich so später leichter wieder aufnehmen, ohne den bisherigen Stand komplett neu erklären zu müssen.
Codex and ChatGPT can now understand the context of your recent work.
Opt into Computer History to give ChatGPT richer context, so it can pick up where you left off, understand patterns in your work, and suggest skills or scheduled tasks for work you repeat. pic.twitter.com/bWbA7A6QrT
— OpenAI Developers (@OpenAIDevs) August 13, 2026
Computer History kann außerdem wiederkehrende Abläufe erkennen und dazu passende Skills oder Scheduled Tasks vorschlagen. Das macht die Funktion nicht nur zu einer Art Arbeitsgedächtnis: Sie soll aus wiederholten Tätigkeiten auch Workflows ableiten, die sich künftig einfacher automatisieren lassen.
Was Computer History tatsächlich erfasst
User entscheiden selbst, welche Apps und Websites in Computer History einfließen. Screenshots, Bildschirmaufnahmen, Mikrofoneingaben oder Systemaudio zeichnet die Funktion nicht auf. Stattdessen erfasst sie Interaktionen wie Klicks, Eingaben, Tastaturkürzel und App-Wechsel sowie Kontext, den macOS über sein Accessibility-System bereitstellt. Private Browser Sessions bleiben außen vor.
Die Erfassung lässt sich jederzeit pausieren, einzelne Apps und Websites können ausgeschlossen und Einträge wieder gelöscht werden. Voraussetzung ist außerdem, dass Memories aktiviert sind.
Bei der Datenspeicherung lohnt sich ein genauerer Blick: Die Interaktionsereignisse werden zunächst temporär auf dem Mac gespeichert. Zur Erstellung der Erinnerungen verarbeitet OpenAI sie anschließend in einer kurzlebigen Codex Session auf den eigenen Servern. Die Event-Dateien danach nicht gespeichert und nicht zum Training verwendet, betont OpenAI. Auf dem Mac werden die temporären Dateien spätestens nach 48 Stunden gelöscht; daraus erstellte Memory-Dateien bleiben lokal erhalten, bis der User sie entfernt.
In Deutschland kommt die Funktion später
Computer History wird zunächst in der ChatGPT Desktop App für Mac für Pro, Business und Enterprise ausgerollt. Bei Business und Enterprise muss ein Admin den Zugang für den Workspace vorab freigeben. Aktiviert wird Computer History dadurch noch nicht automatisch – jeder User entscheidet anschließend selbst, ob die Funktion genutzt werden soll.
Deutschland gehört zum Start noch nicht dazu. Im Europäischen Wirtschaftsraum, in Großbritannien und in der Schweiz ist Computer History zunächst nicht verfügbar. OpenAI kündigt den Zugang für diese Regionen in den kommenden Wochen an.
ChatGPT Work:
OpenAIs Super-Agent verbindet Codex und GPT-5.6 für deine Arbeit

Stelle OnlineMarketing.de als bevorzugte Quelle auf Google ein
Wenn du OnlineMarketing.de auf Google als bevorzugte Quelle einstellen möchtest, um auch in den Schlagzeilen auf Google immer aktuelle News und Tipps aus der Welt des Marketing und der Tech-Entwicklungen zu finden, kannst du einfach die Google-Quelleneinstellungen aufrufen und die Seite anwählen. Über das Stern-Icon neben den Top Stories kannst du ebenfalls bevorzugte Quellen für die spätere Suche speichern.
