Digi-Trends

ChatGPT kopierte über Nacht die Hälfte der KI-Branche, doch die Live-Demonstrationen verliefen häufig katastrophal

Noch vor OpenAI -Entwicklerkonferenz hatten die Nutzer bereits eine „Mitteilung über die Reduzierung“ erhalten: Der Pro-Tarif für 200 US-Dollar pro Monat würde wieder für neue Nutzer geöffnet, das verfügbare Guthaben würde jedoch halbiert.

Der Preis bleibt gleich, aber der Nutzen hat abgenommen. Was kann OpenAI also bieten, um die Nutzer zum Weiterzahlen zu bewegen? Diese Frage muss die diesjährige Entwicklerkonferenz dringend beantworten.

Bild

Soeben kündigte OpenAI CEO Sam Altman eine Reihe von Aktualisierungen an, darunter Dot, ChatGPT Space, GPT-6.1 Sol, UltraFast, Pro 500, Decisions API, Agents API, Codex Cloud-Plattform und OpenAI Marketplace.

Bild

Obwohl die gesamte Pressekonferenz von neuen Produkten geprägt war, lag der Fokus klar auf dem Hauptthema. OpenAI vernetzt Modelle, intelligente Agenten, kollaborative Umgebungen und den kommerziellen Vertrieb und wandelt ChatGPT so schrittweise von einem Werkzeug zur Antwortgenerierung in eine Arbeitsplattform um, die Kontext verstehen, Software aufrufen und langfristige Aufgaben übernehmen kann.

Bei dieser Veröffentlichung geht es jedoch weniger um die Definition eines neuen Produkts als vielmehr um einen umfassenden Vergleich mit Konkurrenzprodukten: OpenAI möchte die Formen, die andere bereits validiert haben, auf plattformbasierte Weise neu erfinden.

Dot taucht auf und verändert die Arbeitsteilung zwischen Menschen und KI.

Die prominenteste Figur auf der gesamten Pressekonferenz war zweifellos "Dot".

Ultramans Augen leuchteten auf der Bühne, als er verkündete, dass dies ein Produkt sei, auf das er viele Jahre gewartet habe. Ähnlich wie die derzeit beliebten Bots Muse und Grok ist auch Dots eine Art hochleistungsfähiger, rund um die Uhr verfügbarer Online-Agent.

Bild

Nutzer können Dot benennen, seine langfristigen Aufgaben definieren und es anschließend für relevante Anwendungen, Geräte und Arbeitsumgebungen autorisieren. Dot führt die Aufgabe kontinuierlich im Hintergrund aus und kontaktiert den Nutzer proaktiv bei wichtigen Änderungen, wenn Entscheidungen erforderlich sind oder eine Genehmigung benötigt wird.

Bild

Konkret können Nutzer Dot verwenden, um Fehlerberichte kontinuierlich zu überwachen, Fehlerbehebungen zu testen und Pull Requests (PRs) zu erstellen, um die Budgetplanung für das nächste Jahr voranzutreiben oder die gesamte Codebasis auf eine neue, demnächst eingestellte API zu migrieren. Dot analysiert Abhängigkeiten, modifiziert den Code, führt Tests aus und übermittelt die Ergebnisse anschließend dem Team zur Überprüfung.

Bild

Die Grundlage für die Ausführung dieser Aufgaben ist, dass Dots über eine eigene Identität, einen Cloud-basierten Computer und einen Browser verfügt und bei Bedarf Code schreiben und testen kann. Es kann sich außerdem mit benutzerautorisierten Laptops verbinden und so direkt in eine reale Arbeitsumgebung eingebunden werden.

Bild

Das Plugin-Ökosystem von OpenAI ermöglicht die Anbindung an über 4.000 Anwendungen. Nutzer können über ChatGPT , SMS, Slack, Teams und Sprachanrufe mit OpenAI kommunizieren, wobei der kanalübergreifende Kontext synchronisiert bleibt.

Bild

Holly, Leiterin des OpenAI -Produktteams, demonstrierte anschließend anhand der fiktiven Musik-App Blossom, wie Dot tatsächlich funktioniert.

Als das Team die Produkteinführung vorbereitete, hatte Dot bereits festgestellt, dass das Release-Review-Meeting verschoben worden war, den Kalender aktualisiert, das Feedback der Testnutzer vom Vorabend zusammengefasst und den vom Designteam in letzter Minute eingereichten Homepage-Entwurf gefunden.

Bild

Sobald Dot den Befehl „Los geht’s!“ empfängt, kann es Codex auf dem Computer aufrufen, um das Design in eine ausführbare Anwendung umzuwandeln und die Änderungen als Pull-Request einzureichen. Während der Live-Demonstration traten jedoch mehrere Probleme auf. Nicht nur die Reaktionszeit war langsam, sondern auch der Codex-Thread, der den Fortschritt der Aufgabe anzeigt, wurde nicht ordnungsgemäß gestartet, als Dotty Codex zum Erstellen der Anwendung aufrief.

Darüber hinaus kann Dot an Slack-Gruppenchats teilnehmen und Aufgaben wie ein Teammitglied erhalten. In der Demo senden die Entwickler einfach Nutzerfeedback und die Sitzungs-ID an den Kanal, woraufhin Dot das Problem untersucht und eine Lösung einreicht.

Bild

Ach ja, übrigens haben Internetnutzer auch ein kleines Easter Egg entdeckt: Wenn man sich jetzt auf der Website "Dot.com" einloggt, wird man direkt auf die Gork Bot-Werbeseite weitergeleitet.

Bild

Meta Chief AI Officer, Alex Wang, übermittelte erwartungsgemäß seine „besten Wünsche“.

Bild

Je proaktiver ein Dot agiert, desto schwieriger lassen sich Berechtigungs- und Sicherheitsprobleme vermeiden. OpenAI konfiguriert für jeden Dot einen isolierten Cloud-Computer, sodass Benutzer festlegen können, auf welche Anwendungen zugegriffen werden darf und Berechtigungen, Einschränkungen oder Vorabgenehmigungen für verschiedene Vorgänge einrichten können.

Vorgänge wie Kontoänderungen oder Informationsaustausch werden automatisch überprüft, während sensible Aufgaben wie das Ändern von Passwörtern stets eine manuelle Durchführung durch die Benutzer erfordern.

Wenn Dot im Hintergrund "aktive Recherchen" durchführt, kann es nur Tools mit eingeschränkten Berechtigungen zum Lesen verbundener Anwendungen verwenden und kann keine Nachrichten direkt senden, Anwendungsinhalte ändern oder Benutzergeräte steuern.

Für Unternehmen hat OpenAI außerdem einen eigenen Dot herausgebracht.

Bild

Unternehmen können intelligente Agenten mit unabhängigen Identitäten und klar definierten Verantwortlichkeiten in Bereichen wie Finanzen, Marketing, Recht, Einkauf und Kundenservice einsetzen. Diese Agenten werden kontinuierlich überprüft und von Mitarbeitern bewertet. OpenAI arbeitet mit Microsoft zusammen, um dedizierte Dot-Lösungen in Agent 365 zu integrieren. Dadurch können Unternehmen diese intelligenten Agenten mithilfe ihrer bestehenden Identitäts-, Berechtigungs- und Sicherheitssysteme verwalten.

Dot wird schrittweise für Pro- und Business-Premium-Nutzer in den entsprechenden Märkten eingeführt, während Enterprise-Nutzer die Beta-Version nach der Administratoraktivierung testen können.

Bild

Der erste Dot ist im entsprechenden Paket enthalten. Konversationen mit dem Dot verbrauchen kein ChatGPT Guthaben, aber tatsächliche Aufgaben, die über Codex oder ChatGPT Aufträge initiiert werden, werden weiterhin wie gewohnt abgerechnet. Zukünftig können Benutzer weitere Dots hinzufügen oder deren Geschwindigkeit und Arbeitslast erhöhen.

Die einzelnen Dots sind dafür zuständig, die Benutzer zu verstehen und Aufgaben kontinuierlich voranzutreiben, während ChatGPT Spaces dafür zuständig sind, den Teammitgliedern des Unternehmens und ihren jeweiligen Agenten die Zusammenarbeit am selben Ort zu ermöglichen.

Bild

Space wurde speziell für die Zusammenarbeit von Menschen und Agenten entwickelt und verwendet Seiten als Grundeinheit. Es kann Texte, Dokumente, Forschungsmaterialien, Bilder, Tabellen, dynamische Diagramme und ausführbare Prototypen enthalten.

Bild

Nutzer können Kollegen wie in kollaborativen Dokumenten per @-Erwähnung erwähnen und auch einen bestimmten Dot in Kommentaren ansprechen, um Abhängigkeiten zu verfolgen, Daten zu finden oder Inhalte zu aktualisieren. Die Seite kann außerdem fortlaufende Anweisungen erhalten, z. B. die tägliche Überprüfung eines festgelegten Slack-Kanals und die Aktualisierung des aktuellen Dokuments mit neuen Erkenntnissen.

Bild

Auf der Pressekonferenz ließ Holly Dot das Nutzerfeedback in ein filterbares Balkendiagramm umwandeln und es stündlich automatisch aktualisieren; dann ließ sie es Registrierungsdaten abrufen, die ein Ingenieur in privaten Slack-Nachrichten erwähnt hatte, und diese den FAQ zur Produktveröffentlichung hinzufügen.

OpenAI kündigte außerdem an, Space zukünftig um Präsentationsfunktionen zu erweitern, sodass es für Agenten lesbar und veränderbar ist und Teams gemeinsam mit mehreren Dots Folien erstellen können.

Die Kombination von Dot und Space spiegelt auch OpenAI Einschätzung der nächsten Generation von Bürosoftware wider. Chatten ist lediglich der Einstieg, um Absichten zu übermitteln; der dauerhafte Kontext, die bedienbare Softwareumgebung und der kollaborative Raum für die menschliche Beteiligung an Genehmigungsprozessen bilden die eigentliche Infrastruktur für den Einsatz intelligenter Agenten im Arbeitsalltag.

Bild

GPT-6.1 Sol senkt die Kosten des langfristigen Betriebs.

Damit intelligente Agenten über längere Zeiträume effektiv arbeiten können, müssen Modelle Vorteile hinsichtlich Leistungsfähigkeit, Geschwindigkeit und Kosten bieten. Um dies zu gewährleisten, hat OpenAI GPT-6.1 Sol veröffentlicht und es als primäres Alltagsmodell für Entwickler und intelligente Agenten positioniert.

Bild

Laut der detaillierten Preisgestaltung berechnet es 2 US-Dollar pro Million Input-Token und 10 US-Dollar pro Million Output-Token, jeweils ein Fünftel des entsprechenden Preises von GPT-6 Astra; die zwischengespeicherte Eingabe berechnet 0,10 US-Dollar pro Million Token, was für Aufgaben geeignet ist, die das wiederholte Lesen von Projektdaten und die Wiederverwendung von Kontext erfordern.

Bild

Der Preisrückgang ging nicht mit einer signifikanten Verringerung der Leistungsfähigkeit einher.

OpenAI gibt an, dass das neue Modell die Leistung von Astra zu geringeren Kosten in den Bereichen komplexe Softwareentwicklung, professionelle Dokumentenverarbeitung, mehrstufige Arbeitsabläufe und Computerbetriebsbewertungen erreicht, während Astra die Obergrenze der Leistungsfähigkeit für die anspruchsvollsten wissenschaftlichen Forschungsaufgaben beibehält.

Im DeepSWE 1.1 Software-Engineering-Benchmark erreichte GPT-6.1 Sol ein Niveau, das dem von Astra nahekommt, jedoch zu etwa einem Fünftel der Kosten und übertraf den Höchstwert von GPT-6 Sol um 6,4 Prozentpunkte.

Bild

Im GDP.pdf, einem Test der Fähigkeiten zum Verständnis komplexer PDFs, übertraf es Opus 5.5 mit Fallback-Mechanismus in allen Inferenzeinstellungen, wobei die Kosten pro Aufgabe weniger als die Hälfte der Kosten des letzteren betrugen.

In AutomationBench, das für mehrstufige Geschäftsprozesse konzipiert wurde, übertrifft GPT-6.1 Sol Opus 5.5 bei mittlerer Inferenzintensität um mehr als zwei Prozentpunkte, während die Kosten nur etwa ein Drittel der Kosten des letzteren betragen.

Im OSWorld 2.0 Benchmark verringerte sich bei höchster Inferenzintensität die Lücke zwischen OSWorld und Astra auf unter 2,1 Prozentpunkte, und die Kosten pro Aufgabe betrugen etwa ein Siebtel der Kosten von Astra.

Bild

Ab heute können Plus-, Pro-, Business-, Enterprise- und Edu-Nutzer GPT-6.1 Sol in ChatGPT und Codex verwenden. Dieses Modell steht jedoch noch nicht im regulären Chat zur Auswahl. Entwickler können es über die API mit gpt-6.1-sol aufrufen.

Im Umfeld von Dot und GPT-6.1 Sol kündigte OpenAI außerdem eine Reihe von Infrastrukturen für intelligente Agenten an.

Der UltraFast-Modus erhöht die Inferenzgeschwindigkeit um das Achtfache gegenüber dem Standardmodus und erreicht bis zu 300 Token pro Sekunde. Er ist aktuell für Astra verfügbar und wird später auch GPT-6.1 Sol unterstützen.

Bild

OpenAI hat außerdem den Pro-Tarif für 500 US-Dollar eingeführt, der etwa das 25-fache Nutzungsguthaben von Plus-Mitgliedern sowie ultraschnellen Zugriff auf ChatGPT und Codex bietet, und den Pro-Tarif für 200 US-Dollar wieder verfügbar gemacht. Am Ende der Präsentation kündigte OpenAI zudem eine Guthaben-Zurücksetzung für alle Nutzer weltweit an.

Bild

Für Szenarien, die Echtzeit-Entscheidungen erfordern, hat OpenAI außerdem die Decisions API veröffentlicht, die mit Jev vergleichbar ist. Sie ermöglicht es Luna, schnell Ergebnisse aus voreingestellten Optionen auszuwählen, die für das Routing von Anfragen, die Bildklassifizierung und die Bestimmung der nächsten Aktion eines Agenten verwendet werden können, wobei visuelles Verständnis, Mehrsprachigkeit und Sicherheitsfunktionen erhalten bleiben.

Bild

Codex wurde ebenfalls vollständig in die Cloud migriert.

Bild

Entwickler können Aufgaben von ihren Mobiltelefonen aus starten und diese anschließend im Browser oder auf einem Desktop-Computer weiterverfolgen. Selbst bei ausgeschaltetem Computer arbeitet der intelligente Agent in der Cloud weiter. Die neue Version der Codex CLI bietet nun auch bidirektionale Sprachkommunikation, und Codex Security Cloud scannt kontinuierlich nach Schwachstellen, entfernt automatisch Duplikate und erstellt verifizierte Abhilfemaßnahmen.

Die Agents API stellt Entwicklern die internen Funktionen von OpenAI zur Verfügung, die für Codex und Dot verwendet werden, darunter Laufzeit-Frameworks, Hosting, Speicherverwaltung, Multiagentensteuerung und Computernutzung.

Bild

OpenAI präsentierte außerdem Private Intelligence, das Unternehmen den Zugriff auf modernste Modellfunktionen ermöglichen soll, ohne dass Inhalte gespeichert werden müssen – durch Datenaufbewahrung ohne Speicherung, sichere private Verarbeitung und private Inferenz.

Bild

Über die Modelle hinaus möchte OpenAI auch den Einstiegspunkt für Anwendungen kontrollieren.

Nachdem das Produkt entwickelt worden war, wollte OpenAI auch den Vertriebsprozess kontrollieren.

Zukünftig können sich Nutzer mit ihren ChatGPT -Konten bei Produkten von Drittanbietern anmelden und die Token in ihren Abonnementpaketen verbrauchen, wodurch Entwickler die Kosten für Nutzer senken können, die das Produkt zum ersten Mal ausprobieren.

Plugin-Erweiterungen ermöglichen es Entwicklern, Editoren, Dashboards und sogar komplette Arbeitsbereiche in ChatGPT und Codex zu integrieren; Figma und Adobe haben dies bereits anhand von Beispielen demonstriert.

Bild

OpenAI Marketplace wurde am selben Tag gestartet und umfasste zunächst über 30 Partner. Unternehmenskunden können ihre bestehenden OpenAI -Vertragsguthaben für den Kauf von Drittanbieterprodukten nutzen, während Entwickler Zugang zu einem Vertriebskanal mit rund 1,2 Milliarden wöchentlich aktiven Nutzern erhalten.

Bild

Während der Konversationen werden außerdem proaktiv Plugins empfohlen, sodass ChatGPT gleichzeitig als Einstiegspunkt, Laufzeitumgebung und App-Store dient.

Nach der Vorstellung der neuen Produkte kam Altman auf das altbekannte Thema Kreditlimits zurück. Er sagte, OpenAI habe so viele „Bank-Resets“ durchgeführt, dass Tibo scherzhaft vorschlug, das Unternehmen in „Reset Company“ umzubenennen.

Was mich aber noch mehr beunruhigt, ist, dass es tatsächlich einen physischen Knopf gibt, um das Kreditlimit zurückzusetzen.

Bild

Es ist erwähnenswert, dass Sam Altman am Ende seiner Präsentation seine ideale Zukunftsvision für KI als eine „neue Renaissance“ und nicht als eine neue industrielle Revolution beschrieb.

Er hofft, dass KI den Einzelnen mehr Möglichkeiten zum Gestalten, Lernen und Erkunden eröffnet. Auch aus geschäftlicher Sicht ist das Ziel von OpenAI klar: ChatGPT soll von einer Super-App zu einer Plattform weiterentwickelt werden, die Nutzer, Agenten und Software von Drittanbietern integriert.

Doch große Metaphern müssen letztendlich in der Realität erprobt werden.

Die grundlegende Logik von Internetdiensten besteht aus einem relativ stabilen System von Servern und Regeln. Webseiten können abstürzen, Systeme können sich aufhängen und Software kann Fehler aufweisen, aber in den meisten Fällen wissen die Nutzer, wem sie ihre Daten anvertraut haben und wie diese behandelt werden.

Die durch KI-Agenten hervorgerufene Veränderung besteht darin, dass sie einen Befehl missverstehen, sich von externen Inhalten beeinflussen lassen oder in einer Reihe scheinbar vernünftiger Schritte eine Entscheidung treffen können, die von der ursprünglichen Absicht des Benutzers abweicht.

Was noch beunruhigender ist: Mit der zunehmenden Übernahme von Aufgaben durch Dot, Codex und private Geheimdienste stellt sich eine drängende Frage: Sind wir wirklich bereit, so viele Informationen, Berechtigungen und Urteile vorbehaltlos an eine Blackbox abzugeben?

Die Antwort ist natürlich nein, aber angesichts des Reizes scheinbar maximaler Effizienz und Bequemlichkeit scheinen wir vergessen zu haben, zu zögern.