Zusammenfassung:
OpenAI hat auf der jüngsten Entwicklerkonferenz Dev Day eine Reihe neuer Funktionen veröffentlicht. Im Einzelnen umfassen diese Funktionen Plug-Ins, KI-Agenten, Anwendungsintegration, Identitätsauthentifizierung und den Markt für Unternehmenssoftware. Wenn wir sie jedoch zusammen betrachten, können wir sehen, dass OpenAI ein Softwareverteilungsmodell fördert, das sich völlig vom traditionellen App Store unterscheidet: Benutzer suchen nicht mehr zuerst nach Anwendungen und öffnen sie dann, um Aufgaben zu erledigen, sondern teilen ChatGPT direkt mit, was sie tun möchten, und die KI entscheidet, welche Anwendung aufgerufen werden soll, und erledigt die Arbeit innerhalb der Konversationsschnittstelle.
Das traditionelle Softwaremodell ist „anwendungsgesteuert“. Möchte der Nutzer Bilder gestalten, öffnet er Photoshop oder Figma; Wenn sie Projekte verwalten möchten, öffnen sie die entsprechende Projektmanagement-Software. Wenn sie Besprechungen planen möchten, müssen sie den Kalender oder die Konferenzanwendung aufrufen. Die App-Stores von Apple und Google basieren auf diesem Modell, bei dem Benutzer zunächst Apps entdecken, herunterladen und installieren und dann die von den Apps bereitgestellten Funktionen nutzen.
OpenAI versucht, diesen Prozess umzukehren.
Laut dem von OpenAI angekündigten Plan wird ChatGPT zum Haupteingang für die Erkennung und den Betrieb von Anwendungen. Wenn ein Benutzer in einem Gespräch nach einer Aufgabe fragt und das System feststellt, dass eine Drittanbieteranwendung bei der Erledigung der Aufgabe helfen kann, kann ChatGPT verwandte Anwendungen direkt empfehlen. Sobald der Benutzer die Verbindung bestätigt, kann er die App in ChatGPT verwenden, ohne die aktuelle Konversation zu verlassen.
Eine der zentralen Änderungen dieser Zeit ist die Erweiterung des ChatGPT-Plug-in-Systems. Entwickler können jetzt umfassendere Anwendungserlebnisse erstellen, anstatt ChatGPT nur eine API aufrufen zu lassen. Anwendungen von Drittanbietern können über eigene Eingänge in der ChatGPT-Seitenleiste verfügen und auch interaktive Panels bereitstellen, sodass Benutzer Funktionen, die ursprünglich unabhängige Websites oder unabhängige Apps erfordern, während des Chat-Vorgangs direkt bedienen können.
Design-Software kann beispielsweise direkt eine Design-Änderungsschnittstelle in ChatGPT bereitstellen. Benutzer können AI ihre Anforderungen verstehen lassen und dann bestimmte Änderungen über die Anwendung vornehmen; Entwicklungstools können auch zu Hintergrundtools werden, die aufgerufen werden, wenn KI-Agenten Aufgaben ausführen.
Die von OpenAI angezeigten Fälle umfassen Designtools wie Figma und Adobe. Benutzer können während eines ChatGPT-Gesprächs an bestehenden Projekten arbeiten oder direkt eine Funktion aufrufen, die zuvor in einer eigenständigen Software geöffnet werden musste.
OpenAI selbst demonstrierte auch, wie man eine Konferenzanwendung verwendet. Benutzer können die App bitten, anstehende Besprechungen im Kalender vorzulesen und mithilfe von KI den Besprechungsinhalt automatisch aufzuzeichnen und nach der Besprechung eine Zusammenfassung und Folgemaßnahmen zu erstellen. Der gesamte Prozess erfordert nicht mehr, dass Benutzer zwischen mehreren Anwendungen hin- und herwechseln.
Das bedeutet, dass sich ChatGPT allmählich von einem „Chat-Fenster“ zu einer Software-Betriebsebene wandelt. Herkömmliche Apps gibt es immer noch, aber die Art und Weise, wie Benutzer mit ihnen interagieren, kann sich ändern: Apps sind für die Bereitstellung spezifischer Funktionen verantwortlich, während ChatGPT dafür verantwortlich ist, Benutzerabsichten zu verstehen, Tools auszuwählen und die Arbeit zwischen verschiedenen Anwendungen zu koordinieren.
OpenAI hat außerdem das Identitätssystem „Mit ChatGPT anmelden“ eingeführt. Benutzer können sich mit ihrer ChatGPT-Identität bei Anwendungen von Drittanbietern anmelden, die diese Funktion unterstützen, und gleichzeitig ihr vorhandenes KI-Nutzungskontingent auf diese Anwendungen übertragen.
Zu den ersten Partnern gehören Devin, Notion, Vercel, T3, OpenClaw und Dactyl usw. von Cognition. Insgesamt beteiligten sich 16 Unternehmen am ursprünglichen Plan, und OpenAI erklärte, dass es den Umfang der Zusammenarbeit in Zukunft weiter ausbauen werde.
Dieses Identitätssystem löst tatsächlich ein wichtiges Problem im KI-Anwendungsökosystem. Wenn Benutzer in der Vergangenheit KI-Anwendungen von Drittanbietern verwendeten, mussten sie häufig separate Konten erstellen, Modelle konfigurieren und Kontingente erwerben. Nun hofft OpenAI, ChatGPT zu einem gemeinsamen Identitäts- und KI-Fähigkeitsportal für diese KI-Anwendungen zu machen.

OpenAI hat außerdem die Rolle von ChatGPT-Sites weiter ausgebaut. Leichte Websites, die von Benutzern mithilfe von ChatGPT erstellt wurden, können diese Drittanbieteranwendungen hosten und anderen den Zugriff darauf ermöglichen. Wenn Kollegen eine solche Seite öffnen, können sie ihre eigenen Konten, Daten und Berechtigungen anstelle der des Erstellers der Freigabe verwenden.
Dadurch verwandeln sich die von ChatGPT generierten Websites schrittweise von „KI-generierten einmaligen Webseiten“ zu kleinen Softwareplattformen, die von mehreren Personen genutzt werden können.
Gleichzeitig baut OpenAI ein eigenes System zur Anwendungsprüfung auf. Nachdem Entwickler ein Plug-in eingereicht haben, können sie den Überprüfungsfortschritt verfolgen, Probleme anzeigen, die geändert werden müssen, und bei Bedarf eine manuelle Überprüfung anfordern. Entwickler können außerdem die Tools im Plug-in aktualisieren, ohne jedes Mal die gesamte Anwendung von Grund auf neu einreichen zu müssen.
Dieser Mechanismus ist tatsächlich dem Überprüfungsprozess im App Store von Apple sehr ähnlich, mit der Ausnahme, dass sich das Überprüfungsobjekt von herkömmlichen mobilen Apps zu nativen KI-Anwendungen geändert hat, die in ChatGPT ausgeführt werden können.
OpenAI kündigte außerdem die Einführung eines Marktes für Unternehmensanwendungen an. In der ersten Reihe von Märkten gibt es bereits mehr als 30 Partner, darunter Adobe, Figma, Sierra, Decagon, HubSpot, Salesforce, ServiceNow, Harvey, Legora, Palo Alto Networks, CrowdStrike und Baseten usw.
Berechtigte Unternehmenskunden können einen Teil ihres bereits für OpenAI bereitgestellten Budgets für den Kauf genehmigter Partnersoftware verwenden. Auf diese Weise möchte OpenAI nicht nur ein Anbieter von KI-Tools werden, sondern versucht auch, eine Vertriebsplattform für Unternehmenssoftware zu werden.
Aber der Teil, der das traditionelle App-Store-Modell wirklich verändern könnte, ist der KI-Agent, den OpenAI gleichzeitig bewirbt.
Dots, der diesmal von OpenAI eingeführte autonome intelligente KI-Agent, kann über einen eigenen Cloud-Computer und Browser verfügen und auf von Benutzern verbundene Anwendungen zugreifen. Der Benutzer muss nicht erst entscheiden: „Welche App soll ich verwenden?“ sondern teilt der KI direkt mit, welche Aufgabe sie erledigen möchte, und der Agent entscheidet dann, welche Tools aufgerufen werden sollen.
Wenn ein Benutzer beispielsweise in der Vergangenheit eine Website erstellen wollte, öffnete er möglicherweise zuerst den Code-Editor, nutzte dann das Design-Tool, gab dann GitHub ein und nutzte schließlich die Bereitstellungsplattform. Im Agentenmodus muss der Benutzer der KI lediglich mitteilen, was sie erreichen möchte, und der Agent kann selbst entscheiden, welche Anwendungen aufgerufen werden müssen.
OpenAI gab an, dass Dots in der Lage war, mehr als 4.000 Anwendungen in seinem Ökosystem zu verbinden.
Dadurch wird der Teil „Anwendungsauswahl“ des traditionellen App Store tatsächlich auf die KI übertragen.
In der Vergangenheit halfen die App Stores von Apple und Google den Nutzern, Apps durch Suche, Klassifizierung, Rankings und Empfehlungen zu finden; Doch im KI-Agent-Modus wissen Nutzer möglicherweise nicht einmal, welche App letztendlich verwendet wurde. Der Benutzer schlägt lediglich ein Ziel vor und die KI entscheidet anhand der Aufgabe über das Tool.
OpenAI hofft auch, Dots ein gewisses Maß an Eigeninitiative zu verleihen. Beispielsweise könnte ein Agent Probleme in einem Projekt erkennen, ohne dass der Benutzer dies ausdrücklich anfordert, oder den Benutzer daran erinnern, eine zuvor vergessene Aufgabe zu erledigen. Für solche proaktiven Vorgänge ist jedoch weiterhin eine Benutzerautorisierung erforderlich.
OpenAI sagte, dass Dots verbundene Anwendungen im Hintergrund verwenden kann, um sogenannte „aktive Forschung“ durchzuführen, aber in diesem Stadium verwendet es hauptsächlich eine schreibgeschützte Methode. Wenn es um tatsächliche Änderungen, das Senden oder andere Vorgänge mit echten Auswirkungen geht, hat der Benutzer weiterhin die Kontrolle.
Wenn dieses Modell ausgereift ist, könnte auch die wirtschaftliche Struktur des traditionellen App Stores betroffen sein.

In der Vergangenheit mussten Softwareentwickler hart arbeiten, um Benutzer dazu zu bringen, den App Store zu betreten, nach ihren Apps zu suchen, die Apps herunterzuladen und sie über einen längeren Zeitraum zu nutzen. Zukünftig könnten Entwickler zunächst dafür sorgen, dass ihre Software von KI-Agenten erkannt und aufgerufen werden kann. Benutzer wissen möglicherweise nicht einmal, welche konkrete App sie verwenden.
Ein Unternehmen kann beispielsweise weiterhin Abonnementdienste auf seiner Website verkaufen. Nachdem der Benutzer den Kauf abgeschlossen hat, kann er das Konto mit ChatGPT oder Codex verbinden und den KI-Agenten den Dienst im Namen des Benutzers nutzen lassen.
OpenAI hat jedoch noch kein vollständiges Zahlungs- und Freigabesystem ähnlich dem App Store von Apple angekündigt. Mit anderen Worten: In dieser Phase löst OpenAI hauptsächlich die Probleme der Anwendungserkennung, -verteilung, der Identitätsauthentifizierung und des Aufrufs. Es wurde nicht klar angekündigt, dass OpenAI die Softwaregebühren von Drittanbietern einheitlich erheben und diese dann nach einem Modell ähnlich dem App Store mit den Entwicklern teilen wird.
Dies ist auch ein wichtiger Unterschied zwischen dem aktuellen neuen Ökosystem und traditionellen App Stores.
Aus technischer Sicht versucht OpenAI nicht wirklich zu ändern, „wo die App platziert wird“, sondern die Interaktion zwischen Software und Menschen.
Das traditionelle Modell ist „Mensch→App→Funktion“, und Benutzer müssen wissen, welche Software sie benötigen; während das KI-Agentenmodell allmählich zu „Mensch→KI→Mehrere Apps→Aufgabenergebnisse“ wird. Im letzteren Modell wird die Software selbst immer mehr zu einem Werkzeug, auf das die KI zugreifen kann, und nicht zu einem Ziel, das der Benutzer physisch bedienen muss.
Dies könnte erklären, warum OpenAI dieses Mal gleichzeitig Anwendungs-Plug-ins, ChatGPT-Identitäten, Unternehmensanwendungsmärkte und Dots-Agenten fördert. Dabei handelt es sich nicht um völlig eigenständige Produkte, sondern sie bauen gemeinsam ein neues Software-Ökosystem auf: ChatGPT ist für das Verständnis von Anforderungen zuständig, Agenten für die Ausführung von Aufgaben, Drittanwendungen stellen professionelle Fähigkeiten zur Verfügung und Entwickler gewinnen Nutzer über dieses neue KI-Portal.
Wenn dieses Modell irgendwann zum Mainstream wird und Benutzer in Zukunft ihre Computer oder Mobiltelefone einschalten, ist das erste, was sie öffnen, möglicherweise nicht mehr eine bestimmte Anwendung, sondern ein KI-Portal. Welche Software die Aufgabe erledigt, kann zu einem Problem werden, um das sich Benutzer überhaupt nicht kümmern müssen.
Dies ist auch die bemerkenswerteste Änderung hinter den vielen Produktaktualisierungen von OpenAI am Dev Day: Es werden nicht einfach nur ein paar Plug-ins zu ChatGPT hinzugefügt, sondern es wird versucht, ChatGPT weiter von einem „Tool zur Verwendung von Anwendungen“ in eine „Plattform, die bestimmt, welche Anwendungen Benutzer verwenden“ weiterzuentwickeln. Sobald sich der Zugang zur Softwareverteilung schrittweise vom App Store auf KI-Agenten verlagert, wird auch das von Apple und Google seit langem etablierte Anwendungsökologiemodell einer neuen Art des Wettbewerbs ausgesetzt sein.
Kommentare