OpenAI hat eine bedeutende Erweiterung seiner beliebten KI-Plattform ChatGPT angekündigt: den ChatGPT-Agenten. Dieser neue allgemeine KI-Agent ist darauf ausgelegt, eine Vielzahl von computerbasierten Aufgaben im Namen der Nutzer zu erledigen. Laut OpenAI kann der Agent automatisch den Kalender eines Nutzers navigieren, bearbeitbare Präsentationen und Diashows erstellen und sogar Code ausführen.
Der ChatGPT-Agent vereint Fähigkeiten aus OpenAIs früheren agentischen Werkzeugen, darunter die Möglichkeit von Operator, auf Webseiten zu navigieren, sowie die Fähigkeit von Deep Research, Informationen aus Dutzenden von Webseiten in einem prägnanten Forschungsbericht zu synthetisieren. Nutzer können mit dem Agenten über natürliche Spracheingaben interagieren, was die Bedienung äußerst benutzerfreundlich macht.
Der Rollout des ChatGPT-Agenten beginnt am Donnerstag für Abonnenten der Pro-, Plus- und Team-Pläne von OpenAI. Um das Tool zu aktivieren, können Benutzer den „Agentenmodus“ im Dropdown-Menü von ChatGPT auswählen.
Diese Einführung markiert OpenAIs kühnsten Versuch, ChatGPT von einer reinen Antwortplattform zu einem agentischen Produkt weiterzuentwickeln, das aktiv Aufgaben übernehmen kann. In den letzten Jahren haben zahlreiche Unternehmen im Silicon Valley, darunter OpenAI, Google und Perplexity, verschiedene KI-Agenten vorgestellt. Diese frühen Versionen hatten jedoch Schwierigkeiten mit komplexen Aufgaben und konnten die hohen Erwartungen oft nicht erfüllen.
OpenAI behauptet jedoch, dass der ChatGPT-Agent wesentlich leistungsfähiger ist als seine Vorgänger. Der neue Agent kann auf ChatGPT-Connectoren zugreifen, die es Nutzern ermöglichen, Apps wie Gmail und GitHub zu verknüpfen, damit der Agent relevante Informationen zu den Anfragen der Nutzer finden kann. Zusätzlich hat der Agent Zugriff auf ein Terminal und kann APIs verwenden, um auf bestimmte Apps zuzugreifen.
Einige der Aufgaben, die der ChatGPT-Agent bewältigen kann, sind das Planen und Kaufen von Zutaten für ein japanisches Frühstück für vier Personen sowie die Analyse von drei Wettbewerbern und das Erstellen einer Präsentation. Diese Fähigkeiten erfordern, dass der ChatGPT-Agent Webseiten durchsucht, einen Handlungsplan erstellt und verschiedene Werkzeuge verwendet – deutlich komplexere Aufgaben als bisher von OpenAI versucht.
Das zugrunde liegende Modell des ChatGPT-Agenten bietet laut OpenAI eine erstklassige Leistung in mehreren Benchmarks. Beispielsweise erreicht es 41,6% auf „Humanity’s Last Exam“, einem herausfordernden Test mit tausenden Fragen aus über hundert Themenbereichen, was etwa doppelt so hoch ist wie die Ergebnisse früherer Modelle.
Ein weiterer Aspekt, den OpenAI betont, ist die Sicherheit. Das Unternehmen hat den ChatGPT-Agenten mit neuen Sicherheitsmaßnahmen ausgestattet, um potenzielle Risiken zu minimieren, da das Produkt neue Fähigkeiten bietet, die in den falschen Händen gefährlich sein könnten. OpenAI hat den Agenten als „höchst leistungsfähig“ in den Bereichen biologische und chemische Waffen eingestuft und Vorsichtsmaßnahmen ergriffen, um diese Risiken zu mindern.
Zu den neuen Sicherheitsvorkehrungen gehört ein Echtzeitmonitor, der die Eingaben der Nutzer überwacht. Wenn eine Anfrage in Zusammenhang mit Biologie steht, wird die Antwort des ChatGPT-Agenten durch einen zweiten Monitor überprüft, um sicherzustellen, dass der Inhalt keine biologische Bedrohung darstellen könnte.
OpenAI hat außerdem die Speicherfunktion des ChatGPT-Agenten deaktiviert, um Missbrauch zu verhindern. Diese Funktion ermöglicht es normalerweise, Informationen aus vorherigen Chats zu referenzieren. Doch in diesem Fall könnte sie von böswilligen Akteuren genutzt werden, um sensible Daten durch sogenannte Prompt-Injection-Angriffe zu extrahieren. OpenAI behält sich vor, die Funktion in der Zukunft möglicherweise wieder zu aktivieren.
Obwohl der ChatGPT-Agent beeindruckend klingt, bleibt abzuwarten, wie fähig er in der Praxis wirklich ist. Bislang hat sich die Agententechnologie als relativ fragil erwiesen, wenn es darum geht, mit der realen Welt zu interagieren. OpenAI ist jedoch zuversichtlich, dass es mit dem ChatGPT-Agenten ein Modell entwickelt hat, das das Potenzial von KI-Agenten voll ausschöpfen kann.