Sam Altman versprach "Intelligenz auf PhD-Niveau." Benutzer bekamen ein Modell, das denkt, Oregon werde "Onegon" genannt und Joe Biden sei immer noch Präsident.
Die neueste Version des Chatbots von OpenAI hat Benutzer enttäuscht und einige humorvolle Fehler gemacht.

Nikolas Kokovlis/NurPhoto via Getty Images
Sam Altman versprach "Intelligenz auf PhD-Niveau." Benutzer bekamen ein Modell, das denkt, Oregon werde "Onegon" genannt und Joe Biden sei immer noch Präsident.
OpenAIs GPT-5, das als das bisher fortschrittlichste KI-Modell des Unternehmens angepriesen wird, hat seit seinem Start am Donnerstag weit verbreitete Enttäuschung und Spott ausgelöst, da Benutzer grundlegende Fehler meldeten, die Debatten darüber neu entfacht haben, ob der skalierende Ansatz der KI-Industrie an eine Grenze geraten ist.
Der Rückschlag war schnell und brutal. Soziale Medien leuchteten mit Screenshots von bizarren Fehlern von GPT-5 auf, wie Landkarten, die Oklahoma als "Gelahbrin", grundlegende Mathematikprobleme wie "5.9 = x + 5.11" falsch gelöst, und Zeitpläne mit fiktiven Präsidenten wie "Willian H. Brusen."
"Der überwältigende Konsens über GPT-5 von sowohl X $TWTR als auch dem Reddit $RDDT AMA ist überwältigend negativ," bemerkte der AI Leaks and News Account, während eine informelle Umfrage ergab, dass die meisten Nutzer das Modell einfach als einfach zu bewerten "Irgendwie mittelmäßig."
Doch die Reaktionen waren nicht durchweg negativ. OpenAI berichtete, dass der API-Datenverkehr innerhalb von 24 Stunden nach dem Start verdoppelt wurde, und einige frühe Nutzer lobten die Programmierfähigkeiten und kreativen Ergebnisse von GPT-5. Box-CEO Aaron Levie hob bedeutende Verbesserungen hervor beim Extrahieren von Daten aus komplexen rechtlichen Dokumenten. Wharton-Professor Ethan Mollick bemerkte die Fähigkeit der KI Nutzerbedürfnisse zu antizipieren und umfassende Ergebnisse über die grundlegenden Anforderungen hinaus zu liefern. Entwickler Simon Willison schrieb, dass GPT-5 "mein neues Lieblingsmodell."
ist. Diese positiven Bewertungen wurden jedoch durch das harte Urteil des Marktes überschattet. Auf Polymarket, einer Prognoseplattform, auf der Händler auf zukünftige Ereignisse wetten, sanken OpenAIs Chancen, bis Monatsende das beste KI-Modell zu haben, von 75% auf 14% in nur einer Stunde am Donnerstagabend.
Bis Freitag betrieb ein zerknirschter Sam Altman Schadensbegrenzung auf Reddit, nachdem Nutzer Kommentare wie " postetenGPT-5 trägt die Haut meines toten Freundes" und eine Change.org-Petition gestartet. He promised to restore GPT-4o access (which OpenAI did by Friday evening) and admitted that ein kaputter "Autoswitcher" zwischen den verschiedenen Modi von GPT-5 hatte das Modell "wesentlich dümmer erscheinen lassen" als beabsichtigt. Das mea culpa markierte eine erstaunliche Kehrtwende für einen CEO, der noch 24 Stunden zuvor sein neuestes Werk als "eindeutig ein Modell, das allgemein intelligent ist."
Das Debakel wirft grundlegende Fragen darüber auf, ob die Kernstrategie der KI-Industrie, immer größere Modelle zu bauen, an eine Wand gestoßen ist. Kritiker haben lange argumentiert, dass allein das Hochskalieren von Modellen nicht zu künstlicher allgemeiner Intelligenz führen werde, und die Patzer von GPT-5 scheinen diese Bedenken zu bestätigen.
"Meine Arbeit hier ist wirklich getan," schrieb Gary Marcus, ein KI-Forscher und langjähriger Kritiker der aktuellen LLM-Entwicklungsansätze. "Niemand mit intellektueller Integrität kann noch glauben, dass das reine Skalieren uns zu AGI bringen wird." Die Probleme, die von einem als promotionsreifes Werkzeug angepriesenen Programm kommen, deuten auf fundamentale Beschränkungen in der Art und Weise hin, wie große Sprachmodelle Informationen verarbeiten, und nicht nur auf Kinderkrankheiten, die mit Patches behoben werden können.
Das Timing könnte für OpenAI nicht ungünstiger sein. Die AI-Gruppe von Alibaba kündigte ihr Qwen 3 Modell an mit einem Kontexte von 1 Million Tokens, was Gespräche ermöglicht, die fast viermal so lang sind wie das, was GPT-5 bietet. Währenddessen hält Anthropic's Claude Opus 4.1 in Coding-Benchmarks Schritt, und Gemini holt nach einem späten Start auf. Was OpenAIs Dominanz zementieren sollte, hat stattdessen den Rivalen ein Geschenk gemacht.
Die Einsätze sind enorm für ein Unternehmen, das gerade 8,3 Milliarden Dollar bei einer Bewertung von 300 Milliarden Dollar aufgenommen hat. $8,3 Milliarden bei einer Bewertung von 300 Milliarden Dollar und sich bei den Computerkosten durch Geldverbrennung auszeichnet. Der Jahresumsatz von OpenAI betrug 13 Milliarden Dollar, aber das Unternehmen bleibt unprofitabel, was jeden Fehltritt kostspielig macht. Die verpfuschte Einführung kommt auch, während Konkurrenten sich um das Unternehmen scharen, mit Meta $META-Berichten zufolge Milliarden-Dollar-Pakete anbietet um OpenAI-Talente abzuwerben.
OpenAI plant, nächste Woche neue Produktivitätsfunktionen einzuführen, darunter die Integration von Gmail und Google $GOOGL Kalender, und hat historisch gesehen im Laufe der Zeit Probleme bei der Einführung geglättet. Aber für ein Modell, an dem das Unternehmen seit Ende 2023 gearbeitet hat seit Ende 2023 gearbeitet hat, ist der Empfang wahrscheinlich nicht das, was sich OpenAI erhofft hatte. Im Januar, Altman schrieb, dass "wir sind jetzt zuversichtlich, dass wir wissen, wie man AGI baut" – ein Vertrauen, das verfrüht scheint, angesichts eines Modells, das Oregon auf einer Karte nicht korrekt kennzeichnen kann.
Schließen Sie sich über 500.000 Lesern an, die ihren Tag mit Quartz beginnen.
Mit dem Abonnieren stimmen Sie unseren Nutzungsbedingungen und unserer Datenschutzrichtlinie zu.