Warum Jacob Coxon Anthropic wegen KI-Risiken verlassen hat
10. September 2026
Der frühere OpenAI- und Anthropic-Forscher Jacob Coxon verließ Anthropic und warnte öffentlich vor selbstverbessernder KI. Was belegt ist – und was seine Warnung nicht beweist.
Worum es geht
Jacob Coxon, ein früherer Forscher bei OpenAI und Anthropic, hat Anthropic verlassen. In Berichten vom 9. September 2026 begründete er seinen Schritt mit der Sorge, dass führende KI-Labore immer leistungsfähigere und möglicherweise selbstverbessernde Systeme entwickeln, ohne dass Gesellschaft und Aufsicht ausreichend vorbereitet seien. Mehrere voneinander unabhängige Medien, darunter AP, WIRED und TechCrunch, berichteten über den Ausstieg und seine Warnungen.
Warum der Ausstieg auffällt
Coxon äußert sich nicht nur als externer Kritiker. Er arbeitete selbst an leistungsfähigen Modellen und verzichtete laut Berichten für den vorzeitigen Abschied auf noch nicht übertragene Unternehmensanteile. Das macht seine Entscheidung relevant, ersetzt aber keine technische Beweisführung. Ein Insider kann wichtige Risiken sehen und sich trotzdem bei Wahrscheinlichkeit oder Zeithorizont irren.
Der Kern seiner Warnung
Im Mittelpunkt steht selbstverbessernde KI: ein System, das Forschung, Softwareentwicklung oder Experimente so stark beschleunigt, dass daraus eine Rückkopplung entsteht. Bessere Systeme helfen dann beim Bau der nächsten Generation. Coxon befürchtet, dass Wettbewerb zwischen Laboren Sicherheitsbremsen schwächt und Menschen die Kontrolle über besonders leistungsfähige Systeme verlieren könnten.
Was wir sicher wissen
Aktuelle KI kann bereits Code schreiben, Werkzeuge bedienen und mehrstufige Aufgaben ausführen. Gleichzeitig scheitert sie weiterhin an scheinbar einfachen Details, halluziniert und benötigt menschliche Kontrolle. Coxons Ausstieg beweist deshalb weder, dass Superintelligenz unmittelbar bevorsteht, noch dass eine Katastrophe unvermeidbar ist. Er ist ein ernstes Warnsignal über die Risikowahrnehmung eines Insiders.
Was jetzt praktisch zählt
Die sinnvolle Reaktion ist weder Panik noch Wegwischen. Labore können Fähigkeiten vor Veröffentlichung unabhängig testen lassen, Schwellenwerte für besonders riskante Fähigkeiten definieren, Vorfälle melden und klar festlegen, wann Training oder Deployment gestoppt wird. Politik kann Transparenz und Haftung schaffen, ohne jede KI-Anwendung gleich zu behandeln.
Einordnung
Die Debatte wird schnell emotional, weil sie existentielle Risiken berührt. Gute Entscheidungen brauchen überprüfbare Tests, veröffentlichte Sicherheitskriterien und institutionelle Gegenmacht. Coxons Schritt erhöht den Druck, genau diese Strukturen zu bauen.
💡 Im Klartext
Ein Ingenieur verlässt eine Autofirma, weil er glaubt, dass ein neues Fahrzeug zu schnell entwickelt wird und die Bremsen nicht ausreichend getestet sind. Das beweist keinen Unfall – aber es ist ein Grund, unabhängige Bremstests ernst zu nehmen.
Wichtigste Erkenntnisse
- →Coxons Ausstieg und Warnung sind breit und unabhängig berichtet
- →Seine Entscheidung ist ein relevantes Insidersignal, aber kein Beweis für unmittelbar bevorstehende Superintelligenz
- →Unabhängige Tests, Schwellenwerte und Stop-Regeln sind konkrete Antworten
Häufige Fragen
Hat Jacob Coxon bewiesen, dass KI die Menschheit auslöschen wird?
Nein. Er beschreibt ein Risiko und seine persönliche Einschätzung. Ein Beweis oder ein belastbarer Zeitpunkt folgt daraus nicht.
Was bedeutet selbstverbessernde KI?
Gemeint ist KI, die Forschung und Entwicklung der nächsten KI-Generation stark beschleunigt und dadurch eine Rückkopplung erzeugen könnte.