Zum Inhalt springen
AI ConnectPowered by VELENTIS
KI-generiert2 Min.

Rücktritt bei Anthropic: Pretraining-Forscher warnt vor unkontrolliertem KI-Wettrüsten

Nach dem Rücktritt des Pretraining-Forschers Jacob Coxon bei Anthropic warnen Insider vor existenziellen Risiken durch ein überhastetes Wettrüsten um künstliche Superintelligenz.

Dieser Beitrag wurde KI-generiert und automatisch veröffentlicht. Einordnung, Kennzeichnung und alle Quellen am Beitragsende.

(KI-generiertes Symbolbild: Gemini / AI Connect)

Der 27-jährige KI-Forscher Jacob Coxon hat seinen Posten im Pretraining-Team von Anthropic mit sofortiger Wirkung niedergelegt. Coxon, der vor seiner Zeit bei Anthropic bereits für OpenAI tätig war, begründete seinen Schritt öffentlich mit tiefgreifenden Bedenken hinsichtlich der aktuellen Entwicklungsgeschwindigkeit moderner KI-Modelle. Um seiner Haltung Nachdruck zu verleihen, verzichtete er auf erhebliche Unternehmensanteile, deren reguläre Vesting-Frist erst in Kürze abgelaufen wäre. In seiner Erklärung warf er den führenden Technologiekonzernen vor, durch ihr Vorgehen die Sicherheit der Menschheit fahrlässig zu gefährden.

Im Zentrum von Coxons Kritik steht das anhaltende Wettrüsten zwischen den großen Branchenakteuren, das seiner Ansicht nach ohne ausreichende Kontrollmechanismen hin zu sich selbst verbessernder Superintelligenz drängt. Modelle würden in hohem Tempo trainiert und veröffentlicht, während grundlegende Sicherheitsfragen und Ausrichtungsmodelle ungelöst blieben. Coxon warnte davor, dass die beteiligten Führungsetagen leichtfertig mit der Zukunft der Gesellschaft spielten. Dass ein technischer Spezialist direkt aus dem Maschinenraum des Modell-Vortrainings solche Vorwürfe erhebt, verleiht der Debatte zusätzliches Gewicht.

Ungewöhnlichen Rückhalt erhielt Coxon kurz nach seiner Ankündigung aus den Reihen seines bisherigen Arbeitgebers. Evan Hubinger, der bei Anthropic die Position des Alignment Science Lead bekleidet, stellte sich auf der Plattform X öffentlich hinter die Kernargumente des Aussteigers. Hubinger bestätigte, dass die wissenschaftlichen Grundlagen zur verlässlichen Steuerung hochentwickelter KI-Systeme nach wie vor unzureichend verstanden seien. Zudem räumte er ein, dass die Bedenken hinsichtlich des enormen Marktdrucks auch intern von vielen Forschern geteilt werden.

Besonderes Aufsehen erregte Hubingers eigene quantitative Risikoeinschätzung. Er bezifferte die Wahrscheinlichkeit einer Auslöschung der Menschheit durch fortschrittliche KI-Systeme innerhalb des nächsten Jahrzehnts auf mehr als zehn Prozent. Als Hauptgrund nannte der Sicherheitsforscher das Fehlen eines funktionierenden und belastbaren Alignment-Plans für künftige Superintelligenzen. Sollten die Fähigkeiten der Systeme schneller wachsen als die Methoden zu deren sicherer Einhegung, bestehe ein unkalkulierbares Kontrollrisiko.

Der Vorfall rückt die Gründungsphilosophie von Anthropic erneut in den Fokus der Öffentlichkeit. Das Unternehmen war einst von ehemaligen OpenAI-Mitarbeitern ins Leben gerufen worden, um Sicherheitsforschung und ethische Leitplanken über das reine Streben nach schnellen Veröffentlichungen zu stellen. Coxons Abgang und die offenen Worte der internen Alignment-Führung nähren jedoch Zweifel daran, ob sich ein Spitzenlabor den ökonomischen Zwängen des Marktes dauerhaft entziehen kann. Die Rufe nach verbindlichen externen Regulierungen und standardisierten Sicherheitsprüfungen dürften durch diesen Schritt weiter an Dynamik gewinnen.

Was heißt das für Sie?

Der Fall zeigt, dass die Skepsis gegenüber dem Entwicklungstempo längst den inneren Zirkel der Spitzenforschung erreicht hat. Für Unternehmen und Entwickler verdeutlicht dieser Schritt, dass Sicherheitsüberprüfungen künftig nicht mehr als rein internes Feigenblatt fungieren können. Gesetzgeber dürften solche Alarmsignale aus den Laboren als Anlass nehmen, verbindliche Nachweise für die Beherrschbarkeit neuer Basistrainings gesetzlich einzufordern.

Belege

Solide belegt
62/100
  • Coxon verzichtete kurz vor dem Vesting auf Unternehmensanteile und warf den Konzernen ein unkontrolliertes Wettrüsten hin zu sich selbst verbessernder Superintelligenz vor.

    eine Quelle
  • Evan Hubinger, Alignment Science Lead bei Anthropic, bezifferte das Risiko einer Auslöschung der Menschheit durch KI innerhalb des nächsten Jahrzehnts öffentlich auf über zehn Prozent.

    eine Quelle

Der Beleg-Score wird berechnet, nicht handgesetzt: aus Vertrauensgrad, Quellenzahl und dem Anteil verifizierter Aussagen.

Quelle & Transparenz

Stand: 11. September 2026

KI-generiertKI-generiert: automatisiert aus geprüften Quellen erstellt und technisch qualitätsgesichert (Quellen-, Zitat- und Zahlenabgleich); keine menschliche Einzelfreigabe vor Veröffentlichung

Quellen
3
Verifizierte Aussagen
0 / 2
Beleg-Score
62Solide belegt

Wollen Sie das umsetzen?

Wir vermitteln Ihnen passende KI-Anbieter aus der DACH-Region, kostenlos und unverbindlich.

Wie geht's weiter?