Anthropic-Insider warnen: AI könnte die Menschheit auslöschen
TL;DR
Drei Anthropic-Forscher haben öffentlich vor unkontrollierter AI gewarnt und halten es für möglich, dass sie die Menschheit noch in diesem Jahrzehnt auslöscht. Jacob Coxon kündigte am Dienstag und schrieb auf X, die Leute, die AI bauen, glaubten das ernsthaft, und das sei kein Marketing-Stunt. Evan Hubinger, Leiter der Alignment-Forschung bei Anthropic, bestätigte das und beziffert sein persönliches Risiko auf über 10 Prozent im nächsten Jahrzehnt.
Nauti's Take
Dass Forscher aus dem Inneren eines Labors ihre Risikoeinschätzung offenlegen, ist ein Fortschritt für die Debatte, denn solche Zahlen bleiben sonst hinter verschlossenen Türen. Problematisch bleibt, dass Anthropic weiter an genau den Systemen baut, vor denen es warnt, und für Alignment bei Superintelligenz noch keinen belastbaren Plan vorlegt.
Im Arbeitsalltag ändert das vorerst nichts, wer aber Governance oder AI-Compliance verantwortet, sollte die Begründungen der Forscher genau lesen.