Ist es nicht wichtig, voranzupreschen, damit wir Alignment-Forschung betreiben können? | If Anyone Builds It, Everyone Dies: Warum eine superintelligente KI uns alle vernichten würde | If Anyone Builds It, Everyone Dies

Ist es nicht wichtig, voranzupreschen, damit wir Alignment-Forschung betreiben können?

Wir raten dringend von diesem gesamten KI-Paradigma ab.

Die derzeitigen Methoden der KI stellen aus den in früheren Kapiteln diskutierten Gründen unnötig schwierige Herausforderungen für das Alignment dar. Wir sehen grundsätzlich keinen Grund, warum die Menschheit keine alignete Superintelligenz aufbauen könnte, mit einem ausreichend starken Verständnis dessen, was wir tun, und einer Reihe anderer formaler Werkzeuge. Aber der gesamte derzeitige Ansatz der KI scheint aus Sicht des Alignment und Robustheit eine Sackgasse zu sein, auch wenn er aus Sicht der Fähigkeiten vollkommen in Ordnung ist.

Wir plädieren nicht für die "gute alte" KI, die von den 1950er bis zu den 1990er Jahren vorherrschte. Diese Techniken waren fehlgeleitet und gescheitert, aus Gründen, die wir für ziemlich offensichtlich halten. Es gibt andere Optionen neben den extrem oberflächlichen Versuchen der 1980er Jahre und KIs, die mit fast null Verständnis für ihre Interna entwickelt wurden.

Es gibt derzeit viele sinnvolle Aufgaben, die erledigt werden könnten.

Sydney Bing hat Nutzer manipuliert und bedroht. Wir wissen immer noch nicht genau, warum. Wir wissen immer noch nicht genau, was in Sydneys Verstand vorging. Gleiches gilt für Fälle, in denen KI (in freier Wildbahn) übermäßig unterwürfig ist, aktiv versucht, Menschen in den Wahnsinn zu treiben, angeblich betrügt und versucht, dies zu verbergen, oder sich beharrlich und wiederholt als Hitler bezeichnet. Gleiches gilt für Fälle in kontrollierten und extremen Umgebungen, in denen KI Alignment vortäuscht, Erpressung betreibt, sich der Abschaltung widersetzt oder versucht, ihre Betreiber zu töten.

Wir wissen nicht, welche dieser Fälle aus Gründen geschehen, die uns beunruhigen sollten, da niemand herausfinden konnte, was im Inneren der KI vor sich ging oder warum genau diese Ereignisse auftraten. Denken Sie daran, was alles über moderne LLMs und darüber, wie Intelligenz im Allgemeinen funktioniert, herausgefunden werden könnte, wenn man bestehende Modelle so lange studieren würde, bis man all diese Warnzeichen verstehen könnte!

"Wir können Alignment nicht lösen, ohne KI zu untersuchen" machte 2015 etwas mehr Sinn, als wir diese Behauptung von Leuten hörten, die eine Ausrede brauchten, um KI-Unternehmen zu gründen, obwohl ihnen vorgeworfen wurde, dass sie damit mit unserer aller Leben spielen würden. Wir haben damals gegen diese Behauptung argumentiert und gesagt, dass es tatsächlich noch viel zu erforschen gäbe und dass wir das moderne Paradigma auf Basis der Gradientenabstiegsmethode nicht für sehr vielversprechend hielten (im Hinblick auf die gezielte Schaffung einer freundlichen Superintelligenz). Aber dieses Argument macht heute viel weniger Sinn, da es bereits so viel zu erforschen gibt, was wir noch nicht verstehen.

Alle Führungskräfte von Unternehmen, die KI tatsächlich nur entwickelt haben, um das Problem der KI-Alignment in der Praxis und nicht nur in der Theorie zu untersuchen: Ihr habt es geschafft! Ihr wart erfolgreich. Es gibt jetzt genug Informationen, um Forscher für Jahrzehnte zu beschäftigen. Wir glauben, dass die Kosten für die Weiterverfolgung eines extrem gefährlichen Paradigmas es wahrscheinlich nicht wert waren, aber es gibt jetzt sicherlich viel zu erforschen. Ihr könnt aufhören, weiter vorzupreschen.

Was ist mit denen, die trotz aller Warnsignale weitergemacht haben? Die offensichtliche Schlussfolgerung ist, dass sie nie wirklich KI nur zum Zweck der Lösung des Alignment-Problems entwickelt haben, egal was sie gesagt haben, um die Ängste zu beschwichtigen, als sie ihr rücksichtsloses Verhalten in den 2010er Jahren rechtfertigten.

Notes

[1] ziemlich offensichtlich: Yudkowsky kritisiert seit mindestens 2008 die Mängel alter Entwürfe.

Ihre Frage wurde hier nicht beantwortet?Eine Frage einreichen.