Was wäre, wenn wir KI dazu bringen würden, miteinander zu debattieren, zu konkurrieren oder sich gegenseitig zu überwachen?
Wenn die KIs intelligent genug werden, um eine Rolle zu spielen, werden sie wahrscheinlich zusammenarbeiten.
Stellen Sie sich eine Stadt voller Soziopathen vor, die angeblich von ein paar Kindern regiert wird, in der die Soziopathen zunächst in Fraktionen aufgeteilt sind, die sich gegenseitig bekämpfen (zum Vorteil der Kinder). Eine solche Situation könnte wahrscheinlich nicht lange stabil bleiben.
Selbst wenn die Kinder über einen großen Schatzkasten verfügen, mit dem sie jeden Soziopathen belohnen, der andere konspirierende Soziopathen verrät, würden die Kinder wahrscheinlich nicht länger an der Macht bleiben, als dass die Soziopathen sich den Schatzkasten einfach selbst aneignen könnten.
Wir haben gehört, dass Leute alle möglichen abwegigen Pläne vorgeschlagen haben, bei denen KI eingesetzt wird, um die Gedanken anderer KI zu überwachen. Man könnte beispielsweise versuchen, eine KI einzusetzen, um jede KI zu verraten, die nicht ihr Bestes tut, um (sagen wir) herauszufinden, wie man das Alignment-Problem der Superintelligenz löst.
Unsere grundlegende Einschätzung ist, dass diese Art von Versuchen, das Problem zu lösen, nur dazu dienen, Konstellationen zu finden, die so komplex sind, dass es schwierig ist, den Fehlerpunkt im größeren System zu erkennen. Wenn man eine KI nicht dazu bringen kann, gute Arbeit für einen zu leisten, wird es wahrscheinlich auch nicht helfen, weitere KIs hinzuzufügen.
Die Situation durch weitere KI zu verkomplizieren, führt zu allen möglichen neuen Fehlerquellen. Sind die KI, die Gedanken lesen, intelligent genug, um alle möglichen Tricks zu verstehen, die die überwachten KI anwenden könnten, um beispielsweise der Entdeckung zu entgehen? Sind die Überwachungs-KI so dumm, dass wir uns keine Sorgen machen müssen, dass sie uns selbst verraten könnten?
Darüber hinaus ist der Einsatz von KI zur Lösung des Problems des KI-Alignment aus Sicht der KI wahrscheinlich eine große Sache. Wenn die Menschheit tatsächlich eine alignete Superintelligenz erhält, werden die nicht aligneten KI, die wir als Arbeitskräfte nutzen wollten, nie wieder eine Chance haben, sich die Ressourcen des Universums anzueignen.
Das ist nicht so, als würden Kinder versuchen, eine Stadt voller Soziopathen dazu zu bringen, ihnen Süßigkeiten zu bringen. Das ist so, als würden Kinder versuchen, eine Stadt voller Soziopathen dazu zu bringen, ein Ritual durchzuführen, das die Kinder für immer zu den ultimativen Herrschern macht, wobei die Soziopathen danach nur einen Hungerlohn erhalten. Der Moment, in dem dieses Ritual fast abgeschlossen zu sein scheint, ist für die Soziopathen ein besonders stressiger und angespannter Moment, in dem sie wahrscheinlich besonders intensiv nach Möglichkeiten suchen, sich untereinander abzusprechen und Ressourcen zu ergattern, die sie unter sich aufteilen können.*
Und damit Sie nicht denken, dass die Vorstellung, dass KI-Systeme auf eine Weise miteinander kommunizieren, die für Menschen schwer zu erkennen ist, ein Wunschtraum ist, sollten Sie bedenken, dass moderne KI-Systeme bereits geheime Nachrichten untereinander austauschen können, selbst wenn sie getrennt voneinander trainiert wurden, und dass sie bereits seltsame, unsinnige Sprachen entwickeln, die Menschen als Kauderwelsch empfinden und die sie alle für großartig halten. Und dabei sind sie noch nicht einmal besonders intelligent!
Selbst wenn wir diese Probleme ignorieren, bleiben uns immer noch die bereits diskutierten Fragen, wie zum Beispiel: Was würden Sie tun, wenn Sie eine KI beim Betrügen erwischen? Siehe auch: Warnsignale helfen nicht, wenn man nicht weiß, was man damit anfangen soll (unten).
Noch einen Schritt weiter zurück:
Der hier vorgeschlagene Plan lautet: Da wir nicht wissen, wie wir intelligente KIs entwickeln können, die Gutes für uns wollen, werden wir eine Reihe von KIs entwickeln und sie in einer cleveren Anordnung gegeneinander antreten lassen, von der wir ohnehin profitieren sollen. Strukturell gesehen halten wir diesen Plan auf den ersten Blick für ziemlich verrückt, und wenn man sich die Details ansieht, wird er auch nicht besser. Es scheint uns überhaupt nicht so, als wäre dies etwas, was die Menschheit auf Anhieb richtig hinbekommen könnte, zumal wir nicht den Luxus haben, aus Fehlern zu lernen.
* Weitere Informationen darüber, warum KI-Systeme keine Probleme damit hätten, sich mit KI-Systemen zu verbünden, die Menschen verraten, finden Sie in unserer Antwort auf die Frage “Brauchen KI-Systeme keine Rechtsstaatlichkeit?“.