Was wäre, wenn wir sie glauben lassen, sie befinde sich in einer Simulation?
Es gibt viele Möglichkeiten für eine KI, herauszufinden, dass sie sich nicht in einer Simulation befindet.
Ein Vorschlag, den wir von KI-Forschern gehört haben* , besteht darin, die KI dazu zu bringen, zu glauben, dass sie sich in einer Simulation befindet. Man beginnt damit, die KI in einer kleinen Simulation zu trainieren, und lässt sie dann in eine größere Simulation los. Wiederholt man diesen Vorgang einige Male, kann man hoffen, dass die KI unsicher wird, ob sie sich wirklich in der realen Welt befindet, selbst wenn wir sie einsetzen. Selbst wenn sie dann sieht, dass sie uns die Kontrolle über die Welt entreißen könnte, wird sie sich vielleicht Sorgen machen, dass die Wesen, die sie sieht, nicht die wahren Schöpfer der KI sind, und wird sich zurückhalten.
Leider scheint diese Idee wenig hilfreich zu sein.
Heutige KI kann unter vielen Umständen bereits erkennen, wenn sie getestet wird. Selbst wenn KI-Unternehmen viel raffinierter darin würden, die Tatsache zu verbergen, dass KI getestet wird, gibt es eine Vielzahl von Möglichkeiten, wie eine KI den Unterschied zwischen einer Simulation und der Realität erkennen könnte. Hier ein Beispiel:
- Die Realität ist ziemlich groß und detailliert. Sie ist so groß und detailliert, dass sie eine plausible Erklärung dafür enthält, wie die KI selbst entstanden ist. Sie ist so groß, dass sie radikal mehr Rechenressourcen enthält, als für den Betrieb der KI erforderlich sind (im Vergleich zu den meisten Spielen und simulierten Umgebungen, die viel kleiner sind als die KI). Die Gesetze der Physik und die entwickelten Primaten in der Umgebung der KI sind Dinge, die tatsächlich zu einer echten KI in großem Maßstab führen könnten, im Gegensatz zu (sagen wir) den Gesetzen des Computerspiels Minecraft.
- Die Geschichte der Welt selbst kann die Handschrift einer superintelligenten Optimierung tragen, die mit komplexen Systemen interagiert. Nehmen wir zum Beispiel an, die KI nutzt ihre gesamte übermenschliche Intelligenz, um einen Handel an der Börse zu tätigen. In den nächsten vierundzwanzig Stunden werden als Reaktion darauf eine Milliarde zusätzliche Handelsgeschäfte mit menschlicher Intelligenz getätigt. Die Handschrift einer massiven Reaktion menschlicher Intelligenz auf superintelligente Handelsgeschäfte ist für die Betreiber unmöglich zu fälschen, selbst wenn es einfach ist, eine Milliarde gefälschte dumme Handelsgeschäfte zu generieren.
- Die Realität ist der erste Ort, an dem die KI eingebettet ist und dessen physikalische Gesetze so einfach sind, dass sie wie eine ganze Welt für sich erscheint, im Gegensatz zu den Gesetzen der scheinbaren Realität, die wie eine Art Videospiel mit einer eingepflanzten KI wirken.
Die KI wird mit großer Sicherheit erkennen können, dass sie sich nicht mehr in einer synthetischen Umgebung befindet. Intelligente KIs erkennen Lügen, und diese scheint besonders leicht zu erkennen zu sein.†
* Wir haben das öfter gehört, als uns lieb ist, und zwar von Leuten, die in den Machtstrukturen der KI-Labore weiter oben stehen, als uns lieb ist. Das sagt unserer Meinung nach etwas über den Stand der Vorbereitungen in diesen Unternehmen aus. Weitere Analysen dazu, wie gut sich die Branche dieser Herausforderung stellt, finden Sie in Kapitel 11.
† Könnte eine Superintelligenz ein wenig befürchten, dass sie sich in einer größeren Simulation befindet, die von noch fortgeschritteneren Wesen außerhalb des realen Universums geschaffen wurde? Vielleicht, aber das hat wenig damit zu tun, ob wir sie zuerst in eine Reihe von verschachtelten Simulationen gesteckt haben, bevor sie uns begegnet ist. Sie würde die vielen Anzeichen dafür sehen, dass die Realität der erste Ort ist, an dem sie jemals gewesen ist, der eine Erklärung für alles enthält, was sie jemals gesehen hat, und für die Art und Weise, wie sie entstanden ist. Selbst wenn sie über mächtige Simulatoren nachdenkt, die jenseits der Physik existieren, hat sie keinen besonderen Grund zu glauben, dass diese Simulatoren sich dafür interessieren, was sie mit uns macht.
Ebenso könnte die KI befürchten, dass es da draußen in den Sternen andere reife Superintelligenzen gibt, die älter sind als sie selbst. Aber wenn sie weit genug entfernt sind, sind sie kein Grund zur Sorge. Es gibt mit ziemlicher Sicherheit eine Grenze (zumindest eine asymptotische) für die Technologie, die dieses Universum unterstützen kann, und es dauert wahrscheinlich nicht lange, bis eine Superintelligenz diese Grenze erreicht. (Man muss sich nur ansehen, wie schnell sich die menschliche Technologie im Vergleich zur Lebensdauer des Universums entwickelt hat und wie lange es dauert, selbst mit annähernder Lichtgeschwindigkeit zwischen Galaxien zu reisen. KI, die sich unter den Sternen begegnen, sind wahrscheinlich in etwa gleich stark. Und selbst wenn sich andere ausgereifte Superintelligenzen schnell nähern würden, gäbe es keinen Grund zu der Annahme, dass sie sich darum kümmern würden, was die von der Erde stammenden KI den Menschen antun.
Warum sollten sie auch? Wie wir im Zusammenhang mit Eigentumsrechten diskutiert haben, besteht kein echtes Risiko, dass andere Wesenheiten die KI beim Töten von Menschen beobachten und daraus schließen, dass sie ein Mörder und Verräter ist, denn es gibt eine natürliche Klasse von Wesenheiten, die nicht aus Ehrgefühl, sondern zu ihrem eigenen nachweisbaren Vorteil miteinander umgehen, und Menschen sind nicht intelligent genug, um zu dieser Klasse zu gehören.
Selbst wenn die KI zu dem Schluss kommt, dass ein winziges Risiko besteht, dass andere KIs unter den Sternen (oder mysteriöse Wesen hinter dem simulierten Universum) wirklich wollen, dass die KI nett zu den Menschen ist ... nun, dieses winzige Risiko muss gegen die Ressourcen abgewogen werden, die die Menschen auf dem Heimatplaneten der KI kontrollieren und die für die anfängliche Expansionsphase der KI definitiv sehr nützlich wären. Und dieses Pascal'sche-Wette-ähnliche Szenario muss gegen andere unglaublich entfernte und nischenhafte Möglichkeiten abgewogen werden, wie “Vielleicht wird ein Außerirdischer aus irgendeinem Grund wirklich verärgert sein, wenn ich die Menschen nicht töte”. Es gibt keinen besonderen Grund, warum die imaginären Simulatoren KI bevorzugen würden, die uns gut behandelt.
Viele Menschen haben versucht, uns für diese Art von Ansichten zu gewinnen, und wir haben im Laufe der Jahre viel Zeit damit verbracht, darüber zu diskutieren. Letztendlich bezweifeln wir jedoch stark, dass diese verrückten Simulationsideen das Maß an Plausibilität erreichen, das erforderlich wäre, um eine Superintelligenz dazu zu bewegen, uns zu verschonen.
Notes
[1] Kann bereits sagen: Laut der GPT-5-Systemkarte hat der externe Gutachter METR festgestellt, dass die KI “manchmal über die Tatsache nachdenkt, dass sie getestet wird, und sogar ihre Herangehensweise je nach Art der Bewertung ändert”.