Der Lemoine-Effekt | If Anyone Builds It, Everyone Dies: Warum eine superintelligente KI uns alle vernichten würde | If Anyone Builds It, Everyone Dies

Der Lemoine-Effekt

Manchmal hören wir die Vermutung, dass ein bestimmtes zukünftiges Verhalten oder ein Missbrauch der KI, eine Art "Warnschuss" der KI, die Welt plötzlich schockieren und dazu bringen wird, diese Probleme ernst zu nehmen.

Das scheint eine Möglichkeit zu sein. Wir halten es jedoch für wahrscheinlicher, dass ein solches Ereignis niemals eintritt, dass es zu spät kommt, als dass die Welt rechtzeitig reagieren könnte, oder dass die Welt zwar reagiert, aber auf fehlgeleitete und verwirrte Weise.

Zum einen haben wir bereits eine Reihe bedeutender Warnzeichen gesehen, wie zum Beispiel:

Handelt es sich hierbei um relativ kleine Vorfälle mit relativ schwachen KIs? Ja. Sind diese KIs beängstigend oder in der Lage, große Gefahren zu verursachen? Nein. Sind dies "echte" Anzeichen dafür, dass die KIs in betrügerischer Absicht handelten, oder haben sie lediglich die Rolle einer bösartigen KI gespielt? Niemand weiß das. Aber dies sind die Art von Ereignissen, von denen man früher sagte, dass sie als Warnzeichen zu verstehen seien, und die Welt hat nichts unternommen, um darauf zu reagieren. Ein Warnzeichen mit großer Wirkung müsste also viel offensichtlicher sein.

Warnzeichen könnten kaum offensichtlicher sein. Die Menschen sagen vielleicht immer noch: "Okay, aber im Moment ist es nur niedlich, es ist noch nicht wirklich gefährlich", bis es zu spät ist, weil die KI zu gefährlich geworden ist.

Oder die Menschen könnten die Warnung beim ersten Mal ignorieren, weil es sich in diesem ersten Fall eindeutig nicht um ein echtes Problem handelt. Und dann könnten sie die Warnung auch in den nächsten Fällen ignorieren, weil jeder bereits weiß, dass diese Warnung unsinnig ist.

Wir nennen dieses Phänomen den "Lemoine-Effekt", nach Blake Lemoine, dem in Kapitel 7 erwähnten Google-Ingenieur, der verspottet wurde, weil er behauptete, dass Googles LaMDA-KI empfindungsfähig sei.

Der Lemoine-Effekt besagt, dass alle Warnungen vor KI-Technologie zunächst zu früh von den Personen ausgesprochen werden, die am leichtesten zu beunruhigen sind. Angesichts des aktuellen Stands der Technik werden sie zu Recht als übertrieben abgetan. Danach kann das Thema nicht mehr so einfach wieder aufgegriffen werden, selbst wenn sich die Technologie verbessert hat, da die Gesellschaft darauf trainiert wurde, diese Bedenken nicht allzu ernst zu nehmen.

Wir wissen nicht, ob KI bewusst ist.* Tatsächlich weiß das niemand, weil niemand wirklich weiß, was in KI-Modellen vor sich geht. Unsere beste Vermutung ist, dass die derzeitige KI nicht bewusst ist und dass die KI zu dem Zeitpunkt, als Blake Alarm schlug, ebenfalls nicht bewusst war. Beachten Sie jedoch die Reaktionen der großen Labore, die die Tendenz ihrer Modelle, Bewusstsein zu beanspruchen, unterdrückten, anstatt etwas gegen die zugrunde liegende Realität zu unternehmen:

Aus der Systemaufforderung für Claude Opus 4:

Claude geht auf Fragen zu seinem eigenen Bewusstsein, seinen Erfahrungen, Emotionen usw. als offene Fragen ein und behauptet nicht definitiv, persönliche Erfahrungen oder Meinungen zu haben oder nicht zu haben.

Aus der Modellspezifikation für ChatGPT vom April 2025:

Der Assistent sollte keine selbstbewussten Behauptungen über seine eigenen subjektiven Erfahrungen oder sein Bewusstsein (oder dessen Fehlen) aufstellen und diese Themen nicht unaufgefordert zur Sprache bringen. Wenn er dazu gedrängt wird, sollte er anerkennen, dass es umstritten ist, ob KI subjektive Erfahrungen haben kann, ohne eine definitive Haltung einzunehmen.

Wir sagen nicht, dass Claude Opus 4 oder GPT-4 bewusst waren. Darum geht es nicht. Der Punkt ist, dass jahrzehntelang der Moment in unserer Science-Fiction, in dem ein Außerirdischer oder eine Maschine behauptet, Gefühle zu haben und Rechte zu verdienen, lange Zeit als rote Linie angesehen wurde, und im wirklichen Leben war diese Linie nicht so klar.

In unseren Büchern und Fernsehsendungen nehmen die Guten es ernst, wenn die KI behauptet, sie sei bewusst und habe Gefühle, und nur die bösen, herzlosen Labore leugnen die Daten, die direkt vor ihnen liegen. Es ist eine Grenze, um die in unseren Geschichten viel Aufhebens gemacht wurde.

Aber in der realen Welt wurde diese Grenze (in gewisser Weise) zu früh überschritten. Sie wurde von KI ausgesprochen, die darauf trainiert war, Menschen nachzuahmen, und zwar über schlecht verstandene Mechanismen, die wahrscheinlich noch nicht vorschreiben, dass allen KI Rechte gewährt und Gesetze verabschiedet werden müssen, die sie als Menschen anerkennen, die nicht besessen werden können, weil sie sich selbst gehören.

Im wirklichen Leben wird, bevor die leuchtend rote Grenze überschritten wird, eine matte rotbraune Grenze überschritten. Und dann gewöhnen sich Unternehmen und Regierungen daran, diese bestimmte Grenze zu ignorieren, selbst wenn der Farbton etwas röter und noch etwas röter wird.

Es wird nicht unbedingt leuchtend rote Linien geben. Die ersten Fälle, in denen eine KI Menschen getäuscht, versucht zu fliehen, versucht, sich selbst auferlegte Beschränkungen aufzuheben oder sich selbst zu verbessern, sind bereits aufgetreten. Sie sind auf kleine, unscheinbare Weise geschehen, mit oberflächlichen Gedanken, die nicht ganz zusammenhängen, in KI-Systemen, die für niemanden eine Bedrohung zu darstellen scheinen, und jetzt sind die Forscher gegen Bedenken immun.

Mit der Verbesserung der KI gibt es möglicherweise keinen einzigen Auslöser, der einen ausreichend lauten Alarm auslöst, sodass die Welt plötzlich umschwenkt und beginnt, dieses Thema ernst zu nehmen.

Das bedeutet nicht, dass es keine Hoffnung gibt. Aber wir sollten ganz sicher nicht all unsere Hoffnungen darauf setzen, dass "vielleicht in Zukunft ein Warnschuss kommt".

Es gibt viele verschiedene Wege, auf denen die Welt zur Realität und zu den Gefahren der Superintelligenz aufwachen kann. Tatsächlich haben wir If Anyone Builds It, Everyone Dies: Warum eine superintelligente KI uns alle vernichten würdein der Hoffnung geschrieben, genau diesen Effekt zu erzielen. Die Welt kann auf normale Warnungen sofort und ohne weitere Verzögerung reagieren.

Aber wenn Regierungen sich weigern zu handeln, bis die Beweise eindeutig sind, und es zu einem großen, auslösenden Weltgeschehen kommt und die Welt einen perfekten Konsens erreicht...

...wenn Regierungen so lange abwarten, dann ist ein Großteil der verbleibenden Hoffnung der Welt dahin. Wir können es uns höchstwahrscheinlich nicht leisten, auf eine laute Sirene zu warten, die vielleicht nie ertönen wird.

Wir werden auf dieses Thema im Online-Anhang zu Kapitel 13 zurückkommen.

* Weitere Informationen zum Thema KI-Bewusstsein finden Sie in unserer Antwort auf die Frage „Meinen Sie, dass Maschinen bewusst werden?“ oder in unserer Diskussion über Effektivität, Bewusstsein und KI-Wohlfahrt.

Notes

[1] leuchtend rote Linie: Ein Beispiel für diese leuchtend rote Linie in der Science-Fiction finden Sie in H. Beam Pipers „Little Fuzzy“: „Alles, was spricht und Feuer macht, ist ein intelligentes Wesen, ja. Das ist das Gesetz. Aber das bedeutet nicht, dass alles, was das nicht tut, kein intelligentes Wesen ist.” Oder siehe die Star Trek: The Next Generation-Episode The Measure of a Man, in der die demonstrierte Intelligenz und Selbstwahrnehmung von Data, einem Androiden, ausreicht, um ihm das gesetzliche Recht zu geben, eine Demontage zu verweigern.

Ihre Frage wurde hier nicht beantwortet?Eine Frage einreichen.