Warum würde es helfen, Menschen intelligenter zu machen?

Es könnte zur Lösung des Alignment-Problems beitragen.

Das KI-Alignment-Problem erscheint uns nicht als grundsätzlich unlösbar. Es scheint uns nur, dass die Menschen noch weit davon entfernt sind, es zu lösen, und dass sie noch nicht über die Intelligenz verfügen, um eine Lösung zu finden, die auch wirklich funktioniert.

KI-Forscher erkennen oft, dass das Alignment-Problem enorm schwierig erscheint und dass bisher nur sehr geringe Fortschritte erzielt wurden. Deshalb ist die Idee "Vielleicht können wir die KIs dazu bringen, unsere Alignment-Hausaufgaben für uns zu erledigen" so attraktiv: Wenn man als KI-Forscher das Gefühl hat, dass man selbst (und die Kollegen) einer bestimmten Aufgabe nicht gewachsen ist, liegt es nahe, auf KI zurückzugreifen.

Aber wie wir in Kapitel 11 und in einer damit verbundenen ausführlichen Diskussion erörtern, ist selbst aus der Perspektive eines Laien klar, dass diese Idee viele Probleme mit sich bringt: Damit eine KI herausfinden kann, wie ein tiefgreifendes Problem zu lösen ist, mit dem selbst die besten menschlichen Forscher große Schwierigkeiten haben, muss sie so intelligent sein, dass sie gefährlich wird. Und da wir nur sehr wenig Ahnung davon haben, was wir tun, haben wir keine Quelle für Grundwahrheiten, die wir direkt für das Training enger Alignment-Fähigkeiten nutzen können, und keine Möglichkeit zu überprüfen, ob ein von KI generierter Alignment-Vorschlag sicher oder effektiv ist.

Die Welt darf uns Probleme aufgeben, die legitimerweise außerhalb unserer Reichweite liegen. Die Natur ist kein Spiel, das der Menschheit nur "faire" Herausforderungen stellt; manchmal stoßen wir auf Probleme, die selbst für die besten Wissenschaftler zu schwer zu lösen sind oder die innerhalb des erforderlichen Zeitrahmens nicht gelöst werden können.

Gibt es eine realistischere Methode, das gesamte Problem an eine intelligentere Instanz weiterzugeben? Eine Möglichkeit wäre, die Menschen so intelligenter zu machen, dass sie das Alignment-Problem tatsächlich lösen können. Menschen sind in einer Weise "vorab ausgerichtet", wie es KI nicht ist; die intelligentesten Menschen haben die gleichen grundlegenden prosozialen Motivationen wie wir alle.

Grundsätzlich scheint es möglich zu sein, dass Menschen den Unterschied zwischen einer scheinbaren alchemistischen Erleuchtung, die ihnen die Umwandlung von Blei in Gold ermöglicht, und dem Wissen, das tatsächlich der Fähigkeit zur Umwandlung von Blei in Gold entspricht (unter Verwendung der Kernphysik, um einige Neutronen aus Bleiatomen herauszuschlagen), erkennen können. Sie sollten sich sicherlich wie unterschiedliche Wissenszustände anfühlen.

Aber echte Ingenieure haben große Schwierigkeiten zu erkennen, in welchem Bereich sie sich befinden. In der tatsächlichen Geschichte der Chemie war das Niveau der Menschheit so, dass die Alchemisten zuverlässig getäuscht wurden.

In der realen Welt hängen Wissenschaftler an ihren Lieblingstheorien und weigern sich, ihre Ansichten zu revidieren, bis die Realität ihnen wiederholt mit "Ihre Theorie war falsch" eins überbrät und manchmal weigern sie sich selbst dann noch, ihre Ansicht zu ändern: Manchmal wird gesagt, dass die Wissenschaft "mit jeder Beerdigung" voranschreitet, weil die alte Garde ihre Ansichten niemals ändern wird und man einfach darauf warten muss, dass die neue Garde reift. Dies ist jedoch keine grundlegende Einschränkung, die von der Natur auferlegt wird, sondern lediglich ein Problem der Menschheit als Spezies, die nicht klug, vorsichtig und selbstbewusst genug ist.

Normalerweise ist es in Ordnung, wenn Menschen in dieser Hinsicht naiv sind, denn normalerweise ist die Realität ziemlich nachsichtig mit Fehlern, zumindest in dem Sinne, dass sie nicht die gesamte Menschheit wegen der Hybris eines Alchemisten auslöscht. Aber diesen Luxus hat die Menschheit nicht, wenn es darum geht, maschinelle Superintelligenz in Einklang zu bringen.

Die Menschheit erlangt ihr Wissen oft durch Kämpfe, Versuche, Misserfolge und langsames Sammeln von Erkenntnissen. Aber das muss nicht so sein.

Einstein war nicht nur in der Lage, die allgemeine Relativitätstheorie zu entwickeln, sondern er gelangte zu dieser Erkenntnis, indem er intensiv über das Problem nachdachte, noch bevor die Menschheit Satelliten in die Umlaufbahn brachte und mit eigenen Augen Diskrepanzen in ihren Uhren feststellen konnte (wie in Kapitel 6 erläutert). Er verfügte über empirische Beweise, aber er war in der Lage, die richtige Antwort auf die ersten leisen Hinweise aus den empirischen Aufzeichnungen effizient zu finden, anstatt darauf zu warten, dass die Wahrheit an seine Tür klopfte.

Dieser Weg ist seltener und schwieriger zu beschreiten, aber diese Art von wissenschaftlichem Genie gibt es, wenn auch selten, selbst unter den Besten und Klügsten der Welt.

Menschen, die ein oder zwei Schritte über das Niveau von Forschern wie Einstein oder John von Neumann hinausgehen, könnten beginnen, ihre eigenen Fehler genau zu erkennen und sie auf Dutzende verschiedene Arten zu korrigieren.

Sie könnten bemerken, wenn sie rationalisieren oder Opfer einer Bestätigungsverzerrung werden. Sie könnten den Punkt überschreiten, an dem sie jemals erwarten würden, dass eine clever klingende Idee funktioniert, obwohl sie in Wirklichkeit nicht funktioniert, bis zu dem Punkt, an dem sie immer dann Erfolg haben, wenn sie Erfolg erwarten. Sie könnten ein Kompetenzniveau erreichen, bei dem sie zwar immer noch viele Fehler machen, aber in schwierigen neuen Bereichen nicht systematisch übermäßig selbstbewusst (oder unterbewusst) sind.

Ist die Steigerung der menschlichen Intelligenz wirklich möglich? Nach unseren Gesprächen mit einer Reihe von Biotech-Forschern, die vielversprechende kurzfristige Ansatzpunkte sehen, scheint uns dies der Fall zu sein. Sorgfältig ausgerichtete, auf Biotech fokussierte KI könnte ebenfalls dazu beitragen, die Arbeit zu beschleunigen. Aus unserer Sicht bleibt es jedoch sehr ungewiss, ob ein solcher Plan realistisch umgesetzt werden kann. Wir sind jedoch zuversichtlich, dass es sich um eine Option mit hohem Hebel handelt, die viel mehr Investitionen und Forschung verdient, als sie derzeit erhält.

Wir empfehlen die Verbesserung der menschlichen Intelligenz nicht als einzige Strategie für die Zeit nach dem Ende der KI, in die die Menschheit unserer Meinung nach massiv investieren sollte. Vielmehr ist dies nur eines von vielen Beispielen, das wir derzeit für das vielversprechendste halten. Wir empfehlen der Menschheit dringend, mehrere mögliche Wege ohne KI in Betracht zu ziehen, anstatt alles auf eine Karte zu setzen.

Augmentierte Menschen stellen kein großes Problem für das "menschliche Alignment" dar.

Augmentierte Menschen hätten im Wesentlichen die gleiche Gehirnarchitektur, Emotionen usw. wie wir anderen auch. Bei KI und selbst bei KI, die darauf trainiert ist, wie wir zu klingen, gibt es eine enorme Kluft in Bezug auf kognitive und motivationale Unterschiede und eine ähnlich große Verständnislücke. Bei etwas intelligenteren Menschen scheint nichts davon besonders wahrscheinlich zu sein.*

Kognitiv verbesserte Forscher müssten nicht ihre eigene mentale Integrität bewahren, während sie sich in riesige Superintelligenzen mit millionenfach größeren Gehirnen verwandeln. Sie müssten nur auf das erforderliche Niveau gebracht werden, um herauszufinden, wie man künstliche Superintelligenzen baut – nicht züchtet –, die wirklich aufeinander abgestimmt und stabil sind.

Es könnte immer noch ein "menschliches Alignment-Problem" im schwachen Sinne geben, da jede Bemühung, mehrere Menschen zu koordinieren, auf Principal-Agent-Probleme und Anreizprobleme stoßen kann. Und diese Probleme sind naturgemäß viel wichtiger bei jeder Gruppe, die mit der Schaffung von Superintelligenz beauftragt ist.

Wir gehen davon aus, dass diese Probleme lösbar sind, solange die Menschen von Anfang an sichtbar altruistisch und wohltätig sind, solange ihre Intelligenz nur langsam erweitert wird und solange sie in einer gut konzipierten Institution mit gut konzipierten Anreizen arbeiten. Aber es ist völlig verständlich, dass Menschen sich Sorgen über die Möglichkeit einer Machtübernahme machen. Die Lösung dieser Probleme wäre nicht unbedingt einfach, aber sie wäre nicht so grundlegend undurchführbar wie der Versuch von Unternehmen, undurchschaubare Superintelligenzen mit völlig unverständlichen Köpfen und unmenschlichen Trieben zu entwickeln.

Die Schaffung eines Elite-Teams aus gentechnisch veränderten Supergenies, das dabei helfen soll, den Planeten sicher durch den Übergang zur Superintelligenz zu navigieren, ist angesichts der hohen Risiken eines solchen Vorhabens definitiv etwas, das die Menschheit mit Bedacht angehen sollte. Ein solcher Schritt bringt verschiedene praktische und ethische Probleme mit sich, aber diese müssen gegen die Kosten abgewogen werden, die entstehen, wenn wir uns von der Superintelligenz alle töten lassen, wenn keine anderen Lösungen ähnlich vielversprechend erscheinen.

Drastische Zeiten können drastische Maßnahmen erfordern, aber eine (bescheidene) Steigerung der menschlichen Intelligenz ist nicht einmal eine besonders drastische Maßnahme. Es scheint sich um eine an sich positiv zu bewertende Technologie zu handeln, die zumindest eine gewisse Chance bietet, der Menschheit in mehrfacher Hinsicht zu helfen.

Wenn Sie daran interessiert sind, uns zu helfen, lassen Sie es uns wissen.

Wenn Sie über Fachkenntnisse in der Biotechnologie verfügen, die für die Steigerung der menschlichen Intelligenz nützlich sein könnten, laden wir Sie ein, sich über dieses Formular mit uns in Verbindung zu setzen. Das gilt gleichermaßen für Geldgeber, Forscher und politische Entscheidungsträger. Wir sind keine Experten für die relevanten Aspekte der Biotechnologie, aber wir haben Verbindungen zu verschiedenen Persönlichkeiten auf diesem Gebiet. Zumindest können wir vielleicht Geldgeber, Forscher und politische Entscheidungsträger miteinander in Kontakt bringen.

Wir können zusammenarbeiten, um Superintelligenz zu verhindern, auch wenn wir in Bezug auf die Verbesserung des Menschen unterschiedlicher Meinung sind.

Auch wenn Sie mit uns in Bezug auf die Idee der menschlichen Verbesserung nicht übereinstimmen, können wir uns dennoch darauf einigen, die Entwicklung der KI an der Grenze zu stoppen.

Wenn wir dieses Problem nicht lösen, sind alle tot. Jeder, der heute nicht sterben will, muss zu diesem Zweck kooperieren. Wir können warten, bis die unmittelbare Todesgefahr vorbei ist, um darüber zu streiten, ob die Verbesserung der menschlichen Intelligenz illegal sein oder subventioniert werden sollte.

"Menschen intelligenter als Einstein machen" ist kein Plan, um 2028 oder 2032 oder wann auch immer der nächste grundlegende Durchbruch bei KI-Algorithmen stattfindet, nicht zu sterben.

Es handelt sich nicht um einen Plan, der parallel zur Entwicklung der KI umgesetzt werden kann. Selbst wenn jemand medizinische Technologien nutzt, die von weniger intelligenten KI-Systemen entwickelt wurden, um die menschliche Intelligenz weit über das Niveau Einsteins hinaus zu steigern, würden diese Verbesserungen wahrscheinlich nicht ausreichen, um das Problem des KI-Alignment zu lösen und unter dem Zeitdruck eines Wettrüstens schnell und sicher maschinelle Superintelligenz zu entwerfen, zu entwickeln und aufzubauen. Der Wettlauf um Superintelligenz muss dennoch gestoppt werden.

Die Idee hinter der Erweiterung der menschlichen Intelligenz ist, dass es dadurch überhaupt möglich werden könnte, das Alignment-Problem zu lösen, wenn eine große Anzahl von aufgerüsteten Forschern auch über einen beträchtlichen Zeitraum von Jahren oder Jahrzehnten an diesem Problem arbeiten könnte. Die Idee ist nicht, dass sie in sechs Jahren den Wettlauf um den Bau einer ausgerichteten Superintelligenz gewinnen könnten, schneller als der Rest der KI-Industrie eine nicht ausgerichtete Superintelligenz bauen und einsetzen kann.

Viele Menschen, die "die menschliche Intelligenz erweitern" für einen relativ vielversprechenden Plan halten (wir selbst eingeschlossen), sind der Meinung, dass der erste Schritt immer noch darin besteht, die KI-Unternehmen zu schließen.

Diejenigen, die andere Pläne haben, was die Menschheit als Nächstes tun sollte, sind sich im Allgemeinen ebenfalls einig, dass der erste Schritt darin bestehen sollte, die KI-Unternehmen zu schließen.

Meta AI darf nicht existieren, OpenAI darf nicht existieren, Anthropic darf nicht existieren. Sie werden uns einfach umbringen. Wir können uns auf diese unmittelbare Priorität einigen, auch wenn wir sehr unterschiedliche Vorstellungen davon haben, was als Nächstes zu tun ist.

* Weitere Informationen darüber, warum KI, die darauf trainiert wurde, freundlich zu klingen, nicht freundlich sein wird, finden Sie in unserer Antwort auf die Frage „Werden LLMs nicht wie die Menschen in den Daten sein, mit denen sie trainiert wurden?“

Ihre Frage wurde hier nicht beantwortet?Eine Frage einreichen.