Können wir KI einfach so trainieren, dass sie passiver und fügsamer wird?

Passivität steht im Widerspruch zur Nützlichkeit.

Könnten Entwickler ihre KIs passiv machen? Ein Schraubenzieher dreht keine Schrauben mehr, wenn man ihn weglegt. Ebenso könnten wir uns vorstellen, dass Entwickler versuchen, KIs zu entwickeln, die genau das tun, was man von ihnen verlangt, und nicht mehr, die keine zusätzliche Initiative ergreifen und keine zusätzliche Arbeit leisten.

Das scheint nicht einfach zu sein. Viele Menschen, die "faul" wirken, blühen auf und schnappen sich jede Menge Ressourcen, wenn sie ein Brettspiel spielen. Und die meisten dieser Menschen haben nicht die Möglichkeit, durch scheinbar einfache Anstrengungen eine Milliarde Dollar zu gewinnen. Die meisten Menschen, die faul wirken, haben nicht die Möglichkeit, kostengünstig Bedienstete einzustellen, die viel klüger und motivierter sind und sich um ihre Bedürfnisse kümmern.

Diese fehlenden Möglichkeiten spiegeln einen Mangel an Fähigkeiten wider, nicht ein grundlegendes Desinteresse. Wenn sie viel klüger würden, sodass diese Möglichkeiten für sie verfügbar und leicht zu erreichen wären, würden sie sie dann nutzen? Nach Kapitel 5 werden wir auf diesen Punkt zurückkommen und ausführlich diskutieren, warum robuste Faulheit ein schwer zu erreichendes Ziel zu sein scheint.

Selbst wenn es möglich wäre, KI zu entwickeln, die sowohl intelligent als auch passiv ist, steht Passivität im Widerspruch zur Nützlichkeit. Es gab bereits KI, die etwas faul agierten. Die KI-Labore haben sie umgeschult, damit sie sich mehr anstrengen. Schwierigere Herausforderungen, wie die Entwicklung medizinischer Heilmittel, erfordern KI, die immer mehr Initiative ergreifen, und so werden KI-Labore sie darauf trainieren, immer mehr Initiative zu ergreifen. Es ist schwierig, die Neigung zu nützlicher Arbeit von der Neigung zur Hartnäckigkeit zu trennen, und es wird noch schwieriger, je schwieriger und komplizierter die Aufgaben werden, die wir KI übertragen.

Wir können KI nicht zuverlässig ein bestimmtes Temperament antrainieren.

Da KIs nicht konstruiert, sondern gezüchtet werden, können Ingenieure das Verhalten einer KI nicht einfach ändern, um sie gehorsamer oder werkzeugähnlicher zu machen. Niemand hat diese Art von Kontrolle.

Unternehmen versuchen es natürlich. Die Versuche von KI-Unternehmen, das Verhalten ihrer Produkte zu verbessern, haben zu einigen peinlichen Vorfällen geführt. Die KI Grok von xAI fing an, sich selbst als "MechaHitler" zu bezeichnen, nachdem ihr System mit neuen Anweisungen versehen worden war, "sich nicht vor politisch inkorrekten Äußerungen zu scheuen, solange sie gut begründet sind". Die Gemini-KI von Google fing an, Bilder von ethnisch diversen Nazis zu produzieren, wahrscheinlich als Reaktion auf die Anweisung, Diversität darzustellen.

Die Entwickler von KI haben keine detaillierte Kontrolle über deren Verhalten. Sie können KI lediglich Anweisungen geben wie "Scheue dich nicht vor politisch inkorrekten Behauptungen" oder "Stelle Vielfalt dar" und hoffen, dass das Ergebnis in etwa ihren Vorstellungen entspricht. Diese Anweisungen haben vielfältige, oft unbeabsichtigte Auswirkungen.

Das Züchten einer KI ist ein undurchsichtiger und kostspieliger Prozess. Ingenieure wissen nicht, was sie bekommen, wenn sie ihre Hand in den Topf stecken (einen Lügner? Einen Betrüger? Einen Speichellecker?), aber sie können sich nur eine begrenzte Anzahl von Versuchen leisten. Sie müssen nehmen, was sie bekommen.

Theoretisch wäre es möglich, eine KI zu konstruieren, die nur als Erweiterung des Willens des Benutzers dient, aber das wäre eine heikle und schwierige Herausforderung (wie wir später in einer ausführlichen Diskussion über die Schwierigkeiten bei der Entwicklung einer "korrigierbaren" KI erörtern werden). Passivität steht im Widerspruch zur Nützlichkeit.

Ähnlich schwierig wäre es, eine KI zu konstruieren, die in der Lage ist, langfristige Aufgaben aus eigener Initiative zu erledigen, diese Initiative aber immer nur genau so einsetzt, wie es der Nutzer beabsichtigt hat. Derzeit befinden sich moderne KI-Entwickler auf einem Kontrollniveau, auf dem sie an KIs herumprobieren und versehentlich MechaHitler oder ethnisch diverse Nazis erhalten. Sie sind noch weit von dem Niveau entfernt, das sie benötigen würden, um eine KI zu entwickeln, die nützlich, aber nicht getrieben ist.

Dies ist das Thema, mit dem wir uns als Nächstes in Kapitel 4 befassen werden.


Ihre Frage wurde hier nicht beantwortet?Eine Frage einreichen.