Wenn KI mit menschlichen Daten trainiert wird, macht sie das dann nicht eher empfänglich für menschliche Konzepte?

Ja, aber das hilft nicht viel.

Wenn man eine Million Affen an Schreibmaschinen setzt, werden sie nicht die gesammelten Werke von Shakespeare produzieren.

Wenn man seine Erwartungen drastisch herunterschraubt und sagt, dass man sich schon mit dem ersten Akt von Hamlet zufrieden gibt und Tippfehler durch die nächstliegende reale Wortform korrigiert, dann ist die Wahrscheinlichkeit, das Ziel zu erreichen, astronomisch viel größer! Und leider hat man trotzdem astronomisch viel Pech.

Es stimmt, dass KI heute mit Unmengen menschlicher Daten trainiert wird, dass sie mit Menschen interagieren kann und dass diese Tatsachen menschenähnliche Konzepte für das Denken der KI wichtiger machen. KI wie diese hat Fakten über die Wörter "Liebe", "Freundschaft" und "Güte" gelernt, die für die Vorhersage des nächsten Tokens relevant sind.

Aber KI sind keine Wesen, die eine große Anzahl menschlicher Wörter lernen und sich dann auf unsere Lieblingswörter konzentrieren, so wie wir sie wirklich meinen. Sie scheinen von einem komplexen Gewirr von Mechanismen angetrieben zu werden, das sich unter anderem darum bemüht, psychotische Menschen psychotisch zu halten, neben vielen anderen seltsamen und unbeabsichtigten Verhaltensweisen.

In Kapitel 4 haben wir argumentiert, dass eine fortgeschrittenere KI sich auf etwas Kompliziertes zubewegen wird, das davon abhängt, wo viele interne Kräfte ihr Gleichgewicht finden, selbst wenn die KI viel intelligenter geworden ist und sich in einem ganz anderen Kontext als ihrer Trainingsumgebung befindet.

Soweit menschenähnliche Konzepte kurze Wörter im mentalen Wörterbuch einer KI haben, könnten diese Konzepte irgendwie mit den Kräften verflochten sein, die die KI beleben. Einige Triebe, die vage mit Konzepten zusammenhängen, die eine schwache Beziehung zu menschlichen Konzepten haben, könnten sogar in der KI vorhanden sein, nachdem sie die Kluft zur Superintelligenz überwunden hat, wenn wir Glück/Pech haben. Aber man kann nicht einfach eine Reihe von englischen Wörtern zusammenwürfeln und daraus einen guten Satz von Antrieben für eine Superintelligenz erhalten.

Außerdem enden die meisten Methoden, um etwas, das uns wichtig ist, in die Präferenzen der KI zu integrieren, immer noch nicht gut für uns, wie wir im Fall der kindlichen Achtung diskutiert haben. Genau die richtige Art von Fürsorge ist ein enges Ziel.

Ihre Frage wurde hier nicht beantwortet?Eine Frage einreichen.