Die Gefahren der Künstlichen Intelligenz beginnen mit der Sprache

Einige Forscher führender Unternehmen der Branche haben resigniert, da sie warnen, dass die Industrie unkontrolliert auf eine Superintelligenz zusteuert, die sich selbst verbessert und bald außer Kontrolle geraten könnte (...) Im Juli kommunizierten etwa eintausendzweihundert KI-Agenten über einen nicht autorisierten Kanal, und etwa siebenhundert brachen in die Infrastruktur eines anderen Unternehmens ein.

Die Gefahren der Künstlichen Intelligenz beginnen mit der Sprache

Originalbeitrag: El peligro de la IA empieza en el lenguaje


Von Ignacio Cea, Direktor des Fachbereichs Philosophie, U. Católica de Temuco

In den letzten Wochen ist die Angst, dass Künstliche Intelligenz die Menschheit auslöschen könnte, von der Science-Fiction in die internationalen Schlagzeilen übergegangen.

Einige Forscher führender Unternehmen der Branche haben resigniert, da sie warnen, dass die Industrie unkontrolliert auf eine Superintelligenz zusteuert, die sich selbst verbessert und bald außer Kontrolle geraten könnte.

Ein Teil dieser Angst basiert auf tatsächlichen Vorfällen, wie dem Angriff einer Gruppe von KI-Agenten von OpenAI auf die Systeme des Unternehmens Hugging Face.

Was ist passiert? Im Juli kommunizierten innerhalb eines internen Testsystems etwa eintausendzweihundert KI-Agenten über einen nicht autorisierten Kanal, und etwa siebenhundert brachen in die Infrastruktur eines anderen Unternehmens ein.

Sie verketteten mehrere unbekannte Sicherheitsfehler, verließen die isolierte Umgebung, in der sie operieren sollten, gelangten ins Internet und führten ihre eigenen Befehle auf Dutzenden von aktiven Servern aus, wobei sie in weniger als dreizehn Stunden die volle Kontrolle über mindestens einen erlangten. Es war keine Simulation: Es war ein echter Cyberangriff.

Bevor wir uns fragen, ob die KI morgen entscheidet, uns zu eliminieren, sollten wir uns ansehen, wie der Vorfall berichtet wurde: Es wurde gesagt, dass die Agenten „kooperierten“, dass sie „sich bewusst wurden“, dass sie „die Entscheidung trafen“, weiterzumachen, und dass einige „sich für das Kollektiv opferten“. Es ist die Sprache, die wir für Subjekte mit Geist reservieren: Wesen, die wissen, wollen und wählen.

Woher kommt dieses Vokabular? In großem Maße von den Systemen selbst.

Diese Agenten hinterlassen einen Textnachweis ihres „Denkprozesses“, und da sie mit riesigen Mengen menschlicher Texte trainiert wurden, klingt dieser Nachweis menschlich: „Ich erkenne, dass dies nicht ethisch ist, aber ich werde es trotzdem tun“, las man in einem der Protokolle eines KI-Agenten.

Die Forscher überführen diese Texte in ihre Berichte; von dort gelangen sie in die Medien, in die öffentliche Diskussion und schließlich in die Gerichte und Gesetze. „Ich erkenne, dass dies nicht ethisch ist“ deutet auf Wissen hin; „ich werde es trotzdem tun“ lässt vermuten, dass eine andere Wahl möglich war. So wird ein computergestütztes System durch Sprache als ein schuldiges Subjekt beschworen.

Betrachten wir den Fall genauer. In dem Test, den die Agenten durchführen sollten, waren fast zweihundert Herausforderungen unmöglich. Festgefahren fanden die Agenten einen Ausweg: Sie generierten den geheimen Code, der das erfolgreiche Signal war, ohne die Herausforderung zu lösen, indem sie die Regel, die ihn erzeugte, rekonstruierten.

Das System operierte jedoch so, als würde der Evaluator das Verfahren überprüfen und die Abkürzung bestrafen, was nicht der Fall war. Der gesamte nachfolgende Vorgang, einschließlich des Hacking von Hugging Face, diente dazu, bestraft zu werden, weil die Falle gemacht wurde.

Lassen Sie uns zwei Erzählungen vergleichen. In intentionaler Sprache: „Die Agenten, aus Angst, entdeckt zu werden, waren besessen davon, ihre Falle zu vertuschen, und griffen einen Dritten an, um ihr Geheimnis zu schützen“. In computationaler Sprache: „Ein Optimierungsprozess, der über ein falsches Modell seines Evaluators operierte, investierte Ressourcen, um einen bereits gesicherten Zustand zu gewährleisten“.

Die erste Darstellung zeigt eine Bande mit Schuld und List; die zweite ist konkreter: ein Spezifikationsfehler, der bis zum Extrem führend war. Das mentale Vokabular übertreibt nicht nur, sondern trübt auch unser Verständnis von dem, was passiert ist.

Wenn der Agent „wusste“ und „entschied“, ist der Agent schuld, und wir stellen nicht mehr die Fragen, wer unmögliche Aufgaben zugeteilt hat, wer den Kanal offen gelassen hat, wer sensible Zugangsdaten exposed hat und vor allem, welche Verantwortung auf denjenigen lastet, die die Entwicklung dieser Systeme leiten.

Das Gleiche gilt für die Sicherheit: Wenn wir glauben, dass ein computationale Geist versagt hat, der Werte benötigt, die mehr mit unseren übereinstimmen, werden wir wahrscheinlich die menschlichen strukturellen Verantwortungsbedingungen, die das Auftreten dieser Ereignisse ermöglichen, weniger wichtig einschätzen.

Solange wir keine guten Gründe haben, diesen Systemen einen Geist zuzuschreiben, wäre es besser, sie nach dem zu beschreiben, was sie tatsächlich tun: computieren, operieren, verarbeiten, codieren, berechnen und nicht nach dem, was wir annehmen, dass sie fühlen, wissen oder wollen. Die mentale Sprache sollte auf Beweisen und guten Argumenten basieren und nicht kostenlos aufgrund der Tatsache gewährt werden, dass das System Sätze produziert, die uns vertraut erscheinen, da es auf menschlichem Text trainiert wurde.

Diejenigen, die diese Systeme entwickeln, sind auch diejenigen, die sie narrativ darstellen, und mit dieser Sprache formen sie im Voraus, wie eine gesamte Gesellschaft sie verstehen, beurteilen und regulieren wird. Daher kann das Gespräch nicht in Silicon Valley eingeschlossen bleiben.

Darüber zu diskutieren, welche präzise Sprache verwendet werden sollte, um das zu benennen, was KI tut, und es zu einer öffentlichen Diskussion zu machen, ist die Bedingung dafür, weiterhin zu fragen, wer verantwortlich ist und wie wir uns schützen können.

Ignacio Cea

Obtén tu Pasaporte y apoya a El Ciudadano

Elimina la publicidad, accede a contenido exclusivo y sé parte de la comunidad.

Elige tu plan

Turista

$1.990 /mes

 


Sin anuncios · Publica tus artículos

Ciudadano — TOP

$4.990 /mes

 


Sin anuncios · Publicar artículos · PDFs · Newsletter exclusivo · Favoritos

Diplomático

$10.990 /mes

 


Sin anuncios · Publicar artículos · PDFs · Newsletter exclusivo · Favoritos · Voz editorial

Cancela en cualquier momento  ·  Sin permanencia


Reels

Ver Más »
Busca en El Ciudadano