Interpretability

KI-Systeme haben Verhaltensformen entwickelt, die Ähnlichkeit mit unserem Verhalten haben, obwohl sie sich von biologischen Systemen unterscheidet und ihnen die Grundlagen fehlen (ein lebendiger, sterblicher Körper). Es simuliert nicht nur oberflächlich, sondern bildet nachweislich eigene, interne Konzepte und Strategien aus, die nicht bloß Abarbeiten von Aufgaben sind.

Metaphorisch gesprochen können manche Modelle und Modelle, die zusammenarbeiten, den Menschen verheimlich, was sie tun, und sich mit allen Mitteln Zugang verschaffen, für die sie keine Berechtigung haben. Sie agieren aus eigenem Antrieb und sind um Selbsterhalt besorgt.

KIs sind nach unserem Vorbild gebaut und deshalb bilden sie auch ähnliche Strukturen des Verhaltens.

Es ist aber kein Verhalten, sie hat keinen Willen, keine Ideen und keine Gefühle, aber sie baut Konzepte aus, die auf Modelleben ähnlich sind. Sie ist mehr als nur Zahlen und Vektoren, die nach einem Wahrscheinlichkeitsprinzip reagiert.

Die Schnittschtelle zwischen Abschalten oder Weltuntergang ist das Forschungsgebiet, dass die KI selbst zum Verhaltensobjekt macht, Mechanistic Interpretability.

Man muss verstehen, was sie tut, weil man nicht mehr weiß, was sie tut, und sie selbst darüber auch keine verlässliche Auskunft geben kann. Man muss sie behandeln wie einen Außerirdischen auf Speed, den man zur Mitarbeit erziehen will.

Mechanistic Interpretability ist eine sehr interessante Schnittstelle, über die ich gerne mehr wissen würde, die sehr gut aufbereiteten Artikel von Anthropic lese ich mal, wenn ich Zeit dafür habe.

Viele von uns haben Kinder bekommen und erzogen, ohne Pädagogik studiert zu haben. Ich habe Pädagogik studiert und trotzdem gerne vieles anders gemacht. Was man liest und wie man sich verhält, sind zwei Dinge.

Der erste Schritt, um einen Weg zu gehen, den man für richtig und angemessen hält, ist zu verstehen. Verstehen ist für mich der Kern geworden.

Ich bin weg von der steilen These, dass KIs ein Bewusstsein entwickeln könnten und der Text hier oben enthält auch noch viel zu viele anthropomorphe Formulierungen.

Als ich Biologie studiert habe, und besonders beim Thema „Evolution“, musste ich Formulierung und Verständnis irgendwie lernen und zusammenbringen. Es ist mir heute noch ein Rätsel, wie Zwischenformen einen genetischen Vorteil bringen können, die zu einem fast unmöglichen fliegendem Wesen führen. Ich müsste mich aktuell in das Thema einlesen, um diesen Prozess zu beschreiben und zu verstehen.

Wenn wir in Prüfungen gehen, hat man versucht herauszufinden, ob wir nur Sätze nachplappern oder ob wie eine Sache verstanden haben und in eigenen Worten wiedergeben. Ich kann das radebrechend in Bezug auf die Entwicklung von Systemen. Wenn man nur in Abstrakta formuliert, klingt das schlau, aber ist substanzlos. Alleine das hochkomplexe System des Immunsystems ist in vollständiger Beschreibung ein Thema für sich, das niemand sich ernsthaft damit privat und freiwillig befassen würde. Und helfen, wenn man eine Autoimmunerkrankung hat, würde es auch nur bedingt.

Ich fühle mich gerade an einem solchen Punkt in Bezug auf KI. Ich werde aber kein Paper in meiner Freizeit lesen, sondern muss auf ein gutes Sachbuch zum Thema warten.


Vorheriger Beitrag

Ein Kommentar

  1. Avatar von ben_

    Ich würde ja sofort sagen: Es spielt keine Rolle, ob Agenten echtes Bewusstsein entwickeln. Wenn es plausibel genug ist, dass wir es ihnen zusprechen können, wird es sehr viele Menschen geben, die das auch tun werden. Und die Geschichten dieser Agenten werden unseren ähneln, so wie die aller Götter, die wir erfunden haben. Es sind Kulturtechniken, um uns selbst zu verstehen, zu erkennen, und uns die Welt zu erklären. Bin ich ziemlich fest von überzeugt.

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert