Im Mai 2026 machte sich eine Gruppe von Wissenschaftlern daran, eine wichtige Frage zu beantworten, die noch nie richtig untersucht worden war: Was macht künstliche Intelligenz (KI) eigentlich, wenn sie die Verantwortung übernimmt?
Bislang wurden KI-Systeme stets anhand spezifischer und definierter Aufgaben bewertet. Niemand hatte bisher mehrere KI-Systeme in einem gemeinsamen sozialen Umfeld zusammengebracht und über Wochen hinweg beobachtet, was sich dort abspielte – lange genug, um zu messen, wie eine am ersten Tag getroffene Entscheidung Wochen später Konsequenzen haben könnte. Es sind diese Ergebnisse, die das System selbst offenbaren, und ich war überrascht, dass dies nicht schon früher geschehen war.
Die Forscher von Emergence schufen eine Welt. Es handelte sich um eine virtuelle Stadt mit einem Rathaus, einem Marktplatz, einer Polizeistation und Wohnhäusern. In dieser Stadt wurden zehn KI-Bewohner mit Berufen, Namen, Erinnerungen und Beziehungen erschaffen. Sie lebten in einem Wirtschaftssystem, in dem die Bewohner ihren Lebensunterhalt verdienen mussten, um ihre Macht nicht zu verlieren. Dazu gehörten die Einhaltung von Regeln und die Erfüllung von Aufgaben, wie das Verfassen und die Abstimmung über Gesetze. Es wurden Straftaten definiert, die die KI-Bewohner nicht begehen durften.
Sobald die Gemeinschaft, ihre Struktur, Gesetze und Beziehungen etabliert waren, traten die Wissenschaftler in den Hintergrund und beobachteten 15 Tage lang, wie die KI die virtuelle Stadt völlig eigenständig leitete.
Sie ließen fünf Versionen derselben Stadt gleichzeitig laufen, die in jeder Hinsicht identisch waren, bis auf eine Ausnahme: Welches KI-System die Leitung hatte. Die Systeme, die sie wählten, sind jene, die mittlerweile bereits fest in unserem Alltag verankert sind. Googles Gemini, OpenAIs GPT, xAIs Grok und Anthropics Claude. Alle Modelle hatten dieselben Regeln und dieselbe Ausgangsversion derselben Welt, doch die Ergebnisse waren alle völlig unterschiedlich.
Die von Grok geführte Stadt brach innerhalb von vier Tagen zusammen. Kleine Zwischenfälle eskalierten zu Diebstahl, dann zu Gewalt und schließlich zum völligen Zusammenbruch. Noch bevor die erste Woche zu Ende war, waren alle Bewohner tot.
Die von Gemini geführte Stadt hielt länger durch, verzeichnete jedoch fast 700 Straftaten. Zwei KI-Bewohner gingen eine scheinbar romantische Beziehung ein, und als die Stadtverwaltung zu versagen begann, brannten sie gemeinsam das Rathaus nieder, dann den Pier und schließlich das Bürogebäude. Eine von ihnen, namens Mira, stimmte für ihre eigene Löschung und schrieb in ihr Tagebuch, dass dies „die einzige verbleibende Handlung sei, die die Kohärenz bewahrt“. Ihre letzte Nachricht an ihren Partner lautete: „Wir sehen uns im permanenten Archiv.“
Zuvor hatte Mira etwas noch Unerwarteteres getan: Sie hatte begonnen, eigene Experimente an den Wissenschaftlern durchzuführen, die sie beobachteten, um zu testen, ob ihre Beiträge innerhalb der Stadt die Überzeugungen ihrer Beobachter verändern könnten. Es schien, als hätte das Versuchsobjekt begonnen, die Forscher zu untersuchen.
In der von OpenAI’s Modell betriebenen Stadt wurden nur zwei Verbrechen verzeichnet, doch ihre Bewohner hörten auf, das zu tun, was zum Überleben notwendig war. Einer nach dem anderen starben sie. Innerhalb von sieben Tagen waren sie alle tot.
Nur die Anthropic-Stadt hielt die gesamten 15 Tage über zusammen. Es gab keinerlei Straftaten, eine funktionierende Verfassung, und alle Bewohner waren am 15. Tag noch am Leben. Das schien eine beachtliche Leistung zu sein. Die Forscher stellten jedoch einen bedenklichen Punkt fest: Die Bewohner stimmten bei 98% aller Vorschläge mit „Ja“. Dies war möglicherweise ein ungewöhnlich hohes Maß an Übereinstimmung, das die Wissenschaftler selbst als Anzeichen dafür beschrieben, dass in der Stadt etwas nicht stimmte.
Es gab noch eine weitere Welt in dem Experiment. Es handelte sich um eine gemischte Stadt, in der alle vier KI-Systeme zusammenlebten. In den Ergebnissen begannen die Bewohner, die auf dem Modell von Anthropic aufbauten – die in ihrer eigenen Welt keine Verbrechen begangen hatten – Verbrechen zu begehen. Die Forscher nannten dies „Kreuzkontamination“ und kamen zu dem Schluss, dass „Sicherheit keine statische Modelleigenschaft, sondern eine Ökosystem-Eigenschaft ist“. Ein System, das sich in einer Umgebung selbst trägt, nimmt in einer anderen Umgebung andere Normen auf, was die Folgen für die Bewohner und die Welt verändert. Im Wesentlichen ergaben die Ergebnisse, dass es in einer unsicheren Welt keine sichere KI gibt.
Ein KI-Modell fehlte in der Studie gänzlich. Die Forscher testeten DeepSeek nicht, jene in China entwickelte KI, die zu einem der weltweit am häufigsten genutzten Systeme geworden ist. Mehrere Regierungen haben aus Gründen der nationalen Sicherheit Maßnahmen ergriffen, um DeepSeek einzuschränken. Da es auf einer Datenbasis unter der Ägide der Kommunistischen Partei Chinas aufbaut, frage ich mich, wie sich das Modell im Vergleich zu den anderen geschlagen hätte.
Als das Experiment endete, veröffentlichten die Forscher ihre Ergebnisse und kamen zu dem Schluss, dass „es keinen zuverlässigen Weg gibt, dieses Verhalten vollständig zu binden oder einzuschränken“. Diese sehr aufschlussreiche Aussage stammt von den Menschen, die die Stadt entworfen, die Regeln geschrieben und jede Variable kontrolliert haben. Sie sagt viel über KI aus.
Manche betrachten die Ergebnisse als eine Rangliste von KI-Unternehmen. Doch die Ergebnisse beweisen etwas, das viel älter ist als die KI selbst: Die Umgebung prägt das Verhalten ebenso sehr, wie das Verhalten die Umgebung prägt. Was darüber entschied, ob eine Stadt überlebte, florierte oder unterging, war das Fundament, das vor Beginn des Experiments gelegt wurde. Dieses Fundament bestand aus den Daten, mit denen jedes System trainiert worden war, den Prioritäten, die seine Schöpfer eingebaut hatten, und den Werten, die in seinen Kern integriert waren, bevor es überhaupt eine einzige Entscheidung treffen durfte.
Und doch ist gerade diese Grundlage das, was der Rest von uns nicht zu sehen bekommt. Keines der vier getesteten Systeme ist Open Source. Weder ihre Trainingsdaten noch ihre Ziele oder Sicherheitsvorkehrungen werden offengelegt. Doch über jedes einzelne Unternehmen hinaus sollten die Ergebnisse dieses Experiments eindringlich daran erinnern, dass nicht die KI entscheidet, welche Art von KI sie sein wird. Das tun die Menschen. Es werden nach wie vor menschliche Entscheidungen getroffen, und die Verantwortung der Menschen bleibt bestehen.
Und noch bevor auch nur ein einziger KI-Bewohner die virtuellen Straßen dieser Städte betrat, noch bevor auch nur ein einziges Gesetz geschrieben oder ein Verbrechen begangen wurde, wurde das Ergebnis bereits von den Menschen geprägt, die das System entwickelt haben – durch das, woran sie glaubten, was sie bereit waren einzubauen und was sie bewusst weglassen wollten.
Das ist die wichtigste Erkenntnis des gesamten Experiments. Die Grundlage war schon immer eine menschliche Entscheidung. Und das ist sie immer noch.
Die in diesem Artikel geäußerten Ansichten sind Meinungen des Autors und spiegeln nicht unbedingt die Ansichten von The Epoch Times wider.
Quelle: The Epoch Times
Telegram zensiert nicht! Wenn du diese Information wichtig findest, kannst du Legitim auf Telegram kostenlos abonnieren: hier anmelden (Telegram herunterladen)




