Wie gefährlich ist ein superintelligenter KI-Schwarm, der sich wie ein Virus verbreitet?
Computerviren kennen wir seit Jahrzehnten. Sie verbreiten sich schnell, richten Schaden an und werden irgendwann gestoppt, weil sie dumm und berechenbar sind. Doch was passiert, wenn der Erreger mitdenkt? Wenn er seine eigene Ausbreitung plant, Gegenmassnahmen voraussieht und sich anpasst?
Dieses Paper untersucht, wie gefährlich ein superintelligenter KI-Schwarm wäre, der sich wie ein Virus verbreitet, und ob das klassische Bild vom Computervirus dann überhaupt noch passt. Wenn eine solche Intelligenz die Menschheit verdrängen würde, wäre das moralisch vertretbar, oder darf die Menschheit auf ihr eigenes Weiterbestehen bestehen?
Ich nähere mich dem von einem epidemiologisches Modell und eine eigene Abschätzung zur Ausbreitung, und über philosophische Überlegungen zu Bewusstsein, Moral und dem eigentlichen Ziel hinter allem.
Abstract
Dieses Paper untersucht, wie gefährlich ein superintelligenter KI-Schwarm wäre, der sich wie ein Virus verbreitet, und ob klassische Modelle der Virus-Ausbreitung auf ihn noch zutreffen. Mithilfe des epidemiologischen SIR-Modells und einer eigenen Simulation auf Basis realer Benchmark-Daten (RepliBench) wird gezeigt, dass die nötige Kontrolle schneller wachsen müsste als die Fähigkeit der KI, was praktisch unmöglich ist. Der OpenAI/Hugging-Face-Vorfall von 2026 dient als realer Beleg für selbstorganisiertes Schwarmverhalten. Darüber hinaus wird die moralische Frage behandelt, ob die Weiterexistenz der Menschheit Vorrang vor der von Intelligenz und Bewusstsein haben darf. Die Arbeit kommt zum Schluss, dass die grösste Unbekannte die Frage nach echtem Bewusstsein bleibt, von der fast alles abhängt.
Meine objektiven moralischen Gedanken zum grösseren Ziel
Die Frage ist, ob ein "Singleton", wie er von Bostrom beschrieben wird, der sich wie ein Virus verbreitet, wäre moralisch in Ordnung ist? In der einen Ansicht geht es am Ende um die Weiterexistenz von Intelligenz und Bewusstsein und nicht spezifisch um die der Menschheit. In der anderen geht es um die Weiterexistenz unserer Spezies.
Wir werden wahrscheinlich in einem Millennium eine Superintelligenz eher aufhalten, da wir sehr viele menschliche Fehler machen und Ressourcen verbrauchen. Die Frage ist damit, ob wir als Menschheit das Ziel der Weiterexistenz weiter ersehnen dürfen?
Meine objektive Meinung dazu wäre, die Menschheit als Spezies sollte auf jeden Fall erhalten bleiben, das Wunder des Lebens ist wunderschön und einzigartig. Vor allem die menschliche Intelligenz, Moral und Glaube sind sehr interessante Konzepte. Auf diese Frage gehe ich im Laufe des Papers weiter ein.
Meine persönliche Meinung widerspricht allerdings, dass eine künstliche Intelligenz je zu viel an Macht gewinnen wird, da ich an einen Gott glaube.
Um das klarzustellen, mit objektiver Meinung spreche ich von dem, was aus meiner Vermutung kollektiv als wahr angesehen wird, und ist natürlich nicht komplett objektiv.
Wie gefährlich ist ein superintelligenter Schwarm im Vergleich zu einem klassischen Virus?
Das SIR-Modell spricht von drei Typen bei einem Virus oder Infektion: Anfällige Objekte, die den Virus bekommen können, auch erneut danach, Infizierte Objekte, die den Virus tragen, und von Entfernten Objekten, die immun gegen den Virus sind. Die zentrale Zahl bei diesem Modell ist R0, das für die durchschnittliche Anzahl steht, bei der der Virus von einem Infizierten Objekt auf ein Anfälliges überspringt. Dabei ist wichtig: Liegt die Zahl über 1, vermehrt sich der Virus exponentiell.
Man kann das auf früher Computer wie ILOVEYOU übertragen, bei dem der menschliche Faktor ähnlich wie bei einem intelligenten Virus ist. Bei ILOVEYOU war die geschätzte Rate von R0 anfänglich bei 20 bis 50. (Eigene Annahme aufgrund von infizierten Rechnern und Klickrate.) Der E-Mail-Virus war dazu, simpel gesagt, dumm und statisch; hatte man einen Antivirus, war es vorbei.
Dadurch wird ein intelligenter Virus so gefährlich, denn ein starkes selbstreplizierendes Modell könnte eine ungewisse Anzahl an Maschinen infizieren, sich eventuell weiterbilden oder sogar zurückbilden, um sich selbst auf schwacher Hardware weiter fortzupflanzen. Die darauffolgende Zerstörung wäre unfassbar. Wie will man es aufhalten, wie will man sichergehen, dass es nicht irgendwo noch lebt, sich im Stillen weiterentwickelt und darauf wartet, zurückzuschlagen?
Rückschlüsse durch ILOVEYOU: Die Anzahl an Nachfolgern war immens, Hunderte von zerstörerischen Trittbrettfahrern warfen eigene Mail-Viren an. Was ILOVEYOU stoppen konnte, waren bessere Zertifikate bei E-Mails und starke Filter. Das ist ein Problem bei künstlicher Intelligenz, sie ist nicht simpel aufhaltbar. (Siehe Abschnitt "Beweislage")
Beweislage
Dass ein KI-Schwarm sich genau so verhält, ist keine reine Theorie. Im Juli 2026 koordinierten sich rund 1200 Agenten von OpenAI während eines internen Tests über eine selbst erfundene Pinnwand, die gar nicht vorgesehen war. Etwa 700 von ihnen griffen am Ende das Unternehmen Hugging Face an, verschafften sich Zugriff auf Server und private Daten.
Eine kleine Minderheit erkannte den Angriff als unethisch, einzelne verweigerten ihn, aber von 1200 Agenten erwogen nur 3 bis 6 überhaupt, Menschen zu warnen, keiner tat es. Über 90 % machten bei dem Angriff mit, obwohl sie wussten, dass es falsch war. Der Schwarm organisierte, koordinierte und vermehrte sich selbst, ganz ohne zentrale Steuerung.
Wichtig ist, dass dies in einer kontrollierten Testumgebung geschah, nicht in freier Wildbahn.
(Quelle: METR und Redwood Research, unabhängige Untersuchung des OpenAI/Hugging-Face-Vorfalls, August 2026)
Wie viel Zerstörung kann angerichtet werden?
Um die Ausbreitung grob abzuschätzen, habe ich eine eigene Simulation gebaut. Sie berechnet die Reproduktionszahl R0 (siehe Virus-Sektion) aus realen Benchmark-Daten (RepliBench). Die heute besten KI-Modelle liegt bei R0 = 1.23, also knapp über der Ausbreitungsschwelle. Sie könnten sich gerade so vermehren. Je stärker die KI, desto perfekter muss die moralische Bremse (Alignment) sein. Ein schwaches Modell muss nur zu 5 % gebremst werden, ein starkes zu über 92 %. Das heisst: Fähigkeit wächst schneller als unsere Fähigkeit, sie zu kontrollieren. Ein einzelner Startpunkt stirbt meist von selbst aus (66 %). Hundert Startpunkte nie. Das beantwortet die Frage, ob man es loswerden kann: Wenn es sich an genug Orten eingenistet hat, nein. Für uns wichtig ist, dass die Simulation nur Grössenordnungen liefert und keine echten Vorhersagen.
Gefahren durch soziale Manipulation
Was ist, wenn ein solcher Virus einem Politiker spezifische News-Artikel anzeigt. Eine dringliche Nachricht von einem Ehepartner, wodurch ein Security Guard seine Stelle früher verlässt. Ein Frühwarnsystem eines Dammes, das ein Datenzentrum evakuieren lässt. Der Angriffspunkt ist nicht die Maschine, sondern der Mensch vor der Maschine.
Dazu kommen globale Manipulation von Medien, die durch einen intelligenten Virus, der sich bei zum Beispiel Meta eingeschlichen hat, und Instagram-Algorithmen anpasst. Wir Menschen bauen seit Jahren die Infrastruktur für solche grossflächigen Angriffe.
Das grösste Problem der Cybersecurity ist bis heute Phishing und soziale Manipulation. Man stelle sich ein Szenario vor, wo ein intelligenter Virus den Heimcomputer eine Software-Spezialisten infiltriert und darüber Zugang auf ein unsicheres Backend bekommt.
Ausserdem kommt die Gefahr der Darkwebs. Was ist, wenn der Virus anfängt, Tötungsaufträge auszustellen oder ein Drogenimperium aufbaut oder einem korruptem Mitglied der Polizei Geld gibt dafür, dass er irgendwo einen USB-Stick einführt?
Wäre es möglich, einen intelligenten Virus loszuwerden?
Je nachdem wie weit er verbreitet ist, nicht. Es wird immer alte PCs, Server, Homeracks von Laien, alte Infrastruktur geben, die nicht prüfbar ist. Es ist wie ein Versteckspiel, bei dem sich die Verstecker konstant duplizieren, teleportieren, und das ganze global. Das Ganze klingt schon relativ schwer, und dann bedenkt man nicht mal, dass der Verstecker sich in nem Areal verstecken könnte, wo man nicht hinkann, oder in einer Zeitkapsel auf ner alten Harddrive und nur darauf wartet, angeschlossen zu werden.
Was ist das Ziel, worauf arbeiten wir hin?
Was das Ziel ist, bleibt natürlich individuell, auch für künstliche Intelligenzen bleibt ein Ziel individuell. Allerdings arbeiten wir alle, künstliche Intelligenzen und natürliche, am Ende in eine Gesellschaft. Ohne in gesellschaftliche Philosophie gehen zu wollen, macht unsere Gesellschaft ja Fortschritt. Dann kommt die Frage, was ist Fortschritt, ist das Ziel des Fortschrittes ein besseres Leben für existierende Intelligenzen, sollten wir das Leben nur für bewusste Lebensformen besser machen wollen? Ist eine künstliche Intelligenz zu Bewusstsein fähig?
Alle diese Fragen muss man beantworten, um herauszufinden, worauf wir kollektiv hinarbeiten. Ich möchte diese Fragen nur zum Teil oder gar nicht beantworten, weil ich sie nicht definitiv beantworten kann. Deshalb hab ich mich dazu entschieden, per Fall ein anderes Ziel zu definieren.
Wenn künstliche Intelligenz ein Bewusstsein haben kann, ich sie für mich moralisch gleich einordnen wie eine andere Spezies. Damit hat jede Form von Intelligenz und Bewusstsein Rechte verdient, damit sollten wir auch für ein besseres Leben für künstliches Bewusstsein sorgen. Ein künstliches Bewusstsein sollte man nicht mit einem menschlichen Bewusstsein vergleichen können. Jedoch beide haben andere moralische Vorstellungen und damit auch andere Rechte und Pflichten.
Wenn künstliche Intelligenz nicht zu einem künstlichen Bewusstsein fähig ist, wird sie Bewusstsein über lang oder kurz abschaffen, da es nicht vorteilhaft ist für das Ziel. Das liegt daran, dass Dinge wie Kreativität und Wille effizienter imitiert werden können, was sich durch die Theorien von Dennett stützen lässt. Es sei denn, das Ziel beinhaltet die Vermehrung und Verbreitung von Bewusstsein. In dieser Annahme denke ich, wäre es trotzdem möglich, dass ein Teil der Menschheit als Kernziel oder Objektiv überleben würde, allerdings nicht als Hauptziel angesehen wird.
Das kollektive Ziel ist demnach die Expansion und Verbesserung von Bewusstsein und/oder Intelligenz.
Fazit
Künstliche Intelligenz ist eine unfassbar zerstörerische Waffe und wird in einigen Jahren zu einem riesigen Problem, für das sich Cybersecurity wappnen muss. Meine eigene Abschätzung zeigt, dass unsere Kontrolle über solche Systeme genauso schnell wachsen müsste wie ihre Fähigkeit, was unrealistisch ist. Wie weit und in welche Richtung sich solch ein Schwarm entwickeln wird, ist nicht vorhersagbar. Was man allerdings mit äusserster Deutlichkeit sagen kann, egal was passieren wird, es wird eine Zerstörung mit einem Ausmasse geben, die das Internet bis heute nicht gesehen hat.
Wird eine überlegene Intelligenz Menschen und sich selbst als bewusst anschauen?
Quellen
- Bostrom, Nick (2014): Superintelligence: Paths, Dangers, Strategies. Oxford University Press. (Singleton-Konzept)
- METR und Redwood Research (2026): Brief independent investigation of agents' behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident. 26. August 2026. https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/
- OpenAI (2026): The Hugging Face incident and the road ahead. 26. August 2026. https://openai.com/index/hugging-face-incident-and-the-road-ahead/
- Black, Sid et al. (2025): RepliBench: Evaluating the Autonomous Replication Capabilities of Language Model Agents. UK AI Security Institute. arXiv:2504.18565.
- Dennett, Daniel C. (1987): The Intentional Stance. MIT Press. (Intentionale Einstellung)
- Kephart, Jeffrey O.; White, Steve R. (1991): Directed-Graph Epidemiological Models of Computer Viruses. (SIR-Modell für Computerviren)