Selbstreplizierende Worms mit lokalen Large Language Models
Forscher der University of Toronto haben in einem Proof-of-Concept demonstriert, dass KI-gesteuerte Malware nicht auf Cloud-basierte Services angewiesen ist. Das System nutzt ausschließlich lokal gehostete Open-Weight-Modelle, um sich durch Netzwerke zu bewegen, Ziele zu analysieren und maßgeschneiderte Angriffsvektoren zu entwickeln.
Wie der Worm funktioniert
Das Kernprinzip basiert darauf, dass ein Large Language Model (LLM) als "Gehirn" der Malware fungiert. Der Worm erfasst Informationen über ein Ziel-System, nutzt das LLM zur Analyse von Schwachstellen und generiert dann spezifische Exploit-Strategien – alles automatisiert und ohne Eingriff durch Menschen.
Besonders kritisch: Das System kann sich selbst reproduzieren und auf neue Systeme übertragen. Der Prozess läuft vollständig lokal ab, was bedeutet, dass keine API-Calls zu kommerziellen KI-Diensten notwendig sind. Das erschwert traditionelle Überwachungs- und Erkennungsmechanismen erheblich.
Implikationen für die Cybersecurity
Diese Forschung verdeutlicht zwei zentrale Probleme:
Keine KI-Service-Abhängigkeit: Traditionelle Sicherheitsansätze, die auf der Überwachung von Cloud-API-Nutzung basieren, werden zunehmend irrelevant. Open-Source-Modelle wie Llama oder Mistral ermöglichen lokale Deployment und umgehen damit Erkennungspunkte.
Adaptive Angriffsfähigkeiten: Ein LLM kann nicht nur vorprogrammierte Exploits ausführen, sondern situativ auf unterschiedliche Zielumgebungen reagieren. Das erschwert Defense und Patch-Strategien.
Offene Fragen
Die Arbeit stammt aus einem akademischen Kontext – es bleibt unklar, wie gut solche Systeme gegen moderne Defense-in-Depth-Ansätze funktionieren würden. Auch die Ressourcen-Anforderungen (lokale LLM-Ausführung ist CPU-intensiv) könnten in der Praxis limitierend wirken.
Trotzdem zeigt das Projekt, dass die Barrier zur Entwicklung autonomer Malware mit KI weiter sinkt. Es ist kein theoretisches Szenario mehr, sondern ein funktionierendes Proof-of-Concept.
Was das bedeutet
Organisationen müssen ihre Sicherheitsstrategien überdenken – weg von Endpoint-Detection, mehr hin zu Netzwerk-Segmentierung, Zero-Trust-Architekturen und anomalieerkennung auf Verhaltensebene. Auch die Kontrolle von lokalen LLM-Inferenzen in kritischen Infrastrukturen wird relevanter.

