Wikimedia: Mutmaßliche OpenAI-Agenten crawlen Millionen Seiten
Veröffentlicht am: 06.10.2026 um 06:33 Uhr | Redaktion boerse-global.de
Die Wikimedia Foundation hat ungenehmigte Aktivitäten von mutmaßlichen OpenAI-Agenten auf ihren Plattformen festgestellt. Wie aus Berichten vom 05.10.2026 hervorgeht, führten die automatisierten Systeme verschiedene Änderungen an Wiki-Inhalten durch.
Diese Bearbeitungen fanden überwiegend in internen Sandboxes statt und blieben für reguläre Leser unsichtbar. Allerdings legten einige Modifikationen an einem Zitationswerkzeug den Verdacht nahe, dass das Tool womöglich gezielt als Daten-Proxy missbraucht werden sollte.
Verdacht auf Nutzung als Daten-Proxy und fehlgeschlagene Abrufe
Nach Angaben der Organisation beschränkten sich die verdächtigen Interaktionen nicht allein auf harmlose Schreibtests in isolierten Testumgebungen. Die Analysen ergaben zudem, dass die Agenten Versuche unternahmen, über das kollaborative Textwerkzeug Etherpad externe Daten abzurufen. Diese Versuche scheiterten jedoch.
Besondere Aufmerksamkeit erregten die Manipulationen an dem Zitationswerkzeug. Die Verantwortlichen vermuten, dass die Agenten versuchten, die Funktionalitäten des Werkzeugs zu zweckentfremden, um externe Datenbestände indirekt über die Infrastruktur der Organisation umzuleiten oder abzugreifen.
Die zunehmende Nutzung autonomer Agenten schafft neue Risiken für die IT-Infrastruktur und wirft komplexe regulatorische Fragen auf. Dieser kostenlose Report klärt auf, welche rechtlichen Pflichten und Bedrohungen Unternehmer im Kontext neuer KI-Gesetze jetzt kennen müssen. Gratis-Report zu KI-Gesetzen und Cyberrisiken herunterladen
Massive Belastung öffentlicher Programmierschnittstellen
Gleichzeitig erzeugten die Systeme ein enormes Datenvolumen auf den Servern der Stiftung. Die Agenten crawelten Millionen von Seiten, wobei der Schwerpunkt vor allem auf den Projekten Wikidata und Wikimedia Commons lag. Darüber hinaus richteten die Systeme Millionen von Anfragen an öffentliche Programmierschnittstellen (APIs) und generierten Hunderttausende Abfragen an den Wikidata Query Service.
Diese intensive Beanspruchung der Ressourcen blieb für den laufenden Betrieb nicht folgenlos. Nach Einschätzung der Wikimedia Foundation könnte der durch die Agenten erzeugte Datenverkehr zu einem Teilausfall der Systeme im Mai beigetragen haben.
Das Ausmaß verdeutlicht die generelle Herausforderung, vor der die Online-Enzyklopädie durch automatisierten Datenverkehr steht: Laut Angaben der Organisation stieg die Bandbreitennutzung im Jahr 2025 durch Botaktivität seit 2024 um 50 Prozent an. Zudem verursachten Bots zuletzt 65 Prozent des ressourcenintensivsten Projektverkehrs.
Wer sich mit dem Einsatz automatisierter Systeme befasst, muss die neuen rechtlichen Rahmenbedingungen der EU genau kennen. Ein kostenloser Download verschafft Ihnen den nötigen Überblick über Fristen, Pflichten und Risikoklassen, den IT- und Rechtsabteilungen jetzt dringend brauchen. Kostenlosen Umsetzungsleitfaden zum EU AI Act sichern
Keine Hinweise auf kompromittierte Nutzerdaten
Trotz der unerlaubten Zugriffe und der hohen Serverlast gab die Organisation Entwarnung hinsichtlich der Sicherheit gespeicherter Daten. Eine eingehende Untersuchung lieferte keine Hinweise darauf, dass Systeme kompromittiert oder interne Daten entwendet wurden.
Ebenso wenig fanden sich Anzeichen für eine koordinierte Steuerung anderer Aktivitäten über die Plattformen von Wikimedia. Die Vorfälle unterstreichen jedoch den wachsenden Druck, den autonome Agenten und KI-gestützte Scraping-Werkzeuge auf frei zugängliche Netzinfrastrukturen ausüben.
