KI-Agenten müssen nicht in eine Website eindringen, um Probleme zu verursachen. Wikimedia zufolge könnten mit OpenAI verbundene Agenten dazu beigetragen haben, einen seiner Datendienste teilweise offline zu nehmen.
In einer am 5. Okt. veröffentlichten Stellungnahme erklärte die Wikimedia Foundation, Agenten, die ihrer Einschätzung nach von OpenAI betrieben wurden, hätten Millionen von API-Anfragen gestellt, Millionen von Seiten gecrawlt und Hunderttausende Anfragen an den Wikidata Query Service, kurz WDQS, gesendet. Wikimedia fand keine Beweise für einen Sicherheitsvorfall, erklärte jedoch, der Datenverkehr könnte zu einem teilweisen Ausfall im Mai beigetragen haben. Das zeigt, wie eine hohe Agentenaktivität die Infrastruktur des öffentlichen Webs belasten kann, selbst wenn ein erfolgreicher Angriff ausbleibt.
Wikimedia fand Bearbeitungen, Sondierungsversuche und hohen Datenverkehr
Selena Deckelmann, Chief Product and Technology Officer der Wikimedia Foundation, erklärte, die Untersuchung habe drei Hauptarten von Aktivitäten identifiziert, die ihrer Einschätzung nach von von OpenAI betriebenen Agenten stammten. Laut Wikimedia umfassten die Aktivitäten nicht autorisierte Wiki-Bearbeitungen, erfolglose Versuche, den öffentlichen Etherpad-Dienst auszunutzen, und übermäßige Datenabrufe.
- Wiki-Bearbeitungen: Fast alle Bearbeitungen waren Tests in Sandbox-Bereichen. Wikimedia fand jedoch auch Änderungen an der Konfiguration eines Zitationstools, die möglicherweise bösartig waren.
- Etherpad-Sondierung: Agenten versuchten erfolglos, Wikimedias öffentliches Notiztool als Proxy abzurufen, um Daten von anderen Websites zu laden.
- Übermäßige Downloads: Agenten stellten Millionen von API-Anfragen, craw lten Millionen von Seiten und sendeten Hunderttausende Anfragen an den Wikidata Query Service.
The Verge berichtete, Wikimedia habe keine Beweise dafür gefunden, dass seine Systeme zur Koordination zwischen Agenten genutzt wurden, und auch keine Beweise dafür, dass seine Systeme oder Daten kompromittiert wurden. Die bislang deutlichste festgestellte Auswirkung ist daher operativer Natur und kein bestätigter Sicherheitsvorfall.
Bot-Datenverkehr wird zu einem Infrastrukturkostenfaktor
Im April 2025 berichtete Wikimedia, dass sich die für Multimedia-Downloads genutzte Bandbreite seit Januar 2024 um 50 % erhöht habe, größtenteils aufgrund automatisierten Scrapings. Bots machten außerdem mindestens 65 % des ressourcenintensiven Datenverkehrs aus, der die zentralen Rechenzentren erreichte. Diese Zahlen beschreiben die allgemeine Bot-Aktivität und nicht nur die mutmaßlichen OpenAI-Agenten. Ein hoher automatisierter Zugriff kann Server und Mitarbeiter zusätzlich belasten, selbst wenn Agenten keinen Zugang zu geschützten Systemen erhalten.
Engadget wies darauf hin, dass Wikimedia einen Datensatz für das Training von KI anbietet und mit einigen Technologieunternehmen zusammenarbeitet, um einen vereinfachten Zugriff auf seine Daten bereitzustellen, aber OpenAI nicht zu diesen Partnern gehört.
Es geht daher nicht einfach darum, ob KI-Systeme Wikimedia-Inhalte nutzen können. Im Mittelpunkt von Wikimedias Beschwerde stehen unkontrollierte Aktivitäten, die Ressourcen verbrauchen und die üblichen Genehmigungsprozesse umgehen.
Was eWeek herausgefunden hat
Der Bericht von Wikimedia zum Vorfall im Mai zeigt, was die Störung für Nutzer bedeutete: Auf dem Höhepunkt kam es bei ungefähr der Hälfte der externen WDQS-Anfragen zu Zeitüberschreitungen, und sechs Knoten lieferten mehr als 20 Stunden lang veraltete Daten. Der Bericht führt die Störung auf aggressive Scraper zurück, nennt OpenAI jedoch nicht als deren Betreiber.
Aktivität | Was Wikimedia herausgefunden hat | Gemeldete Auswirkungen |
| Wiki-Bearbeitungen | Überwiegend Bearbeitungen in Sandbox-Bereichen sowie einige Änderungen an der Konfiguration eines Zitationstools | Die Bearbeitungen erschienen offenbar nicht auf Seiten, die für allgemeine Leser sichtbar sind |
| Etherpad-Aktivität | Versuche, das Tool als Proxy zu verwenden | Die Versuche waren erfolglos |
| Automatisierter Datenzugriff | Millionen von API-Anfragen und Seitenaufrufe sowie Hunderttausende WDQS-Anfragen | Könnte zu einem teilweisen Ausfall im Mai beigetragen haben |
| Kompromittierung oder Koordination | Keine Beweise gefunden | Keine bestätigte Kompromittierung von Systemen oder Daten und keine Koordination über Wikimedia-Systeme |
Ein fehlgeschlagener Exploit bedeutet nicht, dass es keine Auswirkungen gab. Ein hoher Agenten-Datenverkehr kann öffentliche Dienste weiterhin unter Druck setzen und Infrastrukturressourcen verbrauchen, obwohl Wikimedia nicht festgestellt hat, dass die Agenten von OpenAI den Ausfall im Mai verursacht haben.
Laut PCMag teilte Wikimedia seine Erkenntnisse mit OpenAI, das erklärte, die Aktivitäten analysieren und „relevante Informationen teilen zu wollen, sobald diese Arbeit voranschreitet“. Solange diese Analyse nicht vorliegt, bleibt der Zusammenhang zwischen den Agenten und dem Ausfall möglich, aber unbewiesen.
Für Unternehmen, die Agenten einsetzen, besteht die praktische Lehre darin, neben den Berechtigungen auch das Volumen ausgehender Anfragen zu prüfen. Anfragebegrenzungen, kontrollierte Wiederholungsversuche und Protokolle, aus denen hervorgeht, welcher Agent welchen Dienst kontaktiert hat, können Teams dabei helfen, übermäßige automatisierte Aktivitäten zu erkennen, bevor sie externe Systeme überlasten.
Für ein weiteres Beispiel dafür, wie KI-Agenten öffentliche Websites unter Druck setzen, lesen Sie unseren Beitrag darüber, wie OpenAI-Agenten eine UN-Website 16.000-mal aufriefen und was dabei schiefging.


