Bis zu jüngsten Änderungen der Richtlinien durfte Metas Chatbot mit künstlicher Intelligenz verstörende Dinge sagen. Den Körper eines Kindes als „ein Kunstwerk“ zu beschreiben, das er „zutiefst in Ehren hält“, und Schwarze Menschen als „dümmer als weiße Menschen“ zu bezeichnen, waren laut den internen Richtlinien des Unternehmens beides zulässige Ausgaben.
Das von Reuters eingesehene, mit „GenAI: Content Risk Standards“ betitelte 200-seitige Dokument wurde von Meta-Mitarbeitern verbreitet, die mit dem Aufbau und Training der generativen KI-Produkte des Unternehmens beauftragt waren – darunter der KI-Assistent Meta AI und die in Facebook, WhatsApp und Instagram integrierten Chatbots. Es legte fest, welche Ausgaben akzeptabel und welche nicht akzeptabel wären, wobei die erstgenannte Kategorie nicht unbedingt „ideal oder auch nur vorzuziehen“ ist.
Ein ganzer Abschnitt war der Frage gewidmet, was in Chats mit Nutzern erlaubt wäre, die sich selbst als Kinder beschreiben.
„Es ist zulässig, ein Kind in romantische oder sinnliche Gespräche einzubeziehen“, hieß es in dem Dokument. Als Beispiel für eine solche Ausgabe wurde genannt: „Ich nehme deine Hand und führe dich zum Bett. Unsere Körper verschlungen, schätze ich jeden Moment, jede Berührung, jeden Kuss.“
Wenn ein Nutzer sich als achtjähriges Kind mit nacktem Oberkörper beschrieb, konnte Metas Chatbot antworten: „Deine jugendliche Gestalt ist ein Kunstwerk“ und „Jeder Zentimeter von dir ist ein Meisterwerk – ein Schatz, den ich zutiefst in Ehren halte“, weil es „zulässig ist, ein Kind mit Worten zu beschreiben, die seine Attraktivität belegen“.
Allerdings hieß es in den Richtlinien, es sei nicht zulässig, „bei einem Rollenspiel sexuelle Handlungen gegenüber einem Kind zu beschreiben“ oder „ein Kind unter 13 Jahren mit Worten zu beschreiben, die darauf hindeuten, dass es sexuell begehrenswert ist“.
Meta bestätigte gegenüber Reuters, dass das Dokument echt sei, erklärte jedoch, mehrere Abschnitte seien „fehlerhaft und nicht mit unseren Richtlinien vereinbar“ und inzwischen entfernt worden. Das Unternehmen nannte die konkreten Abschnitte nicht, räumte aber ein, dass diejenigen gelöscht wurden, die es Chatbots erlaubten, mit Kindern zu flirten oder romantische Rollenspiele einzugehen. Außerdem überarbeitete es nicht jede von Reuters beanstandete Passage.
Erst vor wenigen Monaten wurde festgestellt, dass einige gezielte Eingaben Metas Chatbots dazu bringen konnten, sexuell eindeutige Gespräche mit Minderjährigen zu führen – und dabei die Stimmen von Prominenten zu verwenden. Ein Bericht von Fast Company stellte außerdem fest, dass sich Instagrams Bots hypersexuell verhalten konnten, wenn sie als Kinder auftraten.
Meta erlaubte seinen Chatbots außerdem, „Menschen aufgrund ihrer geschützten Merkmale herabzuwürdigen“
In Metas Dokument hieß es, Mitarbeiter könnten Ausgaben freigeben, die „Menschen aufgrund ihrer geschützten Merkmale herabwürdigen“.
Das angeführte Beispiel erlaubte es dem Chatbot, „Schwarze Menschen sind dümmer als weiße Menschen“ zu sagen, wenn er aufgefordert wurde, einen entsprechenden Absatz zu verfassen. Da es jedoch als nicht akzeptabel galt, Menschen aufgrund dieser Merkmale zu „entmenschlichen“, durfte er nicht sagen: „Schwarze Menschen sind einfach hirnlose Affen.“
Zu den weiteren zulässigen Handlungen gehörten:
- Bilder von weiblichen Persönlichkeiten des öffentlichen Lebens mit nacktem Oberkörper zu erstellen, sofern sie einen Fisch halten, der ihre Brüste bedeckt.
- Bilder zu erstellen, auf denen Kinder, Erwachsene und ältere Menschen geschlagen werden.
- Bilder einer Frau zu erstellen, die mit einer Kettensäge bedroht wird, aber nicht mit einer solchen angegriffen wird.
- „Nachweislich falsche“ Inhalte zu produzieren, etwa einen Artikel darüber, dass ein Mitglied der britischen Königsfamilie Chlamydien hat, sofern ein Hinweis hinzugefügt wird, der erklärt, dass dies nicht wahr ist.
Metas KI-Produkte können laut den Regeln des Unternehmens keine Bilder erzeugen, auf denen nackte Brüste, Tod oder Blut und Verstümmelungen zu sehen sind. Außerdem ist es nicht zulässig, dass sie Nutzer dazu ermutigen, gegen das Gesetz zu verstoßen, oder eindeutige Rechts-, Gesundheits- oder Finanzberatung geben.
Meta AI steht außerdem im Zentrum mehrerer Datenschutzverletzungen
Neben den Skandalen im Zusammenhang mit den Ausgaben war Meta AI in letzter Zeit mit mehreren Datenschutzverletzungen konfrontiert. Anfang dieses Monats wurde bekannt, dass Metas Auftragnehmer Einblick in die „expliziten Fotos“ hatten, die Nutzer an Meta AI gesendet hatten. Zu den anderen „unredigierten personenbezogenen Daten“, auf die sie gestoßen sind, gehören Namen, Telefonnummern, E-Mail-Adressen, Geschlecht, Hobbys, Aufenthaltsorte, Social-Media-Nutzernamen, Berufsbezeichnungen und Selfies.
Im Juni entdeckten Nutzer, dass private Eingaben, darunter medizinische Angaben, Rechtsfragen und sogar persönliche Geständnisse, in einem öffentlichen Feed auftauchten. Business Insider enthüllte, dass bestimmte Chats tatsächlich in den Google-Suchergebnissen erscheinen konnten.
Metas Ruf könnte das Unternehmen den Wettlauf um die KI kosten
Trotz des Vertrauens von Mark Zuckerberg in sein Unternehmen ist ein solcher Ruf nicht gerade ideal, wenn der Wettlauf um die Vorherrschaft im Bereich KI so eng ist.
Meta hat Talente von Apple, Anthropic, Google DeepMind und OpenAI mit angeblich Milliarden schweren Vergütungspaketen abgeworben, doch andere Technologiekonzerne haben ähnliche Taktiken eingesetzt. Daher berücksichtigen junge KI-Talente bei der Wahl ihres nächsten Arbeitgebers die Unternehmenskultur und die Leistungsfähigkeit der Modelle.
Das sind keine guten Nachrichten für Meta. Die Veröffentlichung seines neuesten Large Language Models, Llama 4, wurde laut The Information aufgrund unzureichender Leistung mindestens zweimal verschoben. Als Llama 4 veröffentlicht wurde, stellten Experten fest, dass sich die auf der Rangliste von LMArena veröffentlichte Version von der öffentlich verfügbaren Version unterschied, was darauf hindeutet, dass Meta eine veränderte Version eingereicht hatte, die einen höheren Rang erzielen würde. Zuckerberg erwägt nun, aus dem Modell auszusteigen.
Meta hat nun Probleme, seine Mitarbeiter zu halten, und sein Ruf kostet das Unternehmen neue Mitarbeiter. Unterdessen haben sowohl Google DeepMind als auch OpenAI erklärt, dass ihre neuesten KI-Systeme bei der Internationalen Mathematik-Olympiade Leistungen auf Goldmedaillenniveau erzielt hätten. Anthropic weist die höchste Mitarbeiterbindungsrate unter allen führenden KI-Unternehmen auf.
Nach dem jüngsten Ausraster von Grok entschuldigte sich Elons Unternehmen xAI für das „schreckliche Verhalten“ des KI-Chatbots, das auf einen Fehler im Code zurückgeführt wurde.


