Reddit a engagé des poursuites contre Anthropic après avoir accusé l’entreprise d’IA d’explorer à plusieurs reprises les forums de Reddit sans autorisation et en violation de la politique d’utilisation des contenus de la plateforme. Cette affaire met en lumière les tensions croissantes entre les entreprises d’IA générative et les plateformes en ligne, dont les communautés produisent d’immenses quantités de contenus gratuits et précieux.
Reddit a saisi la Cour supérieure de Californie à San Francisco le 4 juin.
« Pour sa part, malgré ce qu’affirment ses supports marketing, Anthropic ne se soucie ni des règles ni des utilisateurs de Reddit : l’entreprise estime avoir le droit de prendre n’importe quel contenu et de l’utiliser comme bon lui semble, en toute impunité », ont écrit les avocats de Reddit dans le dossier.
Anthropic n’est pas parvenue à conclure d’accord concernant les contenus de Reddit et a affirmé avoir cessé d’explorer le site
En juillet 2024, Reddit a publié une politique de contenu indiquant qu’elle conclurait des accords de licence avec certains modèles de langage de grande taille.
Google et OpenAI ont accepté ces accords. Ainsi, certains contenus fournis par Gemini ou ChatGPT pourraient avoir été utilisés pour l’entraînement à partir de contenus de Reddit, avec le consentement de Reddit. Les accords de licence imposent aux entreprises d’IA partenaires de respecter certaines restrictions, notamment de ne pas utiliser les publications supprimées ni cibler directement les utilisateurs de Reddit avec des publicités.
Bien que les détails complets des contrats restent confidentiels, Bloomberg a rapporté que l’un des accords pourrait avoir représenté 60 millions de dollars et contribué à la valorisation de Reddit lors de son introduction en bourse (IPO).
Anthropic n’a pas signé d’accord similaire. Malgré avoir déclaré publiquement que Reddit avait été ajouté à sa liste de blocage des robots d’exploration en juillet 2024, Reddit affirme que l’entreprise a continué à collecter des données sur sa plateforme. La plainte affirme que les systèmes d’Anthropic ont accédé à Reddit plus de 100 000 fois depuis cette date.
Le fossé grandissant entre les entreprises d’IA et les plateformes de contenus
La communauté florissante de Reddit a produit 2,72 milliards de commentaires et d’interactions en 2024. Cela en fait un terrain particulièrement riche pour les chatbots d’IA et les résultats de recherche. Reddit est réputé pour fournir des informations pratiques et précises, et est présenté comme une alternative à une sélection de résultats Google Search de plus en plus uniformes.
Cependant, les relations compliquées de la plateforme avec les entreprises d’IA reflètent celles de grands médias, comme l’accord conclu par The New York Times avec Amazon ou le partenariat entre OpenAI et Axios, qui fournissent du contenu éditorial aux systèmes d’IA en échange d’un soutien financier et d’autres initiatives.


