Wikipédia vend ses données au secteur de l’IA

,
Texte : est-ce que wikipédia vend son âme au diable ? Photo : page d'accueil wikipédia

Est-ce que Wikipédia vend son âme au diable ?

Pour le 25ème anniversaire de Wikipédia, la fondation Wikimedia a annoncé la signature d’un partenariat avec des grandes entreprises comme Meta, Microsoft, Amazon ou encore Mistral AI.

Objectifs annoncés ?

  • Permettre à ces entreprises d’accéder aux contenus du site pour entrainer leurs grands modèles de langage (LLM).
  • Assurer ainsi la pérennité de Wikipédia en contrôlant de manière plus raisonnée le passage des bots des LLMs sur le site (qui pèse lourd sur son infrastructure).

Ça ne m’enchante pas que l’on doive nécessairement négocier avec des entreprises qui « détruisent » Wikipédia.
Mais pourquoi pas, faisons payer les multinationales pour le travail qu’elles volent déjà.

  • Entrainer des modèles de langage avec des données de qualité pour obtenir des IA moins biaisées, plus neutres et fiables.

    « Je suis personnellement très heureux que les modèles d’IA s’entraînent sur les données de Wikipédia, parce qu’elles viennent des humains » – Jimmy Wales, cofondateur de Wikipédia.

C’est un vœu pieu. Et illusoire.

The Guardian révèle en effet que ChatGPT utilise Grokipedia, « l’encyclopédie » d’Elon Musk très problématique (je reste polie) entièrement générée par IA, comme source.*

La fiabilité sur internet a de sales jours devant elle.

En savoir plus

En savoir plus sur Marine Gallego

Abonnez-vous pour poursuivre la lecture et avoir accès à l’ensemble des archives.

Poursuivre la lecture