Voici les sources oĂč viennent piocher les IA
Les intelligences artificielles piochent largement dans les sources internet. Mais il y en a quelques-unes qui sont particuliĂšrement privilĂ©giĂ©es par les grandes entreprise de l’IA.

Si les meilleures IA du marchĂ© comme ChatGPT, Gemini ou bien Grok ont pu Ă©merger aussi rapidement, avec des performances toujours plus Ă©levĂ©es, c’est dĂ» au fait que leurs concepteurs ont eu droit Ă un vivier incroyable de donnĂ©es avec internet. Et si vous vous demandiez quelles sources particuliĂšres Ă©taient privilĂ©giĂ©es par les gĂ©ants de la tech, aujourd’hui, on commence Ă avoir une meilleure idĂ©e.
Reddit, une source au-dessus de toutes les autres
C’est une infographie intĂ©ressante qui nous est livrĂ©e par Statista. AprĂšs analyse de rĂ©ponses des IA ChatGPT, Perplexity ainsi que d’AI OverViews et du Mode IA de Google, le spĂ©cialiste des statistiques a pu Ă©tablir les sources les plus utilisĂ©es en moyenne par ces intelligences artificielles.
Au sommet, on retrouve Reddit, qui a été cité dans 40% des réponses effectuées durant le test. Une premiÚre place assez étonnante, qui est par contre suivie de sources plus attendues, à savoir Wikipedia (26,3%), puis YouTube (23,5%) et Google (23,3%).
De l’information communautaire pour des intelligences artificielles privĂ©es
Ce qui est intĂ©ressant de noter, c’est que ces IA, qui permettent Ă leurs sociĂ©tĂ©s de dĂ©gager des revenus, utilisent en grande majoritĂ© du contenu gĂ©nĂ©rĂ© gratuitement par les internautes. C’est Ă©videmment le cas de Reddit, de Wikipedia mais aussi de Yelp, Facebook ou bien de Tripadvisor.
Difficile de se dire combien de temps encore tout ce contenu produit par des individus Ă travers la planĂšte sera considĂ©rĂ© comme des donnĂ©es de base Ă utiliser gratuitement. Mais quand on sait que les ayants droits de contenus protĂ©gĂ©s ont dĂ©jĂ du mal Ă faire respecter leurs droits, il est Ă craindre que tout ce qui est dans le champ public soit encore longtemps l’objet d’une rĂ©colte tranquille des concepteurs de modĂšles de langage.

Comments are Closed