Vous avez interrogé Perplexity avec un prompt sur Mayotte. Avez-vous testé cette même requête avec d’autres modèles d’IA (ChatGPT, Claude ou Gemini) ou en variant la langue du prompt, par exemple en anglais ? Si oui, le résultat a-t-il été le même ?
En réalité, passer d’une langue à l’autre n’est pas le problème, car le processus reste le même. On pourrait, pour simplifier, diviser la connaissance d’un modèle d’IA en deux : celle tirée de ses données d’entraînement et celle tirée des données consultées sur le web lorsqu’on le lui demande ou lorsqu’il juge cela nécessaire. L’une comme l’autre nous est défavorable, car ces modèles ont été entraînés sur des données très majoritairement tirées de livres, de sites web et de productions occidentales, et sur très peu de données africaines, non pas parce que nous n’en produisons pas assez, mais surtout parce que nous ne les numérisons pas assez. Ainsi, passer à Gemini, Claude ou ChatGPT n’aurait rien changé, car le processus reste le même.
L’IA aurait effectué exactement les mêmes tâches. Pourquoi Perplexity, alors ? Parce qu’elle est reconnue comme l’une des IA les plus puissantes en matière de recherche sur le web, et c’était justement ce que je voulais. Plutôt qu’une IA qui répond uniquement à partir de sa base de connaissances, je voulais qu’elle effectue des recherches complémentaires sur le web et documente tout ce qu’elle avait consulté. Par ailleurs, Perplexity repose sur un modèle nommé Sonar, lui-même issu d’un fine-tuning du modèle Llama, développé par Meta (Facebook). Ce modèle est spécifiquement conçu pour limiter les hallucinations, c’est-à-dire pour éviter que l’IA n’invente des réponses non sourcées et non documentées, un phénomène fréquemment observé chez la plupart des IA.
Votre étude conclut que la solution réside dans la production de contenu par les pays africains. Ne pensez-vous pas que le biais se trouve plutôt dans les algorithmes que dans la différence de quantité de données disponibles sur Internet ?
Non, absolument pas. Je pense que le mot « algorithme » est utilisé à tort et à travers par certaines personnes. Il est facile d’affirmer que le problème vient de l’algorithme plutôt que de reconnaître que le problème vient de nos propres insuffisances en matière de documentation, comme le font les grandes puissances. En fait, si nous disposions de nos propres IA, nous utiliserions les mêmes algorithmes, ou presque, car la logique reste la même. On ne peut toutefois pas totalement exclure cette hypothèse. Il est tout à fait normal que Google, par exemple, privilégie certaines institutions américaines plutôt que des institutions chinoises ou européennes, et surtout africaines.
L’exemple le plus concret qui illustre le poids des données sur les algorithmes est l’affaire récente du Hanover Institute for Public Policy. Il s’agit d’une entité israélienne qui s’est faussement présentée comme un institut de recherche indépendant et qui a publié, en très peu de temps, plus de 124 rapports favorables à la position israélienne sur le génocide à Gaza. Des enquêtes de Politico, du Guardian… relayées par plusieurs médias tels que TRT World, ont démontré qu’il s’agissait en réalité d’une initiative financée par le gouvernement israélien, visant à orienter les réponses d’IA comme Claude, ChatGPT ou Perplexity sur des sujets sensibles liés à Israël et à son génocide à Gaza. En somme, les algorithmes profitent à ceux qui savent les exploiter, notamment en y injectant leurs propres données. Et les IA comme Claude, ChatGPT, Gemini, etc. sont entraînées sur des données tirées directement du web. Donc, il est presque obligatoire que nous y soyons également.
Vous préconisez de « produire, documenter et référencer» pour mieux exister sur le web. Mais face aux moyens financiers et techniques colossaux des institutions occidentales, comment les pays en développement peuvent-ils rivaliser avec ces dernières sur ce terrain ?
Les moyens financiers sont en effet un obstacle. Mais je ne pense pas que créer des sites web bien conçus, bien référencés et dédiés à des instituts de recherche chargés de relayer des travaux sur Mayotte, par exemple, et sur presque tout, d’ailleurs… coûte si cher, en tout cas pas pour un État. Je pense surtout que c’est par manque de prise de conscience de nos dirigeants que ces initiatives ne sont pas lancées. Nous avons des chercheurs dans tous les domaines, comme l’histoire, l’informatique, les mathématiques, l’anthropologie, etc. Il faut simplement donner les moyens à ces personnes.
Je ne pense même pas qu’ils demanderaient une rémunération en retour, car pour un chercheur, il n’existe rien de plus précieux que ses recherches et leur transmission à travers le monde. Un petit centre connecté avec quelques dizaines d’ordinateurs suffirait, je pense. Cette inaction de nos dirigeants se reflète aussi dans les transformations numériques et technologiques du monde. Ils évoquent l’IA partout, dans les grandes conférences mondiales et continentales, mais ne soutiennent jamais les initiatives locales qui y travaillent réellement. C’est d’une tristesse.
Richda Radjab (stagiaire)


