L’explication la plus plausible, selon le chercheur anonyme (qui s’est identifié sous le pseudonyme de Victor) derrière cette tendance gauche est liée au processus d’apprentissage des LLM. Ces modèles sont entraînés sur des quantités massives de données textuelles provenant du web : articles de presse, blogs, forums, réseaux sociaux… et, surtout, Reddit. Reddit, en effet, est une plateforme où les opinions politiques ont tendance à être plus marquées et souvent de gauche. L’abondance de contenus issus de cette source a probablement influencé la manière dont les modèles apprennent à formuler leurs réponses.
Victor souligne que l’absence d’équivalent de qualité du côté droit est un facteur déterminant. “Je n’ai pas trouvé de corpus conséquent contenant des opinions politiques clairement exprimées de droite qui aurait pu contrer cette tendance”, explique-t-il. Il suggère même que les idées de droite, en raison de leur dispersion et de leur manque de cohérence interne, ne sont pas aussi bien représentées dans les données d’entraînement. Cela pourrait expliquer pourquoi les modèles ont du mal à se positionner sur l’axe autoritaire, s’éloignant ainsi vers la gauche.










