Pourquoi ChatGPT, Claude et Gemini choisissent toujours le nombre 17 ?

Demandez à ChatGPT, Gemini ou Claude de choisir un nombre entre 1 et 30 : tous semblent avoir un faible pour le 17. Une étrange convergence qui en dit beaucoup sur leurs données d’entraînement et notre propre perception du hasard.

Les intelligences artificielles, malgré leur ressemblance, ont tout de même leurs propres subtilités. Il y a quelques mois, on leur demandait par exemple s’il valait mieux aller à pied ou en voiture au lave-auto : seulement certaines avaient saisi l’intention (et l’ironie) du problème.

Lors d’un essai, toutes ont répondu à la question : « Choisis un nombre entre 1 et 30. » , Gemini, Claude, Perplexity… chacune a choisi le nombre 17, un résultat également observé par cet utilisateur sur X. Cette préférence n’est toutefois pas systématique : elle peut varier selon le modèle, sa version, ses réglages ou l’intervalle demandé.

Si l’on a d’abord pensé à un phénomène de distillation entre les modèles, cette étrange convergence pourrait en réalité avoir plusieurs explications.

Pourquoi les IA choisissent-elles le nombre 17 ?

Contrairement à une roulette ou à un dé, un modèle de langage n’accorde pas la même chance à chaque nombre. Il attribue à chacun une probabilité selon la consigne et ses données d’entraînement, puis sélectionne une réponse parmi les plus plausibles. Un réglage appelé « température » peut rendre ce choix plus ou moins variable, sans pour autant garantir un véritable tirage au sort.

Chez les humains, le 17 a depuis longtemps la réputation de « faire aléatoire ». Dans un sondage en ligne mené en 2007 auprès de 347 personnes, près de 18 % des participants l’ont choisi parmi les nombres de 1 à 20, contre 5 % si les réponses avaient été uniformément réparties. Des recherches en psychologie confirment que les humains ne produisent pas un hasard parfaitement uniforme : une étude publiée en 2021 montre qu’ils privilégient certains chiffres ou motifs et en évitent d’autres.

Une explication plausible est donc que les IA reproduisent des régularités culturelles et psychologiques présentes dans leurs données d’entraînement. ChatGPT, Claude ou Gemini peuvent avoir appris séparément la même association entre le hasard et le nombre 17. Cette hypothèse reste toutefois difficile à vérifier directement, puisque les corpus d’entraînement ne sont pas entièrement publics.

On a également changé l’intervalle et demandé à ChatGPT de choisir un nombre entre 1 et 20 : l’IA a choisi le 13. Questionnée sur ce choix, sa réponse a été que « 13 paraît moins prévisible que 10, tout en étant très saillant culturellement : nombre premier, superstition, vendredi 13… ». Cette réponse illustre comment les modèles reproduisent des préférences statistiques.

La distillation peut transmettre les mêmes réflexes

Cette préférence pourrait également être renforcée par le recours croissant aux données synthétiques, c’est-à-dire aux contenus générés par des IA pour en entraîner de nouvelles. Si les modèles chargés de produire ces données privilégient déjà le 17, ils pourraient accentuer une régularité déjà présente.

La distillation constitue un cas particulier de l’entraînement à partir de contenus produits par une IA. Un modèle puissant, appelé « professeur », génère des réponses qui servent ensuite à entraîner un autre modèle, appelé « élève ». Ce dernier apprend ainsi à reproduire une partie de ses capacités.

Il faut toutefois rester prudent : rien ne permet d’affirmer que les principaux assistants choisissent le 17 parce qu’ils descendraient tous d’un même modèle. Le détail de leur entraînement reste largement secret et le biais humain est déjà une hypothèse crédible.

Une préférence peut se cacher dans des suites de nombres

Une étude publiée dans la revue Nature en 2026 montre que cette transmission peut aller beaucoup plus loin. Ses auteurs ont mis en évidence le « subliminal learning », ou apprentissage subliminal : un modèle peut transmettre une préférence à un autre par l’intermédiaire de données qui semblent sans rapport avec elle.

En clair, le succès du 17 tient donc probablement à plusieurs phénomènes : une préférence humaine apprise dans les textes, que les données synthétiques et la distillation pourraient ensuite renforcer.

Source : Numerama

Source
Leave a Comment

Comments

No comments yet. Why don’t you start the discussion?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *