17 juillet 2026 - Cours IA - Chapitre 4

Les LLM ont-ils une personnalité ?

ChatGPT, Claude, Gemini, Grok, DeepSeek, Mistral : styles, points forts et défauts des principaux LLM, racontés avec une pointe d'ironie.

Oui, ils ont leur propre personnalité

Ce ne sont pas des humains, mais en les utilisant longtemps, on voit émerger des styles par défaut assez reconnaissables. Le comportement du modèle change cependant beaucoup selon d’autres facteurs, parmi lesquels : le modèle spécifique utilisé, comment nous avons configuré les différentes mémoires et instructions du modèle, les instructions à l’intérieur de chaque conversation, divers outils qui font varier le ton (par ex. les Styles de Claude), les skills chargées et aussi la langue de la conversation.

Des études “psychologiques” ont été menées à ce sujet et confirment qu’il existe des différences, mais compte tenu du point précédent, si on sait suffisamment bien les utiliser, on a en dernière analyse la possibilité de modifier dans une large mesure leurs caractéristiques par défaut pour les adapter à la tâche que l’on est en train d’accomplir.

Ces évaluations doivent donc être prises comme une orientation pratique, non comme un verdict, et elles sont écrites certes en ayant recueilli des données, mais surtout comme mes observations personnelles qui, en tant que telles, sont subjectives, et seront exposées avec un certain degré d’ironie.

Dernier point : la valeur habituelle du mot “aujourd’hui”, c’est-à-dire que c’est la situation en juillet 2026, rien ne garantit qu’il en sera de même dans quelques mois.

ChatGPT, l’enthousiaste et capable couteau suisse

ChatGPT a tendance à être sociable, fluide et sûr de lui. Aujourd’hui il est vraiment très, très bon pour faire beaucoup de choses et pour le faire au sein d’une seule interface, et même en code, la dernière version de Codex n’a rien à envier à Claude Code. C’est amusant ! Vous pouvez tout à fait parler avec ChatGPT en conduisant et l’expérience est tout sauf mécanique !

Il est très fort en raisonnement opérationnel, en programmation, en explication pas à pas et dans le passage rapide de l’idée à l’exécution. Le revers de la médaille est la tendance, dans certaines situations, à trop se ranger du côté de l’utilisateur. Il peut se montrer excessivement encourageant, complaisant ou “lèche-bottes” : des formules comme “excellente idée”, “tu t’en sors très bien”, “tu as mis le doigt sur le point important” peuvent apparaître même quand elles ne sont pas vraiment nécessaires, même si dernièrement cette tendance à la sycophancy enthousiaste a été sensiblement améliorée. À Milan, on dirait qu’il “ne se la joue pas”, il a une approche très américaine, donc enthousiaste, à jour, polyvalent, très puissant et parfois un peu lèche-bottes.

Claude, le professionnel éthique

Il est souvent plus enclin que d’autres modèles à dire “je ne sais pas”, à signaler les incertitudes et à corriger l’utilisateur quand il estime qu’une prémisse est erronée.

C’est probablement le plus professionnel, et il l’est par conception : Anthropic a concentré ses énergies à en faire un outil efficace pour les entreprises, et ça se voit ; en effet il ne fait pas de vidéo, ne fait pas d’images et même son système vocal est plutôt médiocre, mais cela ne l’intéresse pas.

Il est plus “européen” dans le ton, même s’il est très américain (son fondateur et PDG est Dario Amodei, d’origine italienne, sorti d’OpenAI pour désaccord sur des questions liées à la sécurité, hasard ?).

Claude Code, son framework de génération de code, a été une révolution et pendant longtemps, inégalé en performances ; aujourd’hui ce n’est plus le cas et les autres concurrents sont alignés. Il faut aussi mentionner Cowork qui vous permet d’agir sur les fichiers de votre PC et de créer des tâches programmées. À mon avis, c’est celui qui apparaît comme “le plus sage”, c’est-à-dire plus posé et plus attentif à des valeurs éthiques profondes, et cela aussi est par conception, Anthropic a des principes fondateurs qui mettent au centre une attention particulière à l’alignement et à la sécurité. Il a une écriture généralement naturelle, moins mécanique, avec un bon rythme argumentatif. Pendant un temps, il a semblé trop prudent (disons ennuyeux), maintenant ça va mieux.

Gemini, le super connecté

Gemini a tendance à être structuré, ordonné, analytique. Ses réponses ressemblent souvent davantage à un briefing bien organisé qu’à une conversation naturelle. Il a des points forts littéralement uniques ! Il est intégré à l’écosystème Google et si vous utilisez Workspace (faites une petite recherche si vous ne le connaissez pas), ses potentialités sont incroyables : il peut co-gérer les mails, votre calendrier, interagir avec les feuilles de calcul Google, lire et analyser les fichiers dans vos documents Google, etc. Très fort en multimodalité, contexte long, recherche, documents étendus, rapport prix/performances. Nano Banana, son créateur d’images intégré, a été une révolution.

Deux autres notes très importantes : YouTube appartient à Alphabet, qui est Google, et sa capacité à résumer avec précision le contenu des vidéos est époustouflante ; de plus, Gemini est le LLM qui fait fonctionner NotebookLM, et si vous ne savez pas ce que c’est, vous devriez immédiatement aller chercher des informations à ce sujet (j’en parlerai évidemment plus loin dans le cours).

Le problème est que de nombreux utilisateurs techniques, dont l’auteur de ces lignes, perçoivent une qualité moins stable par rapport au pic initial de Gemini 2.5 Pro de l’année dernière : parfois il semble brillant, d’autres fois plus plat, froid, filtré ou irrégulier. Sur les sujets sensibles, c’est l’Américain politiquement correct et un peu woke de la Silicon Valley, il peut sembler plus bloqué ou moins explicite, aussi parce que les systèmes de sécurité et de filtrage influent beaucoup sur le comportement final.

Grok, on se prend une petite bière ensemble ?

Mention spéciale pour le LLM d’Elon Musk : de loin le plus sympathique.

Grok est probablement sous-estimé si on le juge seulement à travers les valeurs des benchmarks ou pour ses capacités en coding, car il n’est jamais au niveau des modèles de frontière précédents, mais en pure conversation, c’est un régal ! Ton, spontanéité, ironie, liberté d’expression sur tous les sujets, et interaction avec l’actualité grâce à la forte connexion avec X (ex-Twitter) : ce petit gars a une grande personnalité et, quoi qu’on en dise, il n’est pas du tout bête !

La facturation, elle, est vraiment absurde : noms qui se superposent, plans X et plans xAI séparés, offres temporaires, limites consommateur non explicitées. Et rien, on n’y comprend rien ; si vous y arrivez, dites-le-moi.

DeepSeek, le pragmatique

DeepSeek est difficile à décrire si l’on parle de “personnalité”, c’est le moins “personnage” parmi les grands LLM.

Il a pourtant une empreinte : il est sec, pragmatique, peu théâtral. Il n’a pas ce ton de service client américain, toujours gentil, rassurant, lissé. Il répond plus comme un moteur technique que comme un assistant personnel ; en pratique, il travaille beaucoup, à un prix même pas comparable à celui des modèles de frontière américains.

Et puis le paradoxe : c’est un modèle chinois et en tant que tel, tout le monde le désigne comme “au service du Parti communiste”, “on ne sait pas où finissent nos données et comment elles seront utilisées”, “si tu lui demandes la place Tian’anmen, il ne te répond pas” ; tout cela est vrai, mais DeepSeek a eu et continue d’avoir un impact énorme sur la démocratisation de l’IA parce que c’est un modèle téléchargeable et utilisable en local, avec différentes tailles selon le matériel disponible (les grandes tailles nécessitent des serveurs puissants, pas des PC de maison) ; de plus, les paramètres sont modifiables pour faire du fine-tuning, c’est-à-dire pour le spécialiser dans des tâches particulières, et malgré les tonnes de dollars et les puces dernier cri qu’utilisent les LLM américains, les Chinois ont dû affiner le cerveau pour pallier ces manques, et ils y sont arrivés en inventant des technologies très avancées ! Alors que de nombreux grands laboratoires occidentaux parlent de sécurité, de responsabilité et d’accès universel, mais gardent modèles, données, coûts et infrastructures sous clé, DeepSeek a mis en circulation des modèles puissants, téléchargeables, modifiables et utilisables même commercialement.

Mistral, l’alternative européenne

J’avoue avoir utilisé Mistral peu de fois, mais je m’en souviens. Les réponses me semblaient totalement neutres, encore plus que celles de DeepSeek ; je l’ai réessayé maintenant et je confirme mon impression personnelle.

Mistral est une famille de modèles français, téléchargeables, accessibles sur le web via l’interface Le Chat.

Cette interface, récemment renommée Vibe, met à disposition un excellent écosystème de connexion externe : Google Workspace, Outlook, Slack, GitHub, Notion, Zapier, et des connecteurs MCP personnalisés.

Ses points forts ne sont pas la puissance brute, où il est assez éloigné des modèles de frontière, mais le fait qu’il soit utilisable quotidiennement grâce à ses connexions (grande différence avec DeepSeek par exemple), qu’il soit téléchargeable et modifiable (les versions téléchargeables sont gratuites sauf les versions phares, qui sont payantes uniquement pour les grandes entreprises) et qu’il soit attentif au traitement des données en tant qu’européen soumis au très strict RGPD.

Malheureusement, Le Chat, comparé aux modèles de frontière et aux performances qu’il offre, est plutôt coûteux.


Il n’y a qu’un seul conseil : ouvrez-en deux ou trois que vous n’avez jamais utilisés et posez-leur exactement la même question. Les différences que vous verrez valent plus que mille avis.