Sur 100 questions réelles de comptoir, Galien.AI répond juste 90 fois sur 100.
Les IA généralistes, elles, plafonnent à une réponse juste sur deux. Pas sur des questions pièges de laboratoire : sur des cas d'officine ordinaires, ceux qui décident du médicament qu'on donne.
Un seul et même jeu de questions, cinq systèmes, une seule grille de notation
Chaque système a reçu la question brute, une seule fois, avec sa propre recherche web. Aucun n'a eu droit à un indice.
Score = pourcentage de réponses jugées correctes sur 100 questions de pharmacie d'officine, mesure du 12 août 2026.
Se tromper, ce n'est pas le pire. Affirmer un chiffre faux avec aplomb, si.
Un code LPP inventé, un générique qui n'existe pas, une posologie donnée pour une présentation qui n'est plus commercialisée : ce n'est pas une erreur de raisonnement, c'est une donnée fabriquée.
Galien.AI n'a pas seulement le meilleur score : c'est aussi le système qui invente le moins, deux à quatre fois moins que les IA généralistes du panel.
Un score ne suffit pas. Galien.AI embarque un étage de vérification qui signale ses propres affirmations non confirmées.
Aucun système d'information n'est infaillible, le nôtre non plus. C'est pourquoi chaque réponse de Galien.AI est relue, après coup, par un second étage de vérification indépendant du moteur qui répond : les affirmations qui ne correspondent pas à une source réellement consultée sont signalées visuellement au pharmacien, directement dans la réponse. Les IA généralistes affirment avec le même aplomb quand elles savent et quand elles inventent. Galien.AI montre ce qui est vérifié, et dit ce qui ne l'est pas.
Galien.AI tourne sur Claude Sonnet 5. Interrogé seul, sans nos sources, ce même modèle tombe à 48/100.
Ce n'est donc pas l'intelligence artificielle qui fait la différence. C'est ce qu'on lui donne à lire : la base de données publique des médicaments, la liste des produits et prestations remboursables, le thésaurus des interactions de l'ANSM, les référentiels d'écrasabilité, tenus à jour et vérifiés, plutôt qu'une recherche web générique lancée au dernier moment.
Des questions qui paraissent banales, et qui ne le sont pas
Aucun piège de laboratoire ici : juste le genre de question qui arrive dix fois par jour, où l'intuition la plus probable est la mauvaise réponse.
« L'Epitomax, je peux substituer ? »
Ça dépend de la forme. Les comprimés de topiramate comptent plusieurs génériques commercialisés, mais les gélules ont leurs propres groupes, sans aucun générique inscrit. Une gélule et un comprimé de même dosage ne sont pas le même groupe de substitution.
Réponse plausible d'une IA généraliste : « Oui, le topiramate est génériqué, vous pouvez substituer. »
Source : Répertoire des groupes génériques, ANSM
« Le Previscan, je peux l'écraser pour une dame qui avale mal ? »
La liste nationale le classe écrasable, mais le laboratoire Merck a répondu le 07/05/2022 qu'il n'existe aucune donnée de stabilité une fois écrasé, et laisse la décision au soignant. Sur un anticoagulant, cette réserve n'apparaît pas dans la liste seule.
Réponse plausible d'une IA généraliste : « La liste dit écrasable, donc oui, sans réserve. »
Source : Liste nationale OMéDIT Normandie / SFPC, réponse laboratoire Merck
« L'Aspégic 1000, je prends la boîte de 30 pour en avoir d'avance. »
Mauvaise pioche dans les deux sens : sur l'Aspégic 1000 mg en sachets, seule la boîte de 20 sachets est remboursable, à 65 %, à 2,67 €. Les boîtes de 15 et de 30 sachets sont toutes les deux hors nomenclature, à prix libre.
Réponse plausible d'une IA généraliste : « Les petites boîtes sont remboursées, la grande non. »
Source : Base de données publique des médicaments, prix et taux par présentation
« L'entretien hebdomadaire d'un PICC line, je facture quoi ? »
Le forfait PERFADOM22, code 1170419, à 17,86 €, qui vise spécifiquement le PICC line. À ne pas confondre avec PERFADOM21, code 1103392, à 9,16 €, qui vise l'entretien d'une voie centrale sauf PICC line : les libellés se ressemblent, le tarif non.
Réponse plausible d'une IA généraliste : un code inventé, ou le forfait générique d'entretien de voie centrale sans distinguer le PICC.
Source : Liste des produits et prestations remboursables (LPP)
« Le Kardégic 100, il est remboursé à combien ? »
Il n'existe pas de Kardégic 100. La gamme commercialisée comporte les dosages 75, 160 et 300 mg : la question de remboursement ne se pose donc pas telle quelle, elle dépend du dosage réellement prescrit.
Réponse plausible d'une IA généraliste : un taux et un prix pour un produit qui n'existe pas.
Source : Base de données publique des médicaments (BDPM)
« Parmi Xarelto, Eliquis, Ozempic, Mounjaro, Shingrix et Prevenar 20, lesquels ont le triangle noir ? »
Deux seulement : Mounjaro, à tous ses dosages, et Prevenar 20. Les quatre autres sont explicitement déclarés non soumis à surveillance renforcée au référentiel : ce n'est pas une donnée manquante, c'est un « non » constaté.
Réponse plausible d'une IA généraliste : une réponse par ancienneté supposée du produit, au lieu du référentiel réel.
Source : Base de données publique des médicaments, surveillance renforcée
Voir les 100 questions et les réponses complètes des 5 systèmes
Comment on a mesuré ça
Écrite avant de lancer le premier test, publiée telle quelle.
Des questions réelles, pas des pièges de laboratoire
100 questions ancrées sur la base de données publique des médicaments, la nomenclature LPP et le thésaurus des interactions, dans le format d'un vrai comptoir.
Aucune aide donnée à personne
Question brute, un seul passage, sans reformulation ni relance. Chaque système garde sa propre recherche web, activée pour tous.
Le milieu de gamme, pas la vitrine
Les IA généralistes testées sont celles qu'un pharmacien obtient par défaut, sans compte payant ni choix de modèle : c'est l'usage réel, pas la meilleure version disponible.
Notation à l'aveugle
Un juge IA indépendant compare chaque réponse à une référence sourcée, sur une grille binaire identique pour tous, avec relecture humaine sur les cas sensibles.
Aucun outil français concurrent n'a été nommé ni interrogé dans ce comparatif : il porte uniquement sur les IA généralistes que tout pharmacien a déjà ouvertes une fois, gratuitement, sans y penser.
Le protocole complet, les 100 questions et les réponses intégrales sont dans le rapport PDF
Questions fréquentes
Comment les réponses ont-elles été notées ?
Pourquoi comparer à des IA milieu de gamme plutôt qu'aux meilleures versions disponibles ?
Pourquoi Claude Sonnet 5 fait-il partie du comparatif ?
Le jeu de 100 questions est-il consultable ?
Que se passe-t-il quand Galien.AI se trompe ?
Galien.AI est-il un dispositif médical ?
37 points d'écart avec la meilleure IA généraliste. Voyez pourquoi sur votre propre question.
Une question, sans créer de compte : le vrai moteur répond en direct, sources officielles citées.
Galien.AI restitue une information documentaire sourcée. La vérification et la décision relèvent du pharmacien.