Ressource compagnon · L'IA Minute du Médecin

L'IA open source : le modèle chez vous

Des modèles gratuits qui tournent sur votre propre ordinateur : la donnée ne sort pas du cabinet. Ce que ça vaut, ce que ça coûte, et comment s'y mettre en dix minutes.

Mise à jour : 5 août 2026. Le paysage des modèles bouge vite : les noms cités sont ceux de l'été 2026.

Trois choses à comprendre avant de télécharger

Local ou en ligne : ce qui change vraiment

Grand modèle en ligneModèle ouvert, en local
Où va la donnéeSur les serveurs de l'éditeurNulle part : elle reste sur votre machine
PuissanceMaximale, mise à jour en continuCorrecte à bonne, selon votre matériel
CoûtAbonnement mensuelGratuit ; le coût, c'est votre ordinateur
ConnexionIndispensableAucune : fonctionne en zone blanche, en visite, en avion
Recherche webOui, selon l'outilNon : connaissances figées à la date d'entraînement
Bon usage médicalRaisonnement, synthèse, questions complexes, données anonymiséesTout ce qui touche des documents sensibles, brouillons, anonymisation

Une précision de vocabulaire que les puristes feront à raison : la plupart de ces modèles sont dits « à poids ouverts » : le modèle est téléchargeable, ses données d'entraînement ne le sont pas toujours. Pour l'usage au cabinet, la distinction ne change rien : c'est la licence d'utilisation (souvent très permissive, type Apache 2.0 ou MIT) et l'exécution locale qui comptent.

S'y mettre en trois temps

Mac, Windows ou Linux. Aucune compétence technique au-delà d'installer un logiciel.

1

Installez LM Studio ou Ollama

LM Studio : interface graphique complète, catalogue de modèles intégré : le choix naturel pour débuter. Ollama : plus dépouillé, apprécié des utilisateurs à l'aise avec la ligne de commande, avec désormais sa propre interface. Les deux sont gratuits ; téléchargez depuis le site officiel de l'éditeur, uniquement.

2

Téléchargez un modèle adapté à votre machine

Le logiciel indique ce que votre matériel supporte. Repères : 8 Go de mémoire = petits modèles (4 milliards de paramètres, versions compressées) pour dépanner ; 16 Go = la zone de confort des modèles moyens ; 32 Go et plus = les modèles qui rivalisent avec le milieu de gamme en ligne. Les Mac à puce Apple sont particulièrement à l'aise à cet exercice.

3

Calibrez la confiance avant l'usage

Faites passer au modèle le test des trois questions de la page « 6 erreurs » : une réponse que vous connaissez, une réponse qui n'existe pas, une fausse prémisse volontaire. Un modèle local se trompe plus souvent qu'un grand modèle en ligne : mesurez-le une fois, vous saurez quoi lui confier.

Les modèles qui comptent, été 2026

Tous téléchargeables gratuitement via LM Studio, Ollama ou Hugging Face. Le paysage se renouvelle tous les six mois : retenez les familles plus que les numéros de version.

FamilleÉditeurÀ retenir
Gemma 3GoogleDu très petit (tourne sur un portable modeste) au grand ; comprend aussi les images ; plus de 140 langues
gpt-ossOpenAILes modèles ouverts d'OpenAI (août 2025), licence Apache 2.0 ; bon raisonnement, la version 20b tourne avec 16 Go
Mistral SmallMistral AI (France)Licence Apache 2.0, français particulièrement soigné : le choix naturel pour les courriers
Qwen 3AlibabaLicence Apache 2.0, toutes tailles, très bons scores : la famille la plus déclinée du moment
Llama 4MetaContexte géant (documents très longs) ; licence « communautaire », plus restrictive que l'Apache 2.0
DeepSeekDeepSeek (Chine)Licence MIT, raisonnement remarquable ; les grandes versions demandent du gros matériel
MedGemmaGoogleDérivé médical de Gemma (texte et imagerie), publié sur Hugging Face : outil de recherche, pas un dispositif médical : à explorer, jamais pour décider

Cinq usages qui ont du sens au cabinet

1

Le sas d'anonymisation : l'usage n°1

Le modèle local nettoie un document de toutes ses données identifiantes avant qu'il ne parte vers un outil en ligne. La donnée sensible ne quitte jamais la machine ; le grand modèle en ligne ne reçoit que la version propre. Le meilleur des deux mondes ; le prompt est ci-dessous.

2

Résumer et structurer des documents sensibles

Synthèse d'un dossier avant une consultation complexe, mise en forme de notes : tout ce que vous n'enverriez jamais en ligne se traite en local, porte fermée.

3

Les brouillons hors connexion

Visite à domicile, EHPAD en zone blanche, train : courriers, fiches, reformulations fonctionnent sans réseau. La qualité d'un modèle moyen suffit largement à un premier jet que vous relirez.

4

Interroger vos propres documents

LM Studio et les outils compagnons (AnythingLLM, Open WebUI) permettent de « brancher » le modèle sur un dossier de protocoles ou de recommandations : vos référentiels, interrogeables localement : l'esprit NotebookLM, version porte fermée.

5

Un poste partagé pour le cabinet de groupe

Une machine correcte du cabinet peut servir de modèle commun pour l'équipe, accessible depuis les autres postes du réseau interne. Installation à faire faire par votre prestataire informatique, en exigeant que rien ne soit exposé à l'internet.

Le prompt du sas d'anonymisation

Réécris ce texte en remplaçant toute donnée identifiante par des balises génériques :
noms et initiales → [PATIENT] ou [MÉDECIN], dates précises → [DATE] (garde les délais : « à 3 semaines »),
lieux et établissements → [VILLE], [HÔPITAL], numéros et identifiants → [ID], professions et situations rares → formulation générale.
Ne modifie rien d'autre : ni les données cliniques, ni les résultats, ni la chronologie relative.
Termine par la liste de tout ce que tu as remplacé, pour vérification.

Texte : [coller ici]

Les limites, sans fard

Ce qu'un modèle local n'est pas

  • Ce n'est pas un dispositif médical : aucun modèle ouvert généraliste n'est certifié pour un usage clinique, MedGemma inclus, que Google publie explicitement pour la recherche et le développement.
  • Ce n'est pas plus fiable parce que c'est chez vous : à taille égale, un modèle local hallucine davantage qu'un grand modèle en ligne. Jamais une posologie, un seuil ou une référence sans vérification à la source.
  • Ce n'est pas connecté : pas de recherche web, connaissances arrêtées à la date d'entraînement du modèle : inutilisable pour l'actualité réglementaire ou une reco récente.
  • Ce n'est pas hors la loi pour autant : secret médical et RGPD s'appliquent à votre machine : chiffrement du disque, session verrouillée, sauvegardes maîtrisées. Le local supprime le transfert de données, pas vos obligations.

Le grand modèle en ligne pour la puissance, le petit modèle local pour la confidentialité. Le médecin averti se sert des deux. Règle d'or inchangée : ce qui est sensible reste local ; ce qui part en ligne est anonymisé ; ce qui est décisionnel est vérifié.

Questions fréquentes

Est-ce vraiment gratuit ? Où est le piège ?

Les logiciels (LM Studio, Ollama) et les modèles cités sont gratuits, y compris pour un usage professionnel dans la plupart des licences (Apache 2.0, MIT ; vérifiez pour Llama, dont la licence est spécifique). Le « piège » est ailleurs : le coût, c'est votre matériel et votre temps de prise en main. Les éditeurs de modèles, eux, y trouvent l'adoption de leur écosystème.

Quel matériel acheter si je pars de zéro ?

N'achetez rien avant d'avoir essayé sur votre machine actuelle : un ordinateur de moins de cinq ans avec 16 Go de mémoire donne déjà un résultat honnête. Si vous investissez : un Mac à puce Apple avec beaucoup de mémoire unifiée, ou un PC avec une carte graphique récente et de la mémoire vidéo : c'est elle qui fait la vitesse.

Ai-je le droit d'utiliser MedGemma avec mes patients ?

Vous pouvez le télécharger et l'explorer librement : Google le publie sous conditions d'utilisation dédiées aux modèles de santé, en précisant qu'il ne s'agit pas d'un produit clinique. L'utiliser pour orienter une décision de soin reviendrait à utiliser un outil non certifié dans un acte médical : votre responsabilité pleine et entière, sans le filet du marquage CE. Terrain d'exploration et de recherche : oui. Aide à la décision : non.

Mon éditeur de logiciel métier me vend déjà de l'« IA locale ». C'est pareil ?

Pas forcément : « local » peut signifier sur votre poste, sur un serveur du cabinet, ou sur le cloud privé de l'éditeur. Trois questions à lui poser : où tourne le modèle exactement, quelles données y transitent, et qui est l'hébergeur. S'il y a des données de santé, la certification HDS s'applique. Les réponses figurent dans votre grille d'évaluation (page dédiée du livre).

Sources

ÉlémentSource
gpt-oss : modèles ouverts d'OpenAI, licence Apache 2.0, versions 20b et 120bOpenAI, annonce d'août 2025
MedGemma : modèles médicaux ouverts (4B multimodal, 27B), publiés pour la recherche et le développementGoogle, Health AI Developer Foundations / Hugging Face, 2025
Licences et tailles : Gemma 3, Qwen 3, Mistral Small (Apache 2.0), DeepSeek (MIT), Llama 4 (licence communautaire Meta)Fiches officielles des modèles (Hugging Face), consultées en août 2026
Outils d'exécution locale : LM Studio, Ollama, et compagnons (AnythingLLM, Open WebUI)Sites officiels des éditeurs, consultés en août 2026
Obligations inchangées sur les données de santé traitées localementRGPD ; CSP art. L.1110-4 ; recommandations CNIL sur la sécurité des postes de travail