Des modèles gratuits qui tournent sur votre propre ordinateur : la donnée ne sort pas du cabinet. Ce que ça vaut, ce que ça coûte, et comment s'y mettre en dix minutes.
| Grand modèle en ligne | Modèle ouvert, en local | |
|---|---|---|
| Où va la donnée | Sur les serveurs de l'éditeur | Nulle part : elle reste sur votre machine |
| Puissance | Maximale, mise à jour en continu | Correcte à bonne, selon votre matériel |
| Coût | Abonnement mensuel | Gratuit ; le coût, c'est votre ordinateur |
| Connexion | Indispensable | Aucune : fonctionne en zone blanche, en visite, en avion |
| Recherche web | Oui, selon l'outil | Non : connaissances figées à la date d'entraînement |
| Bon usage médical | Raisonnement, synthèse, questions complexes, données anonymisées | Tout ce qui touche des documents sensibles, brouillons, anonymisation |
Une précision de vocabulaire que les puristes feront à raison : la plupart de ces modèles sont dits « à poids ouverts » : le modèle est téléchargeable, ses données d'entraînement ne le sont pas toujours. Pour l'usage au cabinet, la distinction ne change rien : c'est la licence d'utilisation (souvent très permissive, type Apache 2.0 ou MIT) et l'exécution locale qui comptent.
Mac, Windows ou Linux. Aucune compétence technique au-delà d'installer un logiciel.
LM Studio : interface graphique complète, catalogue de modèles intégré : le choix naturel pour débuter. Ollama : plus dépouillé, apprécié des utilisateurs à l'aise avec la ligne de commande, avec désormais sa propre interface. Les deux sont gratuits ; téléchargez depuis le site officiel de l'éditeur, uniquement.
Le logiciel indique ce que votre matériel supporte. Repères : 8 Go de mémoire = petits modèles (4 milliards de paramètres, versions compressées) pour dépanner ; 16 Go = la zone de confort des modèles moyens ; 32 Go et plus = les modèles qui rivalisent avec le milieu de gamme en ligne. Les Mac à puce Apple sont particulièrement à l'aise à cet exercice.
Faites passer au modèle le test des trois questions de la page « 6 erreurs » : une réponse que vous connaissez, une réponse qui n'existe pas, une fausse prémisse volontaire. Un modèle local se trompe plus souvent qu'un grand modèle en ligne : mesurez-le une fois, vous saurez quoi lui confier.
Tous téléchargeables gratuitement via LM Studio, Ollama ou Hugging Face. Le paysage se renouvelle tous les six mois : retenez les familles plus que les numéros de version.
| Famille | Éditeur | À retenir |
|---|---|---|
| Gemma 3 | Du très petit (tourne sur un portable modeste) au grand ; comprend aussi les images ; plus de 140 langues | |
| gpt-oss | OpenAI | Les modèles ouverts d'OpenAI (août 2025), licence Apache 2.0 ; bon raisonnement, la version 20b tourne avec 16 Go |
| Mistral Small | Mistral AI (France) | Licence Apache 2.0, français particulièrement soigné : le choix naturel pour les courriers |
| Qwen 3 | Alibaba | Licence Apache 2.0, toutes tailles, très bons scores : la famille la plus déclinée du moment |
| Llama 4 | Meta | Contexte géant (documents très longs) ; licence « communautaire », plus restrictive que l'Apache 2.0 |
| DeepSeek | DeepSeek (Chine) | Licence MIT, raisonnement remarquable ; les grandes versions demandent du gros matériel |
| MedGemma | Dérivé médical de Gemma (texte et imagerie), publié sur Hugging Face : outil de recherche, pas un dispositif médical : à explorer, jamais pour décider |
Le modèle local nettoie un document de toutes ses données identifiantes avant qu'il ne parte vers un outil en ligne. La donnée sensible ne quitte jamais la machine ; le grand modèle en ligne ne reçoit que la version propre. Le meilleur des deux mondes ; le prompt est ci-dessous.
Synthèse d'un dossier avant une consultation complexe, mise en forme de notes : tout ce que vous n'enverriez jamais en ligne se traite en local, porte fermée.
Visite à domicile, EHPAD en zone blanche, train : courriers, fiches, reformulations fonctionnent sans réseau. La qualité d'un modèle moyen suffit largement à un premier jet que vous relirez.
LM Studio et les outils compagnons (AnythingLLM, Open WebUI) permettent de « brancher » le modèle sur un dossier de protocoles ou de recommandations : vos référentiels, interrogeables localement : l'esprit NotebookLM, version porte fermée.
Une machine correcte du cabinet peut servir de modèle commun pour l'équipe, accessible depuis les autres postes du réseau interne. Installation à faire faire par votre prestataire informatique, en exigeant que rien ne soit exposé à l'internet.
Réécris ce texte en remplaçant toute donnée identifiante par des balises génériques : noms et initiales → [PATIENT] ou [MÉDECIN], dates précises → [DATE] (garde les délais : « à 3 semaines »), lieux et établissements → [VILLE], [HÔPITAL], numéros et identifiants → [ID], professions et situations rares → formulation générale. Ne modifie rien d'autre : ni les données cliniques, ni les résultats, ni la chronologie relative. Termine par la liste de tout ce que tu as remplacé, pour vérification. Texte : [coller ici]
Le grand modèle en ligne pour la puissance, le petit modèle local pour la confidentialité. Le médecin averti se sert des deux. Règle d'or inchangée : ce qui est sensible reste local ; ce qui part en ligne est anonymisé ; ce qui est décisionnel est vérifié.
Les logiciels (LM Studio, Ollama) et les modèles cités sont gratuits, y compris pour un usage professionnel dans la plupart des licences (Apache 2.0, MIT ; vérifiez pour Llama, dont la licence est spécifique). Le « piège » est ailleurs : le coût, c'est votre matériel et votre temps de prise en main. Les éditeurs de modèles, eux, y trouvent l'adoption de leur écosystème.
N'achetez rien avant d'avoir essayé sur votre machine actuelle : un ordinateur de moins de cinq ans avec 16 Go de mémoire donne déjà un résultat honnête. Si vous investissez : un Mac à puce Apple avec beaucoup de mémoire unifiée, ou un PC avec une carte graphique récente et de la mémoire vidéo : c'est elle qui fait la vitesse.
Vous pouvez le télécharger et l'explorer librement : Google le publie sous conditions d'utilisation dédiées aux modèles de santé, en précisant qu'il ne s'agit pas d'un produit clinique. L'utiliser pour orienter une décision de soin reviendrait à utiliser un outil non certifié dans un acte médical : votre responsabilité pleine et entière, sans le filet du marquage CE. Terrain d'exploration et de recherche : oui. Aide à la décision : non.
Pas forcément : « local » peut signifier sur votre poste, sur un serveur du cabinet, ou sur le cloud privé de l'éditeur. Trois questions à lui poser : où tourne le modèle exactement, quelles données y transitent, et qui est l'hébergeur. S'il y a des données de santé, la certification HDS s'applique. Les réponses figurent dans votre grille d'évaluation (page dédiée du livre).
| Élément | Source |
|---|---|
| gpt-oss : modèles ouverts d'OpenAI, licence Apache 2.0, versions 20b et 120b | OpenAI, annonce d'août 2025 |
| MedGemma : modèles médicaux ouverts (4B multimodal, 27B), publiés pour la recherche et le développement | Google, Health AI Developer Foundations / Hugging Face, 2025 |
| Licences et tailles : Gemma 3, Qwen 3, Mistral Small (Apache 2.0), DeepSeek (MIT), Llama 4 (licence communautaire Meta) | Fiches officielles des modèles (Hugging Face), consultées en août 2026 |
| Outils d'exécution locale : LM Studio, Ollama, et compagnons (AnythingLLM, Open WebUI) | Sites officiels des éditeurs, consultés en août 2026 |
| Obligations inchangées sur les données de santé traitées localement | RGPD ; CSP art. L.1110-4 ; recommandations CNIL sur la sécurité des postes de travail |