AccueilModèles IAGuide

Installer une IA en local : confidentialité pour TPE/PME

GuidePar la rédaction11 min

Installer une IA en local, c’est faire tourner un modèle de langage directement sur votre ordinateur ou votre serveur, sans envoyer le moindre mot dans le cloud. Vos prompts, vos documents, vos données clients restent sur votre disque. Pour une TPE/PME qui manipule des informations sensibles, c’est souvent la seule façon d’utiliser l’IA sans poser de problème de confidentialité ni de RGPD.

La bonne nouvelle : en 2026, ça ne demande plus d’être ingénieur. Trois logiciels gratuits et une poignée de modèles ouverts suffisent. La moins bonne : ce n’est pas magique, et pour beaucoup d’usages le cloud reste plus simple. Ce guide tranche, avec des chiffres vérifiés et une section « concrètement, pour vous ».

IA en local : de quoi parle-t-on exactement

Une IA en local est un modèle de langage (un LLM) dont les fichiers sont téléchargés sur votre machine et qui calcule ses réponses avec votre processeur ou votre carte graphique, sans connexion à un serveur distant. C’est l’opposé de ChatGPT ou Gemini, où chaque message part vers les serveurs d’OpenAI ou de Google.

Pour que ça marche, il faut deux briques :

Une fois les deux en place, vous discutez avec l’IA dans une fenêtre de chat, exactement comme avec ChatGPT, sauf que tout se passe chez vous. Et oui, ça fonctionne même sans internet une fois le modèle téléchargé.

IA locale vs IA cloud, l’essentiel :

  • 0 donnée envoyée à un tiers / IA locale
  • 0 abonnement mensuel / modèle ouvert gratuit
  • 8 Go de RAM minimum / pour démarrer avec un petit modèle
  • Fonctionne hors ligne / une fois le modèle téléchargé

Sources : Ollama System Requirements, LM Studio

Pourquoi installer une IA en local : 4 raisons concrètes

L’argument numéro un, c’est la confidentialité. Quand vous collez un contrat, un fichier RH ou une liste de clients dans ChatGPT, ces données transitent par des serveurs américains. En local, elles ne bougent pas.

1. La confidentialité réelle de vos données

Sur une offre grand public d’IA cloud, vos échanges peuvent servir à entraîner le modèle, sauf réglage contraire ou offre entreprise. Nous l’avons détaillé dans notre guide sur où vont vraiment vos données quand vous utilisez l’IA. En local, la question ne se pose plus : aucune donnée ne sort. C’est la différence entre « j’espère qu’ils ne lisent pas » et « ils ne peuvent pas lire ».

2. La conformité RGPD

Traiter des données personnelles avec un service hébergé hors UE oblige à vérifier les transferts de données, les clauses contractuelles, parfois à signer un accord de sous-traitance. En gardant le traitement sur une machine en France, vous supprimez le transfert hors UE à la racine. Pour un cabinet, un cabinet comptable ou un service RH, c’est un argument lourd.

3. La souveraineté et l’indépendance

Un modèle ouvert installé chez vous ne disparaît pas si un fournisseur change ses tarifs, ferme une API ou bride un service. Le fichier est sur votre disque. Vous ne dépendez plus d’une décision prise à San Francisco un mardi matin.

4. Le coût à l’usage

Les modèles ouverts sont gratuits à télécharger. Pas d’abonnement par utilisateur, pas de facturation au million de tokens. Le seul coût, c’est l’électricité et, éventuellement, une carte graphique correcte. Pour un usage intensif et répété, l’économie devient réelle.

Ce que le local supprime, côté risque :

  • 0 transfert de données hors UE / traitement sur machine locale
  • 0 € par utilisateur et par mois / pas d’abonnement
  • 0 token facturé / modèle gratuit après téléchargement
  • 0 coupure si l’API du fournisseur change / fichier sur votre disque

Sources : Guide to Local LLMs 2026, Mistral Small 3.2 (licence Apache 2.0)

Les 3 outils pour installer une IA en local

Trois logiciels gratuits dominent en 2026. Ils font tous la même chose (faire tourner un modèle sur votre machine) mais visent des profils différents.

Outil Interface Pour qui Prix Particularité
Ollama Ligne de commande + API Pros techniques, développeurs Gratuit, open source API locale sur le port 11434, on lance un modèle en une commande
LM Studio Application graphique Non-techniciens qui veulent du clic Gratuit (perso et pro) Catalogue de modèles intégré, chat prêt à l’emploi, API compatible OpenAI
Jan Application graphique Confidentialité maximale, open source strict Gratuit, open source Tout open source, peut aussi brancher des modèles cloud au besoin

Sources : LM Studio, Jan, Guide to Local LLMs 2026

Notre conseil concret. Si vous n’êtes pas à l’aise avec un terminal, commencez par LM Studio : vous parcourez un catalogue, vous cliquez sur « télécharger », vous discutez. Si vous voulez le plus open source possible, Jan. Si vous comptez brancher l’IA sur d’autres outils (un tableur, un logiciel maison), Ollama et son API locale sont taillés pour ça. Les trois cohabitent très bien.

Quel modèle ouvert installer en local en 2026

Un modèle ouvert est un LLM dont les poids (les fichiers du modèle) sont publiés librement, donc téléchargeables et exécutables sur votre matériel. Quatre familles tiennent le haut du pavé en 2026, et leurs licences ne se valent pas.

Modèle Éditeur Taille de référence Poids du fichier (Q4) Licence
Mistral Small 3.2 Mistral AI (France) 24 milliards de paramètres 15 Go Apache 2.0 (usage commercial libre)
Llama 3.3 Meta 70 milliards de paramètres 43 Go Llama Community License (plafond 700 M d’utilisateurs)
Qwen3 Alibaba variable (8 à 32 B et plus) selon la taille Apache 2.0 (usage commercial libre)
DeepSeek R1 DeepSeek variable (versions distillées) selon la taille MIT (très permissive)

Sources : Ollama (Mistral Small 3.2), Ollama (Llama 3.3), Meta Llama License, Ollama (DeepSeek R1)

Un mot sur la licence, parce que c’est le piège que personne ne mentionne. Apache 2.0 et MIT (Mistral, Qwen, DeepSeek) vous laissent faire ce que vous voulez, y compris en commercial, sans royalties. La licence Llama de Meta est différente : elle autorise l’usage commercial, mais votre licence gratuite expire si votre produit dépasse 700 millions d’utilisateurs actifs par mois, et elle interdit d’entraîner un modèle concurrent avec Llama. Pour une TPE/PME, le plafond ne vous concernera jamais. Mais si la souveraineté est votre motivation première, un modèle français sous Apache 2.0 comme Mistral est plus cohérent.

Licences des modèles ouverts, ce qui change pour vous :

  • Apache 2.0 : usage commercial libre, 0 royalty / Mistral, Qwen
  • MIT : modifications et dérivés autorisés / DeepSeek
  • Llama Community License : libre jusqu’à 700 M d’utilisateurs/mois / Llama 3.3
  • Point commun : 0 frais de licence pour une TPE/PME

Sources : Mistral Small 3.2, Meta Llama License

Quel matériel pour faire tourner une IA en local

La règle de base tient en une phrase : plus le modèle a de paramètres, plus il lui faut de mémoire (RAM ou mémoire vidéo). Un petit modèle tourne sur un ordinateur portable récent. Un gros modèle exige une vraie carte graphique.

Voici les seuils vérifiés, pour des modèles quantifiés en Q4 (une compression standard qui réduit le poids sans trop dégrader la qualité) :

Taille du modèle Mémoire nécessaire Exemple de machine Vitesse indicative
7 à 8 milliards 8 Go de RAM (4 à 6 Go de mémoire vidéo) PC portable récent, Mac M1 3 à 8 tokens/s sans carte graphique
13 à 14 milliards 16 Go de RAM (8 à 10 Go de mémoire vidéo) RTX 3060 12 Go, Mac M1 16 Go 30 à 60 tokens/s
32 à 34 milliards 24 Go et plus (18 à 22 Go de mémoire vidéo) carte graphique 24 Go variable selon la carte
70 milliards environ 40 Go (38 à 42 Go de mémoire vidéo) serveur ou carte haut de gamme réservé aux configs sérieuses

Source : Ollama System Requirements 2026

Concrètement. Le minimum absolu pour Ollama, c’est 8 Go de RAM, 10 Go d’espace disque, un processeur 64 bits avec AVX2, et aucune carte graphique obligatoire. Mais à ce niveau, comptez 3 à 8 mots par seconde : utilisable pour tester, frustrant au quotidien. Pour un usage confortable, visez 16 Go de RAM et une carte graphique de 8 à 12 Go (une RTX 3060 ou un Mac Apple Silicon 16 Go). Là, vous tournez à 30 à 60 tokens par seconde, soit une vitesse de lecture naturelle.

Les limites : ce que le local ne fait pas (encore)

Soyons honnêtes, parce que c’est rare dans les articles sur le sujet. Un modèle de 7 ou 14 milliards de paramètres qui tourne sur votre portable ne joue pas dans la même cour que GPT ou Claude côté cloud, qui mobilisent des centaines de milliards de paramètres sur des fermes de serveurs.

Pour situer les modèles entre eux, propriétaires comme ouverts, notre panorama des modèles d’IA en 2026 détaille qui domine et comment les comparer.

Installer une IA en local : la méthode en 4 étapes

Voici le chemin le plus simple, avec LM Studio pour un démarrage sans terminal. Comptez 30 minutes la première fois, téléchargement du modèle compris.

  1. Téléchargez et installez le logiciel. Rendez-vous sur le site de LM Studio (Windows, Mac ou Linux), installez l’application comme n’importe quel logiciel. Résultat : une interface de chat vide. Durée : 5 minutes.
  2. Choisissez et téléchargez un modèle. Dans le catalogue intégré, cherchez « Mistral Small » ou « Qwen ». Prenez une version Q4 adaptée à votre RAM (un modèle 7B si vous avez 8 Go, 14B si vous avez 16 Go). Cliquez sur télécharger. Durée : 5 à 20 minutes selon votre connexion et le poids du fichier (de 4 à 15 Go).
  3. Lancez une conversation. Sélectionnez le modèle chargé, tapez votre première question. Résultat : une réponse générée entièrement sur votre machine, hors ligne possible. Durée : immédiat.
  4. Vérifiez que rien ne sort. Coupez le wifi et reposez une question. Si le modèle répond toujours, vous avez la preuve que tout se passe en local. C’est le test qu’on conseille à chaque client : voir, pas croire.

Pour brancher cette IA locale sur vos propres outils (un tableur, une base de documents, un logiciel métier), Ollama et son API sur le port 11434 sont plus adaptés, dans la logique d’un projet IA accompagné où l’on relie le modèle à vos données.

Erreurs à éviter

Concrètement, pour vous : faut-il franchir le pas

La vraie question n’est pas « est-ce possible » (ça l’est) mais « est-ce que ça vaut le coup pour mon entreprise ». Voici notre verdict, par profil.

Le local vaut clairement le coup si :

Le cloud reste préférable si :

Notre recommandation pour la plupart des TPE/PME : une approche hybride. Le cloud pour le créatif et le non sensible, une IA locale pour tout ce qui touche aux données confidentielles. Vous gardez le meilleur des deux, et vous ne mettez jamais un fichier client dans un service que vous ne contrôlez pas.

FAQ

Installer une IA en local, est-ce vraiment gratuit ?
Les logiciels (Ollama, LM Studio, Jan) et les modèles ouverts (Mistral, Qwen, DeepSeek) sont gratuits. Le seul coût éventuel, c’est le matériel : une carte graphique de plusieurs centaines d’euros si vous voulez de la vitesse, sinon votre machine actuelle suffit pour démarrer.

Quel matériel minimum pour faire tourner une IA en local ?
Le minimum pour Ollama est de 8 Go de RAM, 10 Go d’espace disque et un processeur 64 bits avec AVX2, sans carte graphique. Vous ferez tourner un modèle 7B, mais lentement (3 à 8 mots par seconde). Pour un usage confortable, visez 16 Go de RAM et une carte graphique de 8 à 12 Go.

Une IA locale est-elle aussi performante que ChatGPT ?
Non, pas sur les modèles qui tiennent sur une machine de TPE/PME. Un modèle de 7 à 14 milliards de paramètres reste en retrait des grands modèles cloud sur le raisonnement complexe. En revanche, pour résumer, reformuler, classer ou répondre sur vos documents, il fait très bien le travail.

L’IA locale est-elle conforme au RGPD ?
Le traitement en local supprime le transfert de données hors UE, qui est l’un des principaux points de friction du RGPD avec les services cloud américains. Vous restez responsable du traitement, mais vous éliminez le risque lié au transfert et au sous-traitant étranger.

Quel modèle ouvert choisir pour commencer ?
Mistral Small est un excellent point de départ : éditeur français, licence Apache 2.0 sans contrainte commerciale, bon équilibre qualité/poids (15 Go en Q4). Pour une machine modeste, un modèle 7B comme Qwen3 ou Mistral 7B tournera plus léger.

Peut-on utiliser une IA locale sans connexion internet ?
Oui. Une fois le modèle téléchargé, tout fonctionne hors ligne. C’est même un bon test de confidentialité : coupez le wifi, posez une question, et constatez que le modèle répond toujours. La preuve que rien ne sort de votre machine.


Sources

  1. Ollama System Requirements
  2. LM Studio
  3. Guide to Local LLMs 2026
  4. Mistral Small 3.2 (licence Apache 2.0)
  5. Jan
  6. Ollama (Mistral Small 3.2)
  7. Ollama (Llama 3.3)
  8. Meta Llama License
  9. Ollama (DeepSeek R1)

Vous êtes une entreprise ?

Ordiama, c'est aussi une agence IA à Strasbourg : on crée votre site, on vous rend visible dans l'IA et on automatise vos tâches.

Découvrir l'agence →

À lire aussi