
Topbiz Inside
Installer une IA en local sur son PC : la méthode
Faire tourner une intelligence artificielle directement sur son ordinateur n'est plus réservé aux spécialistes. Quelques logiciels gratuits suffisent pour discuter avec un modèle de langage, résumer des documents ou générer du code, sans connexion au cloud.
Voici comment installer une IA en local sur un PC Windows, étape par étape, et comment choisir un modèle adapté à votre machine.
Pourquoi installer une IA en local ?
- Confidentialité : vos questions et vos documents restent sur votre PC.
- Fonctionnement hors ligne : une fois le modèle téléchargé, Internet n'est plus nécessaire.
- Pas d'abonnement : les logiciels cités ici et de nombreux modèles ouverts sont gratuits.
Les limites existent : les modèles que l'on peut faire tourner chez soi sont plus petits que les grands services en ligne. Ils restent très utiles pour la rédaction, la synthèse, la traduction ou l'aide au code, mais les réponses peuvent être moins précises sur des sujets pointus.
Ce qu'il faut côté matériel
Le facteur décisif est la mémoire disponible pour charger le modèle :
- la VRAM d'une carte graphique dédiée donne les réponses les plus rapides ;
- à défaut, le modèle peut tourner en RAM sur le processeur, plus lentement ;
- un SSD accélère le chargement des modèles, qui pèsent plusieurs gigaoctets chacun.
Pour bien dimensionner votre machine, consultez notre guide quel matériel choisir pour l'IA en local.
Étape 1 : choisir un logiciel
| Logiciel | Pour qui | Points forts |
|---|---|---|
| LM Studio | Débutants | Interface graphique, catalogue de modèles intégré, indique si un modèle tient dans votre mémoire |
| Ollama | Utilisateurs à l'aise avec le terminal | Léger, tourne en arrière-plan, compatible avec de nombreuses interfaces et outils |
| GPT4All | Usage bureautique | Interface simple, fonction de discussion avec vos documents locaux |
| Jan | Amateurs de logiciel libre | Open source, interface de type chat |
Pour un premier essai, LM Studio est le plus simple : tout se fait depuis l'interface, sans ligne de commande.
Étape 2 : installer et télécharger un modèle
- Téléchargez le logiciel depuis son site officiel et installez-le.
- Ouvrez le catalogue de modèles et cherchez une famille connue (voir ci-dessous).
- Choisissez une version dont la taille tient dans votre mémoire, en quantification Q4 pour commencer.
- Lancez le téléchargement, chargez le modèle, puis posez votre première question.
Avec Ollama, une seule commande dans le terminal télécharge et lance le modèle : ollama run suivi du nom du modèle.
Étape 3 : choisir le bon modèle
Les familles de modèles ouverts
Les familles les plus courantes sont Llama (Meta), Mistral (Mistral AI), Qwen (Alibaba), Gemma (Google) et Phi (Microsoft). Chaque famille existe en plusieurs tailles. Testez-en deux ou trois sur vos propres tâches : c'est le meilleur moyen de choisir.
La taille en milliards de paramètres
La taille d'un modèle s'exprime en milliards de paramètres : 3B, 8B, 14B, 32B, etc. Plus le modèle est grand, plus il est capable, mais plus il demande de mémoire et plus il répond lentement.
La quantification
La quantification compresse le modèle pour qu'il prenne moins de place. Q4 est le bon point de départ : le modèle occupe beaucoup moins de mémoire, pour une perte de qualité généralement faible. Q8 est plus fidèle mais environ deux fois plus lourd.
Quelle taille pour quelle mémoire ?
Ordres de grandeur pour des modèles en Q4, en gardant une marge pour la conversation :
| Taille du modèle | Mémoire conseillée (VRAM ou RAM libre) |
|---|---|
| 3 à 4B | 4 Go environ |
| 7 à 8B | 6 à 8 Go |
| 12 à 14B | 10 à 12 Go |
| 30 à 32B | 20 à 24 Go |
Ces valeurs varient selon le modèle et la longueur du contexte : une longue conversation ou un gros document consomment de la mémoire supplémentaire.
Aller plus loin : interroger vos documents
Certains logiciels (GPT4All, LM Studio, ou des interfaces branchées sur Ollama) permettent de faire lire vos PDF et fichiers texte à l'IA, qui y puise ses réponses. Les documents sont indexés localement et ne quittent pas votre PC.
Usage professionnel : vérifiez la licence
« Ouvert » ne veut pas toujours dire « libre pour un usage commercial ». Certains modèles sont sous licence permissive (Apache 2.0, MIT), d'autres ont leur propre licence avec des conditions d'usage. Lisez la licence indiquée sur la page du modèle avant de l'intégrer à un outil d'entreprise.
Questions fréquentes
Peut-on installer une IA en local gratuitement ?
Oui. LM Studio, Ollama, GPT4All et Jan sont gratuits, tout comme de nombreux modèles ouverts. Vérifiez seulement la licence du modèle pour un usage professionnel.
Faut-il une carte graphique pour faire tourner une IA en local ?
Ce n'est pas obligatoire : un modèle peut tourner sur le processeur et la RAM. Mais une carte graphique avec suffisamment de VRAM rend les réponses beaucoup plus rapides.
Quel logiciel choisir pour débuter ?
LM Studio est le plus simple : interface graphique, catalogue de modèles intégré et indication de compatibilité avec votre mémoire.
Une IA locale fonctionne-t-elle sans Internet ?
Oui. Internet n'est nécessaire que pour télécharger le logiciel et le modèle. Ensuite, tout fonctionne hors ligne.
Quelle taille de modèle choisir ?
Commencez par un modèle de 7 à 8 milliards de paramètres en Q4 si vous disposez de 8 Go de VRAM, ou d'un modèle de 3 à 4 milliards sur une machine plus modeste.
Équipez-vous pour l'IA en local
PC IA, stations de travail et cartes graphiques pour faire tourner vos modèles.