PC de bureau à panneau vitré avec carte graphique, à côté d'un écran, dans un bureau le soir

Topbiz Inside

Installer une IA en local sur son PC : la méthode

Lecture 4 min

Faire tourner une intelligence artificielle directement sur son ordinateur n'est plus réservé aux spécialistes. Quelques logiciels gratuits suffisent pour discuter avec un modèle de langage, résumer des documents ou générer du code, sans connexion au cloud.

Voici comment installer une IA en local sur un PC Windows, étape par étape, et comment choisir un modèle adapté à votre machine.

Pourquoi installer une IA en local ?

  • Confidentialité : vos questions et vos documents restent sur votre PC.
  • Fonctionnement hors ligne : une fois le modèle téléchargé, Internet n'est plus nécessaire.
  • Pas d'abonnement : les logiciels cités ici et de nombreux modèles ouverts sont gratuits.

Les limites existent : les modèles que l'on peut faire tourner chez soi sont plus petits que les grands services en ligne. Ils restent très utiles pour la rédaction, la synthèse, la traduction ou l'aide au code, mais les réponses peuvent être moins précises sur des sujets pointus.

Ce qu'il faut côté matériel

Le facteur décisif est la mémoire disponible pour charger le modèle :

  • la VRAM d'une carte graphique dédiée donne les réponses les plus rapides ;
  • à défaut, le modèle peut tourner en RAM sur le processeur, plus lentement ;
  • un SSD accélère le chargement des modèles, qui pèsent plusieurs gigaoctets chacun.

Pour bien dimensionner votre machine, consultez notre guide quel matériel choisir pour l'IA en local.

Étape 1 : choisir un logiciel

LogicielPour quiPoints forts
LM StudioDébutantsInterface graphique, catalogue de modèles intégré, indique si un modèle tient dans votre mémoire
OllamaUtilisateurs à l'aise avec le terminalLéger, tourne en arrière-plan, compatible avec de nombreuses interfaces et outils
GPT4AllUsage bureautiqueInterface simple, fonction de discussion avec vos documents locaux
JanAmateurs de logiciel libreOpen source, interface de type chat

Pour un premier essai, LM Studio est le plus simple : tout se fait depuis l'interface, sans ligne de commande.

Étape 2 : installer et télécharger un modèle

  1. Téléchargez le logiciel depuis son site officiel et installez-le.
  2. Ouvrez le catalogue de modèles et cherchez une famille connue (voir ci-dessous).
  3. Choisissez une version dont la taille tient dans votre mémoire, en quantification Q4 pour commencer.
  4. Lancez le téléchargement, chargez le modèle, puis posez votre première question.

Avec Ollama, une seule commande dans le terminal télécharge et lance le modèle : ollama run suivi du nom du modèle.

Étape 3 : choisir le bon modèle

Les familles de modèles ouverts

Les familles les plus courantes sont Llama (Meta), Mistral (Mistral AI), Qwen (Alibaba), Gemma (Google) et Phi (Microsoft). Chaque famille existe en plusieurs tailles. Testez-en deux ou trois sur vos propres tâches : c'est le meilleur moyen de choisir.

La taille en milliards de paramètres

La taille d'un modèle s'exprime en milliards de paramètres : 3B, 8B, 14B, 32B, etc. Plus le modèle est grand, plus il est capable, mais plus il demande de mémoire et plus il répond lentement.

La quantification

La quantification compresse le modèle pour qu'il prenne moins de place. Q4 est le bon point de départ : le modèle occupe beaucoup moins de mémoire, pour une perte de qualité généralement faible. Q8 est plus fidèle mais environ deux fois plus lourd.

Quelle taille pour quelle mémoire ?

Ordres de grandeur pour des modèles en Q4, en gardant une marge pour la conversation :

Taille du modèleMémoire conseillée (VRAM ou RAM libre)
3 à 4B4 Go environ
7 à 8B6 à 8 Go
12 à 14B10 à 12 Go
30 à 32B20 à 24 Go

Ces valeurs varient selon le modèle et la longueur du contexte : une longue conversation ou un gros document consomment de la mémoire supplémentaire.

Aller plus loin : interroger vos documents

Certains logiciels (GPT4All, LM Studio, ou des interfaces branchées sur Ollama) permettent de faire lire vos PDF et fichiers texte à l'IA, qui y puise ses réponses. Les documents sont indexés localement et ne quittent pas votre PC.

Usage professionnel : vérifiez la licence

« Ouvert » ne veut pas toujours dire « libre pour un usage commercial ». Certains modèles sont sous licence permissive (Apache 2.0, MIT), d'autres ont leur propre licence avec des conditions d'usage. Lisez la licence indiquée sur la page du modèle avant de l'intégrer à un outil d'entreprise.

Questions fréquentes

Peut-on installer une IA en local gratuitement ?

Oui. LM Studio, Ollama, GPT4All et Jan sont gratuits, tout comme de nombreux modèles ouverts. Vérifiez seulement la licence du modèle pour un usage professionnel.

Faut-il une carte graphique pour faire tourner une IA en local ?

Ce n'est pas obligatoire : un modèle peut tourner sur le processeur et la RAM. Mais une carte graphique avec suffisamment de VRAM rend les réponses beaucoup plus rapides.

Quel logiciel choisir pour débuter ?

LM Studio est le plus simple : interface graphique, catalogue de modèles intégré et indication de compatibilité avec votre mémoire.

Une IA locale fonctionne-t-elle sans Internet ?

Oui. Internet n'est nécessaire que pour télécharger le logiciel et le modèle. Ensuite, tout fonctionne hors ligne.

Quelle taille de modèle choisir ?

Commencez par un modèle de 7 à 8 milliards de paramètres en Q4 si vous disposez de 8 Go de VRAM, ou d'un modèle de 3 à 4 milliards sur une machine plus modeste.

Équipez-vous pour l'IA en local

PC IA, stations de travail et cartes graphiques pour faire tourner vos modèles.

Chargement...
Retour en haut