Une IA installée chez vous, sans cloud : pour qui, comment et à quel prix ?
Le cloud n'est pas la seule option
Quand on parle d'IA générative, on pense à ChatGPT ou Copilot : des services en ligne, puissants, mais qui impliquent d'envoyer vos textes et documents sur des serveurs externes. Il existe une alternative de plus en plus crédible : des modèles « ouverts » (Mistral, Llama, Qwen, Gemma…) que l'on télécharge et fait tourner sur son propre ordinateur ou serveur.
Chez ExsIT, nous utilisons quotidiennement ce type d'installation — pour la traduction, la rédaction et le traitement de documents. Ce n'est plus un bricolage de passionné : c'est un outil de travail.
Pour qui est-ce pertinent ?
- Professions réglementées : médical, paramédical, juridique, comptable, notarial ;
- Services RH : fiches de paie, évaluations, dossiers individuels ;
- Entreprises avec secrets d'affaires : bureaux d'études, R&D, sous-traitants industriels ;
- Structures qui veulent un coût fixe plutôt qu'un abonnement par utilisateur.
Que peut-on en attendre ?
Les modèles locaux ne rivalisent pas toujours avec les plus grands modèles en ligne sur les raisonnements complexes. Mais pour une grande partie des tâches de bureau, ils font très bien le travail :
- résumer et reformuler des documents ;
- rédiger des brouillons d'emails ou de courriers ;
- traduire (FR / NL / EN notamment) ;
- interroger une base de documents internes (« que dit notre procédure sur… ? ») ;
- extraire des informations structurées d'un texte.
Quel matériel ?
L'élément déterminant est la mémoire de la carte graphique (VRAM), qui conditionne la taille du modèle utilisable et sa vitesse.
| Configuration | Usage typique | Ordre de grandeur |
|---|---|---|
| PC récent sans carte graphique dédiée | Petits modèles, tests, usage ponctuel | Matériel existant |
| Poste avec GPU 12–16 Go | Usage individuel confortable (modèles ~8–14 milliards de paramètres) | Station de travail milieu de gamme |
| Serveur avec GPU 24 Go et plus | Usage partagé par une petite équipe | Investissement de type serveur PME |
Côté logiciel, des outils comme Ollama ou LM Studio rendent l'installation beaucoup plus accessible qu'il y a deux ans, avec une interface de discussion proche de ChatGPT.
Les limites à connaître
- Un modèle local n'a pas accès à internet : il ne connaît pas l'actualité.
- La qualité dépend fortement du choix du modèle et de sa configuration.
- Il faut maintenir l'installation (mises à jour, sauvegarde, accès sécurisés) — comme n'importe quel serveur.
Une solution hybride, souvent la meilleure
Dans la pratique, beaucoup de PME combinent les deux : un assistant en ligne encadré pour les tâches courantes sans enjeu, et une IA locale pour les documents sensibles. C'est l'approche que nous recommandons le plus souvent (voir aussi IA et RGPD).
On en parle ?
Nous dimensionnons le matériel, installons et configurons votre IA locale, et formons vos utilisateurs. Le matériel est choisi pour votre usage réel — sans vous vendre ce dont vous n'avez pas besoin.