Plan de l'article
💡 En résumé (TL;DR) — Installez LM Studio depuis le site officiel, commencez par un modèle instruct de taille raisonnable et une quantification 4 bits, puis observez la RAM et la vitesse. L’exécution locale améliore la maîtrise des données, mais les fichiers restent exposés aux comptes et logiciels présents sur le PC.
LM Studio rend les LLM locaux accessibles sans construire une pile Docker. Il permet de télécharger un modèle, discuter avec lui et lancer un serveur HTTP compatible avec de nombreux clients.
Choisir un modèle adapté
La taille sur disque ne correspond pas exactement à la mémoire nécessaire. Le contexte, le cache et l’accélération GPU ajoutent une consommation. Sur une machine modeste, commencez petit plutôt que de charger un modèle qui échange constamment avec le disque.
| Mémoire disponible | Point de départ prudent |
|---|---|
| 8 Go RAM | Petit modèle 3B/4B quantifié |
| 16 Go RAM | 7B/8B quantifié |
| 32 Go RAM | Modèles plus grands ou contexte supérieur |
Les chiffres restent indicatifs : le système et les autres applications utilisent déjà une partie de la mémoire.
Installer et tester
Téléchargez l’application officielle, recherchez un modèle au format GGUF et vérifiez sa licence. Chargez-le, envoyez quelques requêtes représentatives et mesurez la qualité sur vos documents réels, sans données sensibles au premier test.
Le serveur local écoute généralement sur l’ordinateur. Ne modifiez pas l’adresse d’écoute vers tout le réseau sans authentification, pare-feu et besoin explicite. Une API locale ouverte sur 0.0.0.0 peut devenir accessible à d’autres machines.
Tester la qualité au lieu de croire le classement
Préparez dix questions représentatives : extraction structurée, résumé, rédaction en français, refus d’une instruction ambiguë et respect d’un format JSON. Exécutez-les avec la même température et comparez exactitude, vitesse et mémoire. Conservez les réponses et la version du modèle. Pour des données métier, vérifiez manuellement les faits et évitez de présenter une sortie locale comme fiable uniquement parce qu’elle n’a pas quitté le PC.
Vidéo AngleFormation
La vidéo montre l’installation complète d’une IA gratuite et privée avec LM Studio. Le guide ajoute le dimensionnement et les précautions réseau.
FAQ
LM Studio envoie-t-il forcément mes prompts sur Internet ?
L’inférence locale n’exige pas une API distante, mais le téléchargement des modèles et certaines fonctions nécessitent Internet. Vérifiez les réglages et journaux.
Quel modèle choisir en français ?
Testez plusieurs modèles multilingues sur un même jeu de questions métier. La taille seule ne garantit pas la qualité.
Peut-on connecter n8n à LM Studio ?
Oui via l’API locale compatible, à condition de sécuriser l’accès et de tenir compte des limites du modèle.
Sources officielles
Questions Fréquentes & Réponses d'Experts
LM Studio envoie-t-il forcément mes prompts sur Internet ?
L’inférence locale n’exige pas une API distante, mais le téléchargement des modèles et certaines fonctions nécessitent Internet. Vérifiez les réglages et journaux.
Quel modèle choisir en français ?
Testez plusieurs modèles multilingues sur un même jeu de questions métier. La taille seule ne garantit pas la qualité.
Peut-on connecter n8n à LM Studio ?
Oui via l’API locale compatible, à condition de sécuriser l’accès et de tenir compte des limites du modèle.