Moteur IA local : installer Ollama et choisir un modèle
Senzoukria peut répondre depuis un modèle qui tourne sur votre propre machine, via un moteur local comme Ollama ou LM Studio. L'application sonde le moteur, ne liste que ce qui est réellement installé, et suggère des modèles à récupérer quand il n'y en a aucun.
Senzoukria · Documentation · Mis à jour en septembre 2026
Où le trouver
- Où
- Page IA → sélecteur de modèle, et Réglages → IA
- Adresse par défaut
- http://127.0.0.1:11434 — l'adresse de bouclage, rien ne quitte la machine
- Fenêtre de contexte par défaut
- 8 192 jetons (8k)
- Liste des modèles
- Demandée au moteur ; jamais écrite en dur
- Clés
- Une clé Claude commence par sk-ant- et se range dans le trousseau du système ; une clé Groq commence par gsk_
Ce que ça fait
L'application sonde le moteur local et rapporte ce qu'elle a mesuré : s'il a répondu, sa version, la latence de l'aller-retour, et les modèles qu'il déclare — chacun avec son poids sur le disque, son nombre de paramètres et sa quantification quand le moteur les publie. Un moteur éteint revient comme injoignable, avec le message brut : c'est un résultat, pas un diagnostic. Il ne dit pas si la clé, le réseau ou le service est en cause.
Les requêtes passent par le backend Rust de l'application plutôt que par la vue web, pour deux raisons : la politique de sécurité du contenu n'ouvre pas de port HTTP local depuis le front, et le réseau n'a pas sa place là.
Comme la liste vient du moteur, un modèle que vous n'avez pas n'apparaît jamais comme sélectionnable. Reste une question à laquelle le moteur ne peut pas répondre — quoi installer quand vous n'avez rien —, et c'est à cela que sert la liste de suggestions.
Modèles recommandés
| Réglage | Par défaut | Ce que ça change |
|---|---|---|
| qwen2.5-coder:7b | ~4,7 Go | Premier de la liste : écrire du code d'indicateur, là où un 7B spécialisé bat régulièrement un 8B généraliste |
| qwen3:8b | ~5,2 Go | Questions générales |
| deepseek-r1:8b | ~5,2 Go | Raisonnement pas à pas |
| llama3.1:8b | ~4,9 Go | Questions générales |
| gemma2:9b | ~5,4 Go | Questions générales |
| qwen2.5:3b | ~1,9 Go | Machines modestes |
Comment l'installer
- Installez vous-même un moteur — Ollama ou LM Studio — et laissez-le tourner. Senzoukria n'installe jamais le moteur ; il ne fait que parler à celui qui est déjà présent.
- Récupérez un modèle. Le sélecteur affiche la commande exacte à coller, de la forme ollama pull qwen2.5-coder:7b, et le bouton d'installation demande au moteur que vous avez déjà d'aller le chercher. L'avancement est rapporté avec les noms d'étapes du moteur lui-même, parce qu'Ollama compte les octets par couche et qu'un pourcentage retomberait à zéro à chaque nouvelle couche.
- Une suggestion disparaît de la liste dès que le modèle est installé — il apparaît alors dans la vraie liste des modèles installés.
- Réglez la fenêtre de contexte dans Réglages → IA. Le défaut de 8k tient le prompt de l'assistant, le contexte de marché et une conversation courte ; le défaut d'Ollama, 4 096, n'y suffit pas.
Limites et pièges
- Un modèle local est un repli gratuit, pas un égal : il est nettement moins capable que Claude et passera à côté de choses que Claude attrape. En échange, rien de ce que vous écrivez ne quitte la machine.
- Les moteurs locaux reçoivent du texte simple : les captures d'écran ne leur parviennent donc jamais, quoi que le modèle prétende prendre en charge.
- Les modèles d'embedding comme nomic-embed-text sont listés par Ollama à côté des modèles de conversation mais ne savent pas répondre du tout ; le sélecteur les signale.
- Les tailles annoncées sont celles du téléchargement dans la quantification par défaut, et il faut autant de RAM libre du même ordre : un modèle de 5 Go ne tourne pas confortablement sous 8 Go de mémoire disponible.
- Les suggestions privilégient le 7B et au-delà pour le code d'indicateur, où les plus petits modèles produisent souvent du code plausible qui ne tourne pas ; l'unique entrée en 3B est là pour les machines qui ne peuvent pas en tenir davantage.
Pages liées
Cette page dans d’autres langues
Questions fréquentes
- Senzoukria installe-t-il Ollama ou télécharge-t-il des modèles tout seul ?
- Non. C'est vous qui installez le moteur. Le bouton d'installation transmet un ordre de récupération explicite à ce moteur, et la commande est aussi affichée pour que vous puissiez la lancer dans votre propre terminal.
- Pourquoi mon modèle est-il listé mais inutilisable ?
- Il s'agit très probablement d'un modèle d'embedding. Ceux-là rendent des vecteurs, pas des réponses ; le sélecteur les marque, pour qu'un mauvais choix ne passe pas pour une fonction cassée.
- Où est rangée ma clé API Claude ?
- Dans le trousseau de votre système d'exploitation, utilisée depuis cette machine seulement. La conversation et les captures jointes partent chez Anthropic sur votre clé ; rien ne transite par les serveurs de Senzoukria.