Sélecteur de modèle IA : Claude, Groq et moteurs locaux comparés
Le sélecteur de modèle choisit quel moteur vous répond et énonce les trois faits qui décident : ce que ça coûte, où partent vos mots, et ce que le modèle fait mal. Claude, Groq et chaque modèle installé localement apparaissent dans une même liste.
Senzoukria · Documentation · Mis à jour en septembre 2026
Où le trouver
- Où
- Page IA → bouton du modèle dans l'en-tête du chat ; les valeurs par défaut sont aussi dans Réglages → IA
- Moteur par défaut
- Claude, avec votre propre clé API
- Modèle Groq par défaut
- llama-3.3-70b-versatile
- Lecture des captures
- Claude seulement ; Groq et les moteurs locaux ne reçoivent que du texte
- Appel des outils de l'app
- Les trois moteurs
Ce que ça fait
Le sélecteur liste Claude, Groq et tous les modèles que le moteur local déclare réellement installés. Aucun modèle local n'est écrit en dur : la liste est demandée au moteur, seul à savoir ce qui a été téléchargé — un modèle que vous n'avez pas n'apparaît donc jamais comme disponible.
Chaque ligne porte trois colonnes qu'on laisse d'habitude sous silence : le coût, la destination de vos mots, et le point faible du modèle. Claude est payant au message sur votre clé et envoyé à Anthropic. Groq est gratuit sur votre propre clé, rapide, avec des modèles ouverts, mais limité par minute et plus faible sur le raisonnement long et le code. Un modèle local ne quitte jamais la machine et ne coûte rien, et la ligne dit franchement qu'un modèle de 8B est en dessous de Claude sur le code et le raisonnement long.
Le vocabulaire est séparé à l'écran pour une raison : Ollama est le moteur, le programme qui écoute sur un port local ; qwen3:8b est le modèle, les poids qu'il charge. Le moteur a sa propre ligne.
Réglages
| Réglage | Par défaut | Ce que ça change |
|---|---|---|
| Moteur par défaut (Réglages → IA) | Claude | Claude, Groq ou moteur local — qui répond par défaut |
| Modèle Groq | llama-3.3-70b-versatile | L'identifiant exact du modèle Groq ; la liste est lue depuis l'API Groq avec votre clé |
| Fenêtre de contexte | 8k | Jetons avec lesquels le moteur local charge le modèle : 4k, 8k, 16k, 32k ou 64k. Plus grand demande plus de VRAM et fait recharger le modèle par Ollama |
| Accès à internet pour l'assistant | Actif | Chercher sur le web et lire des pages — la recherche d'Anthropic pour Claude, DuckDuckGo via l'application pour Groq et les modèles locaux |
| Outils (lire le graphique, exécuter des scripts) | Actif | Permet à l'agent de lire le graphique, le compte, le calendrier, les actualités, les backtests, les scripts et l'autopilote — en lecture seule |
| Basculer sur le modèle local | Coupé | N'agit que si une requête Claude échoue ; la réponse porte alors le badge du moteur qui l'a écrite |
Comment s'en servir
- Choisissez Claude quand la tâche consiste à écrire du code d'indicateur ou à suivre un long raisonnement, et quand vous voulez que les captures soient lues.
- Choisissez Groq pour démarrer sans payer : une clé gratuite sur la console Groq, des modèles ouverts, l'appel des outils et la recherche web — au prix de limites par minute et de l'absence de lecture d'images.
- Choisissez un modèle local quand rien ne doit quitter la machine. Le sélecteur affiche le nom exact du modèle, jamais le mot « Claude » : une réponse écrite par un modèle de 8B n'est donc jamais prise pour une réponse de Claude.
- Si un modèle local que vous aviez choisi a depuis été supprimé de la machine, le sélecteur marque ce choix comme indisponible, au lieu de laisser un envoi échouer en silence.
Limites et pièges
- « Local » sans modèle sélectionné ne bascule pas discrètement sur Claude. La requête est refusée et le dit, parce que basculer enverrait dans le cloud ce que vous vouliez garder sur la machine.
- Les modèles d'embedding transforment du texte en vecteurs et ne savent pas répondre ; le sélecteur les signale au lieu de laisser en choisir un comme assistant.
- Le palier gratuit de Groq est limité par minute, et le réglage de fenêtre de contexte ne concerne que les moteurs locaux — Claude et Groq gèrent la leur.
- Quel que soit le moteur choisi, son coût est facturé par ce fournisseur sur votre clé. Les données de marché restent facturées séparément par votre fournisseur de données.
Pages liées
Cette page dans d’autres langues
Questions fréquentes
- Ollama est-il un modèle ?
- Non. Ollama est le moteur — le programme sur votre machine qui écoute sur un port local. qwen3:8b est un modèle qu'il charge. Le sélecteur les garde sur des lignes séparées exactement pour cette raison.
- Pourquoi ne puis-je pas joindre une capture sur ce moteur ?
- Le chemin local envoie de simples chaînes au moteur, et les lignes de Groq sont en texte seul : ni l'un ni l'autre ne reçoit d'images. Le sélecteur le dit avant que vous ne joigniez quoi que ce soit, plutôt que de laisser l'envoi échouer après coup.
- À quoi sert le réglage de fenêtre de contexte ?
- Il indique au moteur local avec combien de jetons charger le modèle. 8k tient le prompt de l'assistant et une conversation courte ; des valeurs plus grandes demandent plus de VRAM et font recharger le modèle par Ollama.