Sélecteur de modèle IA : Claude, Groq et moteurs locaux comparés

Le sélecteur de modèle choisit quel moteur vous répond et énonce les trois faits qui décident : ce que ça coûte, où partent vos mots, et ce que le modèle fait mal. Claude, Groq et chaque modèle installé localement apparaissent dans une même liste.

Senzoukria · Documentation · Mis à jour en septembre 2026


Où le trouver

Page IA → bouton du modèle dans l'en-tête du chat ; les valeurs par défaut sont aussi dans Réglages → IA
Moteur par défaut
Claude, avec votre propre clé API
Modèle Groq par défaut
llama-3.3-70b-versatile
Lecture des captures
Claude seulement ; Groq et les moteurs locaux ne reçoivent que du texte
Appel des outils de l'app
Les trois moteurs

Ce que ça fait

Le sélecteur liste Claude, Groq et tous les modèles que le moteur local déclare réellement installés. Aucun modèle local n'est écrit en dur : la liste est demandée au moteur, seul à savoir ce qui a été téléchargé — un modèle que vous n'avez pas n'apparaît donc jamais comme disponible.

Chaque ligne porte trois colonnes qu'on laisse d'habitude sous silence : le coût, la destination de vos mots, et le point faible du modèle. Claude est payant au message sur votre clé et envoyé à Anthropic. Groq est gratuit sur votre propre clé, rapide, avec des modèles ouverts, mais limité par minute et plus faible sur le raisonnement long et le code. Un modèle local ne quitte jamais la machine et ne coûte rien, et la ligne dit franchement qu'un modèle de 8B est en dessous de Claude sur le code et le raisonnement long.

Le vocabulaire est séparé à l'écran pour une raison : Ollama est le moteur, le programme qui écoute sur un port local ; qwen3:8b est le modèle, les poids qu'il charge. Le moteur a sa propre ligne.

Réglages

Réglages des moteurs et leurs valeurs par défaut
RéglagePar défautCe que ça change
Moteur par défaut (Réglages → IA)ClaudeClaude, Groq ou moteur local — qui répond par défaut
Modèle Groqllama-3.3-70b-versatileL'identifiant exact du modèle Groq ; la liste est lue depuis l'API Groq avec votre clé
Fenêtre de contexte8kJetons avec lesquels le moteur local charge le modèle : 4k, 8k, 16k, 32k ou 64k. Plus grand demande plus de VRAM et fait recharger le modèle par Ollama
Accès à internet pour l'assistantActifChercher sur le web et lire des pages — la recherche d'Anthropic pour Claude, DuckDuckGo via l'application pour Groq et les modèles locaux
Outils (lire le graphique, exécuter des scripts)ActifPermet à l'agent de lire le graphique, le compte, le calendrier, les actualités, les backtests, les scripts et l'autopilote — en lecture seule
Basculer sur le modèle localCoupéN'agit que si une requête Claude échoue ; la réponse porte alors le badge du moteur qui l'a écrite

Comment s'en servir

  • Choisissez Claude quand la tâche consiste à écrire du code d'indicateur ou à suivre un long raisonnement, et quand vous voulez que les captures soient lues.
  • Choisissez Groq pour démarrer sans payer : une clé gratuite sur la console Groq, des modèles ouverts, l'appel des outils et la recherche web — au prix de limites par minute et de l'absence de lecture d'images.
  • Choisissez un modèle local quand rien ne doit quitter la machine. Le sélecteur affiche le nom exact du modèle, jamais le mot « Claude » : une réponse écrite par un modèle de 8B n'est donc jamais prise pour une réponse de Claude.
  • Si un modèle local que vous aviez choisi a depuis été supprimé de la machine, le sélecteur marque ce choix comme indisponible, au lieu de laisser un envoi échouer en silence.

Limites et pièges

  • « Local » sans modèle sélectionné ne bascule pas discrètement sur Claude. La requête est refusée et le dit, parce que basculer enverrait dans le cloud ce que vous vouliez garder sur la machine.
  • Les modèles d'embedding transforment du texte en vecteurs et ne savent pas répondre ; le sélecteur les signale au lieu de laisser en choisir un comme assistant.
  • Le palier gratuit de Groq est limité par minute, et le réglage de fenêtre de contexte ne concerne que les moteurs locaux — Claude et Groq gèrent la leur.
  • Quel que soit le moteur choisi, son coût est facturé par ce fournisseur sur votre clé. Les données de marché restent facturées séparément par votre fournisseur de données.

Cette page dans d’autres langues

Questions fréquentes

Ollama est-il un modèle ?
Non. Ollama est le moteur — le programme sur votre machine qui écoute sur un port local. qwen3:8b est un modèle qu'il charge. Le sélecteur les garde sur des lignes séparées exactement pour cette raison.
Pourquoi ne puis-je pas joindre une capture sur ce moteur ?
Le chemin local envoie de simples chaînes au moteur, et les lignes de Groq sont en texte seul : ni l'un ni l'autre ne reçoit d'images. Le sélecteur le dit avant que vous ne joigniez quoi que ce soit, plutôt que de laisser l'envoi échouer après coup.
À quoi sert le réglage de fenêtre de contexte ?
Il indique au moteur local avec combien de jetons charger le modèle. 8k tient le prompt de l'assistant et une conversation courte ; des valeurs plus grandes demandent plus de VRAM et font recharger le modèle par Ollama.