Selettore di modello IA: Claude, Groq e motori locali a confronto
Il selettore di modello sceglie quale motore ti risponde e dichiara i tre fatti che decidono: quanto costa, dove vanno le tue parole e in che cosa il modello è debole. Claude, Groq e ogni modello installato localmente compaiono in un solo elenco.
Senzoukria · Documentazione · Aggiornato a settembre 2026
Dove trovarlo
- Dove
- Pagina IA → pulsante del modello nell'intestazione della chat; i valori predefiniti anche in Impostazioni → IA
- Motore predefinito
- Claude, con la tua chiave API
- Modello Groq predefinito
- llama-3.3-70b-versatile
- Legge gli screenshot
- Solo Claude; Groq e i motori locali ricevono il solo testo
- Esegue gli strumenti dell'app
- Tutti e tre i motori
Che cosa fa
Il selettore elenca Claude, Groq e ogni modello che il motore locale dichiara effettivamente installato. Nessun modello locale è scritto in duro: l'elenco viene chiesto al motore, l'unico che sa che cosa è stato scaricato, così un modello che non hai non compare mai come disponibile.
Ogni riga porta tre colonne che di solito restano taciute: il costo, dove vanno le tue parole e in che cosa il modello è debole. Claude si paga a messaggio sulla tua chiave e va ad Anthropic. Groq è gratuito sulla tua chiave, veloce, con modelli aperti, ma limitato al minuto e più debole sul ragionamento lungo e sul codice. Un modello locale non lascia mai la macchina e non costa nulla, e la riga dice chiaramente che un modello da 8B è sotto Claude su codice e ragionamento lungo.
Il vocabolario è separato a schermo per una ragione: Ollama è il motore, il programma in ascolto su una porta locale; qwen3:8b è il modello, i pesi che carica. Il motore ha una riga propria.
Impostazioni
| Impostazione | Predefinito | Che cosa cambia |
|---|---|---|
| Motore predefinito (Impostazioni → IA) | Claude | Claude, Groq o Motore locale — quale fornitore risponde per impostazione predefinita |
| Modello Groq | llama-3.3-70b-versatile | L'id esatto del modello Groq; l'elenco viene letto dall'API Groq con la tua chiave |
| Finestra di contesto | 8k | Token con cui il motore locale carica il modello: 4k, 8k, 16k, 32k o 64k. Più grande richiede più VRAM e fa ricaricare il modello a Ollama |
| Accesso web per l'assistente | Attivo | Cerca sul web e legge le pagine — la ricerca di Anthropic per Claude, DuckDuckGo tramite l'app per Groq e i modelli locali |
| Strumenti (leggere il grafico, eseguire script) | Attivi | Permettono all'agente di leggere grafico, conto, calendario, notizie, backtest, script e autopilota — in sola lettura |
| Ripiegare sul modello locale | Disattivo | Usato solo quando una richiesta a Claude fallisce; la risposta porta allora il badge del motore che l'ha scritta |
Come usarlo
- Scegli Claude quando il compito è scrivere codice di indicatori o seguire una lunga catena di ragionamento, e quando vuoi che gli screenshot vengano letti.
- Scegli Groq per iniziare senza pagare: una chiave gratuita dalla console Groq, modelli aperti, chiamate a strumenti e ricerca web — al prezzo di limiti al minuto e senza lettura delle immagini.
- Scegli un modello locale quando nulla deve lasciare la macchina. Il selettore mostra il nome esatto del modello, mai la parola «Claude», così una risposta scritta da un modello 8B non viene mai scambiata per una di Claude.
- Se un modello locale che avevi scelto è stato poi eliminato dalla macchina, il selettore segna la scelta come non disponibile invece di lasciar fallire l'invio in silenzio.
Limiti e trappole
- «Locale» senza alcun modello selezionato non ripiega in silenzio su Claude. La richiesta viene rifiutata e lo dice, perché ripiegare manderebbe nel cloud ciò che volevi tenere sulla macchina.
- I modelli di embedding trasformano il testo in vettori e non sanno rispondere; il selettore li segnala invece di lasciarne scegliere uno come assistente.
- Il piano gratuito di Groq è limitato al minuto, e l'impostazione della finestra di contesto vale solo per i motori locali — Claude e Groq gestiscono la propria.
- Qualunque motore tu scelga, il suo costo è addebitato da quel fornitore sulla tua chiave. I dati di mercato restano fatturati a parte dal tuo fornitore di dati.
Pagine correlate
Questa pagina in altre lingue
Domande frequenti
- Ollama è un modello?
- No. Ollama è il motore — il programma sulla tua macchina in ascolto su una porta locale. qwen3:8b è un modello che carica. Il selettore li tiene su righe separate proprio per questo.
- Perché non posso allegare uno screenshot su questo motore?
- Il percorso locale invia al motore stringhe semplici e le righe di Groq sono solo testo, quindi nessuno dei due riceve immagini. Il selettore lo dichiara prima che tu alleghi, invece di lasciar fallire l'invio dopo.
- A che cosa serve l'impostazione della finestra di contesto?
- Indica al motore locale con quanti token caricare il modello. 8k basta per il prompt dell'assistente più una conversazione breve; valori più grandi richiedono più VRAM e fanno ricaricare il modello a Ollama.