Selector de modelo de IA: Claude, Groq y motores locales comparados

El selector de modelo elige qué motor te responde y enuncia los tres hechos que deciden: lo que cuesta, adónde van tus palabras y qué hace mal el modelo. Claude, Groq y cualquier modelo instalado en local aparecen en una sola lista.

Senzoukria · Documentación · Actualizado en septiembre de 2026


Dónde encontrarlo

Dónde
Página de IA → botón de modelo en la cabecera del chat; los valores por defecto también en Ajustes → IA
Motor por defecto
Claude, con tu propia clave API
Modelo Groq por defecto
llama-3.3-70b-versatile
Lee capturas
Solo Claude; Groq y los motores locales reciben solo texto
Ejecuta herramientas de la app
Los tres motores

Qué hace

El selector lista Claude, Groq y todos los modelos que el motor local declara como realmente instalados. Ningún modelo local está escrito a mano en el código: la lista se le pide al motor, que es lo único que sabe qué se ha descargado, así que un modelo que no tienes nunca aparece como disponible.

Cada fila lleva tres columnas que normalmente se callan: el coste, adónde van tus palabras y en qué es flojo el modelo. Claude se paga por mensaje con tu clave y se envía a Anthropic. Groq es gratis con tu propia clave, rápido, con modelos abiertos, pero limitado por minuto y más flojo en razonamiento largo y código. Un modelo local nunca sale de la máquina y no cuesta nada, y la fila dice sin rodeos que un modelo de 8B está por detrás de Claude en código y razonamiento largo.

El vocabulario se separa en pantalla por un motivo: Ollama es el motor, el programa que escucha en un puerto local; qwen3:8b es el modelo, los pesos que carga. El motor tiene su propia línea.

Ajustes

Ajustes de motor y sus valores por defecto
AjustePor defectoQué cambia
Motor por defecto (Ajustes → IA)ClaudeClaude, Groq o Motor local: qué proveedor responde por defecto
Modelo Groqllama-3.3-70b-versatileEl id exacto del modelo Groq; la lista se lee de la API de Groq con tu clave
Ventana de contexto8kTokens con los que el motor local carga el modelo: 4k, 8k, 16k, 32k o 64k. Más grande pide más VRAM y hace que Ollama recargue el modelo
Acceso a internet para el asistenteActivoBuscar en la web y leer páginas: la búsqueda de Anthropic para Claude, DuckDuckGo a través de la app para Groq y los modelos locales
Herramientas (leer el gráfico, ejecutar scripts)ActivoPermite al agente leer el gráfico, la cuenta, el calendario, las noticias, los backtests, los scripts y el piloto automático; solo lectura
Recurrir al modelo localInactivoSolo se usa cuando una petición a Claude falla; la respuesta lleva entonces la insignia del motor que la escribió

Cómo usarlo

  • Elige Claude cuando la tarea sea escribir código de indicadores o seguir una cadena de razonamiento larga, y cuando quieras que se lean las capturas.
  • Elige Groq para empezar sin pagar: una clave gratuita en la consola de Groq, modelos abiertos, llamadas a herramientas y búsqueda web, a cambio de límites por minuto y de no leer imágenes.
  • Elige un modelo local cuando nada deba salir de la máquina. El selector muestra el nombre exacto del modelo, nunca la palabra «Claude», así que una respuesta escrita por un modelo de 8B nunca se confunde con una de Claude.
  • Si un modelo local que habías elegido se ha borrado de la máquina, el selector marca la elección como no disponible en vez de dejar que un envío falle en silencio.

Límites y trampas

  • «Local» sin ningún modelo seleccionado no recurre a Claude en silencio. La petición se rechaza y lo dice, porque recurrir a la nube enviaría fuera lo que querías mantener en la máquina.
  • Los modelos de embeddings convierten texto en vectores y no saben responder; el selector los marca en vez de dejar que se elija uno como asistente.
  • El nivel gratuito de Groq está limitado por minuto, y el ajuste de ventana de contexto solo se aplica a los motores locales: Claude y Groq gestionan la suya.
  • Sea cual sea el motor que elijas, su coste lo factura ese proveedor a tu clave. Los datos de mercado los sigue facturando aparte tu proveedor de datos.

Esta página en otros idiomas

Preguntas frecuentes

¿Ollama es un modelo?
No. Ollama es el motor: el programa de tu máquina que escucha en un puerto local. qwen3:8b es un modelo que carga. El selector los mantiene en líneas separadas exactamente por eso.
¿Por qué no puedo adjuntar una captura con este motor?
La ruta local envía cadenas de texto planas al motor y las filas de Groq son solo de texto, así que ninguno recibe imágenes. El selector lo indica antes de que adjuntes nada, en vez de dejar que el envío falle después.
¿Qué hace el ajuste de ventana de contexto?
Le dice al motor local con cuántos tokens debe cargar el modelo. 8k da para el prompt del asistente y una conversación corta; valores mayores piden más VRAM y hacen que Ollama recargue el modelo.