Motor de IA local: configurar Ollama y modelos recomendados

Senzoukria puede responder desde un modelo que se ejecuta en tu propia máquina, a través de un motor local como Ollama o LM Studio. La aplicación sondea el motor, lista solo lo que está realmente instalado y sugiere modelos que descargar cuando no hay ninguno.

Senzoukria · Documentación · Actualizado en septiembre de 2026


Dónde encontrarlo

Dónde
Página de IA → selector de modelo, y Ajustes → IA
Dirección por defecto
http://127.0.0.1:11434 — la dirección de bucle local, nada sale de la máquina
Ventana de contexto por defecto
8 192 tokens (8k)
Lista de modelos
Se le pide al motor; nunca escrita a mano en el código
Claves
Una clave de Claude empieza por sk-ant- y se guarda en el llavero del sistema; una clave de Groq empieza por gsk_

Qué hace

La aplicación sondea el motor local e informa de lo que midió: si respondió, su versión, la latencia de ida y vuelta y los modelos que declara, cada uno con su peso en disco, su número de parámetros y su cuantización cuando el motor los publica. Un motor apagado vuelve como inaccesible con el mensaje en bruto, lo cual es un resultado y no un diagnóstico: no dice si el fallo está en la clave, en la red o en el servicio.

Las peticiones pasan por el backend en Rust de la aplicación y no por la vista web, por dos razones: la política de seguridad de contenido no abre un puerto HTTP local desde el frontend, y la red no pertenece ahí.

Como la lista sale del motor, un modelo que no tienes nunca aparece como seleccionable. Eso deja una pregunta que el motor no puede responder —qué instalar cuando no tienes nada—, y para eso está la lista de sugerencias.

Modelos recomendados

Los modelos que sugiere el selector cuando todavía no están instalados
AjustePor defectoQué cambia
qwen2.5-coder:7b~4,7 GBEl primero de la lista: escribir código de indicadores, donde un 7B especializado supera con regularidad a un 8B generalista
qwen3:8b~5,2 GBPreguntas generales
deepseek-r1:8b~5,2 GBRazonamiento paso a paso
llama3.1:8b~4,9 GBPreguntas generales
gemma2:9b~5,4 GBPreguntas generales
qwen2.5:3b~1,9 GBEquipos modestos

Cómo configurarlo

  • Instala tú un motor —Ollama o LM Studio— y déjalo en marcha. Senzoukria nunca instala el motor; solo habla con uno que ya esté presente.
  • Descarga un modelo. El selector muestra el comando exacto que hay que pegar, con la forma ollama pull qwen2.5-coder:7b, y el botón Instalar le pide al motor que ya tienes que lo descargue. El progreso se informa con los nombres de paso del propio motor, porque Ollama cuenta bytes por capa y un porcentaje volvería a cero en cada capa nueva.
  • Una sugerencia desaparece de la lista en cuanto el modelo está instalado: entonces aparece en la lista real de modelos instalados.
  • Fija la ventana de contexto en Ajustes → IA. El valor por defecto de 8k da para el prompt del asistente, el contexto de mercado y una conversación corta; el valor por defecto de Ollama, 4 096, no basta para eso.

Límites y trampas

  • Un modelo local es una alternativa gratuita, no un igual: es claramente menos capaz que Claude y se le escaparán cosas que Claude sí ve. A cambio, nada de lo que escribes sale de la máquina.
  • Los motores locales reciben texto plano, así que las capturas nunca les llegan, diga lo que diga el modelo sobre lo que admite.
  • Los modelos de embeddings como nomic-embed-text aparecen en Ollama junto a los conversacionales, pero no saben responder en absoluto; el selector los marca.
  • Los tamaños son la descarga en la cuantización por defecto, y hace falta una cantidad de RAM libre del mismo orden: un modelo de 5 GB no funciona con comodidad con menos de 8 GB de memoria libre.
  • Las sugerencias favorecen los 7B en adelante para el código de indicadores, donde los modelos más pequeños tienden a producir código plausible que no se ejecuta; la única entrada de 3B está ahí para equipos que no pueden con más.

Esta página en otros idiomas

Preguntas frecuentes

¿Senzoukria instala Ollama o descarga modelos por su cuenta?
No. El motor lo instalas tú. El botón Instalar reenvía una orden de descarga explícita a ese motor, y el comando también se muestra para que lo ejecutes en tu propio terminal.
¿Por qué mi modelo aparece en la lista pero no sirve?
Lo más probable es que sea un modelo de embeddings. Esos devuelven vectores, no respuestas; el selector los marca para que una elección equivocada no se confunda con una función rota.
¿Dónde se guarda mi clave API de Claude?
En el llavero de tu sistema operativo, y se usa solo desde esta máquina. La conversación y cualquier captura adjunta van a Anthropic con tu clave; nada pasa por los servidores de Senzoukria.