Agente de terminal local · endpoint de Ollama · herramientas del repositorio

OpenCode con Ollama: configura correctamente un modelo local

La ruta rápida usa un solo comando. Una instalación fiable también necesita un modelo compatible con herramientas, al menos 64K de contexto, memoria suficiente y un entorno Git seguro.

Ruta oficial más corta

Inicia OpenCode mediante Ollama

Instala ambas aplicaciones desde sus fuentes oficiales, verifica que Ollama esté activo y ejecuta:

ollama launch opencode

Ollama permite elegir un modelo disponible e inicia OpenCode con una configuración local en línea sin sobrescribir la configuración permanente.

La comprobación que evita falsos comienzos

Planifica 64K de contexto antes del modelo

La integración oficial de Ollama exige 64K o más para OpenCode. Fragmentos del repositorio, herramientas, salidas e historial ocupan ese espacio.

  • elige tool calls fiables
  • reserva memoria para caché KV
  • empieza con un agente y repositorio pequeño
  • prueba en una rama desechable

Instalación reproducible

Seis pasos hasta el primer parche verificado

  1. 01

    Instala versiones oficiales

    Descarga Ollama y sigue la guía de OpenCode para tu sistema.

  2. 02

    Elige un modelo con herramientas

    Comprueba seguimiento de instrucciones, function calling y contexto en la ficha. Un modelo de autocompletado no siempre es buen agente.

  3. 03

    Confirma el ID exacto

    Ejecuta ollama list y usa exactamente el nombre y la etiqueta mostrados.

  4. 04

    Inicia la integración

    Usa ollama launch opencode. La opción --config prepara la configuración sin abrir una sesión.

  5. 05

    Verifica las herramientas

    Haz que lea un archivo, aplique un cambio reversible y ejecute una prueba inocua. Una buena conversación no demuestra tool calls.

  6. 06

    Mide el límite real

    Observa memoria, espera inicial, velocidad y pruebas. Reduce contexto si falta memoria; cambia de modelo si los parches rápidos son incorrectos.

Configuración manual

Conecta OpenCode a Ollama de forma explícita

En opencode.json, sustituye el ID por el valor de ollama list.

{   "$schema": "https://opencode.ai/config.json",   "provider": {     "ollama": {       "npm": "@ai-sdk/openai-compatible",       "name": "Ollama (local)",       "options": {         "baseURL": "http://localhost:11434/v1"       },       "models": {         "id-del-modelo": {           "name": "Mi modelo de código local"         }       }     }   } }

Endpoint local

Mantén localhost siempre que sea posible

localhost:11434/v1 apunta a Ollama en este PC. No publiques el endpoint solo para conectar rápidamente otro dispositivo.

  • incluye solo modelos instalados
  • el endpoint local no necesita clave cloud
  • el acceso remoto requiere autenticación y firewall
  • revisa por separado las herramientas de red

Modelo + 64K + margen

Memoria necesaria para OpenCode con Ollama

Modelo, cuantización, caché KV y sesiones determinan la clase del PC.

Clase de modeloInicio prácticoUsoComprobación
7B–14B cuantizado12–16 GB VRAM, 32 GB RAMChat centrado y primeras pruebas64K y herramientas deben funcionar juntos.
20B–24B cuantizado24 GB VRAM, 64 GB RAMAgente único más capazReserva margen para caché y compilación.
30B–32B cuantizado32 GB VRAM o 64 GB+ unificadosAgente de repositorio más fuerteLo que cabe a 32K puede ser justo a 64K.
Modelo grande o varios agentes96–128 GB unificados/coherentesCapacidad y varios serviciosValida runtime y espera otro perfil de velocidad.

Son rangos con margen, no garantías. Usa el buscador de PC con archivo de modelo y contexto.

Diagnóstico por síntoma

Corrige la capa que realmente falla

SíntomaCausa probableAcción
Modelo ausenteServicio parado o etiqueta erróneaComprueba ollama list y el ID exacto.
Chat sí, edición noTool calling insuficientePrueba un modelo de código con herramientas documentadas.
Memoria llena despuésCaché de contexto o sesionesCierra sesiones, reduce contexto o cuantización.
Espera larga al inicioPrompt largo, offload CPU o carga fríaComprueba offload y elimina contexto innecesario.
Endpoint inaccesibleHost, puerto o servicio incorrectoRestaura http://localhost:11434/v1.

Local no significa sin riesgo

Da al agente un entorno seguro

Commit previo

Rama o worktree limpio con vuelta sencilla.

Carpeta limitada

Sin secretos ni volcados de producción accesibles.

Comandos revisados

Rechaza acciones destructivas o privilegiadas que no entiendas.

Parche probado

Diff, pruebas, lint y seguridad antes del merge.

Referencias oficiales

Verifica comandos y modelo

OL

Integración de Ollama

Inicio, contexto 64K y configuración en la guía oficial.

QW

Qwen3-Coder

Arquitectura, contexto y herramientas en la ficha oficial.

¿Aún eliges PC?

Dimensiona modelo y contexto antes del sistema

El buscador separa velocidad de VRAM dedicada y capacidad de memoria compartida.

Abrir el buscador