Agente terminale locale · endpoint Ollama · tool repository

OpenCode con Ollama: configurare correttamente un modello locale

Il percorso rapido usa un solo comando. Una configurazione affidabile richiede anche un modello compatibile con i tool, almeno 64K di contesto, memoria sufficiente e un ambiente Git sicuro.

Percorso ufficiale più breve

Avvia OpenCode tramite Ollama

Installa entrambe le applicazioni dalle fonti ufficiali, verifica che Ollama sia attivo ed esegui:

ollama launch opencode

Ollama permette di scegliere un modello disponibile e avvia OpenCode con una configurazione locale temporanea senza sovrascrivere quella persistente.

Il controllo che evita partenze false

Pianifica 64K di contesto prima del modello

La documentazione Ollama per OpenCode richiede 64K o più. Estratti del repository, tool, output e cronologia occupano questo spazio.

  • scegli tool call affidabili
  • riserva memoria alla cache KV
  • inizia con un agente e un repository piccolo
  • prova in un branch sacrificabile

Configurazione riproducibile

Sei passi fino alla prima patch verificata

  1. 01

    Installa dalle fonti ufficiali

    Scarica Ollama e segui la guida OpenCode per il tuo sistema.

  2. 02

    Scegli un modello con tool

    Controlla instruction following, function calling e contesto nella scheda modello. Autocomplete non significa automaticamente buon agente.

  3. 03

    Conferma l’ID esatto

    Esegui ollama list e usa esattamente nome e tag visualizzati.

  4. 04

    Avvia l’integrazione

    Usa ollama launch opencode. L’opzione --config prepara la configurazione senza aprire subito una sessione.

  5. 05

    Verifica i tool

    Fai leggere un file, applicare una modifica reversibile ed eseguire un test innocuo. Una chat fluida non prova le tool call.

  6. 06

    Misura il vero limite

    Osserva memoria, attesa iniziale, velocità e test. Riduci il contesto se manca memoria; cambia modello se le patch sono veloci ma errate.

Configurazione manuale

Collega OpenCode a Ollama in modo esplicito

In opencode.json, sostituisci l’ID con quello mostrato da ollama list.

{   "$schema": "https://opencode.ai/config.json",   "provider": {     "ollama": {       "npm": "@ai-sdk/openai-compatible",       "name": "Ollama (local)",       "options": {         "baseURL": "http://localhost:11434/v1"       },       "models": {         "id-del-modello": {           "name": "Il mio modello coding locale"         }       }     }   } }

Endpoint locale

Mantieni localhost dove possibile

localhost:11434/v1 punta all’endpoint compatibile OpenAI di Ollama su questo PC. Non renderlo pubblico per collegare velocemente un altro dispositivo.

  • elenca solo modelli installati
  • non serve una chiave cloud per l’endpoint locale
  • accesso remoto richiede autenticazione e firewall
  • controlla separatamente i tool di rete dell’agente

Modello + 64K + margine

Memoria necessaria per OpenCode con Ollama

Modello, quantizzazione, cache KV e sessioni definiscono la classe del PC.

Classe modelloPartenza praticaUsoControllo
7B–14B quantizzato12–16 GB VRAM, 32 GB RAMChat focalizzata e primi test64K e tool devono funzionare insieme.
20B–24B quantizzato24 GB VRAM, 64 GB RAMAgente singolo più capaceLascia margine per cache e build.
30B–32B quantizzato32 GB VRAM o 64 GB+ unificatiAgente repository più forteCiò che entra a 32K può essere stretto a 64K.
Modello grande o più agenti96–128 GB unificati/coerentiCapacità e più serviziVerifica il runtime e aspettati velocità diverse.

Sono intervalli con margine, non garanzie. Usa il selettore PC con file modello e contesto desiderato.

Diagnostica per sintomo

Correggi il livello che sta davvero fallendo

SintomoCausa probabileAzione
Modello assenteServizio fermo o tag erratoControlla ollama list e l’ID esatto.
Chat sì, modifica noTool calling insufficienteProva un modello coding con tool documentati.
Memoria piena dopo un po’Cache contesto o sessioniChiudi sessioni, riduci contesto o quantizzazione.
Lunga attesa inizialePrompt lungo, offload CPU o caricamento freddoControlla offload e rimuovi contesto inutile.
Endpoint irraggiungibileHost, porta o servizio erratiRipristina http://localhost:11434/v1.

Locale non significa senza rischi

Dai all’agente un ambiente sicuro

Commit prima

Branch o worktree pulito con rollback semplice.

Cartella limitata

Nessun segreto o dump di produzione accessibile.

Comandi rivisti

Rifiuta azioni distruttive o privilegiate non comprese.

Patch testata

Diff, test, lint e sicurezza prima del merge.

Riferimenti ufficiali

Verifica comandi e modello

OL

Integrazione Ollama

Avvio, contesto 64K e configurazione nella guida ufficiale.

PC ancora da scegliere?

Dimensiona modello e contesto prima del sistema

Il selettore separa la velocità della VRAM dedicata dalla capacità della memoria condivisa.

Apri il selettore PC