Skip to content
Gemini CLI

ollama handoff for Gemini CLI

io.github.michael-whitecapdata/ollama-handoff

Offload cheap work from your AI agent to a local Ollama model, at zero cloud cost.

client:Gemini CLI transport:stdio runtime:pypi

Install ollama handoff in Gemini CLI

~/.gemini/settings.json · windows: %USERPROFILE%\.gemini\settings.json

Held in this page only — never stored, logged, or sent anywhere but back to your screen.

{
  "mcpServers": {
    "ollama-handoff": {
      "command": "uvx",
      "args": [
        "ollama-handoff"
      ],
      "env": {
        "OLLAMA_URL": "<OLLAMA_URL>",
        "OLLAMA_DEFAULT_MODEL": "<OLLAMA_DEFAULT_MODEL>",
        "OLLAMA_NUM_CTX": "<OLLAMA_NUM_CTX>",
        "OLLAMA_KEEP_ALIVE": "<OLLAMA_KEEP_ALIVE>",
        "OLLAMA_TIMEOUT_S": "<OLLAMA_TIMEOUT_S>"
      }
    }
  }
}

Gemini expands $VAR and ${VAR} inside env values, so a secret can live in your shell rather than this file. Gemini CLI docs

ollama handoff in other clients