ollama handoff for Gemini CLI
io.github.michael-whitecapdata/ollama-handoff
Offload cheap work from your AI agent to a local Ollama model, at zero cloud cost.
client:Gemini CLI
transport:stdio
runtime:pypi
Install ollama handoff in Gemini CLI
~/.gemini/settings.json · windows: %USERPROFILE%\.gemini\settings.json
{
"mcpServers": {
"ollama-handoff": {
"command": "uvx",
"args": [
"ollama-handoff"
],
"env": {
"OLLAMA_URL": "<OLLAMA_URL>",
"OLLAMA_DEFAULT_MODEL": "<OLLAMA_DEFAULT_MODEL>",
"OLLAMA_NUM_CTX": "<OLLAMA_NUM_CTX>",
"OLLAMA_KEEP_ALIVE": "<OLLAMA_KEEP_ALIVE>",
"OLLAMA_TIMEOUT_S": "<OLLAMA_TIMEOUT_S>"
}
}
}
}
Gemini expands $VAR and ${VAR} inside env values, so a secret can live in your shell rather than this file. Gemini CLI docs