Skip to content
Gemini CLI

Inference AIops for Gemini CLI

io.github.aiops-tools/inference-aiops

Governed GPU inference ops (vLLM + Ray Serve): latency RCA, scaling, drain, 39 tools.

client:Gemini CLI transport:stdio runtime:pypi

Install Inference AIops in Gemini CLI

~/.gemini/settings.json · windows: %USERPROFILE%\.gemini\settings.json

{
  "mcpServers": {
    "inference-aiops": {
      "command": "uvx",
      "args": [
        "inference-aiops"
      ]
    }
  }
}

Gemini expands $VAR and ${VAR} inside env values, so a secret can live in your shell rather than this file. Gemini CLI docs

Inference AIops in other clients