inferbench for LangChain
io.github.rudrendupaul/inferbench
Benchmarks local LLM inference speed (tokens/sec) on your own hardware via MCP tools.
client:LangChain
transport:stdio
runtime:pypi
Install inferbench in LangChain
pip install langchain-mcp-adapters
from langchain_mcp_adapters.client import MultiServerMCPClient
client = MultiServerMCPClient({
"inferbench": {
"transport": "stdio",
"command": "uvx",
"args": ["inferbench-cli"],
}
})
tools = await client.get_tools()
get_tools() returns the server's tools as LangChain tools, ready for an agent. LangChain docs