PDF Text, Table and OCR Extractor for LangChain
io.github.brenton-keller/pdf-text-table-ocr-extractor
PDF URLs to per-page text, tables as rows, Markdown, metadata and OCR for scanned pages.
client:LangChain
transport:streamable-http
Install PDF Text, Table and OCR Extractor in LangChain
pip install langchain-mcp-adapters
from langchain_mcp_adapters.client import MultiServerMCPClient
client = MultiServerMCPClient({
"pdf-text-table-ocr-extractor": {
"transport": "streamable_http",
"url": "https://mcp.apify.com/?tools=brenton8907/pdf-text-table-ocr-extractor",
}
})
tools = await client.get_tools()
get_tools() returns the server's tools as LangChain tools, ready for an agent. LangChain docs