Skip to content
LangChain

PDF Text, Table and OCR Extractor for LangChain

io.github.brenton-keller/pdf-text-table-ocr-extractor

PDF URLs to per-page text, tables as rows, Markdown, metadata and OCR for scanned pages.

client:LangChain transport:streamable-http

Install PDF Text, Table and OCR Extractor in LangChain

pip install langchain-mcp-adapters

from langchain_mcp_adapters.client import MultiServerMCPClient

client = MultiServerMCPClient({
        "pdf-text-table-ocr-extractor": {
            "transport": "streamable_http",
            "url": "https://mcp.apify.com/?tools=brenton8907/pdf-text-table-ocr-extractor",
        }
})

tools = await client.get_tools()

get_tools() returns the server's tools as LangChain tools, ready for an agent. LangChain docs

PDF Text, Table and OCR Extractor in other clients