Skip to content
LangChain

PDF Extractor: Bulk PDF to Text, Tables & Markdown from a CSV for LangChain

io.github.nero-engine/dataset-pdf-extract

Extract text, tables and metadata from every PDF linked in a dataset, CSV or Google Sheet.

client:LangChain transport:streamable-http

Install PDF Extractor: Bulk PDF to Text, Tables & Markdown from a CSV in LangChain

pip install langchain-mcp-adapters

from langchain_mcp_adapters.client import MultiServerMCPClient

client = MultiServerMCPClient({
        "dataset-pdf-extract": {
            "transport": "streamable_http",
            "url": "https://mcp.apify.com/?tools=nerolabs/dataset-pdf-extract",
        }
})

tools = await client.get_tools()

get_tools() returns the server's tools as LangChain tools, ready for an agent. LangChain docs

PDF Extractor: Bulk PDF to Text, Tables & Markdown from a CSV in other clients