PDF Extractor: Bulk PDF to Text, Tables & Markdown from a CSV for LangChain
io.github.nero-engine/dataset-pdf-extract
Extract text, tables and metadata from every PDF linked in a dataset, CSV or Google Sheet.
client:LangChain
transport:streamable-http
Install PDF Extractor: Bulk PDF to Text, Tables & Markdown from a CSV in LangChain
pip install langchain-mcp-adapters
from langchain_mcp_adapters.client import MultiServerMCPClient
client = MultiServerMCPClient({
"dataset-pdf-extract": {
"transport": "streamable_http",
"url": "https://mcp.apify.com/?tools=nerolabs/dataset-pdf-extract",
}
})
tools = await client.get_tools()
get_tools() returns the server's tools as LangChain tools, ready for an agent. LangChain docs