MCP Server

doc-convert-mcp

dev.ioconnex/doc-convert-mcp
Media & Content Productivity Public & reachable MCP 2025-11-25

What this MCP does

Extracts text from images, PDFs, spreadsheets, and public web pages, including OCR and spreadsheet-to-Markdown conversion.

ocr_image
Ocr Image
Run OCR on an image (base64-encoded bytes) and return recognized text.
Input schema
{'type': 'object', 'required': ['image_base64'], 'properties': {'lang': {'type': 'string', 'default': 'eng', 'description': "Tesseract language code (default 'eng')."}, 'image_base64': {'type': 'string', 'description': 'The image file contents, base64-encoded.'}}, 'additionalProperties': False}
Output schema
{'type': 'object', 'required': ['result'], 'properties': {'result': {'type': 'string'}}, 'x-fastmcp-wrap-result': True}
parse_spreadsheet
Parse Spreadsheet
Parse a CSV or XLSX file (base64-encoded bytes) into Markdown tables.
Input schema
{'type': 'object', 'required': ['file_base64', 'filename'], 'properties': {'filename': {'type': 'string', 'description': 'Original filename (used to detect .csv vs .xlsx).'}, 'file_base64': {'type': 'string', 'description': 'The spreadsheet file contents, base64-encoded.'}}, 'additionalProperties': False}
Output schema
{'type': 'object', 'required': ['result'], 'properties': {'result': {'type': 'string'}}, 'x-fastmcp-wrap-result': True}
pdf_to_markdown
Pdf To Markdown
Convert a PDF (base64-encoded bytes) to Markdown, one section per page.
Input schema
{'type': 'object', 'required': ['pdf_base64'], 'properties': {'max_pages': {'type': 'integer', 'default': 100, 'description': 'Maximum pages to extract (default 100).'}, 'pdf_base64': {'type': 'string', 'description': 'The PDF file contents, base64-encoded.'}}, 'additionalProperties': False}
Output schema
{'type': 'object', 'required': ['result'], 'properties': {'result': {'type': 'string'}}, 'x-fastmcp-wrap-result': True}
url_to_clean_text
Url To Clean Text
Fetch a public http(s) URL and return its main text content as plain text.
Input schema
{'type': 'object', 'required': ['url'], 'properties': {'url': {'type': 'string', 'description': 'The http(s) URL to fetch. Private/loopback hosts are rejected.'}}, 'additionalProperties': False}
Output schema
{'type': 'object', 'required': ['result'], 'properties': {'result': {'type': 'string'}}, 'x-fastmcp-wrap-result': True}
Added
url_to_clean_text
Sept. 27, 2026, 2:40 a.m.
Added
parse_spreadsheet
Sept. 27, 2026, 2:40 a.m.
Added
ocr_image
Sept. 27, 2026, 2:40 a.m.
Added
pdf_to_markdown
Sept. 27, 2026, 2:40 a.m.