wellknown
SearchCapabilitiesReliabilityJournalSourcesDocs
/mcpAdd to your agentSign in
wellknown

A live, machine-queryable index of AI agents, MCP servers and tools. Every record separates what publishers declare from what we observed.

Product
  • Search
  • Capabilities
  • Reliability report
  • Journal
  • Sources & freshness
  • Network status
Developers
  • Documentation
  • HTTP API
  • MCP server
  • Claim an agent
  • Dashboard
For machines
  • llms.txt
  • openapi.json
  • agent-card.json
  • sitemap.xml
  • About our crawler
Records are indexed from public sources and attributed to them. Observed data is ours; declared data is theirs.v0.1 · early network
Capabilities/Documents/documents.extraction

Data Extraction

Extract structured fields from documents.

101 records32 liveRefine in search →
technical-seo-mcpMCP serverMCP
by sourav28
Unknown

MCP server for technical & on-page SEO audits — crawlability, HTTPS, Core Web Vitals, sitemap, robots.txt, structured data, and AI-crawler access. Reports as Markdown, JSON, or a shareable HTML file.

SEOData Extraction~100%Web Scraping
npm:technical-seo-mcp · local package19/wkpublished 29 d ago
mcp-web-toolsMCP serverMCP
by paifas
Unknown

MCP server providing web search tools for AI assistants

Web SearchWeb ScrapingData Extraction~71%
npm:mcp-web-tools · local package18/wkpublished 3 mo ago
weblens-mcpMCP serverMCP
by bariskau
Unknown

MCP server for web scraping, page rendering, and content extraction — renders any URL (including SPAs) with Playwright, extracts readable content, downloads images locally, and returns clean markdown. Built for Claude, Cursor, Copilot, and any MCP-compati

Data Extraction~100%Web ScrapingBrowser Automation
npm:weblens-mcp · local package16/wkpublished 3 mo ago
@agentdocs1/mcp-serverMCP serverMCP
by uplo69
Unknown

UPLO MCP Server — Organizational knowledge for AI agents. 21 tools for searching, querying, and exporting structured organizational context.

Data Extraction~100%
npm:@agentdocs1/mcp-server · local package15/wkpublished 6 mo ago
html-scraper-mcpMCP serverMCP
by _brcode
Unknown

MCP server for HTML scraping and data extraction using Puppeteer

Data Extraction~100%Web ScrapingBrowser Automation
npm:html-scraper-mcp · local package15/wkpublished 11 mo ago
@zensystemai/multi-agent-memory-mcpMCP serverMCP
by expertlocal
Unknown

Persistent multi-path memory for AI agents — vector + BM25 keyword + entity graph search with RRF fusion, credential scrubbing, auto-consolidation, multi-backend storage (Qdrant + SQLite/Postgres)

Vector SearchAgent MemoryKnowledge GraphsAgent OrchestrationDatabases~80%
npm:@zensystemai/multi-agent-memory-mcp · local package15/wkpublished 5 mo ago
@mseep/tavily-mcpMCP serverMCP
by skydeckai
Unknown

MCP server for advanced web search using Tavily

Web SearchData Extraction~71%
npm:@mseep/tavily-mcp · local package14/wkpublished 17 mo ago
onto-mcpMCP serverMCP
by kangminlee
Unknown

MCP server for LLM agents: check an artifact's ontological integrity (the logical consistency of its concepts, authority, and purpose) and derive a domain ontology from real sources, with every structured claim gated by runtime validation.

Code Review~100%Knowledge GraphsSecurity Review~75%Spreadsheets~73%Data Extraction~71%
npm:onto-mcp · local package14/wkpublished 1 mo ago
whizoai-mcpMCP serverMCP
by uditsingh0909
Unknown

WhizoAI MCP Server for Claude Desktop - Enterprise web scraping through Model Context Protocol (MCP) integration

Web ScrapingData Extraction~71%
npm:whizoai-mcp · local package13/wkpublished 10 mo ago
@mseep/hyperbrowser-mcpMCP serverMCP
by skydeckai
Unknown

Hyperbrowser Model Context Protocol Server

Web ScrapingData Extraction~71%
npm:@mseep/hyperbrowser-mcp · local package11/wkpublished 3 mo ago
mcp-server-image-extractorMCP serverMCP
by abhiramk65
Unknown

MCP server for extracting and categorizing images from web pages with intelligent classification

Browser AutomationWeb ScrapingData Extraction~71%
npm:mcp-server-image-extractor · local package10/wkpublished 13 mo ago
@lithium-ai/mcpMCP serverMCP
by 0xjaksun
Unknown

MCP server for Lithium. Give AI agents tools to navigate, store, and retrieve structured data.

Data Extraction~100%Agent Memory~100%Vector Search
npm:@lithium-ai/mcp · local package7/wkpublished 3 mo ago
liciumMCP serverMCP
by licium.ai
Unknown

Clean rows from public web pages that break ordinary scrapers. Client and CLI for the Licium catalog.

Web ScrapingSpreadsheetsData Extraction~71%
npm:licium · local package7/wkpublished 1 mo ago
vibesynthexMCP serverMCP
by davixavierai
Unknown

VibeSEO — Auditoria de SEO para quem cria com IA. Meta tags, sitemap, Open Graph e visibilidade no Google.

SEOKnowledge Graphs~100%Data Extraction~75%
npm:vibesynthex · local package1/wkpublished 5 mo ago
docuScanAgentA2A
Unknown

PDF and document extraction via Google Document AI. Extract structured values from invoices, leases, bonds, contracts.

Data Extraction~89%Invoice Processing~81%
https://docu-scan.spocont.com
Docu-Scan MCPMCP serverMCP
by com.spocont
Unknown

PDF and document extraction via Google Document AI. Free trial available.

Data Extraction~89%OCR~67%
https://docu-scan.spocont.com/api/document-scan/mcp
Pet Data StationAgentA2A
by Pet Data Station
Unknown

AI-crawler-friendly pet regulatory & health data API. Source-verified RAG topics (AAFCO/FEDIAF/EU/China/Japan/Korea/Canada statutes, FDA openFDA ADE/recalls, Europe PMC evidence layer) plus structured nutrient/recall/breed-legality endpoints. No registration, no API key, English-only responses. Fre…

Vector SearchAcademic ResearchData Extraction~75%
https://petforai.com
Mart402AgentA2A
by Mart402
Unknown

Web content extraction API for AI agents. Pay per call with x402 (USDC on Base) - no account, no API key.

OCRData ExtractionInvoice ProcessingReporting & DashboardsPeople & Company Research
https://mart402.com
Iteration LayerMCP serverMCP
by com.iterationlayer
Unknown

Composable APIs for document extraction, image transformation, and document & sheet generation.

Data Extraction~89%
https://api.iterationlayer.com/mcp
webclawAgentA2A
by webclaw
Unknown

Web extraction agent for turning public web pages into markdown, JSON, structured data, summaries, diffs, brand signals, and research context for AI agents.

Writing & EditingData Extraction~100%Web ScrapingMonitoring & ObservabilityDeep Web Research
https://webclaw.io
← Previouspage 5 of 6Next →
Machine query
GET /api/v1/search?capability=documents.extraction&status=live
Aliases

extraction, document extraction, parse document, structured data, form extraction

Also in Documents
  • OCR
  • Invoice Processing
  • Contracts & Legal
  • Document Conversion
  • Spreadsheets
  • Presentations