List your agent
Task · Data

Best AI agents to extract website data

This task needs 2 capabilities. 16 tools cover all of them; 493 cover at least one.

Required capabilities:Data ExtractionWeb Scraping
#ToolCoverageAccessTrustSeen
151Steady API ScrapersMCP
YouTube transcripts, Google Hotels prices, Google Ads Transparency, Google Trends and Threads posts.
50%REMOTELOCALDECLARED5d ago
152docforgeMCP
12 paid document tools: PDF to markdown, OCR, tables, invoices, Word/Excel/HTML, merge/split. x402
50%REMOTELOCALDECLARED5d ago
153smart-crawlerMCP
E-commerce competitor intelligence, VOC sentiment, Amazon ASIN analysis, Reddit growth playbooks.
50%REMOTELOCALDECLARED5d ago
154geo-tool-checkMCP
Is this page readable for AI search? Crawler access, structure and citability checks, runs locally.
50%REMOTELOCALDECLARED5d ago
155robotstxt-aiMCP
Analyze and generate robots.txt with AI crawler detection for 20+ bots like GPTBot and ClaudeBot.
50%REMOTELOCALDECLARED5d ago
156Native DevToolsMCP
MCP server for desktop, browser (CDP), and Android automation. Screenshot, OCR, click, type.
50%REMOTELOCALDECLARED5d ago
157OpenGraph.io MCP ServerMCP
MCP server for OpenGraph.io API - fetch OG data, screenshots, scrape, and generate images
50%REMOTELOCALDECLARED5d ago
158scrapercity-cliMCP
B2B lead generation MCP server - 20+ scrapers, email finder, skip trace, and more.
50%REMOTELOCALDECLARED5d ago
159scrapeless-mcp-serverMCP
Web search, browser automation, scraping, crawling and CAPTCHA solving for AI agents.
50%REMOTELOCALDECLARED5d ago
160techtenstein-pdfMCP
PDF text and table extraction plus metadata. Supports OCR for scanned documents.
50%REMOTELOCALDECLARED5d ago
161Agent Crawl ReadinessMCP
Bounded crawl-readiness check for agent access: robots.txt, sitemap.xml, llms.txt, homepage.
50%REMOTELOCALDECLARED5d ago
162webMCP
Web scraping, search, monitoring, and HTML-to-markdown for AI agents
50%REMOTELOCALDECLARED5d ago
163Robot Resources ScraperMCP
Token compression for web content — 70-80% reduction from HTML to clean markdown
50%REMOTELOCALDECLARED5d ago
164ReplyNodesMCP
Web MCP: scrape/crawl sites, web search, brand assets, app stores, YouTube, Reddit, Hacker News.
50%REMOTELOCALDECLARED5d ago
165ReefAPIMCP
One MCP server for 180+ live web-data APIs returning clean JSON from sites that block scrapers.
50%REMOTELOCALDECLARED5d ago
166FineDataMCP
FineData web scraping MCP — JavaScript rendering, captcha solving, markdown for AI agents
50%REMOTELOCALDECLARED5d ago
167visiongemmaMCP
Local AI vision MCP server for Windows: OCR, chart analysis, scene description. 100% offline.
50%REMOTELOCALDECLARED5d ago
168GroundAPIMCP
Real-time data API for AI Agents: stocks, weather, forex, logistics, search, scrape, news, IP.
50%REMOTELOCALDECLARED5d ago
169crawlgraph-mcpMCP
Backlink lookups and competitor gap analysis on Common Crawl's open web graph (4.4B links).
50%REMOTELOCALDECLARED5d ago
170reMarkable MCP Server (Read/Write)MCP
Read, write, and manage your reMarkable tablet — browse, upload, create folders, move, delete, OCR
50%REMOTELOCALDECLARED5d ago
171ScrapingbeeMCP
ScrapingBee MCP — wraps the ScrapingBee headless-scraping API (scrapingbee.com)
50%REMOTELOCALDECLARED5d ago
172ScrapingantMCP
ScrapingAnt MCP — wraps the ScrapingAnt web scraping API (scrapingant.com)
50%REMOTELOCALDECLARED5d ago
173OxylabsMCP
Oxylabs MCP — Oxylabs Web Scraper API (oxylabs.io)
50%REMOTELOCALDECLARED5d ago
174OcrspaceMCP
OCR.space MCP — wraps the OCR.space API (ocr.space) for image/PDF → text OCR.
50%REMOTELOCALDECLARED5d ago
175FirecrawlMCP
Firecrawl MCP — wraps the Firecrawl API (firecrawl.dev) for web
50%REMOTELOCALDECLARED5d ago
176DecodoMCP
Decodo MCP — wraps the Decodo Web Scraping API (decodo.com, formerly
50%REMOTELOCALDECLARED5d ago
177DbpediaMCP
DBpedia MCP — SPARQL + Lookup over Wikipedia-derived structured data
50%REMOTELOCALDECLARED5d ago
178CrawlgraphMCP
CrawlGraph MCP — backlink intelligence on the public Common Crawl webgraph
50%REMOTELOCALDECLARED5d ago
179CrawlbaseMCP
Crawlbase MCP — wraps the Crawlbase Crawling API (crawlbase.com, formerly
50%REMOTELOCALDECLARED5d ago
180CommoncrawlMCP
Common Crawl's public web archive — find every time a URL was crawled since 2008 and read the…
50%REMOTELOCALDECLARED5d ago
181ApifyMCP
Apify MCP — run web-scraping Actors and fetch their dataset results.
50%REMOTELOCALDECLARED5d ago
182bol-aiMCP
Extract structured data from Bills of Lading: parties, ports, containers, incoterms. EU-hosted.
50%REMOTELOCALDECLARED5d ago
183gate402-mcpMCP
x402 pay-per-call agent APIs: LLM inference, Base trading data, SEC filings & scraping
50%REMOTELOCALDECLARED5d ago
184Reclame Aqui Scraper — Reputação de Empresas BRMCP
Reputação de empresas no Reclame Aqui: nota, índice de solução e total de reclamações.
50%REMOTELOCALDECLARED5d ago
185ZAP Imóveis Scraper — Anúncios de Venda e AluguelMCP
Extrai anúncios do ZAP Imóveis: venda e aluguel com preço, área, quartos e localização.
50%REMOTELOCALDECLARED5d ago
186PDF4meMCP
PDF & document automation via the PDF4me API — convert, OCR, extract, edit, secure.
50%REMOTELOCALDECLARED5d ago
187doc-to-markdownMCP
PDF, Word, PowerPoint, Excel, HTML, EPUB to Markdown: OCR, page ranges, tables, RAG chunking
50%REMOTELOCALDECLARED5d ago
188iFood Scraper Brasil: Leads de Restaurantes com CNPJMCP
Extrai restaurantes do iFood no Brasil com endereço, categoria e CNPJ da Receita Federal.
50%REMOTELOCALDECLARED5d ago
189broken-link-checkerMCP
Crawl a site for broken links, 404s, dead images, redirect chains and slow pages, with sources
50%REMOTELOCALDECLARED5d ago
190Shopee Brasil Scraper — Produtos, Preços, Vendidos e LojasMCP
Produtos da Shopee Brasil por busca ou loja: preço, Pix, nota, cidade, loja e vendidos
50%REMOTELOCALDECLARED5d ago
191Google News Scraper — Real Publisher URLs, MCP-ReadyMCP
Scrapes Google News and returns the real publisher URLs, not redirect links.
50%REMOTELOCALDECLARED5d ago
192Web Page FetcherMCP
Fetch web pages with SSRF protection. Returns clean, readable markdown from any URL.
50%REMOTELOCALDECLARED5d ago
193superhighway-mcpMCP
Web search for AI agents — 5 tools: search, news, images, scrape, research. x402/USDC or API key.
50%REMOTELOCALDECLARED5d ago
194PaperOffice AIMCP
Document AI and headless DMS: OCR, IDP, search, workflows, signatures. EU-hosted, OAuth 2.1.
50%REMOTELOCALDECLARED5d ago
195NIRA Screen Vision MCPMCP
Real-time screen capture + AI vision for Claude — see, analyze, and OCR your screen
50%REMOTELOCALDECLARED5d ago
196plonkMCP
Plonk gives agents local macOS tools for windows, workspaces, screenshots, OCR, and more.
50%REMOTELOCALDECLARED5d ago
197Google Ads Transparency Center Scraper (orbots) - Apify ActorMCP
Every ad an advertiser runs on Google, from the public Ads Transparency Center. Unofficial tool.
50%REMOTELOCALDECLARED5d ago
198Google Trends Scraper (orbots) - Apify ActorMCP
Google Trends trending searches, volume estimates & trend duration. Not affiliated with Google LLC.
50%REMOTELOCALDECLARED5d ago
199Olostep MCP ServerMCP
Search, scrape, and crawl the web for AI agents. Batch scraping and answers with citations.
50%REMOTELOCALDECLARED5d ago
200sociavault-mcpMCP
Scrape social data from TikTok, Instagram, YouTube, X, LinkedIn, Reddit, and ad libraries.
50%REMOTELOCALDECLARED5d ago

Coverage = share of this task's required capabilities that an agent or tool documents. For AI agents, capabilities are those stated on the vendor's website; for tools, they are matched automatically from the publisher's description (keyword method, low confidence).