web-scraper
Web Scraper to Markdown API
Извлекайте чистый markdown из любого URL. Удаляет навигацию/рекламу/скрипты, возвращает структурированный контент. Создан для RAG-пайплайнов и AI-исследовательских агентов. Оплата за вызов через x402 (USDC на Base L2) — без API-ключа, без регистрации, без ограничений по частоте запросов.
Часть маркетплейса klymax402 — 100 x402 микроплатежных API для AI-агентов, один кошелек, USDC на Base.
Быстрый старт -- MCP
Добавьте в конфигурацию вашего MCP-клиента (Claude Desktop, Cursor, ElizaOS и т.д.):
{
"mcpServers": {
"web-scraper": {
"url": "https://web-scraper.api.klymax402.com/mcp"
}
}
}Related MCP server: skim-mcp
Быстрый старт -- HTTP (x402)
curl "https://web-scraper.api.klymax402.com/api/scrape?url=https://example.com"
# -> 402 Payment Required, with an x402 payment challenge in the response bodyЛюбой x402-совместимый клиент (@x402/fetch, x402-agent-tools, ATXP) автоматически обрабатывает цикл 402 -> подпись -> повтор.
Инструменты
Tool | Method | Path | Price | Description |
| GET |
| $0.012 | Скрапить URL и преобразовывать в чистый markdown |
| POST |
| $0.05 | Скрапить до 10 URL пакетно |
web_scrape_to_markdown
Скрапит и извлекает контент с URL с полным рендерингом JS, возвращает чистый markdown. Альтернатива Firecrawl scrape по цене в 2,5 раза ниже. Удаляет навигацию, рекламу, скрипты и шаблонный контент — идеально для RAG-пайплайнов и AI-исследовательских агентов.
Параметры
Имя | Тип | Обязательный | Описание |
| string | да | URL для скрапинга (например, https://example.com/article) |
Пример ответа:
{"title":"How to Scale APIs","description":"A guide to...","content":"# How to Scale APIs\n\nScaling requires...","wordCount":1250,"charCount":7800,"url":"https://blog.example.com/scale-apis"}Когда использовать: для суммаризации статей, создания RAG-корпусов, исследования тем из веб-источников или извлечения данных из страниц документации. Необходим для любого рабочего процесса, которому нужно скрапить и извлекать контент с веб-страниц в качестве входных данных для LLM. Прямая замена Firecrawl scrape.
Не для: скриншотов (используйте capture_screenshot), SEO-аудита (используйте seo_audit_page), определения технологического стека (используйте website_detect_tech_stack), веб-поиска (используйте web_search_query).
web_scrape_batch
Используйте это, когда нужно извлечь чистый контент с нескольких веб-страниц одновременно (до 10 URL). Возвращает тот же структурированный markdown-вывод, что и web_scrape_to_markdown, для каждого URL.
Параметры
Имя | Тип | Обязательный | Описание |
| array | да | Массив URL (максимум 10) |
Пример ответа:
{"results":[{"url":"https://a.com","title":"Page A","wordCount":800},{"url":"https://b.com","title":"Page B","wordCount":1200}],"summary":{"total":2,"totalWords":2000,"failed":0}}Когда использовать: для создания исследовательских корпусов, сравнения контента на страницах конкурентов или массового извлечения документации. Необходим, когда у вас есть 3+ URL для обработки в одном рабочем процессе.
Не для: одиночных URL (используйте web_scrape_to_markdown), SEO-сравнения (используйте seo_audit_batch).
Примеры промптов для агентов
"Скрапить и извлекать контент с URL с полным рендерингом JS, возвращать чистый markdown"
"Извлекать чистый контент с нескольких веб-страниц одновременно (до 10 URL)"
Оплата
Протокол: x402 — нативный HTTP-протокол оплаты за вызов, без регистрации, без API-ключа
Сеть: Base L2 (
eip155:8453)Актив: USDC
Фасилитатор: Coinbase CDP (основной), PayAI (резервный)
Также доступен через ATXP (x402 с OAuth-оберткой, метаданные защищенных ресурсов RFC 9728)
Часть klymax402
100 x402 микроплатежных API для AI-агентов — один кошелек, USDC на Base, без регистрации.
Каталог: https://klymax402.com/llms.txt
Полная справочная документация API: https://klymax402.com/llms-full.txt
Живая статистика: https://klymax402.com/stats
Лицензия
MIT
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- FlicenseNot gradedqualityDmaintenanceExtracts the content from any URL and returns it in clean, optimized Markdown for LLMs. Supports standalone monetization via Dodo Payments (HTTP 402).131
- AlicenseAqualityBmaintenancePay-per-use clean web reader for AI agents. URL in, markdown plus metadata out, in milliseconds. Settled per-call in USDC over x402 — no signup, no API keys.1852MIT
- AlicenseNot gradedqualityCmaintenanceEnables extracting clean Markdown from any webpage by paying $0.005 USDC per call via the x402 protocol, with automatic wallet-based payment settlement.14MIT
- AlicenseAqualityBmaintenanceEnables AI agents to read web pages reliably, returning clean markdown content, hyperlinks, and metadata without navigation or ad noise.314MIT
Related MCP Connectors
Web scraping for AI agents. Converts URLs to clean, LLM-ready Markdown with anti-bot bypass.
Web intelligence for AI agents: fetch, render, extract, research. x402 micropayments, no API keys.
Web reader for AI agents — output ~4x smaller than raw HTML. Card API key or x402. Free tier.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Br0ski777/web-scraper-x402'
If you have feedback or need assistance with the MCP directory API, please join our Discord server