HyperCrawl
HyperCrawl
Самостоятельно размещаемый движок веб-автоматизации с поддержкой cookie. Превращает любой сайт в вызываемые MCP-инструменты (на основе DOM-селекторов), запускает их в headless-режиме со stealth на наших серверах и по запросу получает живые авторизационные cookie из реального браузера, в котором выполнен вход. Внутренний инструмент NEB — работает вместе с Apify.
Статус: продакшн на GCE VM hypercrawl-vm (Caddy auto-TLS + шлюз Firebase-Auth, hypercrawl.service). Возможности: лестница возможностей acquire() (hypercrawl_acquire — повтор/гидратация API → выученный инструмент → DOM-агент → set-of-marks → зрение → специалист), многостраничное обнаружение (hypercrawl_map, hypercrawl_crawl_site), отслеживание изменений между обходами (stateless previousHashes или track-потоки на основе БД, оба интента), веб-поиск (hypercrawl_search), а также HTTP MCP-транспорт, ProxyPool и запасной адаптер Apify. См. docs/USAGE.md (инструменты) и deploy/gcp/README.md (развертывание/обновление — включает необходимые шаги npm install + npx playwright install).
Браузерные сессии
Помимо разового получения возможностей, HyperCrawl предоставляет stateful-интерфейс браузера: 15 MCP-инструментов hypercrawl_browser_*, которые управляют одной живой страницей в рамках многих вызовов, так что агент может прочитать страницу, кликнуть по ней, заполнить форму и отправить её — каждый шаг оказывается на той же вкладке. hypercrawl_browser_open возвращает sessionId, который принимает каждый остальной инструмент.
Сессии — ограниченный ресурс: каждая занимает реальный контекст Chromium, поэтому сервер ограничивает параллелизм (HYPERCRAWL_MAX_SESSIONS, по умолчанию 4) и вычищает сессии, бездействующие более пяти минут. Закрывайте свои, когда закончите. Неизвестный sessionId — это явная ошибка, а не бесшумное открытие новой страницы.
Наряду с ними: hypercrawl_analyze / hypercrawl_quality (структура страницы и проверка того, разрешаются ли селекторы сохранённого шаблона на живой странице — сигнал того, что редизайн сломал её), hypercrawl_auth_save / _auth_list, а также hypercrawl_metrics / _events / _speed / _setup для внутрипроцессной наблюдаемости. Справочник инструментов и все переменные окружения: docs/USAGE.md.
Две возможности подключаются только при запуске сервера через hypercrawl serve — пара auth и hypercrawl_setup — потому что их реализации находятся в CLI-пакете. В неподключённом состоянии они сообщают об этом, а не возвращают пустой результат, который можно было бы прочитать как «ничего не настроено».
Развертывание в GCP
Чтобы запустить полный движок (включая авторизованный скрапинг с извлечением cookie) на выделенной GCE VM с Caddy auto-TLS и шлюзом Firebase Auth token, используйте идемпотентные скрипты подготовки и операционный ранбук в deploy/gcp/README.md. Дизайн: docs/superpowers/specs/2026-05-29-hypercrawl-gcp-deploy-design.md.
This server cannot be installed
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
AI-powered browser automation — navigate, click, fill forms, and extract data from any website.
Hosted real Google Chrome MCP with per-user persistent state. Navigate, click, type, screenshot.
Self-hosted MCP gateway: turn any API, database or MCP server into AI connectors — no code.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/JoinSyndicate/hypercrawl'
If you have feedback or need assistance with the MCP directory API, please join our Discord server