Browser Automation MCP Server
🤖 Агент автоматизации браузера
Мощный инструмент автоматизации браузера, созданный с помощью MCP (Model Controlled Program), который сочетает возможности веб-скрейпинга с интеллектом на основе LLM. Этот агент может выполнять поиск в Google, переходить на веб-страницы и интеллектуально скрейпинговать контент с различных веб-сайтов, включая GitHub, Stack Overflow и сайты документации.
🚀 Особенности
🔍 Интеграция с поиском Google : находит и извлекает лучшие результаты поиска по любому запросу
🕸️ Интеллектуальный веб-скрапинг : индивидуальные стратегии скрапинга для разных типов веб-сайтов:
📂 Репозитории GitHub
💬 Вопросы и ответы Stack Overflow
📚 Страницы документации
🌐 Общие веб-сайты
🧠 Обработка на базе искусственного интеллекта : использует искусственный интеллект Mistral для понимания и обработки собранного контента.
🥷 Скрытый режим : реализует защиту отпечатков пальцев браузера, чтобы избежать обнаружения
💾 Сохранение контента : автоматически сохраняет как скриншоты, так и текстовое содержимое с извлеченных страниц.
Related MCP server: Web Search MCP
🏗️ Архитектура
В этом проекте используется клиент-серверная архитектура на базе MCP:
🖥️ Сервер : выполняет задачи автоматизации браузера и веб-скрапинга.
👤 Клиент : предоставляет интерфейс ИИ с использованием Mistral AI и LangGraph
📡 Связь : использует stdio для клиент-серверной связи.
⚙️ Требования
🐍 Питон 3.8+
🎭 Драматург
🧩 MCP (Программа с модельным управлением)
🔑 API-ключ Mistral AI
📥 Установка
Клонируйте репозиторий:
git clone https://github.com/yourusername/browser-automation-agent.git
cd browser-automation-agentУстановить зависимости:
pip install -r requirements.txtУстановить браузеры Playwright:
playwright installСоздайте файл
.envв корне проекта и добавьте свой ключ API Mistral AI:
MISTRAL_API_KEY=your_api_key_here📋 Использование
Запуск сервера
python main.pyЗапуск клиента
python client.pyОбразец взаимодействия
После запуска сервера и клиента:
Введите ваш запрос при появлении соответствующего запроса
Агент будет:
🔍 Найдите в Google соответствующие результаты
🧭 Перейти к верхнему результату
📊 Сбор контента на основе типа веб-сайта
📸 Сохраняйте скриншоты и контент в файлы
📤 Возврат обработанной информации
🛠️ Функции инструмента
get_top_google_url
🔍 Выполняет поиск в Google и возвращает URL-адрес лучшего результата по заданному запросу.
browse_and_scrape
🌐 Переходит по URL-адресу и извлекает контент на основе типа веб-сайта.
scrape_github
📂 Специализируется на извлечении содержимого README и блоков кода из репозиториев GitHub.
scrape_stackoverflow
💬 Извлекает вопросы, ответы, комментарии и блоки кода со страниц Stack Overflow.
scrape_documentation
📚 Оптимизирован для извлечения содержимого документации и примеров кода.
scrape_generic
🌐 Извлекает текст абзацев и блоки кода из общих веб-сайтов.
📁 Структура файла
browser-automation-agent/
├── main.py # MCP server implementation
├── client.py # Mistral AI client implementation
├── requirements.txt # Project dependencies
├── .env # Environment variables (API keys)
└── README.md # Project documentation📤 Выходные файлы
Агент генерирует два типа выходных файлов с временными метками:
📸
final_page_YYYYMMDD_HHMMSS.png: Скриншот конечного состояния страницы📄
scraped_content_YYYYMMDD_HHMMSS.txt: Извлеченный текстовый контент со страницы
⚙️ Настройка
Вы можете изменить следующие параметры в коде:
🖥️ Размер окна браузера: отрегулируйте
widthиheightвbrowse_and_scrape👻 Режим Headless: установите
headless=Trueдля невидимой работы браузера.🔢 Количество результатов Google: Измените
num_resultsвget_top_google_url
❓ Устранение неполадок
🔌 Проблемы с подключением : убедитесь, что сервер и клиент работают на разных терминалах.
🎭 Ошибки Playwright : убедитесь, что браузеры установлены с
playwright install🔑 Ошибки API-ключа : проверьте, правильно ли установлен ваш API-ключ Mistral в файле
.env🛣️ Ошибки пути : при необходимости обновите путь к
main.pyвclient.py
📜 Лицензия
Лицензия Массачусетского технологического института
🤝 Вклад
Вклады приветствуются! Пожалуйста, не стесняйтесь отправлять запрос на включение.
Создано с помощью 🧩 MCP, 🎭 Playwright и 🧠 Mistral AI
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- FlicenseBqualityDmaintenanceEnables web searching and content scraping through Google Custom Search API. Provides tools to search the internet, extract webpage content, and automatically scrape search results for comprehensive information gathering.3
- Alicense-qualityCmaintenanceEnables web searching through Google, DuckDuckGo, and Bing using a headless Chrome browser, returning structured results with titles, URLs, and snippets. Also supports fetching and extracting text content from any webpage.12MIT
- Alicense-qualityDmaintenanceProvides web search and page fetch capabilities using a browser-based approach, enabling LLMs to search DuckDuckGo, Google, or Yandex and retrieve rendered HTML from URLs.3MIT
- Alicense-qualityCmaintenanceEnables LLMs to fetch and extract web content using browser automation, OCR, and multiple extraction methods, handling JavaScript rendering and anti-scraping techniques.17MIT
Related MCP Connectors
AI-powered browser automation — navigate, click, fill forms, and extract data from any website.
Provides cloud browser automation capabilities using Stagehand and Browserbase, enabling LLMs to i…
Web research for agents: quality-scored Google search, webpage extraction, and deep research.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Raghu6798/Browser_scrape_mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server