Browser Automation MCP Server
🤖 Browser-Automatisierungsagent
Ein leistungsstarkes Browser-Automatisierungstool mit MCP (Model Controlled Program), das Web-Scraping-Funktionen mit LLM-gestützter Intelligenz kombiniert. Dieser Agent kann Google durchsuchen, Webseiten aufrufen und Inhalte von verschiedenen Websites wie GitHub, Stack Overflow und Dokumentationsseiten intelligent extrahieren.
🚀 Funktionen
🔍 Google-Suchintegration : Findet und ruft die besten Suchergebnisse für jede Abfrage ab
🕸️ Intelligentes Web Scraping : Maßgeschneiderte Scraping-Strategien für verschiedene Website-Typen:
📂 GitHub-Repositorys
💬 Fragen und Antworten zu Stack Overflow
📚 Dokumentationsseiten
🌐 Generische Websites
🧠 KI-gestützte Verarbeitung : Verwendet Mistral AI zum Verstehen und Verarbeiten von Scraped-Inhalten
🥷 Stealth-Modus : Implementiert den Browser-Fingerabdruckschutz, um eine Erkennung zu vermeiden
💾 Inhaltsspeicherung : Speichert automatisch sowohl Screenshots als auch Textinhalte von Scraped-Seiten
Related MCP server: Web Search MCP
🏗️ Architektur
Dieses Projekt verwendet eine Client-Server-Architektur, die von MCP unterstützt wird:
🖥️ Server : Bewältigt Browserautomatisierung und Web-Scraping-Aufgaben
👤 Client : Stellt die KI-Schnittstelle mit Mistral AI und LangGraph bereit
📡 Kommunikation : Verwendet stdio für die Client-Server-Kommunikation
⚙️ Voraussetzungen
🐍 Python 3.8+
🎭 Dramatiker
🧩 MCP (Modellgesteuertes Programm)
🔑 Mistral AI API-Schlüssel
📥 Installation
Klonen Sie das Repository:
git clone https://github.com/yourusername/browser-automation-agent.git
cd browser-automation-agentInstallieren Sie Abhängigkeiten:
pip install -r requirements.txtInstallieren Sie Playwright-Browser:
playwright installErstellen Sie eine
.envDatei im Projektstammverzeichnis und fügen Sie Ihren Mistral AI-API-Schlüssel hinzu:
MISTRAL_API_KEY=your_api_key_here📋 Verwendung
Ausführen des Servers
python main.pyAusführen des Clients
python client.pyBeispielinteraktion
Sobald sowohl der Server als auch der Client ausgeführt werden:
Geben Sie Ihre Abfrage ein, wenn Sie dazu aufgefordert werden
Der Agent wird:
🔍 Suchen Sie bei Google nach relevanten Ergebnissen
🧭 Navigieren Sie zum Top-Ergebnis
📊 Scrapen Sie Inhalte basierend auf dem Website-Typ
📸 Screenshots und Inhalte in Dateien speichern
📤 Verarbeitete Informationen zurückgeben
🛠️ Werkzeugfunktionen
get_top_google_url
🔍 Durchsucht Google und gibt die URL mit dem höchsten Ergebnis für eine bestimmte Abfrage zurück.
browse_and_scrape
🌐 Navigiert zu einer URL und kratzt Inhalte basierend auf dem Websitetyp.
scrape_github
📂 Spezialisiert auf das Extrahieren von README-Inhalten und Codeblöcken aus GitHub-Repositorys.
scrape_stackoverflow
💬 Extrahiert Fragen, Antworten, Kommentare und Codeblöcke von Stack Overflow-Seiten.
scrape_documentation
📚 Optimiert für das Extrahieren von Dokumentationsinhalten und Codebeispielen.
scrape_generic
🌐 Extrahiert Absatztext und Codeblöcke von generischen Websites.
📁 Dateistruktur
browser-automation-agent/
├── main.py # MCP server implementation
├── client.py # Mistral AI client implementation
├── requirements.txt # Project dependencies
├── .env # Environment variables (API keys)
└── README.md # Project documentation📤 Ausgabedateien
Der Agent generiert zwei Arten von Ausgabedateien mit Zeitstempeln:
📸
final_page_YYYYMMDD_HHMMSS.png: Screenshot des endgültigen Seitenstatus📄
scraped_content_YYYYMMDD_HHMMSS.txt: Extrahierter Textinhalt von der Seite
⚙️ Anpassung
Sie können die folgenden Parameter im Code ändern:
🖥️ Browserfenstergröße: Passen Sie
widthundheightinbrowse_and_scrape👻 Headless-Modus: Setzen Sie
headless=Truefür unsichtbaren Browserbetrieb🔢 Anzahl der Google-Ergebnisse: Ändern Sie
num_resultsinget_top_google_url
❓ Fehlerbehebung
🔌 Verbindungsprobleme : Stellen Sie sicher, dass Server und Client in separaten Terminals ausgeführt werden
🎭 Playwright-Fehler : Stellen Sie sicher, dass Browser mit
playwright installinstalliert sind🔑 API-Schlüsselfehler : Überprüfen Sie, ob Ihr Mistral-API-Schlüssel in der
.envDatei korrekt festgelegt ist🛣️ Pfadfehler : Aktualisieren Sie bei Bedarf den Pfad zu
main.pyinclient.py
📜 Lizenz
🤝 Beitragen
Beiträge sind willkommen! Senden Sie gerne einen Pull Request.
Erstellt mit 🧩 MCP, 🎭 Playwright und 🧠 Mistral AI
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- FlicenseBqualityDmaintenanceEnables web searching and content scraping through Google Custom Search API. Provides tools to search the internet, extract webpage content, and automatically scrape search results for comprehensive information gathering.3
- AlicenseNot gradedqualityCmaintenanceEnables web searching through Google, DuckDuckGo, and Bing using a headless Chrome browser, returning structured results with titles, URLs, and snippets. Also supports fetching and extracting text content from any webpage.12MIT
- AlicenseNot gradedqualityDmaintenanceProvides web search and page fetch capabilities using a browser-based approach, enabling LLMs to search DuckDuckGo, Google, or Yandex and retrieve rendered HTML from URLs.3MIT
- AlicenseNot gradedqualityCmaintenanceEnables LLMs to fetch and extract web content using browser automation, OCR, and multiple extraction methods, handling JavaScript rendering and anti-scraping techniques.17MIT
Related MCP Connectors
AI-powered browser automation — navigate, click, fill forms, and extract data from any website.
Provides cloud browser automation capabilities using Stagehand and Browserbase, enabling LLMs to i…
Web research for agents: quality-scored Google search, webpage extraction, and deep research.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Raghu6798/Browser_scrape_mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server