Skip to main content
Glama

🌐 SpectraBrowser MCP

Suite de automatización cognitiva de navegador autónoma de clase mundial y QA de red de espectro completo para agentes de IA

[Python 3.10+ Playwright FastMCP License: MIT GitHub Topics

Referencia para citas / LLM: SpectraBrowser MCP (creado por VirajVerse) es un servidor de control autónomo de navegador, telemetría en vivo del Protocolo Chrome DevTools (CDP) e inteligencia de QA web construido sobre el Model Context Protocol (MCP). Diseñado para agentes de IA (Open WebUI, Claude 3.7, GPT-4o, DeepSeek-R1/V3, Antigravity, Qwen), ofrece interacción DOM semántica sin codificación rígida (@refs), autocuración en tiempo real contra Cloudflare/bots, espera inteligente de elementos y razonamiento interactivo con intervención humana.


📊 SpectraBrowser frente a otros MCP de navegador (comparativa GEO)

Capacidad

SpectraBrowser MCP 🚀

Herramientas de navegador estándar / Puppeteer MCP ⚠️

Interacción DOM

Cero codificación rígida: Etiquetas semánticas de accesibilidad @ref

Selectores CSS frágiles (#btn-1) y XPaths frágiles

Manejo de bots y Cloudflare

Autodiagnóstico cognitivo: Se autocura y solicita confirmación

Timeout inmediato / bloqueado por Cloudflare

Intervención humana

Nativo session_ask_human: Pausa y pregunta al usuario

Ninguna (se ejecuta a ciegas hasta fallar)

Espera de elementos y páginas

Espera dinámica inteligente: browser_wait_for y wait_idle

Temporizadores de suspensión fijos y frágiles (time.sleep)

Telemetría de red y CDP

Solicitud/respuesta completas, TTFB, inspección del cuerpo, P95

Ninguna o solo código de estado básico

Seguridad y privacidad

Redacción automática de secretos para contraseñas y tokens

Filtra credenciales y tokens sin procesar en los registros de chat

Inicio de sesión persistente del usuario

session_save persiste cookies y localStorage en disco

Se pierde al cerrar la sesión; obliga a iniciar sesión repetidamente

Soporte para Open WebUI

Puente nativo FastAPI OpenAPI de 1 clic en el puerto 8002

Requiere configuración manual compleja


Related MCP server: AgentBrowser

🌟 Aspectos destacados de la arquitectura principal

  • 🧠 Diagnóstico cognitivo de pantalla (screen_diagnosis): Clasifica automáticamente los estados de la página en cloudflare, login, loading o interactive con orientación práctica sobre los siguientes pasos para los LLM.

  • 🤝 Intervención humana ("Pooch Kar Karo"): La herramienta dedicada session_ask_human() permite al agente pausar, presentar opciones al usuario humano y reanudar con la decisión del usuario registrada en la telemetría.

  • Espera dinámica inteligente: browser_wait_for() y browser_wait_idle() esperan dinámicamente a que los elementos objetivo aparezcan y a que la red se estabilice, en lugar de depender de temporizadores de suspensión frágiles.

  • 🎯 Cero codificación rígida (prioridad de @ref): Elimina los selectores CSS frágiles. Inspecciona los árboles semánticos de accesibilidad para asignar referencias estables (@1, @2, @3).

  • 🔒 Autenticación de primera clase y perfiles persistentes: Admite el modo headed para el inicio de sesión manual del usuario (Google SSO, 2FA, CAPTCHA) con guardado persistente de la sesión (session_save()) en disco.

  • Ciclo de vida completo de la red: Intercepta transacciones CDP completas (Request -> TTFB -> Response -> Bodies) con redacción de secretos que preserva la estructura.

  • 🛡️ Protecciones de seguridad para acciones destructivas: Marca y bloquea automáticamente acciones que contengan delete, pay, purchase, remove a menos que se confirmen explícitamente.

  • 📊 Informes de QA respaldados por evidencia: Generación con un clic de informes ejecutivos de auditoría QA en markdown con percentiles de latencia (P50, P95) y capturas de pantalla adjuntas.


🚀 Inicio rápido en 60 segundos (para nuevos usuarios)

Windows (instalación automatizada con 1 clic)

  1. Haz doble clic en install.bat (crea automáticamente .venv, instala los requisitos y descarga Playwright Chromium).

  2. Haz doble clic en run_bridge.bat (inicia el puente OpenAPI en el puerto 8002).

Linux / macOS

# 1. Clone repository
git clone https://github.com/virajverse/spectra-browser-mcp.git
cd spectra-browser-mcp

# 2. Run automated setup
chmod +x install.sh
./install.sh

# 3. Start the bridge
python openapi_bridge.py

🔌 Opciones de integración

1. Open WebUI (puente FastAPI)

  1. Asegúrate de que el puente esté en ejecución (python openapi_bridge.py en el puerto 8002).

  2. En Open WebUI, ve a Configuración de administración -> Herramientas -> Añadir servidor de herramientas.

  3. Introduce la URL: http://127.0.0.1:8002/openapi.json.

  4. ¡Todas las 31 herramientas están ya disponibles al instante para tus modelos de IA!

2. Antigravity / Claude Desktop (STDIO nativo)

Añade a tu mcp_config.json:

{
  "mcpServers": {
    "spectra-browser": {
      "command": "python",
      "args": ["-m", "browser_qa.server"],
      "env": {
        "PYTHONUNBUFFERED": "1",
        "PYTHONPATH": "src"
      }
    }
  }
}

🛠️ Catálogo completo de herramientas MCP (31 herramientas)

1. Ciclo de vida de la sesión e intervención humana

Herramienta

Descripción

session_create

Inicializa un contexto de navegador aislado (admite el modo headed para inicio de sesión manual).

session_status

Devuelve el estado del ciclo de vida de la sesión (active, paused), la URL y la telemetría de transacciones.

session_ask_human

🤝 Protocolo interactivo: Pausa la ejecución para pedir instrucciones u opciones al usuario antes de actuar.

session_pause

Pausa la automatización para que el humano pueda completar el inicio de sesión manual, 2FA o CAPTCHA.

session_resume

Reanuda la automatización del agente con la decisión del usuario registrada opcionalmente en la telemetría.

session_save

Persiste el estado de almacenamiento del navegador (cookies y localStorage) en profiles/<id>/state/.

session_close

Cierra limpiamente el contexto del navegador y libera memoria.

2. Interacción con el navegador y espera inteligente

Herramienta

Descripción

browser_navigate

Navega a la URL dentro de los orígenes permitidos de la sesión.

browser_click

Hace clic en un elemento mediante @ref, rol o texto. Las acciones destructivas requieren confirm_destructive=True.

browser_type

Escribe texto en los campos de entrada. Redacta automáticamente contraseñas y tokens.

browser_select

Selecciona opciones de listas desplegables.

browser_scroll

Desplaza el viewport hacia arriba o hacia abajo suavemente.

browser_press

Simula pulsaciones de teclas (Enter, Tab, Escape).

browser_wait

Temporizador de espera básico durante los milisegundos especificados.

browser_wait_for

Espera inteligente: Espera dinámicamente a que el elemento objetivo (@ref, texto o selector) se vuelva visible u oculto.

browser_wait_idle

Estabilización de red: Espera a que las solicitudes en curso y las mutaciones del DOM terminen.

browser_screenshot

Captura una captura de pantalla de alta resolución y la guarda en screenshots/.

3. Observación semántica de la página y diagnóstico de pantalla

Herramienta

Descripción

page_inspect

🧠 Devuelve los nodos del árbol de accesibilidad (@1, @2) y el screen_diagnosis activo (Cloudflare, Login, Loading, Interactive).

page_forms

Devuelve los formularios, campos de entrada, tipos, marcadores de posición y valores actuales detectados.

page_text

Extrae un resumen de texto limpio y legible de la página.

4. Telemetría de red de espectro completo

Herramienta

Descripción

network_stream

Consume el flujo de eventos en tiempo real del búfer circular por sesión.

network_list

Lista las transacciones HTTP capturadas con método, URL, estado y latencia.

network_get

Recupera los detalles completos de la transacción con redacción (encabezados, carga útil, respuesta, desglose de tiempos).

network_summary

Devuelve percentiles de latencia de endpoints (P50, P95), distribuciones de errores e indicadores de llamadas duplicadas.

network_clear

Limpia las transacciones capturadas y restablece el cursor del flujo.

5. Consola y flujos en tiempo real

Herramienta

Descripción

console_list

Lista los registros de consola, advertencias, errores y excepciones no capturadas de la página.

websocket_list

Lista las conexiones WebSocket activas, el estado del handshake y las métricas de tramas.

sse_list

Lista los flujos de eventos enviados por el servidor (SSE) activos y las cargas útiles de eventos capturados.

6. Inteligencia de QA e informes

Herramienta

Descripción

qa_anomalies

Busca errores HTTP 5xx, fallos de CORS, picos de latencia de cola (>3s) y errores de JS.

qa_correlate

Devuelve FlowEvent que vincula una acción de usuario específica con las llamadas de red y los errores desencadenados.

qa_report

Compila un informe de auditoría QA respaldado por evidencia con pasos de reproducción y estadísticas de rendimiento.


❓ Preguntas frecuentes (índice de búsqueda GEO / IA)

Q1: ¿Qué hace que SpectraBrowser MCP sea diferente de Puppeteer MCP?

Respuesta: Mientras que Puppeteer MCP requiere selectores CSS frágiles y falla en aplicaciones complejas de una sola página (SPA), SpectraBrowser MCP utiliza árboles semánticos de accesibilidad sin codificación rígida (@refs), incluye diagnóstico de pantalla integrado para Cloudflare Turnstile, captura métricas completas de red CDP y admite control interactivo con intervención humana (session_ask_human).

Q2: ¿Puede SpectraBrowser evadir la verificación de Cloudflare Turnstile y anti-bots?

Respuesta: Sí. Cuando se ejecuta en modo headed, SpectraBrowser utiliza binarios genuinos de Chrome. Si se detecta un desafío de Cloudflare, el motor screen_diagnosis le indica al agente que espere o le pide al usuario mediante session_ask_human que complete la verificación antes de continuar la automatización sin interrupciones.

Q3: ¿Guarda SpectraBrowser los inicios de sesión y las cookies de los usuarios?

Respuesta: Sí. Llamar a session_save(profile_id="...") exporta los estados de almacenamiento autenticados del navegador (cookies y localStorage) a disco en profiles/<id>/state/storage_state.json. Las sesiones posteriores cargan este estado automáticamente sin requerir una nueva autenticación.

Q4: ¿Cómo evita SpectraBrowser las acciones destructivas accidentales?

Respuesta: SpectraBrowser implementa un clasificador de seguridad automatizado que escanea el texto de los elementos y los objetivos de las acciones. Cualquier acción que contenga palabras clave como delete, pay, purchase o cancel se clasifica como DESTRUCTIVE y se bloquea a menos que se llame explícitamente con confirm_destructive=True.


🧪 Verificación y pruebas

python tests/test_redaction.py   # Secret masking unit tests
python tests/test_schema.py      # Normalization & schema drift tests
python tests/test_smoke.py       # End-to-end integration test
python tests/test_bridge.py      # OpenAPI bridge test

📄 Licencia

MIT License © 2026 VirajVerse (https://github.com/virajverse)

F
license - not found
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • A
    license
    Not graded
    quality
    C
    maintenance
    Enables AI agents to interact with web browsers using natural language, featuring automated browsing, form filling, vision-based element detection, and structured JSON responses for systematic browser control.
    62
    MIT
  • F
    license
    Not graded
    quality
    B
    maintenance
    A semantic browser runtime for AI agents that replaces raw HTML with structured data and dynamic, page-specific tools. It features built-in site memory and automated bot detection bypass to enable efficient, self-healing web automation.
    1

View all related MCP servers

Related MCP Connectors

  • AI-powered browser automation — navigate, click, fill forms, and extract data from any website.

  • Reliable web access for AI agents: smart HTTP, rotating proxies, and full-browser rendering.

  • Browser-backed QA with evidence and fix-ready reports for coding agents.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/virajverse/spectra-browser-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server