Where's Waldo Rick
Servidor MCP de Regresión Visual
Un servidor del Protocolo de Contexto de Modelo (MCP) que aporta capacidades de visión agéntica a Claude Code para pruebas de regresión visual utilizando Gemini 3 Flash.
Descripción general
Nunca más vuelvas a tener conversaciones ambiguas sobre cambios visuales. Mira exactamente qué cambió, rodeado y anotado, con detección de cambios intencionados frente a no intencionados.
Problema resuelto
El desarrollador trabaja durante horas en cambios de la interfaz de usuario
La compilación pasa, el código está "limpio"
Abres la aplicación... exactamente el mismo diseño
Preguntas: "¿Qué cambió específicamente?"
El desarrollador dice: "Añadimos 2 píxeles a la tarjeta"
Preguntas: "¿Dónde? ¿Arriba? ¿Abajo? ¿Dentro de la caja? ¿Alrededor?"
😤 Tiempo perdido, comunicación poco clara
Solución
Where's Waldo Rick proporciona:
Captura de pantalla desde múltiples plataformas (macOS, simulador de iOS, Web)
Comparación píxel a píxel con umbrales configurables
Análisis de visión agéntica usando Gemini 3 Flash (zoom/recorte/anotación iterativos)
Detección de cambios esperados frente a no intencionados
Investigación conversacional ("No esa caja, el elemento hijo")
Related MCP server: visual-ui-debug-agent-mcp
Instalación
Requisitos
Python 3.10+
Clave de API de Gemini (nivel gratuito: 15 solicitudes/minuto)
Instalar desde GitHub
# Install via uvx
uvx --from git+https://github.com/bretbouchard/gemini-vision-mcp wheres_waldo.server
# Or install locally
pip install -e .Configurar Claude Code
Añadir a la configuración MCP de Claude Code (~/.claude/mcp.json o específica del proyecto):
G
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseAqualityBmaintenanceMCP server for vision AI — screenshots to code, OCR, error diagnosis, and image analysis via OpenAI-compatible APIs.82MIT
- AlicenseCqualityAmaintenanceAn MCP server that enables AI agents to autonomously test, debug, and analyze web interfaces visually using Playwright, with 30 tools for screenshots, workflows, performance, and visual comparison.301780ISC
- AlicenseNot gradedqualityDmaintenanceA Model Context Protocol (MCP) server that analyzes software UI screenshots using Google's Gemini AI vision, providing detailed descriptions of UI elements, layout, functionality, and accessibility.181MIT
- AlicenseNot gradedqualityAmaintenanceMCP server for rendering responsive screenshots of URLs at multiple viewports. Enables agents to capture screenshots and detect visual issues like overflow, clipped elements, and missing alt text.MIT
Related MCP Connectors
Screenshot, diff, audit and sitemap-capture any web page — 5 MCP tools for AI agents.
Capture screenshots, detect visual regressions between page versions, and analyze with AI.
MCP server for AI agents to plan, verify, and deploy Cloudflare-native apps.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/bretbouchard/gemini-vision-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server