embodied-mcp
embodied-nav-mcp
Un modelo de lenguaje que puede mirar alrededor de una habitación, ir a lo que nombra, contar lo que ve y detenerse cuando termina.
El modelo decide qué hacer. Los sensores deciden dónde están las cosas.
Herramientas
Tool | Qué hace |
| Cuatro caras en perspectiva de la cámara de 360°, más la pose |
| Expresión de referencia → caja de píxeles → metros de lidar → punto de ruta ajustado por el convertidor |
| Publicar un |
| Estacionar para que el planificador deje de perseguir el último punto de ruta |
| Dividir una pregunta de conteo en objetivo / ancla |
| Contar solo desde este punto de vista; cada instancia se eleva con lidar |
| Agrupar miradas por posición; publicar el entero |
| AABB de lidar del último |
commit_count no toma un número del modelo. Dos vistas de cuatro almohadas se convierten en 4, no en 8.
La geometría es la pila Tipo 3 del equipo Xiao Hei feat/xiao-hei-instruction-merge: compuerta de tamaño, manejo de cono ciego, pose de asentamiento del convertidor, estacionamiento al salir.
Instalación
uv sync --extra dev
export ANTHROPIC_API_KEY=...
uv run pytestPython 3.11+. El robot/simulación en vivo necesita ROS Jazzy y la pila de autonomía. Las pruebas usan un robot falso y no necesitan ninguna de las dos.
Pruébalo
# Dry run, no ROS
uv run embodied-mcp-agent --fake "How many blue chairs are between the table and the wall?"
uv run embodied-mcp-agent --fake "Find the potted plant on the kitchen island closest to the fridge."
uv run embodied-mcp-agent --fake "Take the path near the window to the fridge."En un robot (o en el contenedor del desafío) con la pila activa:
uv run embodied-mcp-challenge
# evaluators still run: ros2 launch dummy_vlm dummy_vlm.launchembodied-mcp --attach-ros son las mismas herramientas sobre stdio MCP. El nodo del desafío las llama en proceso: un contenedor de robot no tiene una URL pública para un conector MCP remoto.
CMU VLN Challenge
Adaptador de inserción directa: examples/cmu_vln/. El nombre del paquete dummy_vlm no cambia.
Tipo | Herramientas | Salida ROS |
Numérico |
|
|
Referencia a objeto |
|
|
Seguimiento de instrucciones |
|
|
Sensores permitidos: /camera/image, /registered_scan, /terrain_map, /terrain_map_ext, /state_estimation. La llegada es /state_estimation, no /way_point_reached. Una pregunta por proceso.
Configuración
Variable | Predeterminado | |
| — | requerido |
|
| modelo de anclaje de píxeles / conteo |
|
| segundos desde el inicio del proceso |
|
| tema de cámara |
Licencia
MIT. Geometría y E/S ROS incluidos del equipo Xiao Hei; ver NOTICE.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Video scene understanding for AI agents via the Primate Vision API.
E2LLM gives your AI eyes and hands in a real browser: structured perception (SiFR) plus action.
Codebase intelligence for agents: 152 structured artifacts across 21 programs, one call.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/aryanmangal769/embodied-nav-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server