architecture-mcp
[PROJECT NAME]
Un banco de trabajo controlado por gestos para explorar la poda de profundidad en un transformer, donde un agente del navegador puede analizar y proponer, y solo una persona puede confirmar.
En vivo: https://architecture-mcp.vercel.app
El nombre del proyecto es un marcador de posición. Las preguntas frecuentes del evento recomiendan que los equipos lo elijan ellos mismos en lugar de delegarlo a una IA, por lo que se deja deliberadamente para que lo complete un humano.
Qué es
Las 28 capas de Qwen/Qwen2.5-1.5B-Instruct se representan como una pila a la que puedes llegar.
Toma una capa — con el ratón, el teclado o tu mano frente a una cámara web — llévala a la bandeja de poda y suéltala. La capa se elimina y la arquitectura cierra el hueco.
Un agente en el navegador puede leer ese espacio de trabajo, clasificar los candidatos más débiles, proponer un conjunto de capas como un fantasma visible, evaluar la capa que sostienes, validar el plan y preparar una exportación determinista.
No puede eliminar una capa. Ese es el punto.
Related MCP server: permitd MCP Server
La contribución de WebMCP
Las herramientas registradas con el navegador cambian según lo que la persona está haciendo.
Registradas | Herramientas |
Siempre |
|
Mientras una capa está seleccionada |
|
Mientras se sostiene una capa |
|
El registro se reconcilia a partir de una suscripción al almacén, un AbortController por
herramienta registrada dinámicamente. Pide a un agente que "evalúe la capa que estoy sosteniendo"
y solo puede responder mientras eso sea cierto; suéltala, y la herramienta se desregistra
y cualquier llamada ya en curso se cancela.
Ninguna herramienta de selección acepta un id de capa, y sus esquemas prohíben propiedades adicionales. Su sujeto es lo que esté visiblemente seleccionado. El agente no puede informar sobre una capa mientras la persona está mirando otra, y la persona puede cambiar el sujeto sin decir nada.
Quién puede hacer qué
El límite lo impone el almacén, no la redacción de las indicaciones. Los manejadores de herramientas despachan a través de un punto de entrada que rechaza cualquier cosa fuera de una lista de cuatro acciones, y sella al actor en lugar de confiar en el llamador.
Un agente puede: preparar una propuesta, borrarla, abrir el cajón de exportación, cerrarlo. Las cuatro son reversibles por construcción.
Ninguna herramienta puede: confirmar una eliminación, restaurar una capa, deshacer, iniciar la cámara, leer fotogramas de la cámara o puntos de referencia de la mano, copiar o descargar.
Cada confirmación la realiza una persona, y la línea de tiempo de procedencia registra quién actuó, qué hizo y qué entrada utilizó.
La evidencia y sus límites
La influencia de bloque se mide, no se inventa: 1 - cosine_similarity entre las
entradas y salidas de estados ocultos de cada bloque, promediado sobre tokens de calibración.
Modelo:
Qwen/Qwen2.5-1.5B-Instructen la revisión989aa7980e4cf806f80c7fef2b1adb7bc71aa306Calibración: prueba PG19, 16 documentos de 1024 tokens
Resumen:
be647c5baf85…
La forma medida coincide con lo que predice el método: la capa 0 obtiene 0.959 y la capa 27 obtiene 0.558, mientras que cada bloque entre ellas está por debajo de 0.16, con el valle en las capas 14 a 16 alrededor de 0.038.
Lo que esto no muestra. La similitud coseno compara solo la dirección, por lo que la influencia de bloque mide cuánto rotó un bloque el flujo residual, no cuánto lo cambió — un bloque que reescala sin girar su entrada también obtiene una puntuación baja. Se calcula por capa, de forma aislada, en un corpus. Identifica un candidato que vale la pena evaluar. No es evidencia de que eliminar la capa preserve la calidad de salida, y nada aquí mide perplejidad, precisión de referencia o calidad de generación después de la eliminación.
La interfaz también dice todo esto. Cada resultado de herramienta que informa una puntuación lleva la misma advertencia, porque un agente al que se le pide que indique las limitaciones debería citar un campo en lugar de parafrasear prosa.
Privacidad
El video se procesa en la página. No hay carga, ni llamada a API multimodal, ni interpretación remota de gestos. La cámara se inicia solo con un clic, y el agente no tiene acceso a la cámara, sus fotogramas ni los puntos de referencia derivados de ellos.
Ejecución
npm install
npm run devWebMCP está detrás de una bandera. En Chrome 149 o posterior, habilita
chrome://flags/#enable-webmcp-testing y reinicia. La
extensión Model Context Tool Inspector
enumera las herramientas registradas y puede llamarlas.
Sin la bandera, la página sigue funcionando: detecta la ausencia, recurre a un sustituto en memoria y lo dice en pantalla en lugar de fingir.
npm test # unit and integration tests
npm run build # type check and production buildCómo medir las puntuaciones tú mismo
pip install 'transformers>=4.43' datasets torch
python scripts/prepare_calibration.py
python scripts/measure_block_influence.pyEl corpus se transmite en lugar de descargarse. Las puntuaciones van a
src/data/scores.json, que es lo único que la aplicación lee para las puntuaciones de capa
— intercambiar marcadores de posición por mediciones es un cambio de datos, no de código. El archivo
lleva su propio source, y los contratos de tipo hacen que la evidencia medida sin un resumen
sea inconstrutible, por lo que no hay estado en el que la aplicación pueda afirmar una medición
que no tiene.
Arquitectura
Human hand, mouse or keyboard
│ select, hold, commit, cancel, undo
▼
Workspace store ──────────► Three.js stage
(pure reducer, ──────────► DOM inspector and provenance timeline
provenance log) ──────────► WebMCP tool registry
▲
│ inspect, rank, explain, compare, preview, evaluate, validate, export
Browser agentEl reductor es puro y toma el tiempo de pared como argumento en lugar de leer un reloj,
por lo que la reducción es determinista y una sesión podría reproducirse desde su registro de procedencia.
El estado es readonly en todo momento: el almacén es el único escritor, y una mutación directa
omitiría la procedencia, el contador de versiones y la verificación de autoridad.
Licencia
MIT.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- FlicenseNot gradedqualityDmaintenanceEnables AI agents to publish HTML artifacts for human review, receive anchored feedback, and iterate until approval.2
- AlicenseNot gradedqualityCmaintenanceGates agent tool execution with human approval, audit trails, and replay-resistant permits, enabling safe use of tools in agent loops.MIT
- AlicenseAqualityAmaintenanceThe open-source review layer for AI agents. Work done for humans is decided by humans.182201AGPL 3.0
- FlicenseNot gradedqualityBmaintenanceEnables agents to drive an evidence-based approval loop for Bright Data scraper repairs, detecting breakage, generating heal prompts, and verifying fixes against golden rows before commit.
Related MCP Connectors
Runtime permission, approval, and audit layer for AI agent tool execution.
Agentic code review, no signup to try: reality gates + frontier-model review, with veto.
Browser-backed QA with evidence and fix-ready reports for coding agents.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Davedat-110105/architecture-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server