Skip to main content
Glama

[PROJECT NAME]

Un banco de trabajo controlado por gestos para explorar la poda de profundidad en un transformer, donde un agente del navegador puede analizar y proponer, y solo una persona puede confirmar.

En vivo: https://architecture-mcp.vercel.app

El nombre del proyecto es un marcador de posición. Las preguntas frecuentes del evento recomiendan que los equipos lo elijan ellos mismos en lugar de delegarlo a una IA, por lo que se deja deliberadamente para que lo complete un humano.

Qué es

Las 28 capas de Qwen/Qwen2.5-1.5B-Instruct se representan como una pila a la que puedes llegar. Toma una capa — con el ratón, el teclado o tu mano frente a una cámara web — llévala a la bandeja de poda y suéltala. La capa se elimina y la arquitectura cierra el hueco.

Un agente en el navegador puede leer ese espacio de trabajo, clasificar los candidatos más débiles, proponer un conjunto de capas como un fantasma visible, evaluar la capa que sostienes, validar el plan y preparar una exportación determinista.

No puede eliminar una capa. Ese es el punto.

Related MCP server: permitd MCP Server

La contribución de WebMCP

Las herramientas registradas con el navegador cambian según lo que la persona está haciendo.

Registradas

Herramientas

Siempre

get_workspace_state, rank_pruning_candidates, preview_pruning_plan, validate_current_plan, prepare_export_plan

Mientras una capa está seleccionada

explain_selected_layer, compare_selected_layer

Mientras se sostiene una capa

evaluate_held_layer

El registro se reconcilia a partir de una suscripción al almacén, un AbortController por herramienta registrada dinámicamente. Pide a un agente que "evalúe la capa que estoy sosteniendo" y solo puede responder mientras eso sea cierto; suéltala, y la herramienta se desregistra y cualquier llamada ya en curso se cancela.

Ninguna herramienta de selección acepta un id de capa, y sus esquemas prohíben propiedades adicionales. Su sujeto es lo que esté visiblemente seleccionado. El agente no puede informar sobre una capa mientras la persona está mirando otra, y la persona puede cambiar el sujeto sin decir nada.

Quién puede hacer qué

El límite lo impone el almacén, no la redacción de las indicaciones. Los manejadores de herramientas despachan a través de un punto de entrada que rechaza cualquier cosa fuera de una lista de cuatro acciones, y sella al actor en lugar de confiar en el llamador.

Un agente puede: preparar una propuesta, borrarla, abrir el cajón de exportación, cerrarlo. Las cuatro son reversibles por construcción.

Ninguna herramienta puede: confirmar una eliminación, restaurar una capa, deshacer, iniciar la cámara, leer fotogramas de la cámara o puntos de referencia de la mano, copiar o descargar.

Cada confirmación la realiza una persona, y la línea de tiempo de procedencia registra quién actuó, qué hizo y qué entrada utilizó.

La evidencia y sus límites

La influencia de bloque se mide, no se inventa: 1 - cosine_similarity entre las entradas y salidas de estados ocultos de cada bloque, promediado sobre tokens de calibración.

  • Modelo: Qwen/Qwen2.5-1.5B-Instruct en la revisión 989aa7980e4cf806f80c7fef2b1adb7bc71aa306

  • Calibración: prueba PG19, 16 documentos de 1024 tokens

  • Resumen: be647c5baf85…

La forma medida coincide con lo que predice el método: la capa 0 obtiene 0.959 y la capa 27 obtiene 0.558, mientras que cada bloque entre ellas está por debajo de 0.16, con el valle en las capas 14 a 16 alrededor de 0.038.

Lo que esto no muestra. La similitud coseno compara solo la dirección, por lo que la influencia de bloque mide cuánto rotó un bloque el flujo residual, no cuánto lo cambió — un bloque que reescala sin girar su entrada también obtiene una puntuación baja. Se calcula por capa, de forma aislada, en un corpus. Identifica un candidato que vale la pena evaluar. No es evidencia de que eliminar la capa preserve la calidad de salida, y nada aquí mide perplejidad, precisión de referencia o calidad de generación después de la eliminación.

La interfaz también dice todo esto. Cada resultado de herramienta que informa una puntuación lleva la misma advertencia, porque un agente al que se le pide que indique las limitaciones debería citar un campo en lugar de parafrasear prosa.

Privacidad

El video se procesa en la página. No hay carga, ni llamada a API multimodal, ni interpretación remota de gestos. La cámara se inicia solo con un clic, y el agente no tiene acceso a la cámara, sus fotogramas ni los puntos de referencia derivados de ellos.

Ejecución

npm install
npm run dev

WebMCP está detrás de una bandera. En Chrome 149 o posterior, habilita chrome://flags/#enable-webmcp-testing y reinicia. La extensión Model Context Tool Inspector enumera las herramientas registradas y puede llamarlas.

Sin la bandera, la página sigue funcionando: detecta la ausencia, recurre a un sustituto en memoria y lo dice en pantalla en lugar de fingir.

npm test          # unit and integration tests
npm run build     # type check and production build

Cómo medir las puntuaciones tú mismo

pip install 'transformers>=4.43' datasets torch
python scripts/prepare_calibration.py
python scripts/measure_block_influence.py

El corpus se transmite en lugar de descargarse. Las puntuaciones van a src/data/scores.json, que es lo único que la aplicación lee para las puntuaciones de capa — intercambiar marcadores de posición por mediciones es un cambio de datos, no de código. El archivo lleva su propio source, y los contratos de tipo hacen que la evidencia medida sin un resumen sea inconstrutible, por lo que no hay estado en el que la aplicación pueda afirmar una medición que no tiene.

Arquitectura

Human hand, mouse or keyboard
        │  select, hold, commit, cancel, undo
        ▼
   Workspace store  ──────────►  Three.js stage
   (pure reducer,   ──────────►  DOM inspector and provenance timeline
    provenance log) ──────────►  WebMCP tool registry
        ▲
        │  inspect, rank, explain, compare, preview, evaluate, validate, export
   Browser agent

El reductor es puro y toma el tiempo de pared como argumento en lugar de leer un reloj, por lo que la reducción es determinista y una sesión podría reproducirse desde su registro de procedencia. El estado es readonly en todo momento: el almacén es el único escritor, y una mutación directa omitiría la procedencia, el contador de versiones y la verificación de autoridad.

Licencia

MIT.

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

View all related MCP servers

Related MCP Connectors

  • Runtime permission, approval, and audit layer for AI agent tool execution.

  • Agentic code review, no signup to try: reality gates + frontier-model review, with veto.

  • Browser-backed QA with evidence and fix-ready reports for coding agents.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Davedat-110105/architecture-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server