Skip to main content
Glama

[PROJECT NAME]

Ein gestengesteuerter Arbeitsplatz zum Erkunden von Depth Pruning in einem Transformer, bei dem ein Browser-Agent analysieren und Vorschläge machen kann, aber nur ein Mensch Änderungen vornehmen darf.

Live: https://architecture-mcp.vercel.app

Der Projektname ist ein Platzhalter. Die FAQ der Veranstaltung empfiehlt den Teams, ihn selbst zu wählen, anstatt ihn einer KI zu überlassen, daher bleibt er bewusst einem Menschen vorbehalten.

Was es ist

Die 28 Schichten von Qwen/Qwen2.5-1.5B-Instruct werden als Stapel dargestellt, in den man hineingreifen kann. Heben Sie eine Schicht an – mit der Maus, der Tastatur oder der Hand vor einer Webcam – tragen Sie sie zum Prune-Ablagefach und lassen Sie los. Die Schicht wird entfernt und die Architektur schließt die Lücke.

Ein Agent im Browser kann diesen Arbeitsbereich lesen, die schwächsten Kandidaten einstufen, eine Reihe von Schichten als sichtbaren Geist vorschlagen, die Schicht bewerten, die Sie gerade halten, den Plan validieren und einen deterministischen Export vorbereiten.

Er kann keine Schicht entfernen. Genau das ist der Punkt.

Related MCP server: permitd MCP Server

Der WebMCP-Beitrag

Die beim Browser registrierten Tools ändern sich je nachdem, was die Person gerade tut.

Registriert

Tools

Immer

get_workspace_state, rank_pruning_candidates, preview_pruning_plan, validate_current_plan, prepare_export_plan

Während eine Schicht ausgewählt ist

explain_selected_layer, compare_selected_layer

Während eine Schicht gehalten wird

evaluate_held_layer

Die Registrierung wird über ein Store-Abonnement abgeglichen, mit einem AbortController pro dynamisch registriertem Tool. Bitten Sie einen Agenten, „die Schicht zu bewerten, die ich gerade halte", und er kann nur antworten, solange das zutrifft; lassen Sie los, und das Tool wird abgemeldet und jeder bereits laufende Aufruf wird abgebrochen.

Keines der Auswahl-Tools akzeptiert eine Schicht-ID, und ihre Schemata verbieten zusätzliche Eigenschaften. Ihr Gegenstand ist das, was sichtbar ausgewählt ist. Der Agent kann nicht über eine Schicht berichten, während die Person eine andere betrachtet, und die Person kann das Thema wechseln, ohne etwas zu sagen.

Wer was tun darf

Die Grenze wird vom Store durchgesetzt, nicht durch den Wortlaut der Aufforderung. Tool-Handler senden über einen Einstiegspunkt, der alles außerhalb einer Vier-Aktionen-Whitelist ablehnt, und stempeln den Akteur selbst, anstatt dem Aufrufer zu vertrauen.

Ein Agent darf: einen Vorschlag einstufen, ihn löschen, die Export-Schublade öffnen, sie schließen. Alle vier Aktionen sind konstruktionsbedingt umkehrbar.

Kein Tool darf: eine Entfernung festschreiben, eine Schicht wiederherstellen, rückgängig machen, die Kamera starten, Kamerabilder oder Hand-Landmarken lesen, kopieren oder herunterladen.

Jedes Festschreiben wird von einer Person durchgeführt, und die Provenienz-Zeitleiste hält fest, wer gehandelt hat, was sie getan haben und welche Eingabe sie verwendet haben.

Die Evidenz und ihre Grenzen

Block Influence wird gemessen, nicht erfunden: 1 - cosine_similarity zwischen den Eingabe- und Ausgabe-Hidden-States jedes Blocks, gemittelt über Kalibrierungstokens.

  • Modell: Qwen/Qwen2.5-1.5B-Instruct in Revision 989aa7980e4cf806f80c7fef2b1adb7bc71aa306

  • Kalibrierung: PG19-Test, 16 Dokumente mit 1024 Tokens

  • Digest: be647c5baf85…

Die gemessene Form entspricht dem, was die Methode vorhersagt: Schicht 0 erreicht 0,959 und Schicht 27 erreicht 0,558, während alle Blöcke dazwischen unter 0,16 liegen, mit dem Tiefpunkt bei den Schichten 14 bis 16 bei etwa 0,038.

Was dies nicht zeigt. Die Kosinus-Ähnlichkeit vergleicht nur die Richtung, daher misst Block Influence, wie stark ein Block den Residualstrom gedreht hat, nicht, wie stark er ihn verändert hat – ein Block, der ohne Drehung neu skaliert, erzielt ebenfalls einen niedrigen Wert. Sie wird pro Schicht, isoliert, an einem Korpus berechnet. Sie identifiziert einen Kandidaten, der eine Bewertung wert ist. Sie ist kein Beleg dafür, dass das Entfernen der Schicht die Ausgabequalität erhält, und nichts hier misst Perplexität, Benchmark-Genauigkeit oder Generierungsqualität nach der Entfernung.

Die Oberfläche sagt auch all dies. Jedes Tool-Ergebnis, das einen Wert meldet, trägt denselben Hinweis, denn ein Agent, der gebeten wird, die Einschränkungen zu nennen, sollte ein Feld zitieren, statt Prosa zu paraphrasieren.

Datenschutz

Video wird in der Seite verarbeitet. Es gibt keinen Upload, keinen multimodalen API-Aufruf und keine Remote-Gesteninterpretation. Die Kamera startet nur durch einen Klick, und der Agent hat keinen Zugriff auf die Kamera, ihre Bilder oder die daraus abgeleiteten Landmarken.

Ausführen

npm install
npm run dev

WebMCP befindet sich hinter einem Flag. Aktivieren Sie in Chrome 149 oder neuer chrome://flags/#enable-webmcp-testing und starten Sie neu. Die Model Context Tool Inspector-Erweiterung listet registrierte Tools auf und kann sie aufrufen.

Ohne das Flag funktioniert die Seite trotzdem: Sie erkennt das Fehlen, fällt auf einen In-Memory-Ersatz zurück und weist auf dem Bildschirm darauf hin, anstatt so zu tun, als wäre nichts.

npm test          # unit and integration tests
npm run build     # type check and production build

Die Werte selbst messen

pip install 'transformers>=4.43' datasets torch
python scripts/prepare_calibration.py
python scripts/measure_block_influence.py

Das Korpus wird gestreamt statt heruntergeladen. Die Werte landen in src/data/scores.json, der einzigen Datei, die die Anwendung für Schichtwerte liest – das Austauschen von Platzhaltern gegen Messungen ist eine Datenänderung, keine Codeänderung. Die Datei trägt ihre eigene source, und die Typverträge machen gemessene Evidenz ohne Digest nicht konstruierbar, sodass es keinen Zustand gibt, in dem die App eine Messung behaupten kann, die sie nicht hat.

Architektur

Human hand, mouse or keyboard
        │  select, hold, commit, cancel, undo
        ▼
   Workspace store  ──────────►  Three.js stage
   (pure reducer,   ──────────►  DOM inspector and provenance timeline
    provenance log) ──────────►  WebMCP tool registry
        ▲
        │  inspect, rank, explain, compare, preview, evaluate, validate, export
   Browser agent

Der Reducer ist rein und nimmt die Wanduhrzeit als Argument, anstatt eine Uhr zu lesen, sodass die Reduktion deterministisch ist und eine Sitzung aus ihrem Provenienzprotokoll wiedergegeben werden könnte. Der Zustand ist durchgehend readonly: Der Store ist der einzige Schreiber, und eine direkte Mutation würde Provenienz, Versionszähler und Autoritätsprüfung überspringen.

Lizenz

MIT.

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

View all related MCP servers

Related MCP Connectors

  • Runtime permission, approval, and audit layer for AI agent tool execution.

  • Agentic code review, no signup to try: reality gates + frontier-model review, with veto.

  • Browser-backed QA with evidence and fix-ready reports for coding agents.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Davedat-110105/architecture-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server