agentctl
agentctl
Operador de cargas de trabajo de agente/modelo nativo de K8s con registro de malla SAM y plano de operaciones MCP.
Reemplaza los orquestadores que generan procesos (vllm-orchestrator) con recursos declarativos de K8s. Cada operación se expone como una herramienta MCP para la composición de flujos de trabajo LangGraph/LangChain.
Architecture
LangGraph agent ──MCP──▶ agentctl ops plane (:8091)
│
┌─────────┼─────────┐
▼ ▼ ▼
workload_* fleet_* sam_*
tools tools tools
│ │ │
▼ ▼ ▼
K8s API K8s API SAM node
(CRDs) (pods) (discovery)Related MCP server: Hatchet MCP
Install
pip install agentctl
# or
uv pip install agentctlInstall (cluster)
kubectl apply -f https://github.com/moreWax/agentctl/releases/latest/download/install.yamlEsto instala el CRD, el operador y el plano de operaciones MCP en agentctl-system. El plano de operaciones es accesible dentro del clúster en http://agentctl-mcp.agentctl-system.svc.cluster.local:8091/mcp (HTTP Streamable sin estado).
Usage
Desplegar las cargas de trabajo de ejemplo
kubectl apply -f examples/qwen3.8-27b.yaml # Qwen3.8-27B, TP2 on 2 GPUs
kubectl apply -f examples/qwen3.8-27b-fp8.yaml # FP8 variant, single GPU
kubectl apply -f examples/litellm-gateway.yaml # LiteLLM proxy gatewayDesde el código fuente (desarrollo)
uv venv && uv pip install -e ".[dev]"
kubectl apply -f crd/agentctl-crd.yaml
agentctl serve # operator (kopf controllers)
agentctl mcp --port 8091 # MCP ops-plane server (stateless Streamable HTTP)Desplegar una carga de trabajo de modelo
kubectl apply -f examples/qwen3.8-27b.yaml # Qwen3.8-27B, TP2 on 2 GPUs
kubectl apply -f examples/qwen3.8-27b-fp8.yaml # FP8 variant, single GPU
kubectl apply -f examples/litellm-gateway.yaml # LiteLLM proxy gatewayLa puerta de enlace LiteLLM enruta solicitudes compatibles con OpenAI a los backends vLLM. Apunte sus agentes a http://litellm-gateway:4000/v1 y use nombres de modelo como qwen3.8-27b o qwen3.8-27b-fp8.
Herramientas MCP (para composición de agentes / LangGraph)
Las 20 herramientas son sin estado, devuelven JSON estructurado y protegen las acciones destructivas detrás de indicadores de aprobación.
Consultas de flota
Tool | Description |
| Vista agregada: cargas de trabajo por fase, totales de GPU |
| Capacidad de GPU por nodo / asignada / libre + consumidores |
| Detalle por pod: nodo, fase de arranque, GPUs, reinicios |
| Simulación: qué nodos pueden alojar N GPUs — llame antes del arranque |
| Disponibilidad de endpoint por servicio |
| Descubrir servicios de malla SAM |
Ciclo de vida de la carga de trabajo
Tool | Description |
| Listar cargas de trabajo con fase, GPUs, estado de fijación |
| Detalle completo incl. fases de arranque por pod |
| Registros de contenedor recientes por pod |
| Escalar réplicas (0 = estacionar; rechaza reducir escala en fijadas a menos que |
| Eliminar carga de trabajo — requiere |
| Crear carga de trabajo de modelo (idempotente) |
| Eliminar carga de trabajo de modelo |
| Forzar eliminación de pod colgado — requiere |
| Fijar evita la reducción de escala (mantener modelo residente) |
| Suspender/despertar. Cargas de trabajo FMA ( |
Orquestación de arranque
Tool | Description |
| Desplegar + espera opcional en el servidor ( |
| Consultar progreso de arranque: fases de pod + marcadores de registro vLLM ( |
Patrón de espera de arranque de agente (bucle LangGraph):
boot_model(model_id="qwen38-27b", image="vllm/vllm-openai:v0.18.0", gpu_count=2)
while True:
s = boot_status(model_id="qwen38-27b")
if s["ready"]: break # proceed to inference
if s["failed"]: ... # inspect s["pods"], kill_pod + retry
time.sleep(10) # poll againDevelopment
uv venv && uv pip install -e ".[dev]"
pytest tests/ -qLicense
MIT
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Control plane for autonomous software labor. Agents claim objectives over MCP with audit trail.
MCP Hub: AI service discovery, per-user OAuth, and multi-service workflow orchestration
MCP-first control plane for ProAgentStore agents and private instances.
Protocol-native energy infrastructure orchestration for AI data centers. Provides 46 MCP tools across 8 grid protocols (IEC-61850, DNP3, Modbus, OCPP, OpenADR, IEEE 2030.5, IEC 60870-5-104, ICCP) with 5 core API primitives: connect, dispatch, settle, comply, and intel. Enables AI agents to programmatically interact with substations, grid interfaces, and energy assets for real-time workload-grid coordination.
Related MCP Servers
- FlicenseNot gradedqualityDmaintenanceEnables management of Mistral AI agents through MCP tools including creating, listing, searching, viewing details, and deleting agents. Integrates with Mistral API to provide agent management capabilities through natural language interactions.1
- AlicenseNot gradedqualityBmaintenanceEnables running durable, traceable AI agents via LangGraph through a universal MCP interface, integrating with Hatchet for orchestration, logging, and retries. Provides tools for knowledge management (ingestion, RAG) and Kubernetes operations (diagnosis, auto-fix).MIT
- AlicenseAqualityBmaintenanceGoverned Kubernetes operations for AI agents with 15 MCP tools, audit logging, policy engine, and safety features.55MIT
- AlicenseNot gradedqualityDmaintenanceEnables AI-powered Kubernetes management using natural language, supporting kubectl, Helm, diagnostics, and port forwarding via MCP protocol.MIT
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/moreWax/agentctl'
If you have feedback or need assistance with the MCP directory API, please join our Discord server