inferwatch-mcpMonitoringObservabilityAI & Machine LearningfloatsmyboatAlicense-Not gradedqualityCmaintenanceEnables agents to query real-time and historical metrics for locally served Ollama and vLLM instances, including request rates, latency, token counts, and GPU utilization, over stdio. Updated 4 days ago (2026-08-20 03:23 UTC)Apache 2.0