vision-bridge-mcp
Related Servers
Alternatives to vision-bridge-mcp
No user-submitted related servers found.
Related Servers
- AlicenseAqualityBmaintenanceBridges DeepSeek (text-only) with vision models via MCP, enabling image description and compression using any OpenAI-compatible visual API.321 npm1MIT
- AlicenseBqualityCmaintenanceLets any MCP-compatible agent analyze, describe, OCR, compare, locate, upload, and manage images through DeepSeek's vision model.81MIT
- AlicenseAqualityCmaintenanceEnables text-only LLMs to analyze images by sending files, URLs, or data URIs to a separate OpenAI-compatible vision model through a single MCP tool.1MIT
- AlicenseAqualityBmaintenanceEnables non-multimodal models to see images by providing MCP tools for image understanding and OCR, backed by any OpenAI-compatible vision model.2MIT
- AlicenseNot gradedqualityCmaintenanceAdds vision capabilities to text-only LLMs by integrating external vision models via MCP. It supports OCR, error screenshot reading, UI description, image comparison, and natural-language queries on images.34 npmMIT
- AlicenseAqualityBmaintenanceGives text-only LLMs vision capabilities via MCP, using vision models like Xiaomi MiMo-V2.5 to analyze images, describe content, and extract text through tools such as analyze_image, describe_image, and extract_text_from_image.31MIT
TDQS
Scored across 5 tools
Each tool has a distinct, non-overlapping purpose: comparing images, describing images for text-only models, extracting text via OCR, providing setup rules, and showing configuration status. No ambiguity.
All tool names follow a consistent verb_noun snake_case pattern (compare_images, describe_image, extract_text, vision_rules, vision_status). Predictable and clear.
5 tools is well-scoped for a vision bridge server. Each tool serves a distinct need without redundancy or unnecessary bloat, fitting the server's purpose perfectly.
Core operations are covered: image description, comparison, OCR, and configuration display. A minor gap is the lack of a tool to modify settings (e.g., change model), but the set handles the primary use case of bridging vision for text-only models.