A local MCP server for generative image description, providing prose captions, OCR, and LoRA dataset caption sidecars via Florence-2, with deterministic decoding and an honesty contract.
An MCP server for analyzing images using OpenRouter vision models, offering capabilities like automatic image resizing, model configuration, and handling custom queries about images.
MCP server that provides image description capability using StepFun Step-3.7-flash multimodal model, enabling models to 'see' images by converting them into detailed text descriptions.