Skip to main content
Glama
README.md
# API Vision MCP Server

视觉模型图像识别 MCP server,默认模型 `mimo-v2.5`,兼容 OpenAI 格式 API。

---

## 安装

### 1. 克隆仓库

```bash
git clone https://github.com/stzhiyang/api-vision-mcp.git ~/.claude/plugins/custom/api-vision-mcp
cd ~/.claude/plugins/custom/api-vision-mcp
npm install
```

### 2. 注册到 Claude Code

编辑 `~/.claude.json`,添加全局配置:

```json
"mcpServers": {
  "api-vision": {
    "command": "node",
    "args": ["~/.claude/plugins/custom/api-vision-mcp/index.js"],
    "env": {
      "VISION_API_KEY": "你的API密钥",
      "VISION_API_BASE_URL": "https://api.example.com",
      "VISION_API_MODEL": "mimo-v2.5"
    }
  }
}
```

### 3. 重启 Claude Code

---

## 环境变量

| 变量 | 必填 | 说明 | 默认值 |
|------|------|------|--------|
| `VISION_API_KEY` | 是 | API 密钥 | - |
| `VISION_API_BASE_URL` | 是 | API 地址 | - |
| `VISION_API_MODEL` | 否 | 模型名称 | `mimo-v2.5` |

---

## 使用

在对话中粘贴图片并提问,或显式调用:

```
请使用 analyze_image 工具识别图片内容
```

> **说明**:MCP 工具不会自动触发,需要用户显式请求或 Claude 判断需要图像识别时才会调用。

---

## 切换模型/平台

修改 `env` 中的三个变量即可:

| 平台 | VISION_API_BASE_URL | VISION_API_MODEL |
|------|---------------------|------------------|
| OpenAI | `https://api.openai.com` | `gpt-4o` |
| DeepSeek | `https://api.deepseek.com` | `deepseek-chat` |
| 通义千问 | `https://dashscope.aliyuncs.com/compatible-mode` | `qwen-vl-max` |
| 智谱 | `https://open.bigmodel.cn/api/paas` | `glm-4v` |
| Ollama | `http://localhost:11434` | `llava` |

> **注意**:不同平台的 API 路径可能不同。如果请求失败,检查 `index.js` 中的 `/v1/chat/completions` 路径是否需要调整(如某些平台用 `/v1/messages`)。

---

## 依赖

- Node.js >= 18
- @modelcontextprotocol/sdk
- zod

Maintenance

ActivityStale
ResponsivenessNo issues