Skip to main content
Glama

Server Configuration

Describes the environment variables required to run the server.

NameRequiredDescriptionDefault
Z_AI_MODENoPlatform: ZHIPU (China) or ZAI (International).ZHIPU
Z_AI_API_KEYNoZhipu Coding Plan API key. Required if ZAI_MCP_API_KEY is not set.
Z_AI_TIMEOUTNoRequest timeout in milliseconds.300000
ZAI_MCP_API_KEYNoFallback alias for Z_AI_API_KEY. Auto-mapped if Z_AI_API_KEY is not set.
GLM_VISION_CACHENoEnable result caching.true
Z_AI_RETRY_COUNTNoMaximum retries for retryable errors.2
Z_AI_VISION_MODELNoVision model ID.glm-5v-turbo
GLM_VISION_CACHE_MAXNoMax LRU cache entries.100
GLM_VISION_CACHE_TTLNoCache TTL in seconds (7 days).604800
GLM_IMAGE_MAX_SIZE_MBNoMaximum image file size in megabytes.5
GLM_VIDEO_MAX_SIZE_MBNoMaximum video file size in megabytes.8
Z_AI_VISION_MODEL_TOP_PNoNucleus sampling parameter.0.6
Z_AI_VISION_MODEL_MAX_TOKENSNoMax output tokens.32768
Z_AI_VISION_MODEL_TEMPERATURENoSampling temperature.0.8

Capabilities

Features and capabilities supported by this server

CapabilityDetails
tools
{
  "listChanged": true
}

Tools

Functions exposed to the LLM to take actions

NameDescription
ui_to_artifactA

将 UI 截图转换为代码、提示词、设计规范或自然语言描述。

仅在用户需要以下操作时使用:

  • 从 UI 设计生成前端代码(output_type='code')

  • 创建用于 UI 复刻的 AI 提示词(output_type='prompt')

  • 提取设计规范文档(output_type='spec')

  • 获取 UI 的自然语言描述(output_type='description')

不要用于:需提取的文字/代码、错误信息、技术图表、数据可视化。

extract_text_from_screenshotA

使用 OCR 从截图中提取和识别文字。专门用于代码、终端输出、文档和通用文本提取。

仅在用户需要以下操作时使用:

  • 从截图提取代码(保持正确缩进与格式)

  • 提取终端输出和日志

  • 提取文档和文本内容

不要用于:UI 转 code、错误诊断、图表分析。

diagnose_error_screenshotA

解析错误弹窗、堆栈跟踪和日志截图,给出定位与修复建议。

仅在用户需要以下操作时使用:

  • 分析错误消息和堆栈跟踪

  • 定位根本原因

  • 提供可操作的修复方案

不要用于:提取代码、UI 分析、图表解读。

understand_technical_diagramA

分析技术图表并生成结构化解读,覆盖架构图、流程图、UML、ER 图、序列图等。

仅在用户需要以下操作时使用:

  • 分析架构图

  • 理解流程图与 UML 图

  • 解释 ER 图与序列图

  • 识别设计模式

不要用于:UI 截图、错误消息、数据可视化图表。

analyze_data_visualizationA

阅读仪表盘、统计图表,提炼趋势、异常与业务要点。

仅在用户需要以下操作时使用:

  • 从图表提取洞察

  • 识别趋势与模式

  • 检测异常值

  • 提供业务影响分析

不要用于:技术架构图、UI 截图、错误诊断。

ui_diff_checkA

对比两张 UI 截图,识别视觉差异和实现偏差。专门用于 UI 质量保证和设计到实现的验证。

仅在用户需要以下操作时使用:

  • 比较预期 UI 与实际实现

  • 识别视觉差异

  • 提供详细差异报告

  • 按严重程度排列问题优先级

需要两张图:预期/参考图 与 实际/当前图。

analyze_imageA

通用图像理解能力,适配未被专项工具覆盖的视觉内容。

仅在用户需要以下操作时使用:

  • 当专项工具(UI/OCR/错误/图表/数据可视化/视频)都不适用时

  • 灵活理解任何视觉内容

  • 全面的图像描述和分析

这是兜底工具,优先使用更专业的工具。

analyze_videoA

使用 AI 视觉模型分析视频内容。

仅在用户需要以下操作时使用:

  • 理解视频中发生了什么

  • 提取关键时刻或动作

  • 分析视频内容、场景或序列

  • 识别视频中的对象、人物或活动

支持本地文件与远程 URL,最大 8MB,支持 MP4/MOV/M4V 等格式。

Prompts

Interactive templates invoked by user choice

NameDescription

No prompts

Resources

Contextual data attached and managed by the client

NameDescription

No resources

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/JJChou000/glm-vision-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server