视觉看图 MCP
MCP 服务配置
复制以下 JSON 到 OPClaw 或其他 MCP 客户端的配置文件中即可使用
{
"mcpServers": {
"vision-mcp-ms": {
"args": [
"vision-mcp-ms"
],
"command": "uvx",
"env": {
"OPENAI_API_KEY": "sk-wsmiuzccwpyohcgglmdlssizfgyezqgutqttapcihljkgbyb",
"OPENAI_BASE_URL": "https://api.siliconflow.cn/v1",
"VISION_MODELS": "Qwen/Qwen2.5-VL-7B-Instruct,Qwen/Qwen2.5-VL-72B-Instruct"
}
}
}
}
该服务需要配置环境变量:OPENAI_API_KEY、OPENAI_BASE_URL、VISION_MODELS
可用工具 (1 个)
该服务在 MCP 协议中暴露的工具,AI 可按需调用
analyze_image 2 个参数 需填 1 项
分析一张图片,返回视觉模型给出的文字结果。 image 可以是:HTTP/HTTPS 图片 URL、base64 data URL(data:image/...)。 按 VISION_MODELS 配置的顺序调用模型,遇限流/超时/5xx 自动切换到下一个。
必填参数:image
服务介绍
视觉看图 MCP(vision-mcp-ms)
云端视觉 MCP 服务:调用硅基流动(SiliconFlow)等 OpenAI 兼容视觉大模型分析图片,
为 DeepSeek 这类纯文本大模型提供「看图」能力。
工具
analyze_image
| 参数 | 必填 | 说明 |
|---|---|---|
image |
是 | HTTP(S) 图片 URL 或 base64 data URL |
prompt |
否 | 对图片的问题,默认「请描述这张图片的内容」 |
返回视觉模型的文字结果(描述 / OCR / 问答等)。
支持格式
JPG、PNG、WebP、GIF。图片会自动缩放到最长边 2048,并清除 EXIF。
环境变量
| 变量 | 必填 | 默认值 | 说明 |
|---|---|---|---|
OPENAI_API_KEY |
是 | - | 硅基流动 API Key |
OPENAI_BASE_URL |
否 | https://api.siliconflow.cn/v1 |
OpenAI 兼容接口 |
VISION_MODELS |
否 | Qwen/Qwen2.5-VL-7B-Instruct |
逗号分隔的有序模型列表,限流/超时自动切换 |
使用示例
- 「分析这张截图」→ 传入图片 URL,返回画面内容、文字、布局。
- 「这张壁纸是什么风格?」→ 传入壁纸图片 URL,返回风格、构图、配色描述。
- 「提取图中表格文字」→ 传入图片,返回 Markdown 表格。