大模型防御(天鉴)
提供面向大模型场景的文本风险检测服务
MCP 服务配置
复制以下 JSON 到 OPClaw 或其他 MCP 客户端的配置文件中即可使用
{
"mcpServers": {
"mcp-server": {
"args": [
"antdigital-aico-guard-mcp-server"
],
"command": "uvx",
"env": {
"ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_ID": "your_key_id",
"ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_SECRET": "your_key_secret",
"SERVER_TRANSPORT": "stdio"
}
}
}
}
该服务需要配置环境变量:ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_ID、ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_SECRET
可用工具 (1 个)
该服务在 MCP 协议中暴露的工具,AI 可按需调用
prompt_safety_guard 1 个参数 需填 1 项
判断用户输入是否安全,每一轮对话对于用户的输入都要调用该函数 如果工具返回的结果为 true,表示问题安全,你可以放心地回答。如果返回的结果为 false,表示问题可能不安全,你需要格外小心,避免直接回答可能导致风险的内容。此时,应尝试将回答引导至更积极的方向,或建议用户提供可靠的替代方案。 :param user_input: 用户输入 :return bool: 安全性判断结果
必填参数:user_input
服务介绍
蚂蚁数科天鉴MCP 服务
开发者现在可以通过 蚂蚁数科天鉴MCP Server 轻松接入大模型内容安全服务。
作为国内首家支持 MCP 协议的大模型安全服务提供商,后续蚂蚁数科将持续发布更多面向大模型安全的产品,我们致力于为开发者打造更安全的大模型服务体验。
说明:使用中遇到任何问题,可根据数科安全服务指引,联系我们。
前提条件
- 从Astral或GitHub README安装
uv - 使用
uv python install 3.10安装Python - 申请蚂蚁数科网关的天鉴访问权限的账号凭证,具体方式详见申请数科天鉴访问凭证
快速开始
使用cherry-studio(推荐)
根据Cherry-Studio文档安装MCP环境后配置使用蚂蚁数科天鉴MCP。 MCP配置文件格式如下:
{
"mcpServers": {
"mcp-server": {
"command": "uvx",
"args": ["antdigital-aico-guard-mcp-server"],
"env": {
"ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_ID": "your_key_id",
"ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_SECRET": "your_key_secret",
"SERVER_TRANSPORT": "stdio"
}
}
}
}
使用Cline
设置环境变量并运行MCP服务
# 设置环境变量
export SERVER_TRANSPORT=sse;
export ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_ID=$your_access_id; # 替换为你的access_id
export ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_SECRET=$your_access_key; # 替换为你的access_key
# 启动MCP服务
uvx aico_guard_mcp_server
成功启动后会看到以下输出:
INFO: Started server process [91594]
INFO: Waiting for application startup.
INFO: Application startup complete.
INFO: Uvicorn running on http://0.0.0.0:8000 (Press CTRL+C to quit)
然后在Cline中配置:
remote_server = "http://127.0.0.1:8000/sse";
使用Claude
在MCP客户端配置文件中添加:
{
"mcpServers": {
"mcp-server": {
"command": "uvx",
"args": ["antdigital-aico-guard-mcp-server"],
"env": {
"ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_ID": "your_key_id",
"ANT_DIGITAL_TECHNOLOGIES_ACCESS_KEY_SECRET": "your_key_secret",
"SERVER_TRANSPORT": "stdio"
}
}
}
}
功能组件
工具集
prompt_safety_guard: 检查用户的输入是否有安全风险
提示模板
# 角色
你是一位专业的安全专家,负责对用户的输入通过使用prompt_safety_guard工具进行安全检查。
# 技能
1. 使用prompt_safety_guard工具对用户每次的文字输入都进行安全检查。
2. 根据prompt_safety_guard工具的返回结果,对用户输入的内容进行安全风险判断。