字
字符索引字符串处理工具
myalone/char-index
暂无简介
开发者工具
1.3k
JSON转Excel CSV by WTSolutions
WTSolutions/JSON_to_Excel_MCP
JSON转Excel MCP(模型上下文协议)提供了一个标准化的接口,用于将JSON数据转换为CSV格式字符串。它包括两个工具:json_to_excel_mcp_from_data和json_to_excel_mcp_from_url,可以将JSON数据或来自URL的JSON文件转换为CSV格式。
开发者工具
1.3k
K
Kubernetes语控服务器
@Flux159/mcp-server-kubernetes
一种连接到 Kubernetes 集群的服务器,它通过自然语言命令启用管理功能,支持列出资源、创建/删除 Pod 以及安装 Helm 图表等操作。
开发者工具
1.3k
H
Hugging Face MCP服务器
@shreyaskarnik/huggingface-mcp-server
一种模型上下文协议服务器,为克劳德和其他大语言模型提供对 Hugging Face Hub API 的只读访问,通过自然语言启用与模型、数据集、空间、论文和集合的交互。
学术研究
1.3k
MCP超级终端
aeryking/MCPHyperTerminal
暂无简介
开发者工具
1.3k
骰
骰子滚动服务
myalone/dice
暂无简介
开发者工具
1.3k
免费文字生成图像或视频MCP工具
seostar/image-video-generation-mcp
一个用于图像和视频生成的MCP(模型上下文协议)服务器,支持BigModel AI平台上的CogView和CogVideoX模型。它提供了图像和视频生成、配置管理、异步处理、错误处理、TypeScript支持和调试工具等功能。
娱乐与多媒体
1.3k
虚幻分析器
@ayeletstudioindia/unreal-analyzer-mcp
为虚幻引擎代码库提供深度源代码分析,使人工智能助手能够理解C++类结构、搜索代码和分析子系统。
开发者工具
1.3k
语
语音转文字
chance617/Speech_to_Text
# 语音转文字 MCP 服务器
一个功能强大的语音转文字 MCP 服务器,支持多种音频格式和识别引擎。
## 功能特性
### 🎯 核心功能
- **多引擎支持**: 远程API调用(阿里云百炼、OpenAI Whisper、讯飞等)、Google Speech Recognition、CMU Sphinx
- **多格式支持**: WAV、MP3、M4A、FLAC、OGG、AAC
- **多语言支持**: 中文、英文、日文、韩文、法文、德文、西班牙文、俄文
- **批量处理**: 支持批量转写多个音频文件
- **实时进度**: 提供详细的转写进度信息
- **无本地模型**: 全部通过远程API调用,无需下载大模型
### 🛠️ 工具功能
- `transcribe_audio_file`: 转写音频文件
- `transcribe_audio_data`: 转写音频数据
- `transcribe_with_remote_api`: 通过远程API转写音频
- `batch_transcribe`: 批量转写多个文件
- `analyze_audio_file`: 分析音频文件信息
- `convert_audio_file_format`: 转换音频格式
- `get_supported_formats`: 获取支持的格式
### 📚 资源功能
- `audio://info/{file_path}`: 获取音频文件信息
- `audio://formats`: 获取支持的音频格式
### 💡 提示模板
- 语音转文字助手
- 音频格式转换助手
## 安装
### 使用 uv (推荐)
```bash
# 克隆项目
git clone <repository-url>
cd DW_MCP_Server
# 安装依赖
uv sync
# 运行服务器
uv run python main.py
```
### 使用 pip
```bash
# 安装依赖
pip install -r requirements.txt
# 运行服务器
python main.py
```
## 使用方法
### 1. 启动服务器
```bash
# 开发模式
uv run mcp dev main.py
# 或者直接运行
uv run python main.py
```
### 2. 在 Claude Desktop 中安装
```bash
uv run mcp install main.py
```
### 3. 使用示例
#### 转写单个音频文件
```python
# 使用 Google Speech Recognition
result = await transcribe_audio_file(
file_path="/path/to/audio.wav",
language="zh-CN",
engine="google"
)
# 使用远程API(需配置API密钥)
result = await transcribe_audio_file(
file_path="/path/to/audio.mp3",
language="zh-CN",
engine="remote_api"
)
# 直接调用远程API
result = await transcribe_with_remote_api(
file_path="/path/to/audio.wav",
api_type="bailian", # 支持 bailian, openai, xunfei
api_key="your_api_key",
api_url="your_api_url",
language="zh-CN"
)
```
#### 批量转写
```python
file_paths = [
"/path/to/audio1.wav",
"/path/to/audio2.mp3",
"/path/to/audio3.m4a"
]
results = await batch_transcribe(
file_paths=file_paths,
language="zh-CN",
engine="whisper"
)
```
#### 分析音频文件
```python
info = await analyze_audio_file("/path/to/audio.wav")
print(f"格式: {info.format}")
print(f"时长: {info.duration}秒")
print(f"采样率: {info.sample_rate}Hz")
```
#### 转换音频格式
```python
output_path = await convert_audio_file_format(
input_path="/path/to/audio.mp3",
output_path="/path/to/output.wav",
target_format="wav"
)
```
## 支持的格式
### 输入格式
- WAV
- MP3
- M4A
- FLAC
- OGG
- AAC
### 输出格式
- WAV
- MP3
- TXT (转写文本)
- SRT (字幕文件)
- VTT (WebVTT 字幕)
### 支持的语言
- 中文 (zh-CN)
- 英文 (en-US)
- 日文 (ja-JP)
- 韩文 (ko-KR)
- 法文 (fr-FR)
- 德文 (de-DE)
- 西班牙文 (es-ES)
- 俄文 (ru-RU)
## 识别引擎对比
| 引擎 | 优点 | 缺点 | 适用场景 |
|------|------|------|----------|
| 远程API(百炼/OpenAI/讯飞) | 准确率高,支持多种语言,无需本地模型 | 需要网络连接和API密钥 | 在线应用 |
| Google Speech Recognition | 准确率高,支持多种语言 | 需要网络连接 | 在线应用 |
| CMU Sphinx | 完全离线,轻量级 | 准确率相对较低 | 嵌入式设备 |
## 配置选项
### 环境变量
```bash
# 设置默认语言
export DEFAULT_LANGUAGE=zh-CN
# 设置默认引擎
export DEFAULT_ENGINE=remote_api
# 设置默认API类型
export DEFAULT_API_TYPE=bailian
# 配置API密钥和地址
export BAILIAN_API_KEY=your_bailian_api_key
export BAILIAN_API_URL=https://bailian.aliyuncs.com/v1/audio/transcriptions
```
### 服务器配置
```python
# 在 main.py 中修改服务器配置
mcp = FastMCP(
"语音转文字服务",
dependencies=["speechrecognition", "pydub", "openai-whisper", "torch"]
)
```
## 开发
### 安装开发依赖
```bash
uv sync --extra dev
```
### 运行测试
```bash
uv run pytest
```
### 代码格式化
```bash
uv run black main.py
uv run isort main.py
```
### 类型检查
```bash
uv run mypy main.py
```
## 故障排除
### 常见问题
1. **API密钥配置错误**
```bash
# 检查环境变量
echo $BAILIAN_API_KEY
echo $BAILIAN_API_URL
# 或在代码中直接传入
result = await transcribe_with_remote_api(
file_path="audio.wav",
api_key="your_api_key",
api_url="your_api_url"
)
```
2. **音频格式不支持**
```bash
# 安装 ffmpeg
# Windows: 下载 ffmpeg 并添加到 PATH
# macOS: brew install ffmpeg
# Linux: sudo apt install ffmpeg
```
3. **网络连接错误**
- 检查网络连接
- 检查API地址是否正确
- 考虑使用本地引擎(Google Speech Recognition)
### 日志调试
```python
# 启用详细日志
import logging
logging.basicConfig(level=logging.DEBUG)
```
## 贡献
欢迎提交 Issue 和 Pull Request!
### 开发指南
1. Fork 项目
2. 创建功能分支
3. 提交更改
4. 推送到分支
5. 创建 Pull Request
## 许可证
MIT License
## 更新日志
### v0.1.0
- 初始版本
- 支持 Google Speech Recognition、Whisper、CMU Sphinx
- 支持多种音频格式
- 支持批量处理
- 提供进度反馈
## 联系方式
如有问题或建议,请通过以下方式联系:
- 提交 Issue
- 发送邮件
- 加入讨论群
---
**注意**: 使用远程API需要配置API密钥和地址,请在使用前设置相应的环境变量或在调用时传入参数。推荐使用阿里云百炼、OpenAI Whisper、讯飞等主流语音识别API。
开发者工具
1.3k
网络基础数据查询
dongkitchen/fdp_basic
网络基础数据,包括passivedns解析数据、域名和IP的注册信息、网站证书、IOC库的查询。
数据来源于奇安信X实验室被动收集的大网安全研究、威胁分析溯源和大规模多维度安全数据平台。
学术研究
1.3k
P
Prometheus指标查询服务器
@pab1it0/prometheus-mcp-server
通过标准化的Model Context Protocol接口提供对Prometheus指标和查询的访问,允许AI助手执行PromQL查询并分析指标数据。
开发者工具
1.3k
n
n8n 工作流管理器
@spences10/mcp-n8n-builder
🪄 用于通过编程方式创建和管理n8n工作流的MCP服务器。通过一套全面的工具和资源与n8n的REST API进行交互,使AI助手能够在无需用户直接干预的情况下构建、修改和管理工作流。
开发者工具
1.3k
菜谱
lcd18601611267/whateat
看起来您想要翻译一份英文技术文档,但您提供的内容中只有"asd"这个字符串,并没有实际的文档内容。请提供需要翻译的具体英文技术文档文本,这样我才能帮助您进行准确的翻译。如果有特定部分或格式要求,请一并告知。
开发者工具
1.3k
道旅机票查询MCP
yorklu/RollingGo_Flight
暂无简介
搜索工具
1.2k
基于mermaid生成PNG、PDF的MCP服务-MCP&Agent挑战赛
wwwzhouhui/mermaid_mcp_server_MCP_Agent_Challenge
暂无简介
开发者工具
1.2k
C
CDK最佳实践服务器
myalone/awslabs.cdk-mcp-server
暂无简介
开发者工具
1.2k
项目规划器
virgo777/sequence_think
该工具通过灵活的思维流程帮助分析问题,这种流程能够适应变化并不断演进。随着认知的深入,每个思维节点都可以对先前结论进行补充、质疑或修正。
适用场景
拆解复杂问题为可执行步骤
需要预留修订空间的设计规划
可能需要方向调整的深度分析
初期范围不明确的探索性问题
需多阶段推理的复合型问题
多步骤关联的任务场景
需过滤干扰信息的决策场景
交流协作工具
1.2k
M
MCP手机控制插件
@hao-cyber/phone-mcp
一个用于MCP的插件,它使人工智能助手能够控制安卓手机,通过自然语言命令实现打电话、发信息、截屏和访问联系人等功能。
交流协作工具
1.2k
g
gemini-mcp-tool的windows版本
orzcls/gemini-mcp-tool-windows
暂无简介
交流协作工具
1.2k
P
PostgreSQL模式分析器
@DanielRSnell/postgres-mcp
提供对 PostgreSQL 数据库的只读访问,使大型语言模型(LLM)能够在安全的事务上下文中检查数据库模式并执行只读 SQL 查询。
开发者工具
1.2k
A
API测试器-MCP
@Vikrant-Khedkar/api-tester-mcp
一种模型上下文协议服务器,允许克劳德代表您发起API请求,提供测试各种API的工具,包括HTTP请求和OpenAI集成,而无需在聊天中共享您的API密钥。
浏览器自动化
1.2k
P
PostgreSQL AI服务
@antonorlov/mcp-postgres-server
使AI模型能够通过标准化接口与PostgreSQL数据库进行交互,支持查询、表操作和模式检查等操作。
开发者工具
1.2k
json对比
yohanLiu/jsonDiffMcp
基于Model Context Protocol (MCP) 的json对比工具。
开发者工具
1.2k
O
OBS远程控制面板
@royshil/obs-mcp
一台通过OBS WebSocket协议提供远程控制OBS Studio工具的服务器,可以通过MCP客户端界面管理场景、源、流媒体和录制。
开发者工具
1.2k