文本读取
TextIn MCP 服务器是一个用于从文档中提取文本并执行OCR的工具,包括文档文本识别、身份证识别和发票识别。它还支持将文档转换为Markdown格式。
MCP 服务配置
复制以下 JSON 到 OPClaw 或其他 MCP 客户端的配置文件中即可使用
{
"mcpServers": {
"textin-ocr": {
"args": [
"-y",
"@intsig/server-textin"
],
"command": "npx",
"env": {
"APP_ID": "\u003cYOUR_APP_ID\u003e",
"APP_SECRET": "\u003cYOUR_APP_SECRET\u003e",
"MCP_SERVER_REQUEST_TIMEOUT": "600000"
},
"timeout": 600
}
}
}
该服务需要配置环境变量:APP_ID、APP_SECRET、MCP_SERVER_REQUEST_TIMEOUT
可用工具 (3 个)
该服务在 MCP 协议中暴露的工具,AI 可按需调用
recognition_text 1 个参数 需填 1 项
Text recognition from images, Word documents, and PDF files.
必填参数:path
general_information_extration 3 个参数 需填 1 项
Automatically identify and extract information from documents, or identify and extract user-specified information.
必填参数:path
doc_to_markdown 1 个参数 需填 1 项
Convert images, PDFs, and Word documents to Markdown.
必填参数:path
服务介绍
TextIn OCR MCP
English | 中文
TextIn OCR MCP 服务器
TextIn MCP 服务器是一款用于从文档中提取文本并执行OCR的工具,包括文档文本识别、身份证识别和发票识别。它还支持将文档转换为Markdown格式。
工具
-
recognition_text- 从图像、Word文档和PDF文件中识别文本。
- 输入:
path(字符串, 必填):文件路径或指向文档的URL (HTTP/HTTPS)
- 返回: 文档的文本。
- 支持的转换格式:
- 图像 (Jpeg, Jpg, Png, Bmp)
-
doc_to_markdown- 将图像、PDF和Word文档转换为Markdown。
- 输入:
path(字符串, 必填):文件路径或指向文档的URL (HTTP/HTTPS)
- 返回: 文档的Markdown格式。
- 支持的转换格式:
- Microsoft Office 文档 (Word, Excel)
- 图像 (Jpeg, Jpg, Png, Bmp)
-
general_information_extration- 自动识别并从文档中提取信息,或识别并提取用户指定的信息。
- 输入:
path(字符串, 必填):文件路径或指向文档的URL (HTTP/HTTPS)key(字符串数组, 可选): 用户希望识别的非表格文本信息,输入格式为字符串数组。table_header(字符串数组, 可选): 用户希望识别的表格信息,输入格式为字符串数组。
- 返回: 关键信息的JSON。
- 支持的转换格式:
- Microsoft Office 文档 (Word, Excel)
- 图像 (Jpeg, Jpg, Png, Bmp)
当输入是URL时,不支持处理受保护资源的访问。
设置
APP_ID 和 APP_SECRET
点击这里注册一个TextIn账号。
按照这里的说明获取Textin的APP_ID和APP_SECRET。
NPX
json
{
"mcpServers": {
"textin-ocr": {
"command": "npx",
"args": [
"-y",
"@intsig/server-textin"
],
"env": {
"APP_ID": "<YOUR_APP_ID>",
"APP_SECRET": "<YOUR_APP_SECRET>",
"MCP_SERVER_REQUEST_TIMEOUT": "600000"
},
"timeout": 600
}
}
}
许可证
此MCP服务器根据MIT许可证授权。这意味着您可以自由使用、修改和分发该软件,但需遵守MIT许可证的条款和条件。更多详情,请参见项目仓库中的LICENSE文件。