基础OCR识别

dingtalk/Basic-OCR-recognition
Hosted
2 Stars 357 次浏览 DingTalk 更新于 2026-08-23

云端OCR识别,轻松提取图片中的文字、表格和关键信息。

该服务暂未提供标准配置,请参考 README 手动接入

可用工具 (7 个)

该服务在 MCP 协议中暴露的工具,AI 可按需调用

ocr_qrcode

多种类型的二维码、条形码智能识别,对图片中的二维码、条形码进行检测和识别,返回存储的文字信息。精准识别,支持多种图片格式识别

该工具无需必填参数,直接调用即可

ocr_fruit_vegetable

识别果蔬类食材,即对于输入的一张图片(可正常解码,且长宽比适宜),输出图片中的果蔬食材结果

该工具无需必填参数,直接调用即可

ocr_animal_discernment

传入动物图片,返回动物名称,并可获取识别结果对应的百科信息,可识别近万种动物,基于业界先进模型,识别率高达99%以上。适用于拍照识图、科普教育、图像分析等厂家

该工具无需必填参数,直接调用即可

ocr_main_multi_object

检测图片中的主体,支持单主体检测、多主体检测。可识别出图片中主体的位置和标签,方便裁剪出对应主体的区域,用于后续图像处理

该工具无需必填参数,直接调用即可

ocr_numbers

对图片中的数字进行提取和识别,自动过滤非数字内容,仅返回数字内容及其位置信息,识别准确率超过99%以上

该工具无需必填参数,直接调用即可

ocr_english

精准识别图像中的英文内容并实现结构化输出,支持PNG、JPG、JPEG、BMP、TIFF、PDF等多种图像格式

该工具无需必填参数,直接调用即可

detect_vehicle_image

识别图像中所有车辆的类型和位置,并对小汽车、卡车、巴士、摩托车、三轮车5类车辆分别计数,同时可定位小汽车、卡车、巴士的车牌位置

该工具无需必填参数,直接调用即可

服务介绍

基础OCR识别 MCP Server

1. 什么是基础OCR识别 MCP Server?

基础OCR识别是开放平台官方提供的 MCP,支持对图像中的文字内容进行识别和提取,包括通用文字、表格、手写体等场景的识别能力。

2. 如何使用基础OCR识别 MCP Server?

钉钉已为你部署好了云端的基础OCR识别 MCP 服务。你可以直接在对话输入框中添加并使用。

MCP Tools

  • detect_text:检测并识别图像中的通用文字内容
  • detect_handwriting:识别图像中的手写体文字
  • detect_table:识别图像中的表格内容并结构化输出
  • detect_document_info:提取文档类图像的关键信息(如标题、段落)
  • extract_invoice_info:从发票图像中提取结构化字段数据
  • extract_id_card_info:从身份证图像中提取姓名、号码等个人信息
  • get_ocr_result:获取指定任务的OCR识别结果

用户使用案例

  • 帮我识别这张图片中的所有文字内容,并以文本形式返回
  • 请解析上传的发票图片,提取发票代码、发票号码、金额和开票日期
  • 识别这张身份证正反面照片,获取姓名、性别、身份证号码信息
  • 将这个表格图片转换成结构化的数据,保留原表格的行列关系
  • 识别这张手写笔记的照片,转为可编辑的电子文本
  • 提取这份扫描版合同文档的主要段落和标题内容
  • 查询一张包含文字的图片,返回其中所有可读文本的位置与内容

相关 MCP 服务