m

mcp-JapaneseTextAnalyzer(日语文本分析器)

@Mistizz/mcp-JapaneseTextAnalyzer
1 Stars 364 次浏览 Mistizz 更新于 2026-08-23

统计日语和英语文本文件中的字符和单词数量,对日语进行特殊的形态学分析,并正确排除空格和换行符的字符计数。

MCP 服务配置

复制以下 JSON 到 OPClaw 或其他 MCP 客户端的配置文件中即可使用

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "args": [
        "/c",
        "npx",
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ],
      "command": "cmd"
    }
  }
}

服务介绍

日语文本分析器 MCP 服务器

这是一个可以进行日语文本形态素分析的MCP服务器。它可以从语言学的角度测量和评估文章的特点,有助于提供文章生成的反馈。

功能

  • 计算日语文本的实际字符数(不包括空格和换行符)
  • 计算日语文本中的单词数量
  • 分析日语文本的详细语言特征(如平均句子长度、词性比例、词汇多样性等)
  • 支持文件路径或直接文本输入
  • 灵活的文件路径解析(支持绝对路径、相对路径或仅文件名搜索)

工具

目前实现了以下工具:

count_chars

计算文件中的字符数。请指定绝对路径(支持Windows格式 C:\Users... 或 WSL/Linux 格式 /c/Users/...)。将计算去除空格和换行符后的实际字符数。

输入:

  • filePath (string): 要计算字符数的文件路径(推荐使用Windows或WSL/Linux格式的绝对路径)

输出:

  • 文件的实际字符数(不包括空格和换行符)

count_words

计算文件中的单词数量。请指定绝对路径(支持Windows格式 C:\Users... 或 WSL/Linux 格式 /c/Users/...)。对于英文文本,按空格分割计数;对于日文文本,则使用形态素分析。

输入:

  • filePath (string): 要计算单词数量的文件路径(推荐使用Windows或WSL/Linux格式的绝对路径)
  • language (string, 可选, 默认: "en"): 文件的语言 (en: 英语, ja: 日语)

输出:

  • 文件的单词数量
  • 如果是日语模式,还将显示形态素分析的详细结果

count_clipboard_chars

计算文本中的字符数。将计算去除空格和换行符后的实际字符数。

输入:

  • text (string): 要计算字符数的文本

输出:

  • 文本的实际字符数(不包括空格和换行符)

count_clipboard_words

计算文本中的单词数量。对于英文文本,按空格分割计数;对于日文文本,则使用形态素分析。

输入:

  • text (string): 要计算单词数量的文本
  • language (string, 可选, 默认: "en"): 文本的语言 (en: 英语, ja: 日语)

输出:

  • 文本的单词数量
  • 如果是日语模式,还将显示形态素分析的详细结果

analyze_text

对文本进行详细的形态素分析和语言特征分析。分析内容包括句子复杂度、词性比例、词汇多样性等。

输入:

  • text (string): 待分析的文本

输出:

  • 文本的基本信息(总字符数、句子数量、总形态素数)
  • 详细分析结果(平均句长、词性比例、字符类型比例、词汇多样性等)

analyze_file

对文件进行详细的形态素分析和语言特征分析。分析内容包括句子复杂度、词性比例、词汇多样性等。

输入:

  • filePath (string): 待分析文件的路径(推荐使用Windows或WSL/Linux格式的绝对路径)

输出:

  • 文件的基本信息(总字符数、句子数量、总形态素数)
  • 详细分析结果(平均句长、词性比例、字符类型比例、词汇多样性等)

使用方法

通过npx运行

可以直接通过npx从GitHub仓库运行此包:

npx -y github:Mistizz/mcp-JapaneseTextAnalyzer

在Claude for Desktop中使用

请在Claude for Desktop的配置文件中添加以下内容:

Windows:
%AppData%\Claude\claude_desktop_config.json

macOS:
~/Library/Application Support/Claude/claude_desktop_config.json

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "command": "npx",
      "args": [
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ]
    }
  }
}

在Cursor中使用

同样地,在.cursor文件夹内的mcp.json文件中添加相应设置。

Windows:
%USERPROFILE%\.cursor\mcp.json

macOS/Linux:
~/.cursor/mcp.json

通用设置(大多数环境下有效):

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "command": "npx",
      "args": [
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ]
    }
  }
}

如果在Windows环境下上述设置不起作用,请尝试以下设置:

{
  "mcpServers": {
    "JapaneseTextAnalyzer": {
      "command": "cmd",
      "args": [
        "/c",
        "npx",
        "-y",
        "github:Mistizz/mcp-JapaneseTextAnalyzer"
      ]
    }
  }
}

示例

直接计算文本的字符数

このテキストの文字数を数えてください。

以日语模式计算文件的单词数

C:\path\to\your\file.txt の単語数を日本語モードで数えてください。

用WSL/Linux格式路径计算单词数

/c/Users/username/Documents/file.txt の単語数を日本語モードで数えてください。

仅用文件名计算单词数

README.md の単語数を英語モードで数えてください。

粘贴文本并计算日语单词数

次のテキストの日本語の単語数を数えてください:

吾輩は猫である。名前はまだ無い。どこで生れたかとんと見当がつかぬ。何でも薄暗いじめじめした所でニャーニャー泣いていた事だけは記憶している。

分析文本的详细语言特征

次のテキストを詳細に分析してください:

私は昨日、新しい本を買いました。とても面白そうな小説で、友人からの評判も良かったです。今週末にゆっくり読む予定です。

分析文件的详细语言特征

C:\path\to\your\file.txt を詳細に分析してください。

文件路径解析功能

当指定了文件路径时,该工具能够灵活地查找文件:

  1. 如果指定了绝对路径,则直接使用
    • Windows格式的绝对路径(例如: C:\Users\username\Documents\file.txt
    • WSL/Linux格式的绝对路径(例如: /c/Users/username/Documents/file.txt)两者都会被自动检测和转换
  2. 以当前目录(工作目录)为基准解析相对路径
  3. 以主目录(如%USERPROFILE%$HOME)为基准进行搜索
  4. 以桌面目录为基准进行搜索
  5. 以文档目录为基准进行搜索

这样,即使只指定像“README.md”这样的文件名,也会在一些常见的目录中自动搜索,如果找到文件则会使用它。此外,从WSL环境或Git Bash等获取的路径(/c/Users/...形式)也可以在Windows环境中直接使用。

内部工作原理

此工具使用了名为“kuromoji.js”的形态素分析库来进行日语单词计数。形态素分析是自然语言处理的基础步骤之一,它将文本分割成具有意义的最小单位(即形态素)。

形态素分析过程可能需要一段时间来初始化,特别是首次运行时因为需要加载词典数据,可能会花费较长时间。通过在服务器启动时初始化形态素分析器,我们尽量减少了工具执行时的延迟。

关于语言特征的分析

“analyze_text”与“analyze_file”工具基于形态素分析的结果,计算出文本的各种语言学特征。这些指标包括但不限于:

  • 平均句长:每句话的平均字符数。这个值越大,文章越可能是难以阅读的。
  • 每句中的形态素数量:每句话的平均形态素数量。这反映了句子的密度及语法复杂度。
  • 词性比例:名词、动词、形容词等不同词性在文本中的使用比例。
  • 助词比例:显示特定助词使用的频率,帮助分析句子结构和流。
  • 字符种类比例:平假名、片假名、汉字、英数字的比例组成。
  • 词汇多样性:不同单词数与总单词数之比(类型/令牌比率),用于衡量词汇丰富程度。
  • 片假名字词比例:展示片假名字词的使用频率,反映外来词或专业术语的数量以及文体的非正式程度。
  • 敬语频率:显示敬语表达的使用频率,用以测量文章的礼貌程度或正式度。
  • 标点符号平均数:每句话中标点符号的平均数量,提供有关句子分隔和易读性的指标。

通过结合这些指标,可以从多个角度分析文本特性,并评估其风格、可读性和专业性等。

许可证

该MCP服务器是在MIT许可证下提供的。这意味着您可以在遵守MIT许可证条款的前提下自由地使用、修改和分发软件。更多详情,请参阅项目仓库中的LICENSE文件。

相关 MCP 服务