mcp-JapaneseTextAnalyzer(日语文本分析器)
统计日语和英语文本文件中的字符和单词数量,对日语进行特殊的形态学分析,并正确排除空格和换行符的字符计数。
MCP 服务配置
复制以下 JSON 到 OPClaw 或其他 MCP 客户端的配置文件中即可使用
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"args": [
"/c",
"npx",
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
],
"command": "cmd"
}
}
}
服务介绍
日语文本分析器 MCP 服务器
这是一个可以进行日语文本形态素分析的MCP服务器。它可以从语言学的角度测量和评估文章的特点,有助于提供文章生成的反馈。
功能
- 计算日语文本的实际字符数(不包括空格和换行符)
- 计算日语文本中的单词数量
- 分析日语文本的详细语言特征(如平均句子长度、词性比例、词汇多样性等)
- 支持文件路径或直接文本输入
- 灵活的文件路径解析(支持绝对路径、相对路径或仅文件名搜索)
工具
目前实现了以下工具:
count_chars
计算文件中的字符数。请指定绝对路径(支持Windows格式 C:\Users... 或 WSL/Linux 格式 /c/Users/...)。将计算去除空格和换行符后的实际字符数。
输入:
filePath(string): 要计算字符数的文件路径(推荐使用Windows或WSL/Linux格式的绝对路径)
输出:
- 文件的实际字符数(不包括空格和换行符)
count_words
计算文件中的单词数量。请指定绝对路径(支持Windows格式 C:\Users... 或 WSL/Linux 格式 /c/Users/...)。对于英文文本,按空格分割计数;对于日文文本,则使用形态素分析。
输入:
filePath(string): 要计算单词数量的文件路径(推荐使用Windows或WSL/Linux格式的绝对路径)language(string, 可选, 默认: "en"): 文件的语言 (en: 英语, ja: 日语)
输出:
- 文件的单词数量
- 如果是日语模式,还将显示形态素分析的详细结果
count_clipboard_chars
计算文本中的字符数。将计算去除空格和换行符后的实际字符数。
输入:
text(string): 要计算字符数的文本
输出:
- 文本的实际字符数(不包括空格和换行符)
count_clipboard_words
计算文本中的单词数量。对于英文文本,按空格分割计数;对于日文文本,则使用形态素分析。
输入:
text(string): 要计算单词数量的文本language(string, 可选, 默认: "en"): 文本的语言 (en: 英语, ja: 日语)
输出:
- 文本的单词数量
- 如果是日语模式,还将显示形态素分析的详细结果
analyze_text
对文本进行详细的形态素分析和语言特征分析。分析内容包括句子复杂度、词性比例、词汇多样性等。
输入:
text(string): 待分析的文本
输出:
- 文本的基本信息(总字符数、句子数量、总形态素数)
- 详细分析结果(平均句长、词性比例、字符类型比例、词汇多样性等)
analyze_file
对文件进行详细的形态素分析和语言特征分析。分析内容包括句子复杂度、词性比例、词汇多样性等。
输入:
filePath(string): 待分析文件的路径(推荐使用Windows或WSL/Linux格式的绝对路径)
输出:
- 文件的基本信息(总字符数、句子数量、总形态素数)
- 详细分析结果(平均句长、词性比例、字符类型比例、词汇多样性等)
使用方法
通过npx运行
可以直接通过npx从GitHub仓库运行此包:
npx -y github:Mistizz/mcp-JapaneseTextAnalyzer
在Claude for Desktop中使用
请在Claude for Desktop的配置文件中添加以下内容:
Windows:
%AppData%\Claude\claude_desktop_config.json
macOS:
~/Library/Application Support/Claude/claude_desktop_config.json
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "npx",
"args": [
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
在Cursor中使用
同样地,在.cursor文件夹内的mcp.json文件中添加相应设置。
Windows:
%USERPROFILE%\.cursor\mcp.json
macOS/Linux:
~/.cursor/mcp.json
通用设置(大多数环境下有效):
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "npx",
"args": [
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
如果在Windows环境下上述设置不起作用,请尝试以下设置:
{
"mcpServers": {
"JapaneseTextAnalyzer": {
"command": "cmd",
"args": [
"/c",
"npx",
"-y",
"github:Mistizz/mcp-JapaneseTextAnalyzer"
]
}
}
}
示例
直接计算文本的字符数
このテキストの文字数を数えてください。
以日语模式计算文件的单词数
C:\path\to\your\file.txt の単語数を日本語モードで数えてください。
用WSL/Linux格式路径计算单词数
/c/Users/username/Documents/file.txt の単語数を日本語モードで数えてください。
仅用文件名计算单词数
README.md の単語数を英語モードで数えてください。
粘贴文本并计算日语单词数
次のテキストの日本語の単語数を数えてください:
吾輩は猫である。名前はまだ無い。どこで生れたかとんと見当がつかぬ。何でも薄暗いじめじめした所でニャーニャー泣いていた事だけは記憶している。
分析文本的详细语言特征
次のテキストを詳細に分析してください:
私は昨日、新しい本を買いました。とても面白そうな小説で、友人からの評判も良かったです。今週末にゆっくり読む予定です。
分析文件的详细语言特征
C:\path\to\your\file.txt を詳細に分析してください。
文件路径解析功能
当指定了文件路径时,该工具能够灵活地查找文件:
- 如果指定了绝对路径,则直接使用
- Windows格式的绝对路径(例如:
C:\Users\username\Documents\file.txt) - WSL/Linux格式的绝对路径(例如:
/c/Users/username/Documents/file.txt)两者都会被自动检测和转换
- Windows格式的绝对路径(例如:
- 以当前目录(工作目录)为基准解析相对路径
- 以主目录(如
%USERPROFILE%或$HOME)为基准进行搜索 - 以桌面目录为基准进行搜索
- 以文档目录为基准进行搜索
这样,即使只指定像“README.md”这样的文件名,也会在一些常见的目录中自动搜索,如果找到文件则会使用它。此外,从WSL环境或Git Bash等获取的路径(/c/Users/...形式)也可以在Windows环境中直接使用。
内部工作原理
此工具使用了名为“kuromoji.js”的形态素分析库来进行日语单词计数。形态素分析是自然语言处理的基础步骤之一,它将文本分割成具有意义的最小单位(即形态素)。
形态素分析过程可能需要一段时间来初始化,特别是首次运行时因为需要加载词典数据,可能会花费较长时间。通过在服务器启动时初始化形态素分析器,我们尽量减少了工具执行时的延迟。
关于语言特征的分析
“analyze_text”与“analyze_file”工具基于形态素分析的结果,计算出文本的各种语言学特征。这些指标包括但不限于:
- 平均句长:每句话的平均字符数。这个值越大,文章越可能是难以阅读的。
- 每句中的形态素数量:每句话的平均形态素数量。这反映了句子的密度及语法复杂度。
- 词性比例:名词、动词、形容词等不同词性在文本中的使用比例。
- 助词比例:显示特定助词使用的频率,帮助分析句子结构和流。
- 字符种类比例:平假名、片假名、汉字、英数字的比例组成。
- 词汇多样性:不同单词数与总单词数之比(类型/令牌比率),用于衡量词汇丰富程度。
- 片假名字词比例:展示片假名字词的使用频率,反映外来词或专业术语的数量以及文体的非正式程度。
- 敬语频率:显示敬语表达的使用频率,用以测量文章的礼貌程度或正式度。
- 标点符号平均数:每句话中标点符号的平均数量,提供有关句子分隔和易读性的指标。
通过结合这些指标,可以从多个角度分析文本特性,并评估其风格、可读性和专业性等。
许可证
该MCP服务器是在MIT许可证下提供的。这意味着您可以在遵守MIT许可证条款的前提下自由地使用、修改和分发软件。更多详情,请参阅项目仓库中的LICENSE文件。