j

jcrawl4ai-mcp-server 工具

@rainyheart/jcrawl4ai-mcp-server
0 Stars 15 次浏览 rainyheart 更新于 2026-08-23

识别出“jcrawl4ai-mcp-server”并非一种自然语言的句子或单词,它看起来像是一个技术术语、项目名称或者代码片段。在没有更多信息的情况下,直接翻译为: jcrawl4ai-mcp-server(保持原样,因为它是专有名词或技术术语)。

该服务暂未提供标准配置,请参考 README 手动接入

服务介绍

jcrawl4ai-mcp-server

Java 实现的 MCP 服务器,用于与 Crawl4ai API 进行交互。

项目概述

jcrawl4ai-mcp-server 是一个基于 Spring Boot 的 MCP 服务器,用于调用 Crawl4ai API 进行网页爬取。该项目的主要功能包括:

  • 使用指定的策略、最大深度和输出格式对给定的 URL 进行爬取。
  • 根据给定的任务 ID 获取爬取结果。

配置

application.properties

src/main/resources/application.properties 文件中配置以下属性:

  • cawl4ai.base-url:Crawl4ai 服务器的基础 URL。
  • cawl4ai.api-token:Crawl4ai 服务器的 API 令牌。

示例配置:

cawl4ai.base-url=http://your-cral4ai-server-url:11235
cawl4ai.api-token=your-api-token

依赖

项目依赖于以下库:

  • Spring AI MCP Server
  • Spring Boot
  • Hutool

启动

使用 Maven 构建并运行项目:

mvn clean install
java -jar target/jcawl4ai-mcp-server-1.0.0.jar

接口

Crawl4aiApi

crawl 方法

  • 描述:调用 Crawl4ai API 爬取指定的 URL。
  • 参数
    • urls:目标网站的 URL 数组。
    • strategy:爬取策略。
    • max_depth:最大深度。
    • output_format:输出格式。
  • 返回值:爬取结果的 JSON 字符串。

task 方法

  • 描述:根据给定的任务 ID 获取爬取结果。
  • 参数
    • taskId:任务 ID。
  • 返回值:爬取结果的 JSON 字符串。

日志

日志文件路径为 ./target/mcp-stdio-server.log

MCP Server 配置

{
  "mcpServers": {
    "jcawl4ai-mcp-server": {
      "autoApprove": [
        "crawl",
        "task"
      ],
      "disabled": false,
      "timeout": 60,
      "command": "java",
      "args": [
        "-jar",
        "/path/to/your/jar/file/jcawl4ai-mcp-server-1.0.0.jar"
      ],
      "transportType": "stdio"
    }
  }
}

联系

如果您有任何问题或建议,请联系 Ken Ye