Elasticsearch Semantic Search MCP Server
一个 Python MCP 服务器,可以通过 Elasticsearch 中索引的 Search Labs 博客文章实现语义搜索,从而使 Claude 能够智能地从博客内容中检索相关信息。
README
MCP Server: Elasticsearch 语义搜索工具
Demo repo for: https://j.blaszyk.me/tech-blog/mcp-server-elasticsearch-semantic-search/
目录
概述
此存储库提供了一个 MCP 服务器的 Python 实现,用于通过索引在 Elasticsearch 中的 Search Labs 博客文章进行语义搜索。
它假设您已经抓取了博客文章,并使用 Elastic Open Crawler 将它们存储在 search-labs-posts 索引中。
运行 MCP Server
将 ES_URL 和 ES_AP_KEY 添加到 .env 文件中(有关使用最小权限生成 API 密钥的信息,请参见此处)。
在 MCP Inspector 中启动服务器:
make dev
运行后,通过以下地址访问 MCP Inspector:http://localhost:5173
与 Claude Desktop 集成
要将 MCP 服务器添加到 Claude Desktop:
make install-claude-config
这会更新您主目录中的 claude_desktop_config.json。下次重新启动时,Claude 应用程序将检测到服务器并加载声明的工具。
抓取 Search Labs 博客文章
1. 验证爬虫设置
要检查 Elastic Open Crawler 是否正常工作,请运行:
docker run --rm \
--entrypoint /bin/bash \
-v "$(pwd)/crawler-config:/app/config" \
--network host \
docker.elastic.co/integrations/crawler:latest \
-c "bin/crawler crawl config/test-crawler.yml"
这应该打印来自单个页面的抓取内容。
2. 配置 Elasticsearch
设置 Elasticsearch URL 和 API 密钥。
生成具有最小爬虫权限的 API 密钥:
POST /_security/api_key
{
"name": "crawler-search-labs",
"role_descriptors": {
"crawler-search-labs-role": {
"cluster": ["monitor"],
"indices": [
{
"names": ["search-labs-posts"],
"privileges": ["all"]
}
]
}
},
"metadata": {
"application": "crawler"
}
}
从响应中复制 encoded 值,并将其设置为 API_KEY。
3. 更新索引映射以进行语义搜索
确保 search-labs-posts 索引存在。如果不存在,请创建它:
PUT search-labs-posts
更新映射以启用语义搜索:
PUT search-labs-posts/_mappings
{
"properties": {
"body": {
"type": "text",
"copy_to": "semantic_body"
},
"semantic_body": {
"type": "semantic_text",
"inference_id": ".elser-2-elasticsearch"
}
}
}
body 字段使用 Elasticsearch 的 ELSER 模型索引为语义文本。
4. 开始抓取
运行爬虫以填充索引:
docker run --rm \
--entrypoint /bin/bash \
-v "$(pwd)/crawler-config:/app/config" \
--network host \
docker.elastic.co/integrations/crawler:latest \
-c "bin/crawler crawl config/elastic-search-labs-crawler.yml"
[!TIP] 如果使用全新的 Elasticsearch 集群,请等待 ELSER 模型启动后再进行索引。
5. 验证索引文档
检查文档是否已索引:
GET search-labs-posts/_count
这将返回索引中的文档总数。您也可以在 Kibana 中进行验证。
完成! 您现在可以对 Search Labs 博客文章执行语义搜索了。
推荐服务器
Baidu Map
百度地图核心API现已全面兼容MCP协议,是国内首家兼容MCP协议的地图服务商。
Playwright MCP Server
一个模型上下文协议服务器,它使大型语言模型能够通过结构化的可访问性快照与网页进行交互,而无需视觉模型或屏幕截图。
Magic Component Platform (MCP)
一个由人工智能驱动的工具,可以从自然语言描述生成现代化的用户界面组件,并与流行的集成开发环境(IDE)集成,从而简化用户界面开发流程。
Audiense Insights MCP Server
通过模型上下文协议启用与 Audiense Insights 账户的交互,从而促进营销洞察和受众数据的提取和分析,包括人口统计信息、行为和影响者互动。
VeyraX
一个单一的 MCP 工具,连接你所有喜爱的工具:Gmail、日历以及其他 40 多个工具。
graphlit-mcp-server
模型上下文协议 (MCP) 服务器实现了 MCP 客户端与 Graphlit 服务之间的集成。 除了网络爬取之外,还可以将任何内容(从 Slack 到 Gmail 再到播客订阅源)导入到 Graphlit 项目中,然后从 MCP 客户端检索相关内容。
Kagi MCP Server
一个 MCP 服务器,集成了 Kagi 搜索功能和 Claude AI,使 Claude 能够在回答需要最新信息的问题时执行实时网络搜索。
e2b-mcp-server
使用 MCP 通过 e2b 运行代码。
Neon MCP Server
用于与 Neon 管理 API 和数据库交互的 MCP 服务器
Exa MCP Server
模型上下文协议(MCP)服务器允许像 Claude 这样的 AI 助手使用 Exa AI 搜索 API 进行网络搜索。这种设置允许 AI 模型以安全和受控的方式获取实时的网络信息。