Thinking Agent MCP
Enables thinking models to extend their reasoning by outsourcing parts of the chain of thought to a non-thinking model via the chat_agent tool, with configurable parameters.
README
Thinking Agent MCP
MCP Server 暴露 chat_agent 工具,封装非思考模型(non-thinking model),供思考模型(thinking model)在推理过程中调用,实现思维链的外包和延长。
核心思想
思考模型(主推理)
└─ 构建完整的 input_text(包含所有上下文)
└─ chat_agent 独立执行
└─ 返回结果,思考模型整合
- 上下文隔离:工具不依赖对话历史,思考模型需将所有上下文打包进
input_text - 参数控制:通过
temperature、top_p等参数控制输出的确定性与多样性 - 思维链延长:思考模型可将部分推理外包给工具,突破单模型输出 token 限制
配置
环境变量(推荐)
SILICONFLOW_API_KEY=sk-your-api-key-here
SILICONFLOW_BASE_URL=https://api.siliconflow.cn/v1
SILICONFLOW_MODEL=deepseek-ai/DeepSeek-V4-Flash
配置文件
复制 .env.example 修改,或创建 test/config.json:
{
"apiKey": "sk-xxx",
"baseUrl": "https://api.siliconflow.cn/v1",
"model": "deepseek-ai/DeepSeek-V4-Flash"
}
配置按以下优先级加载:环境变量 > test/config.json
工具:chat_agent
参数
| 参数 | 类型 | 默认值 | 说明 |
|---|---|---|---|
input_text |
string | 必填 | 完整、自包含的任务描述,包含所有上下文 |
system_prompt |
string | 可选 | 系统提示词,设定角色或行为约束 |
temperature |
number | 0.7 | 采样温度 0.0-2.0。低=确定/精确,高=创造/发散 |
top_p |
number | 0.9 | 核采样阈值 0.0-1.0 |
max_tokens |
number | 4096 | 最大输出 token 数(API 级控制) |
stop |
string[] | ["\n\n"] | 停止序列 |
seed |
number | 无 | 随机种子,配合低 temperature 实现输出复现 |
参数协同策略
校验模式: temperature=0.1, top_p=0.1, max_tokens=2048, seed=42
发散模式: temperature=1.2, top_p=0.95, max_tokens=4096
平衡模式: temperature=0.5, top_p=0.8, max_tokens=4096
错误响应格式
工具返回结构化错误信息,包含 type 和 action 字段:
{
"success": false,
"type": "api",
"action": "report",
"error": "API 认证失败(401),请检查 API Key 是否正确",
"status_code": 401
}
| type | action | 触发场景 |
|---|---|---|
network |
retry |
DNS 解析失败、连接被拒绝 |
api |
backoff |
429 限流 |
api |
report |
401 认证失败 |
api |
retry |
5xx 服务不可用 |
validation |
fix_input |
input_text 为空 |
config |
report |
未配置 API Key/Model |
使用方式
MCP Client 配置(如 Claude Desktop)
{
"mcpServers": {
"thinking-agent": {
"command": "node",
"args": ["path/to/mcp/dist/index.js"],
"env": {
"SILICONFLOW_API_KEY": "sk-xxx",
"SILICONFLOW_BASE_URL": "https://api.siliconflow.cn/v1",
"SILICONFLOW_MODEL": "deepseek-ai/DeepSeek-V4-Flash"
}
}
}
}
测试框架
项目内置交互式测试框架,用于调试和验证:
# 带工具模式(思考模型可使用 chat_agent)
npm run test:with-tool
# 纯思考模式(对比用)
npm run test:without-tool
项目结构
├── src/
│ ├── index.ts # MCP Server 入口
│ ├── chatAgentTool.ts # chat_agent 工具实现
│ └── logger.ts # 结构化日志
├── test/
│ ├── testFramework.ts # 交互式测试框架
│ ├── batchTest.ts # 批量对比测试
│ ├── fullTest.ts # 完整功能测试
│ ├── quickTest.ts # 快速集成测试
│ └── config.json # API 配置(不提交)
├── .env.example # 环境变量模板
├── blueprint.md # 项目蓝图
└── package.json
开发
npm run build # 编译 TypeScript
npm run start # 启动 MCP Server
npm run dev # 开发模式(ts-node)
License
MIT
推荐服务器
Baidu Map
百度地图核心API现已全面兼容MCP协议,是国内首家兼容MCP协议的地图服务商。
Playwright MCP Server
一个模型上下文协议服务器,它使大型语言模型能够通过结构化的可访问性快照与网页进行交互,而无需视觉模型或屏幕截图。
Audiense Insights MCP Server
通过模型上下文协议启用与 Audiense Insights 账户的交互,从而促进营销洞察和受众数据的提取和分析,包括人口统计信息、行为和影响者互动。
Magic Component Platform (MCP)
一个由人工智能驱动的工具,可以从自然语言描述生成现代化的用户界面组件,并与流行的集成开发环境(IDE)集成,从而简化用户界面开发流程。
VeyraX
一个单一的 MCP 工具,连接你所有喜爱的工具:Gmail、日历以及其他 40 多个工具。
Kagi MCP Server
一个 MCP 服务器,集成了 Kagi 搜索功能和 Claude AI,使 Claude 能够在回答需要最新信息的问题时执行实时网络搜索。
graphlit-mcp-server
模型上下文协议 (MCP) 服务器实现了 MCP 客户端与 Graphlit 服务之间的集成。 除了网络爬取之外,还可以将任何内容(从 Slack 到 Gmail 再到播客订阅源)导入到 Graphlit 项目中,然后从 MCP 客户端检索相关内容。
Exa MCP Server
模型上下文协议(MCP)服务器允许像 Claude 这样的 AI 助手使用 Exa AI 搜索 API 进行网络搜索。这种设置允许 AI 模型以安全和受控的方式获取实时的网络信息。
mcp-server-qdrant
这个仓库展示了如何为向量搜索引擎 Qdrant 创建一个 MCP (Managed Control Plane) 服务器的示例。
e2b-mcp-server
使用 MCP 通过 e2b 运行代码。