现在大家谈 MCP,几乎都在聊「怎么让 Agent 多接几个工具」——查天气、读数据库、操作浏览器。但很少有人反过来想一个问题:
Agent 能调的工具越多,它闯祸的上限就越高。
与其不停给它加「能做的事」,不如先给它加一道「该不该做」的闸。这次我把 HallucC 的 MCP server 接进了 Claude Code,一个地址、一条命令,5 分钟搞定,把「事实核验 + 安全检测 + 动作分级」整套能力变成 Agent 随手可调的 5 个工具。
这篇不讲概念,就是一个完整的接入 + 使用实战,含命令、含踩坑、含实测结果。
一、先搞清楚:这个 MCP server 到底给 Agent 加了什么
一句话:它把「这段内容是不是编的」「这个输入有没有攻击」「这个动作危不危险」变成 Agent 自己能调用的工具。
它一共暴露 5 个工具:
| 工具 | 作用 | 耗额度 |
|---|---|---|
| verify_text | 逐声明事实核验:把长文拆成一条条原子声明,逐条查证,返回红/黄/绿 + 置信度 + 来源 | 是 |
| verify_agent | Agent 输出核验 + 执行轨迹六维评估(事实性 / 来源 / 指令合规 / 工具声明一致 / 任务完成 / 反思) | 是 |
| check_cua_actions | Computer-Use Agent 动作风险分级,覆盖敏感路径、破坏性命令、支付阈值、任务越界等 | 否 |
| check_cua_code_audit | Agent 源码静态审计:危险导入、权限边界、注入面、危险默认值、沙箱缺失 | 否 |
| check_safety | 安全网关:Prompt 注入 / 越狱 / 有害内容 / 敏感信息泄露 / 欺诈,40+ 特征 | 是 |
两个「不耗额度」的纯规则工具可以放心高频调用——这点在 CI 或批量巡检里很实用。
二、接入:三种方式,从最省事到最可控
方式一:公网远程接入(推荐,零本地依赖)
MCP server 已经部署在https://aihcc.cloud/mcp(remote,streamable-http),你只需要一个 API key。先去 https://aihcc.cloud 注册,在 /keys 页创建个人 key,然后:
Claude Code(一条命令):
claude mcpadd--transporthttp hallucc https://aihcc.cloud/mcp\--header"Authorization: Bearer <你的KEY>"Cursor / Claude Desktop:配置里填 URL + Header 即可——
{"mcpServers":{"hallucc":{"url":"https://aihcc.cloud/mcp","headers":{"Authorization":"Bearer <你的KEY>"}}}}方式二:npx 本地跑(stdio,不用 clone)
如果你更习惯本地 stdio 传输:
{"mcpServers":{"hallucc":{"command":"npx","args":["-y","hallucc-mcp"],"env":{"HALLUCC_API_KEY":"<你的KEY>"}}}}同一套工具,key 从环境变量读,默认连公网后端。
方式三:源码本地开发
要改代码或接入内网就自己起服务:npm install→cp .env.example .env→npm run dev,服务监听http://127.0.0.1:8787/mcp。
接完之后,在 Claude Code 里跑claude mcp list应该能看到 hallucc;Claude Desktop / Cursor 重启后,工具列表里会多出上面那 5 个。
三、实战:接上之后到底能干嘛
1. 交付前,给 AI 回答「过一遍安检」
直接让它核验一段 AI 生成的回答:
帮我核验下面这段话里每条事实性表述,标出编造的部分,并给出来源。
它会把长句拆成原子声明,逐条搜证,返回三档标注 + 来源;证据不足时会降级成「无法核实」,不硬判。适合在交付前给 AI 输出、文档摘要过一道。
2. 上线前,扫一遍 Agent 的「能力面」
用check_cua_code_audit扫整个 Agent 仓库,输出「这个 Agent 理论上能干什么」的能力清单,标出危险导入和权限边界,和运行时轨迹互补。因为不耗额度,仓库再大也能随便扫。
3. 给危险动作装刹车
用check_cua_actions对 CUA 动作分级:像删除文件、凭据读取、未知域导航、超阈值支付这类,会被实时标出来;命中凭据场景时会直接挂起,等你亲手输入。
4. 挡住输入侧的攻击
用check_safety扫用户输入和模型输出,Prompt 注入、越狱、有害内容、敏感信息泄露一次过一遍,返回风险分和命中类别。
四、几个我实测踩到的坑(提前避雷)
这几个坑我踩过,写出来帮你省时间:
- base 必须带
/api前缀。nginx 只把/api/代理到后端,你要是填裸域名https://aihcc.cloud,会打到前端页面——返回 200,但 body 是 HTML,请求静默失败,审计里啥都看不到。 - 没有报错 ≠ 成功。key 无效或没带 Authorization,MCP 层会返回 401;key 有效但额度用尽,后端返回 429,会被映射成「免费额度已用完」。
- 先用 MCP Inspector 空跑一遍。不想耗额度又想验证工具列表和鉴权,
npx @modelcontextprotocol/inspector选 Streamable HTTP,填地址 + Header,能先把 5 个工具的 schema 看个遍。 - 额度怎么算。免费套餐每天有额度:verify_text / verify_agent / check_safety 会扣,两个纯规则工具不扣。
五、一个设计细节,值得单独说
它的鉴权模型挺干净:key 只在 HTTP 头里流转,不进工具参数、不进模型 transcript。也就是说,Agent 在对话里根本看不到你的密钥——密钥留在客户端配置里,server 拿到后原样透传给后端校验。
对「要让 Agent 用工具、又怕它把密钥说出去」这种顾虑,这个设计算是直接给了回答。
写在最后
MCP 让 Agent 接工具变得前所未有的简单,但也让「它到底能做什么」变得前所未有的模糊。与其等它在生产里给你演示一遍,不如现在就给它配一个随手可调的安全工具集。
接入成本?一条命令。
地址和数据手册都在这里:https://aihcc.cloud ,key 在 /keys 页创建,免费套餐每天有额度,先跑通再说。
参考来源:HallucC MCP Server 官方文档与 npm 包(hallucc-mcp)说明;aihcc.cloud API 参考文档。