拓十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

MCP 实战:一条命令,把「事实核验 + 安全网关」装进 Claude Code(附踩坑避雷)

MCP 实战:一条命令,把「事实核验 + 安全网关」装进 Claude Code(附踩坑避雷)

现在大家谈 MCP,几乎都在聊「怎么让 Agent 多接几个工具」——查天气、读数据库、操作浏览器。但很少有人反过来想一个问题:

Agent 能调的工具越多,它闯祸的上限就越高。

与其不停给它加「能做的事」,不如先给它加一道「该不该做」的闸。这次我把 HallucC 的 MCP server 接进了 Claude Code,一个地址、一条命令,5 分钟搞定,把「事实核验 + 安全检测 + 动作分级」整套能力变成 Agent 随手可调的 5 个工具。

这篇不讲概念,就是一个完整的接入 + 使用实战,含命令、含踩坑、含实测结果。

一、先搞清楚:这个 MCP server 到底给 Agent 加了什么

一句话:它把「这段内容是不是编的」「这个输入有没有攻击」「这个动作危不危险」变成 Agent 自己能调用的工具。

它一共暴露 5 个工具:

工具作用耗额度
verify_text逐声明事实核验:把长文拆成一条条原子声明,逐条查证,返回红/黄/绿 + 置信度 + 来源是
verify_agentAgent 输出核验 + 执行轨迹六维评估(事实性 / 来源 / 指令合规 / 工具声明一致 / 任务完成 / 反思)是
check_cua_actionsComputer-Use Agent 动作风险分级,覆盖敏感路径、破坏性命令、支付阈值、任务越界等否
check_cua_code_auditAgent 源码静态审计:危险导入、权限边界、注入面、危险默认值、沙箱缺失否
check_safety安全网关:Prompt 注入 / 越狱 / 有害内容 / 敏感信息泄露 / 欺诈,40+ 特征是

两个「不耗额度」的纯规则工具可以放心高频调用——这点在 CI 或批量巡检里很实用。

二、接入:三种方式,从最省事到最可控

方式一:公网远程接入(推荐,零本地依赖)

MCP server 已经部署在https://aihcc.cloud/mcp(remote,streamable-http),你只需要一个 API key。先去 https://aihcc.cloud 注册,在 /keys 页创建个人 key,然后:

Claude Code(一条命令):

claude mcpadd--transporthttp hallucc https://aihcc.cloud/mcp\--header"Authorization: Bearer <你的KEY>"

Cursor / Claude Desktop:配置里填 URL + Header 即可——

{"mcpServers":{"hallucc":{"url":"https://aihcc.cloud/mcp","headers":{"Authorization":"Bearer <你的KEY>"}}}}

方式二:npx 本地跑(stdio,不用 clone)

如果你更习惯本地 stdio 传输:

{"mcpServers":{"hallucc":{"command":"npx","args":["-y","hallucc-mcp"],"env":{"HALLUCC_API_KEY":"<你的KEY>"}}}}

同一套工具,key 从环境变量读,默认连公网后端。

方式三:源码本地开发

要改代码或接入内网就自己起服务:npm install→cp .env.example .env→npm run dev,服务监听http://127.0.0.1:8787/mcp。

接完之后,在 Claude Code 里跑claude mcp list应该能看到 hallucc;Claude Desktop / Cursor 重启后,工具列表里会多出上面那 5 个。

三、实战:接上之后到底能干嘛

1. 交付前,给 AI 回答「过一遍安检」

直接让它核验一段 AI 生成的回答:

帮我核验下面这段话里每条事实性表述,标出编造的部分,并给出来源。

它会把长句拆成原子声明,逐条搜证,返回三档标注 + 来源;证据不足时会降级成「无法核实」,不硬判。适合在交付前给 AI 输出、文档摘要过一道。

2. 上线前,扫一遍 Agent 的「能力面」

用check_cua_code_audit扫整个 Agent 仓库,输出「这个 Agent 理论上能干什么」的能力清单,标出危险导入和权限边界,和运行时轨迹互补。因为不耗额度,仓库再大也能随便扫。

3. 给危险动作装刹车

用check_cua_actions对 CUA 动作分级:像删除文件、凭据读取、未知域导航、超阈值支付这类,会被实时标出来;命中凭据场景时会直接挂起,等你亲手输入。

4. 挡住输入侧的攻击

用check_safety扫用户输入和模型输出,Prompt 注入、越狱、有害内容、敏感信息泄露一次过一遍,返回风险分和命中类别。

四、几个我实测踩到的坑(提前避雷)

这几个坑我踩过,写出来帮你省时间:

  1. base 必须带/api前缀。nginx 只把/api/代理到后端,你要是填裸域名https://aihcc.cloud,会打到前端页面——返回 200,但 body 是 HTML,请求静默失败,审计里啥都看不到。
  2. 没有报错 ≠ 成功。key 无效或没带 Authorization,MCP 层会返回 401;key 有效但额度用尽,后端返回 429,会被映射成「免费额度已用完」。
  3. 先用 MCP Inspector 空跑一遍。不想耗额度又想验证工具列表和鉴权,npx @modelcontextprotocol/inspector选 Streamable HTTP,填地址 + Header,能先把 5 个工具的 schema 看个遍。
  4. 额度怎么算。免费套餐每天有额度:verify_text / verify_agent / check_safety 会扣,两个纯规则工具不扣。

五、一个设计细节,值得单独说

它的鉴权模型挺干净:key 只在 HTTP 头里流转,不进工具参数、不进模型 transcript。也就是说,Agent 在对话里根本看不到你的密钥——密钥留在客户端配置里,server 拿到后原样透传给后端校验。

对「要让 Agent 用工具、又怕它把密钥说出去」这种顾虑,这个设计算是直接给了回答。

写在最后

MCP 让 Agent 接工具变得前所未有的简单,但也让「它到底能做什么」变得前所未有的模糊。与其等它在生产里给你演示一遍,不如现在就给它配一个随手可调的安全工具集。

接入成本?一条命令。
地址和数据手册都在这里:https://aihcc.cloud ,key 在 /keys 页创建,免费套餐每天有额度,先跑通再说。

参考来源:HallucC MCP Server 官方文档与 npm 包(hallucc-mcp)说明;aihcc.cloud API 参考文档。

返回列表