检测局限性说明

HallucC 能做什么,不能做什么

HallucC 通过多源搜索引擎交叉核验 AI 生成内容中的事实声明,并对 AI Agent 的全链路轨迹 做六维结构化评估,采用多级置信度分级判定(可信 / 存疑 / 无法核实),证据不足时不强行定性。 但我们坦诚说明以下检测边界,以帮助你正确理解和使用检测结果。

已知检测盲区

🕐

实时动态信息

对于实时变化的新闻事件、股市行情、体育比分等,搜索引擎索引存在延迟,可能导致时效性误判。检测结果反映的是搜索时可获取的公开信息状态。

🔬

专业领域深度知识

医疗诊断、法律判例、前沿科研等高度专业化的内容,搜索引擎可能无法检索到权威信源全文,系统仅能依据公开摘要做判断,不构成专业建议。

🌐

小众语言与方言

当前搜索引擎主要覆盖中文和英文主流内容,对小语种、方言、古文等内容的事实核验能力有限,可能出现较多「无法核实」的判定。

💭

主观观点与价值判断

系统仅对可验证的事实声明进行核验。对于审美评价、价值判断、个人偏好等主观内容,系统将其归类为「主观声明」,不做真伪判定。

🔒

企业内部与未公开信息

涉及企业内部数据、未公开发表的论文、付费墙后的学术文献等内容,搜索引擎无法访问,系统无法进行有效核验。此类场景建议使用私有知识库功能。

🔗

多轮对话中的隐含前提

在长对话中,AI 回答可能隐含前几轮未经验证的前提假设。系统独立检测每条声明,不会追溯对话历史中的隐含逻辑链。

Agent 轨迹检测的特有边界

Agent 全链路轨迹检测在文本核验之外引入了工具调用与轨迹传播的判定,相应也有其特有的检测边界——以下几项不适用于普通文本检测,仅在使用 /detect-agent 或 /detect-agent-trajectory 时需留意。

🔒

私有工具输出无法外部核验

Agent 调用企业内部数据库、私有 API、内部知识检索等工具时,其 observation 搜索引擎无法访问,系统只能判断「工具输出与 Agent 声称是否一致、轨迹内部逻辑是否自洽」,不能独立核实该输出本身真伪。建议为关键工具提供 JSON Schema 以启用结构化校验。

🔄

离线 / 重放轨迹依赖记录忠实度

导入的 ReAct / LangSmith / OpenAI Agents / Dify 历史轨迹,系统按既有记录判定。若轨迹中 observation 被篡改或步骤被省略,检测受限于记录忠实度——重放无法还原工具当时的真实返回。高价值场景建议用 @trace_agent 实时采集,而非事后补录。

⚙️

工具 schema 缺失时降级评估

未提供 tool_schemas 时,工具是否存在、参数是否违反 schema 等结构性判定会跳过,仅做观察忠实度、推理连贯等内容维评估。补全 schema 可显著提升工具调用真实性维度(tool_selection / parameter_validity)的覆盖。

📏

轨迹长度与裁判成本截断

超长轨迹(上限约 20 步、LLM 裁判调用受限)会被截断,尾部步骤可能不在裁判层完整覆盖;fast 档(纯规则)下部分 LLM 维度置信度为 0.0,不可等同于「已充分验证」。深度场景建议用 standard / deep 档以获得完整六维评估。

置信度体系说明

高可信多个权威信源交叉验证一致,置信度 ≥ 0.8
疑似存疑信源信息矛盾或仅部分匹配,置信度 0.4–0.8
判定幻觉多信源明确反驳,置信度 ≥ 0.8。但仍有小概率误判
无法核实证据不足,不强行判定。这是设计选择,不是错误

使用建议

  • 1.高风险场景(金融交易、医疗诊断、法律意见)请务必配合人工审核,不可仅依赖自动检测结果
  • 2.对于被判定为「无法核实」的声明,建议手动点击来源链接查看原始网页进行二次确认
  • 3.检测结果仅供参考,不构成事实认定或法律证据
  • 4.如发现误判(假阳性或假阴性),欢迎通过结果页面的反馈按钮提交,帮助我们持续改进
  • 5.定期查看本页面,我们会在检测能力提升后更新局限性说明

最后更新:2026年9月 · 检测能力持续迭代中,本页面将同步更新(本次新增 Agent 轨迹检测特有边界)