citlyze docs
使用 Citlyze

Brand FactCheck

用你自己审核通过的事实,核查 AI 回答对你品牌的各种断言。

AI 回答不只是提到你的品牌,它们还会对品牌做出断言:价格、成立时间、 政策、产品能力。其中有些断言是错的。FactCheck 从每条被追踪的回答 中提取关于你品牌的事实性断言,逐条对照一个由你掌控的事实库进行核查, 并按测量窗口逐一评分:引擎描述你的准确程度到底如何。

事实库

核查的质量取决于背后的事实,所以 FactCheck 从一个由你维护的知识库 开始。填充它有三种方式:

  • 手动添加事实:你自己输入的事实立即生效。
  • 引导式抓取:FactCheck 会建议你网站上值得提取的页面(定价、 关于我们、支持等),抓取你选中的页面,并为发现的每条陈述提出一条 原子化的事实建议。
  • 粘贴文档:粘贴宣传册、FAQ 或政策文档的文本,系统会以同样的 方式提取事实建议。

抓取和粘贴得到的事实一律以待审建议的形式进入:在你逐条批准之前, 不会用它们核查任何内容。每条事实都带有类别(产品、定价、公司、人物、 政策或其他),以及可选的生效日期,用于随时间变化的陈述。

事实会过时。批准后 180 天未再更新的事实会出现复核提示,避免旧价格 或已废止的政策悄悄继续通过核查。覆盖度指示器展示已批准事实覆盖了 哪些类别,让你在阅读分数之前先看到缺口。

断言如何核查

在每个测量窗口,FactCheck 读取你的被追踪回答,提取其中关于品牌的 可核查陈述,并逐条与已批准的事实比对:

  • 准确:断言与某条已批准事实一致。
  • 不准确:断言与已批准事实相矛盾。每条不准确的断言还会进一步 归类为幻觉(凭空捏造)、过时(曾经属实,如今不再)或 错误(对当前事实表述有误),帮助你区分编造和信息滞后。
  • 无法核实:没有任何已批准事实覆盖该断言,因此无从判断对错。

Accuracy Score

某个窗口、某个引擎的 Accuracy Score,是已判定断言中准确断言的占比: 准确数除以准确数与不准确数之和。无法核实的断言绝不会计入你的失分; 它们单独列示,作为事实库存在缺口的信号。

分数务必结合知识库覆盖度来读。事实库单薄时的高分只说明核查得少, 不代表一切无误。扩充事实库会把无法核实的断言变成可判定的断言,让 分数既更严格,也更可信。

复核队列与反馈

核查器没有把握的判定会先进入复核队列,不会影响分数;你确认或更正 之后,它们才开始计入。对任何断言,你也可以提出异议:

  • 不算错误:屏蔽该断言,它会退出分数,且同样的断言在之后的 窗口中不会再被标记。
  • 判定有误:用你的判定替换原判定,分数随之重新计算。

主题与来源

反复出现的断言会聚类成主题,同一个错误价格的十二种说法只呈现为一个 问题,而不是十二行记录。主题按出现频率和出错频率排序,最严重的反复 性错误一眼可见。

每条断言还会归因到回答所引用的来源,并区分你自己的页面和第三方 网站,让你看清哪些外部页面在不断把错误信息回灌给引擎。

修正不准确的断言

当不准确的断言追溯到你自己的页面时,FactCheck 会接入建议引擎:你会 收到修改该页面、让它明确陈述事实的具体建议,覆盖缺口也会转化为值得 发布的内容建议。对第三方网站,可以生成外联材料包:一份中立的更正 请求,列出该网站的错误表述、涉及的页面,以及你的正确事实和来源, 可直接粘贴进发给站点所有者的邮件。

可用范围

FactCheck 从 Pro 套餐起可用。Pro 每个测量窗口最多核查 500 条断言, Scale 最多 2,000 条;断言扩容包附加组件可为两者各增加 500 条, Enterprise 套餐则没有上限。窗口用完额度后,核查暂停,并在下一个 窗口恢复。

本页内容