知识
为什么 AI 系统需要可核查的企业知识?
因为无论如何,AI 系统都会给出一个关于贵公司的答案。如果您的公开信息稀薄、不一致,或在不同来源之间互相矛盾,答案照样会被拼出来——用它当时能找到的东西。核实的意义不在于"被找到",而在于:被反复传播的是哪一个版本的您。
"未经核实"在现实中是什么样子
它很少表现为谎言。它更像是:一个产品名称出现在三份内部文档里,有三种不同的定义,而其中没有一种与软件实际做的事情吻合。它也像是:一项能力在规划里用将来时描述,在宣传材料里却用了现在时。
人类读者会借助上下文悄悄消化这些矛盾;而一个正在拼装答案的系统不会——它要么挑一个,要么取平均。
核实实际需要什么
每一条事实都需要一个可引用的来源、一个核查日期,以及一位为它负责的责任人。无法支撑的说法,应当被明确标记为"无法支撑",而不是改写成一句更含糊、却能通过审核的话。
最后这一点最常被跳过。把无法核实的说法改得更含糊,比原话更糟——因为它同样是错的,却更难被发现。
- 每条事实都有可引用的来源
- 有最近一次核查的日期
- 有明确的责任人
- 对无法支撑的内容有明确记录
本网站就是例子
这里的每一句事实陈述,都对应一条有来源、有复核日期的受管控依据。凡是无法支撑的数字,我们选择删除而不是弱化——这也是为什么整个网站上看不到对接数量、成本下降百分比或客户 logo 墙。
客户常问的问题
- 这不就是结构化数据吗?
- 不是。结构化数据是把已核实的知识表达给机器的方式。如果底层知识本身是错的,结构化数据只会让错误答案更容易被采用。
- 我们该从哪里开始?
- 从盘点目前对外声称了什么、以及每一条能否被支撑开始。这个过程通常不太舒服,但总是有用。