One Intelligence(1-i.ai)正式推出 FALCON Verify,旨在解决生成式 AI 的核心痛点:即使内容存在错误,AI 生成的答案往往仍极具说服力且令人难以辨别。

FALCON Verify 可直接在 ChatGPT 和 Claude 内部运行,连接过程仅需一分钟。该工具通过逐句审查 AI 回复并对照可用证据,帮助用户识别哪些内容值得信赖,从而捕捉可能带来高昂代价的错误。

AI 自信未必可靠,验证成刚需

随着 AI 助手深入研究、分析及商业决策等领域,其回复虽迅速流畅,却常混合准确信息与虚构细节。One Intelligence 创始人兼首席执行官 Deepesh Desai 指出:“AI 面临的挑战已不再是获取答案,而是是否应该信赖它。”

数据佐证了这一信任危机。2025 年 EBU/BBC 研究显示,在 3000 多个 AI 回复中,45% 至少包含一个重大问题;斯坦福大学研究人员发现,专用 AI 法律研究工具的幻觉率介于 17% 至 33% 之间;而在 One Intelligence 内部的 SEC 文件测试中,54% 的 AI 生成陈述缺乏文件支撑。

逐句核查,透明呈现证据

FALCON Verify 不依赖不透明的信心评分,而是基于证据对每个可核查的主张进行评估,并给出明确判定:

  • SUPPORTED(有支持):证据证实了 AI 的说法。
  • UNSUPPORTED(无支持):主张未得到现有证据支持。
  • CONTRADICTED(相矛盾):证据表明情况不同,并指出具体差异。
  • INSUFFICIENT(证据不足):现有证据无法确认主张,系统如实说明而非猜测。

例如,若 AI 错误报告收入增长 18% 而实际为 12%,FALCON 会逐一标记有据可依和被反驳的陈述,并提供相应证据。每次验证均生成带有可共享 ID 的记录,确保追溯性。

无缝集成,免费版每月 25 次

该工具遵循“提问 → 获取答案 → 验证 → 决策”的工作流,用户只需在关键回答后输入“FALCON,验证一下”即可,无需复制内容至其他应用或手动检查。

FALCON Verify 既可作为连接器添加至 ChatGPT 或 Claude,也可集成到软件、AI 代理及产品中。个人用户每月可享 25 次免费验证机会,无需绑定信用卡;企业客户则支持在其自有网络内部署。