
One Intelligence(1-i.ai)正式推出 FALCON Verify,旨在解决生成式 AI 的核心痛点:即使内容存在错误,AI 生成的答案往往仍极具说服力且令人难以辨别。
FALCON Verify 可直接在 ChatGPT 和 Claude 内部运行,连接过程仅需一分钟。该工具通过逐句审查 AI 回复并对照可用证据,帮助用户识别哪些内容值得信赖,从而捕捉可能带来高昂代价的错误。
AI 自信未必可靠,验证成刚需
随着 AI 助手深入研究、分析及商业决策等领域,其回复虽迅速流畅,却常混合准确信息与虚构细节。One Intelligence 创始人兼首席执行官 Deepesh Desai 指出:“AI 面临的挑战已不再是获取答案,而是是否应该信赖它。”
数据佐证了这一信任危机。2025 年 EBU/BBC 研究显示,在 3000 多个 AI 回复中,45% 至少包含一个重大问题;斯坦福大学研究人员发现,专用 AI 法律研究工具的幻觉率介于 17% 至 33% 之间;而在 One Intelligence 内部的 SEC 文件测试中,54% 的 AI 生成陈述缺乏文件支撑。
逐句核查,透明呈现证据
FALCON Verify 不依赖不透明的信心评分,而是基于证据对每个可核查的主张进行评估,并给出明确判定:
- SUPPORTED(有支持):证据证实了 AI 的说法。
- UNSUPPORTED(无支持):主张未得到现有证据支持。
- CONTRADICTED(相矛盾):证据表明情况不同,并指出具体差异。
- INSUFFICIENT(证据不足):现有证据无法确认主张,系统如实说明而非猜测。
例如,若 AI 错误报告收入增长 18% 而实际为 12%,FALCON 会逐一标记有据可依和被反驳的陈述,并提供相应证据。每次验证均生成带有可共享 ID 的记录,确保追溯性。
无缝集成,免费版每月 25 次
该工具遵循“提问 → 获取答案 → 验证 → 决策”的工作流,用户只需在关键回答后输入“FALCON,验证一下”即可,无需复制内容至其他应用或手动检查。
FALCON Verify 既可作为连接器添加至 ChatGPT 或 Claude,也可集成到软件、AI 代理及产品中。个人用户每月可享 25 次免费验证机会,无需绑定信用卡;企业客户则支持在其自有网络内部署。