跳到正文
新功能:向 Rexfin 分析师智能体询问你的模型,每个数字都附带出处
· 阅读约 5 分钟

对着你的财报进行 AI 对话,每一个数字都有引用出处

Rexfin 的对话功能从你的财报中回答财务问题,并为每一个数字标注引用来源,否则就拒绝回答。任何数字都不会在没有源头依据的情况下出现在文字中。

作者 The Rexfin team

你在对话框里输入“2024 财年的毛利率是多少,相比 2023 财年有什么变化”,然后有东西用一句正常的话回答了你,句子里带着一个数字。这一步不难做到。难的是确保这个数字是真实的,而且当在场有人质疑时,你能在三秒钟内证明它。这正是大多数财务对话工具会跳过的一步,也正是 Rexfin 的对话功能所围绕构建的核心。

两项工作,彼此分开

Rexfin 的问答引擎把工作拆分成推理的一步和写作的一步。首先,一个确定性的调查模块从摄取阶段构建的原子图谱中检索出你的问题所需的具体事实:具体的数字、它们所在的报表行、它们所在的页码。这些证据被组装成一个固定的证据块。只有到这时,一个语言模型才开始撰写句子,而且它只被允许看到这个证据块,它从不接触原始财报文本,也没有其他数字的记忆可供调用。

在答案发出之前,一个独立的检查步骤会读取模型写出的文字,并寻找其中的数字。每一个数字都必须能追溯到证据块中一条被引用的事实。如果模型写出的数字没有引用支撑,无论是四舍五入方式不同、凭空生成,还是取自证据之外的内容,答案就会被拒绝发出,而不是被送出。这种拒绝不是一句软性提醒,它是“我提供的财报中没有这项数据”与一个包装成事实的错误数字之间的分界线。你可以在引用或拒答中详细了解这条信任边界是如何被强制执行的。

追问不能作弊

对话只有在你能追问的时候才真正像对话。“那 2023 年呢?”这句话只有在系统记得“那”指的是什么时才有意义。Rexfin 的对话线程通过延续上一个问题的措辞来处理这一点,也就是一个规范化的谓词,比如“毛利率”,而不是延续上一个答案,不延续它的引用,也不延续任何数字。当前的问题依然会从头完整地跑一遍先检索、后引用的流程。上一轮对话无法把一个未经验证的数字偷偷带入之后的答案,而如果追问最终没有对应任何支持性证据,它同样会像第一个问题一样被拒绝回答。上游的一次拒绝,也不会因为一个含糊的追问而被“救回来”,它依然会是一次拒绝。

你看到的答案还带有文档和主体范围的限定。如果你在一份带有分部拆分的财报中询问“收入”,引擎不会把某个分部的数字包装成合并总数交给你,也不会跨越一份不相关的财报来回答你的问题。这个数字究竟存在哪里,以及引擎为什么足够信任它、愿意引用它,在信任链如何对证据排序中有详细说明。

重复的问题会立刻得到回应

同一个问题被问两次,不论是你自己,还是同一工作区里的同事,都不会重新运行模型。Rexfin 会缓存答案,其键值部分绑定于该工作区当前所有可见文档的一个指纹。一旦文档集合中有任何变化,比如新上传了一份文档、某份文档被标记、某份财报被替代,这个指纹就会随之改变,缓存条目也就无法再匹配。在什么都没变化时,你会得到一个快速的重复答案;而一旦有变化,系统会立刻重新计算,无需任何手动清除缓存的操作。界面上会标注出某个答案来自缓存,这样不会有人把速度误认为是新鲜度。

这项功能不做什么

这是基于你已有证据的对话功能,不是一个预测工具。如果你想就某个驱动因素提出“假如”式的问题,而不是询问历史数字,那是一项相关但不同的能力,参见自然语言假设分析。如果你想让同一个经过验证的答案,针对董事会和针对分析师用不同的方式表达出来,那是构建在同一引擎之上的一个呈现层,参见分析师语气

值得诚实说明的一个局限是:引擎只能引用你的财报实际披露的内容。如果这个数字确实不在文档之中,正确的答案是拒绝回答,而不是一个看似合理的猜测,而这正是这项功能被设计出来要确保的行为,每一次都是如此,而不仅仅是在有人恰好测试过的那些问题上。

关于这篇文章所属的更大专题,请从 Rexfin 产品导览开始阅读。

所属专题 Rexfin 产品导览:每一个数字都可追溯

继续阅读

预约演示

亲眼看到您的数字对得上账。

预约一场 30 分钟的演示。带上一个您总是无法快速回答的问题,我们将基于真实财务数据现场为您建模。