五项基于规则的检查:盯住你的数字,而不是 AI 的猜测
Rexfin 的完整性扫描对你的实际数据运行五项确定性检查,包括本福特偏差、重复项、整数偏向,并将异常标记出来交由人工判断。没有 AI,没有机器学习。
作者 The Rexfin team
“欺诈”这个词不会出现在 Rexfin 完整性扫描的任何地方,不在结果里,不在文案里,也不在底层检查逻辑里。这是一条刻意设定并经过验证的规则。这项扫描所做的,是标记出值得再看一眼的统计模式:这是一种异常,而不是一项指控。判断异常意味着什么是人的工作;而在一份有上百行的试算表中找到它,才是这项扫描真正发挥价值的地方。
五项检查,全部是算术,没有一处用到 AI
这项扫描对一个工作区的内部实际数据运行五项确定性检查,规格中明确写明的设计约束是:仅基于规则,没有 AI,没有机器学习,没有任何做出判断、且无法复现的模型。
本福特偏差使用卡方检验,将公司级数字的首位数字分布与本福特定律预测的分布进行比较,并设有一个诚实的样本量门槛,数据不足时不给出结论,同时明确注明这只是一个指示性的、科目层面的信号,而非确定性的结论。重复金额检查同一个数值,在相同的科目和部门下,是否在滚动窗口内的两个不同月份出现,但仅适用于损益表类科目,因为资产负债表的结转本来就应该重复出现,同时会排除明显属于周期性安排的项目,例如租金或工资。整数偏向衡量数据集中有多大比例落在 1,000 的整数倍上,比例过高可能意味着估计数字被当作真实数字使用,不过该检查也能识别出某个工作区只是以千为单位报告数据,并会相应地自动跳过。期末集中度检查某个月的活动是否有不成比例的比例集中在最后两天,这是一种典型的操纵迹象,不过目前它在大多数工作区中如实报告自己被跳过,因为它需要日级别的过账日期,而内部实际数据按合同规定是按月提供的。重复行捕捉跨次上传的完全重复项,同时能识别出较新的上传只是在修正较早的记录,属于合法的重述,而不应被标记为重复。
让扫描保持有用而非噪音的防护机制
这些检查如果照搬朴素的实现方式,会在真实工作区中充斥大量误报,比如周期性租金看起来像重复项、一个静止不变的资产负债表科目看起来“没变化”但其实是有原因的、季度性的入职批量上传看起来像重复。这项扫描的防护机制之所以存在,正是因为这些失效模式被专门测试过:检查需要满足最低历史数据量才会给出结论、排除周期性安排的项目,以及在一种特定的边缘情况下,当一家公司的营收在各期间之间可疑地完全相同时,会给出一个带对冲说明的标记,而不是保持沉默,因为持平的营收本身就是一种值得指出的经典平滑模式,只是不需要像真正的重复项那样大声警示。
结果会出现在哪里
这项扫描不会创建一个独立的仪表盘。每一项结果都汇入工作区中已有的、承载其他被标记项的同一条洞察信息流,遵循相同的“新建、已确认、已解决”生命周期,使用相同的界面,并附带触发该结果的具体试算表行作为引用凭证,这样一项结果就不会只是一个空洞的断言。点击进去,会跳转到被标记行所来源的底层KPI 与差异分析视图,而不是一段罐头式的解释。
这项扫描会在试算表上传被确认时自动运行,也可以通过一个受限于编辑者级别权限的“立即运行”操作按需触发,这与管理工作区其余部分的基于角色的访问控制保持一致。公司报表页面上的完整性卡片会显示运行了多少项检查、返回了多少条结果、扫描上一次运行的时间,以及对于任何未能给出结论的检查,会显示诚实的原因,而不是留一片看起来什么都没检查过的空白。
它刻意不做的事
如果底层的实际数据源不可用,各项检查会单独跳过,而不会让整个扫描失败或抛出错误页面,一个存在临时数据缺口的工作区会在受影响的检查上看到“已跳过,来源不可用”,而不是崩溃。目前也存在一个已知且明确指出的缺口:在当前的数据模型下,一次完全替换式的重新上传如果悄悄改变了此前已报告某个月的数值,会被视为一次合法的更正,扫描目前还没有把“这个数字上次看时不一样”作为一项独立的披露呈现出来。这一点被内部标记为一个值得单独设计的真实局限,而不是被掩盖过去。
这适合谁
适合那些希望在一份试算表成为董事会材料依据之前,先获得一次独立的第二遍复核的财务主管,不是取代判断力,而是在判断力之前先行一步;也适合那些曾经因为一笔重复入账,或一个可疑的整数估计悄悄混入一组实际数据而吃过亏的人。想了解完整性结果如何与工作区的其余部分协同运作,请参阅产品导览中心,或预约演示,看一场针对真实试算表的完整性扫描实况运行。