Vai al contenuto
Novità: chiedi al Rexfin Analyst Agent del tuo modello. Ogni cifra torna con la sua fonte.
← Risorse

Risorse

Il livello di affidabilità di cui l'AI ha bisogno prima di toccare i vostri numeri

L'AI ha allucinazioni sulle cifre e non riesce a fare aritmetica in modo affidabile. La soluzione non è un modello più intelligente. È un modello finanziario riconciliato da cui l'AI recupera dati e su cui calcola.

Chiedete a un modello frontier quanto fa 4.182.019 per 7.431. Risponderà all’istante, con totale sicurezza, e probabilmente sbaglierà. Non un errore di arrotondamento. Sbaglierà di qualche centinaio di migliaia, presentato come se venisse da una calcolatrice.

Ora immaginate lo stesso modello mentre risponde a una domanda del board sul vostro andamento del margine lordo su tre entità, due valute e un cambio di piano dei conti a metà anno. Risponderà con la stessa sicurezza. E voi non avete un modo rapido per capire se il numero è reale o inventato.

Quel divario, tra quanto suona sicura l’AI e quanto è realmente affidabile la sua matematica, è l’intero problema. Ed è anche il motivo per cui la maggior parte dei team finance che ha provato ad aggiungere un chatbot sopra i propri numeri ha smesso di usarlo in silenzio.

Il modello non è il collo di bottiglia

C’è un riflesso, oggi, nella leadership finance, di dare per scontato che la prossima versione del modello risolva il problema. Non lo farà, almeno non nel modo in cui la gente spera, perché il fallimento non è una lacuna di conoscenza. È architetturale.

I modelli linguistici non calcolano. Predicono il token successivo in base a schemi nel testo. I numeri vengono spezzettati in pezzi che il modello non riassembla mai in una quantità su cui può operare. Quindi quando un LLM “fa i conti”, in realtà sta facendo pattern-matching su come tende ad apparire la risposta a un problema dall’aspetto simile. Sulle somme piccole e comuni ci azzecca perché le ha viste un milione di volte. Spingetelo verso un’aritmetica più grande o meno familiare e l’accuratezza crolla. I ricercatori hanno documentato esattamente questo tipo di collasso: quasi perfetto sui casi facili, quasi inutile su quelli più difficili, senza alcun avviso nel mezzo.

Quest’ultimo punto è ciò che dovrebbe preoccupare un CFO. Il modello non diventa più cauto quando è incerto. È ugualmente fluente quando ha ragione e quando sta inventando. Approfondiamo i meccanismi in perché la vostra AI sbaglia i numeri, ma la versione breve è: un modello più eloquente non è un modello più accurato.

Quindi, se al modello non ci si può affidare per l’aritmetica, a cosa serve davvero l’AI in finanza? A molto. Leggere una domanda in linguaggio semplice. Sapere quali cifre contano. Spiegare una varianza come farebbe un analista acuto. Redigere il commento. Sono compiti linguistici, ed è esattamente per questo che questi sistemi sono stati costruiti. Il calcolo è la parte che va tolta loro.

Perché anche “basta dargli i nostri dati” non funziona

Il secondo istinto comune è il retrieval. Collegare il modello ai vostri dati finanziari reali così che smetta di indovinare. È la direzione giusta, ma non basta da sola.

La retrieval-augmented generation può dirvi da dove viene un numero. Non può dirvi se l’aritmetica sopra quel numero è corretta, o se i dati sottostanti quadrano. Puntate un sistema di retrieval su un libro mastro disordinato e tre fogli di calcolo esportati e otterrete risposte veloci, ben citate, costruite su cifre che non erano mai state riconciliate in primo luogo. Sicure di sé, con fonti, e comunque sbagliate. Il retrieval ingenuo tende a raggiungere un plateau ben al di sotto dell’accuratezza che un team finance sarebbe disposto ad approvare. Analizziamo questo limite in Il RAG per la finanza non basta.

Sotto tutto questo c’è un punto strutturale più ampio, e il MIT gli ha dato un numero. Uno studio del 2025 ampiamente citato ha rilevato che la stragrande maggioranza dei progetti pilota di GenAI aziendale non ha prodotto alcun impatto misurabile sul risultato economico. In finanza in particolare, ciò che manda in crisi i progetti pilota è raramente il modello. È che i dati non erano mai stati in uno stato su cui qualsiasi sistema potesse ragionare in modo pulito. I numeri vivevano in strumenti diversi, con tempistiche diverse, sotto definizioni diverse di “ricavi”. Nessuna riconciliazione, nessuna fonte di verità condivisa. Analizziamo cosa significa questo per i team finance in il problema del 95%.

Lo schema in tutto questo è sempre lo stesso. Prompt più intelligenti, finestre di contesto più ampie, modelli più recenti: nulla di tutto ciò corregge una base che non è mai stata costruita. Dovete costruire quella base.

Cos’è realmente il livello di affidabilità

Ecco l’architettura che regge. Tre compiti, tenuti rigorosamente separati, così che ciò che è bravo con il linguaggio non si trovi mai ad occuparsi di ciò che deve essere esatto.

Un unico modello riconciliato sotto. Prima che qualsiasi AI entri in gioco, estraete i dati da dovunque risiedano, QuickBooks, Xero, NetSuite, Sage, un data warehouse o estratti conto caricati, e li risolvete in un unico modello finanziario che quadra con il libro mastro. Un’unica definizione per ogni metrica. Un unico insieme di cifre coerenti tra loro. È la parte che tutti vogliono saltare ed è la parte da cui dipende tutto il resto.

Un motore deterministico per la matematica. Quando una domanda richiede un calcolo, l’aritmetica viene eseguita in un vero motore di calcolo, non nella “testa” del modello. Gli stessi input producono lo stesso output ogni volta. Sommare una colonna, costruire un rapporto, far scorrere una previsione, eseguire un what-if: tutto calcolato, non predetto. L’LLM propone cosa calcolare. Non calcola mai.

Ogni cifra risale alla fonte. Qualsiasi numero riportato dal sistema può essere ricondotto ai registri sottostanti e al percorso di calcolo esatto che lo ha prodotto. Non “fidatevi di me”. Cliccate, e vedete da dove viene. Questo è ciò che trasforma una risposta dell’AI in qualcosa che potete presentare a un board o a un auditor.

Fate bene questi tre elementi e il ruolo dell’AI cambia. Diventa l’interfaccia e l’analista, seduta sopra numeri già riconciliati e sempre ricalcolati in modo deterministico. Il modello gestisce il significato. Il motore gestisce la matematica. Il livello del modello gestisce la verità.

Questo è esattamente ciò che la piattaforma di Rexfin è costruita per essere, e come funziona illustra il flusso dall’inizio alla fine.

Notate cosa manca deliberatamente da questo elenco: un passaggio in cui all’AI viene affidata la risposta. Il modello non detiene mai la cifra. La richiede, il motore la calcola sul modello riconciliato, e il risultato torna indietro con la sua tracciabilità allegata. Quella separazione è l’intero punto. È anche il motivo per cui questo approccio degrada in modo controllato. Quando il modello è incerto, il caso peggiore è una frase vaga, non un numero inventato, perché produrre i numeri non è mai stato compito del modello.

Dove sta andando tutto questo: gli agenti

Il motivo per cui questo conta sempre di più ogni trimestre è l’autonomia. La conversazione si sta spostando dall’AI che risponde quando interpellata verso agenti che agiscono, rielaborano previsioni per conto proprio, segnalano una violazione del covenant prima che lo facciate voi, attivano uno scenario quando un numero si muove. La maggior parte dei CFO si aspetta un uso di routine di agenti finance entro pochi anni.

Un agente che agisce su una cifra allucinata non commette un unico errore silenzioso. Amplifica l’errore a velocità macchina e lo propaga nella decisione successiva. L’autonomia alza la posta in gioco sulla base, non la abbassa. Non potete automatizzare in sicurezza sopra numeri che non potete verificare. Il livello riconciliato e tracciabile non è un vantaggio accessorio per l’era agentica. È la precondizione.

I limiti onesti

Questo non è magia, e fingere il contrario sarebbe esattamente l’eccesso di sicurezza contro cui stiamo mettendo in guardia. Se i vostri dati sorgente sono realmente inutilizzabili, un livello di riconciliazione fa emergere i conflitti, non inventa un accordo che non esiste. I casi limite in configurazioni multi-entità disordinate hanno ancora bisogno di una persona che prenda la decisione. E il livello linguistico può comunque formulare una spiegazione in modo goffo anche quando il numero dietro di essa è esatto.

Ciò che garantisce è la cosa che conta davvero: la cifra è reale, quadra con la fonte, e potete dimostrarlo. L’affidabilità non consiste nel far suonare l’AI degna di fiducia. Consiste nel rendere la fiducia verificabile. Sono problemi diversi, e solo uno dei due vale la pena risolvere.

Il messaggio finale è netto. Non aspettate un modello abbastanza intelligente da meritare fiducia con i vostri numeri, perché la fiducia non nasce dal modello. La fiducia nasce dal livello sottostante. Costruite prima quello, e l’AI in finanza smette di essere una demo che impressiona e inizia a essere qualcosa su cui scommettereste una riunione del board.

Se volete vedere numeri verificabili e tracciabili alla fonte che operano su un libro mastro reale, prenotate una demo e portate una domanda che fareste davvero al vostro team.

In questo percorso

Loop animato: le cifre di un documento vengono estratte e ciascuna viene ricondotta alla propria citazione.

Prenota una demo

Guarda i tuoi numeri quadrare.

Prenota una demo di 30 minuti. Porta una domanda a cui non riesci mai a rispondere abbastanza in fretta: la modelleremo dal vivo su dati finanziari reali.