Una telefonata apparentemente impossibile da ignorare, una voce familiare che ordina bonifici urgenti e riservati, un canale di comunicazione informale come WhatsApp: questi sono gli ingredienti della truffa da circa 95 milioni di euro che ha colpito Banca Fideuram nel febbraio del 2026, portando alla luce quanto la truffa voice cloning WhatsApp sia diventata una minaccia concreta e devastante anche per i vertici del sistema bancario italiano. La notizia, emersa pubblicamente a settembre 2026, ha scosso il mondo della finanza e riaperto un dibattito urgente: nessuno, nemmeno chi dovrebbe sapere tutto sui rischi digitali, è immune.
Cosa è successo a Fideuram: la ricostruzione
La vittima è Paolo Molesini, ex presidente di Fideuram, istituto che fa parte del gruppo Intesa Sanpaolo. Secondo quanto riportato dalle fonti, tutto è partito da un messaggio WhatsApp che sembrava provenire da Carlo Messina, amministratore delegato di Intesa Sanpaolo. Il messaggio era costruito per sembrare autentico: tono autorevole, contesto plausibile, urgenza calibrata. Un primo contatto pensato per abbassare le difese e instaurare un clima di fiducia.
Ma il colpo decisivo è arrivato con una telefonata. I truffatori hanno utilizzato la tecnologia di voice cloning — la clonazione della voce tramite intelligenza artificiale — per impersonare una figura di autorità in una chiamata di follow-up. La voce sintetizzata era sufficientemente convincente da indurre Molesini ad autorizzare una serie di bonifici. In totale, sono stati disposti trasferimenti fraudolenti per circa 95 milioni di euro. Di questi, circa 36 milioni di euro risultano ancora non recuperati.
È una sequenza che gli esperti di sicurezza informatica definiscono multi-vector social engineering: si parte da un canale testuale informale, si consolida la credibilità con un secondo canale vocale, e si spinge la vittima ad agire prima che possa verificare. Il tutto in un contesto dove la pressione gerarchica — un presunto ordine dall’AD del gruppo — rende psicologicamente difficile mettere in dubbio la richiesta.
Come funziona il voice cloning e perché WhatsApp è il vettore ideale
Il voice cloning è una tecnologia che, partendo da campioni audio di una persona reale — discorsi pubblici, interviste, video — è in grado di generare una voce sintetica quasi indistinguibile dall’originale. Per una figura come Carlo Messina, il materiale audio disponibile pubblicamente è abbondante: conferenze stampa, presentazioni agli investitori, interviste televisive. Bastano pochi minuti di registrazione per addestrare un modello sufficientemente convincente.
👉 Leggi anche: Clonazione vocale: +2137% di truffe digitali, come difendersi dall'audio sintetico
WhatsApp, dal canto suo, offre ai truffatori una serie di vantaggi strutturali. È un canale percepito come personale e diretto, meno formale della posta elettronica aziendale e quindi meno soggetto a filtri di sicurezza istituzionali. Consente di falsificare il numero mittente attraverso tecniche di spoofing o di creare profili con foto e nomi credibili. E soprattutto, crea un senso di intimità e urgenza che abbassa il livello di guardia anche nelle persone più accorte.
La truffa voice cloning WhatsApp non è un fenomeno nuovo a livello internazionale, ma il caso Fideuram rappresenta uno dei casi più gravi mai documentati in Italia per entità economica e per il profilo della vittima. Non si tratta di un utente comune raggirato: si tratta dell’ex presidente di uno dei principali istituti di gestione patrimoniale del Paese.
Il profilo delle vittime: perché anche i vertici sono vulnerabili
Uno degli aspetti più inquietanti di questa vicenda è che smonta un luogo comune rassicurante: l’idea che solo le persone poco avvezze alla tecnologia cadano nelle truffe digitali. Molesini era una figura di primo piano nel mondo bancario, abituata a gestire operazioni complesse e a valutare rischi. Eppure il meccanismo ha funzionato.
Gli psicologi che studiano il social engineering spiegano questo paradosso con il concetto di autorità percepita: quando una richiesta sembra provenire da qualcuno gerarchicamente superiore, il cervello tende a sopprimere il dubbio e ad agire in conformità. Questo meccanismo è ancora più potente quando la voce — con le sue inflessioni, il ritmo, il tono — corrisponde esattamente a quella che ci si aspetta di sentire. La tecnologia di clonazione vocale sfrutta precisamente questa vulnerabilità neurologica.

I dirigenti di alto livello sono, paradossalmente, bersagli privilegiati per diverse ragioni:
- Hanno accesso diretto a strumenti finanziari e possono autorizzare movimenti di denaro senza passare per approvazioni multiple.
- Sono abituati a ricevere comunicazioni riservate e urgenti, il che rende meno sospetta una richiesta inusuale.
- Il loro profilo pubblico — voce, immagine, relazioni — è ampiamente documentato online, facilitando la costruzione di scenari credibili.
- Spesso operano in contesti ad alta pressione, dove la velocità decisionale è valorizzata rispetto alla verifica sistematica.
La risposta del sistema bancario e le misure di prevenzione
Il caso Fideuram sta accelerando una riflessione già in corso nel settore bancario italiano sulla necessità di protocolli di verifica più robusti per le operazioni di importo elevato. Il problema non è solo tecnologico: è procedurale e culturale.
👉 Leggi anche: Cash trapping al bancomat: la nuova truffa della "linguetta" e come riconoscerla
Sul fronte tecnologico, alcune istituzioni stanno valutando l’adozione di sistemi di autenticazione multifattore anche per le comunicazioni interne, e di strumenti di deepfake detection capaci di analizzare in tempo reale le chiamate vocali e segnalare anomalie. Tuttavia, la corsa tra chi sviluppa queste tecnologie di rilevamento e chi perfeziona il voice cloning è continua, e non è detto che la difesa tenga il passo con l’attacco.
Sul fronte procedurale, la lezione più immediata che si può trarre è la necessità di verifiche fuori banda (out-of-band verification): qualsiasi richiesta di bonifico significativa, indipendentemente da chi sembri provenire, dovrebbe essere confermata attraverso un canale separato e precedentemente concordato — una chiamata su un numero di telefono fisso registrato, un sistema interno certificato, un incontro di persona. Non WhatsApp, non una chiamata su un numero sconosciuto.
Alcune banche europee stanno anche introducendo parole d’ordine riservate tra dirigenti, da usare nelle conversazioni sensibili per autenticare reciprocamente l’identità. È una misura apparentemente semplice, ma efficace proprio perché non replicabile da un sistema di intelligenza artificiale che non conosce quel codice.
Un campanello d’allarme per l’intero sistema finanziario
Il caso Fideuram non è un episodio isolato destinato a restare nella cronaca di settembre 2026 come una curiosità. È un segnale che la convergenza tra intelligenza artificiale generativa, ingegneria sociale e canali di comunicazione informali ha raggiunto un livello di sofisticazione tale da mettere a rischio anche le istituzioni più solide. La truffa voice cloning WhatsApp ai danni di Paolo Molesini dimostra che il fattore umano rimane la vulnerabilità più difficile da correggere, e che nessuna posizione di potere o esperienza professionale costituisce, da sola, una protezione sufficiente.
Per approfondire la dinamica tecnica e le raccomandazioni ufficiali in materia di frodi digitali, l’articolo di RaiNews offre una ricostruzione dettagliata dell’intera vicenda.
Con 36 milioni di euro ancora da recuperare e un’indagine in corso, questa storia è tutt’altro che chiusa. E mentre gli inquirenti lavorano, il mondo bancario — e non solo — ha già iniziato a fare i conti con una domanda scomoda: se può succedere al presidente di Fideuram, chi può davvero ritenersi al sicuro?
Questo articolo è stato realizzato con il supporto dell'AI e sottoposto a revisione editoriale.
