← Torna alle notizie
SecurityWeek28 Sept 2026 · 2 min di lettura

Modulate raccoglie 25 milioni di dollari per espandere la tecnologia di rilevamento dei deepfake vocali

L'azienda di IA audio Modulate ha raccolto ulteriori 25 milioni di dollari di finanziamenti per espandere una tecnologia progettata per identificare in tempo reale il parlato sintetico, le conversazio...

L'azienda di IA audio Modulate ha raccolto ulteriori 25 milioni di dollari di finanziamenti per espandere una tecnologia progettata per identificare in tempo reale il parlato sintetico, le conversazioni dannose e altri rischi basati sulla voce.

Il round è stato guidato da Future Ventures, con la partecipazione di Hyperplane e Lakestar. Modulate ha dichiarato che l'investimento porta il finanziamento totale a 60 milioni di dollari.

L'azienda sviluppa modelli di IA incentrati sull'audio per la propria piattaforma Velma, pensata per valutare caratteristiche che potrebbero non essere rilevate dalla sola trascrizione testuale. Tali segnali includono tono, emozione, intenzione, comportamento conversazionale e indicatori di parlato generato dall'IA.

Modulate ha dichiarato che il proprio sistema combina oltre 100 modelli specializzati basati sull'architettura Ensemble Listening Model. Secondo l'azienda, la piattaforma elabora oltre 10 milioni di ore di audio al mese e ne ha analizzate complessivamente più di 600 milioni. L'azienda ha inoltre affermato che i suoi modelli di trascrizione e rilevamento dei deepfake hanno ottenuto ottimi risultati nei benchmark pubblici, sebbene tali dichiarazioni non siano state verificate in modo indipendente nell'annuncio.

Focus sull'intervento in tempo reale

La clonazione vocale e altre forme di audio sintetico sono diventate una preoccupazione crescente per le organizzazioni che utilizzano call center, assistenti vocali e sistemi automatizzati di assistenza clienti. I truffatori possono usare voci sintetiche convincenti in schemi di ingegneria sociale, mentre voci alterate o mascherate possono anche complicare gli sforzi di moderazione e verifica dell'identità.

Modulate afferma che Velma è progettata per supportare il rilevamento in tempo reale, consentendo ai clienti di rispondere durante un'interazione anziché dopo aver esaminato una registrazione. Tra i possibili usi citati dall'azienda figurano l'identificazione di frodi abilitate dai deepfake che prendono di mira organizzazioni sanitarie, il rilevamento di molestie o contenuti estremisti sulle piattaforme di comunicazione, la protezione degli utenti vulnerabili da conversazioni di adescamento e la valutazione del comportamento degli agenti di IA vocale.

L'azienda presenta inoltre la tecnologia come un mezzo per aiutare le applicazioni vocali a riconoscere le emozioni e migliorare il modo in cui gli agenti automatizzati rispondono agli utenti. Tali implementazioni potrebbero richiedere un'attenta governance, in particolare quando i sistemi analizzano conversazioni sensibili o prendono decisioni che incidono sugli utenti in tempo reale.

Piani di investimento

Modulate ha dichiarato che utilizzerà il nuovo capitale per ampliare il proprio team e l'infrastruttura, estendere l'offerta di modelli e sviluppare API aggiuntive, kit di sviluppo software, integrazioni e opzioni di implementazione per sviluppatori e partner.

L'amministratore delegato e cofondatore Carter Huffman ha affermato che l'audio richiede un'analisi che vada oltre una trascrizione scritta, in particolare mentre la voce diventa un'interfaccia sempre più comune per i sistemi di IA. Il finanziamento riflette il continuo interesse degli investitori per strumenti destinati a contrastare l'uso improprio dell'IA generativa, incluse capacità di clonazione vocale sempre più accessibili.

Condividi questo articolo:TwitterLinkedIn