Riconoscimento vocale
Migliorare la qualità, la robustezza e l'adattamento al dominio degli ASR multilingue in condizioni rumorose.
Area di ricerca
Sviluppiamo sistemi vocali, IA conversazionale e interfacce native per la voce attraverso ricerche su pipeline a bassa latenza, gestione delle interruzioni, riconoscimento robusto e generazione di risposte naturali in ambienti reali.
Pilastri principali della ricerca
Migliorare la qualità, la robustezza e l'adattamento al dominio degli ASR multilingue in condizioni rumorose.
Progettare meccanismi di turn-taking, mantenimento del contesto e strategie di dialogo per interazioni parlate naturali.
Costruire sistemi TTS espressivi, controllabili e a bassa latenza per l'uso in produzione.
Ottimizzare la latenza end-to-end, l'affidabilità dello streaming e l'elaborazione vocale consapevole delle interruzioni.
Creare modelli di interazione incentrati sulla voce per assistenti, strumenti ed esperienze intelligenti integrate.
Focus attuale
Collabora con OpenQCore Research per sviluppare sistemi di intelligenza vocale affidabili, naturali e scalabili.