🎧 NVIDIA presenta Audio Flamingo: il nuovo modello di linguaggio per la comprensione audio
Il team di ricerca NVIDIA ha presentato Audio Flamingo, un modello di linguaggio audio che sfrutta l'apprendimento contestuale, la generazione aumentata di recupero e le capacità di dialogo multigiro, ottenendo prestazioni all'avanguardia nella comprensione audio.
L'architettura di Audio Flamingo comprende un estrattore di funzionalità audio, livelli di trasformazione della rappresentazione audio, un modello linguistico di solo decodifica e livelli ad alta densità xattn.
Il modello è stato valutato su diversi benchmark, superando i sistemi precedentemente all'avanguardia e dimostrando significativi miglioramenti nelle attività di dialogo. Il team intende rendere open-source sia il codice di addestramento che quello di inferenza per Audio Flamingo, con una demo disponibile online.
#AIInsights - by @UAITales
Post #3577
19.1K