CARREGANDO O RADAR…
Noise Adaptive Streaming Audio-Visual Speech Token Enhancement for Robust Full-Duplex Spoken Dialogue Models | Radar arXiv · portela.dev