Toggle Poster Visibility
Oral
Fri Jul 23 02:00 AM -- 02:20 AM (CEST)
Global Prosody Style Transfer Without Text Transcriptions
[ Paper ]
Spotlight
Fri Jul 23 02:20 AM -- 02:25 AM (CEST)
SoundDet: Polyphonic Moving Sound Event Detection and Localization from Raw Waveform
[ Paper ]
Spotlight
Fri Jul 23 02:25 AM -- 02:30 AM (CEST)
EfficientTTS: An Efficient and High-Quality Text-to-Speech Architecture
[ Paper ]
Spotlight
Fri Jul 23 02:30 AM -- 02:35 AM (CEST)
Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech
[ Paper ]
Spotlight
Fri Jul 23 02:35 AM -- 02:40 AM (CEST)
Learning de-identified representations of prosody from raw audio
[ Paper ]
Spotlight
Fri Jul 23 02:40 AM -- 02:45 AM (CEST)
UniSpeech: Unified Speech Representation Learning with Labeled and Unlabeled Data
[ Paper ]
Spotlight
Fri Jul 23 02:45 AM -- 02:50 AM (CEST)
You Only Sample (Almost) Once: Linear Cost Self-Attention Via Bernoulli Sampling
[ Paper ]
Successful Page Load