Binnen Basecamp Research, de AI-startup die evolutie omzet in trainingsdata
Het AI-team Qwen van Alibaba heeft Qwen-Audio-3.1 uitgebracht, een reeks van vijf modellen voor spraakherkenning (ASR), tekst-naar-spraak (TTS) en realtime interactie. Het ASR-model verbetert de herkenning van meerdere talen en dialecten en ruimt automatisch opvulwoorden en herhalingen op. ASR-Next voegt identificatie van meerdere sprekers met timestamps toe en detecteert emoties, omgevingsgeluiden en machinegeluid. TTS verzorgt meertalige synthese […] Het artikel Alibaba lanceert Qwen Audio 3.1 met nieuwe modellen en verlaagt
🔗 lees originele bron