ChatGPT Voice komt dichter bij "Her" met toegang tot e-mail, agenda en Slack
Google introduceert twee nieuwe tekst-naar-spraakmodellen, Gemini 3.8 Flash TTS en Flash-Lite TTS, die meer dan 100 talen ondersteunen. Flash TTS kan nieuwe stemmen creëren op basis van tekstbeschrijvingen, en beide modellen laten gebruikers regie-aanwijzingen aan afzonderlijke zinnen toevoegen en een dialoog met twee stemmen genereren uit één script. Met een stemklonen-functie kan een stemprofiel worden opgebouwd uit een sample van 30 seconden. Het artikel Met Google's nieuwe Flash TTS-modellen ontwerp je AI-stemmen vanaf nul met tekstbeschrijvingen verscheen eerst
🔗 lees originele bron