A Google szöveges leírásból tervezhető hangokat ad a Flash TTS modellekben
🤖 AI-generált tartalom — A címet és az összefoglalót mesterséges intelligencia készítette automatikusan, emberi szerkesztői átnézés nélkül.
A Google két új szövegfelolvasó modellt mutatott be: a Gemini 3.8 Flash TTS és a Flash-Lite TTS több mint 100 nyelvet támogat, szöveges leírásból új hangokat tervezhetnek, sornkénti színpadi utasításokat adhatnak, és egyetlen szkriptből két hangos párbeszédet generálhatnak. Egy 30 másodperces mintából klónozható a hang, ha a tulajdonos beleegyező nyilatkozatot ad; minden klipe hallhatatlan SynthID vízjelet kap. A Voice Remixing funkció még nem érhető el.
Folytasd az appban — szavazz és szólj hozzá ➔Forrás: The Decoder (AI) · innen ahirlevel.hu