Google nagpakita sa Gemini 3.1 Flash TTS.

Google's pinakabag-ong text-to-speech nga modelo gidisenyo aron maghimo og mas natural, ekspresibo ug makustomisang mga tinuig nga gihimo sa AI.
Naghatag usab kini og mas dako nga kontrol sa mga user kung paano ipadala ang mga tingog, lakip na ang tono, paspasan, ug estilo.
Usa sa mga nag-unang feature mao ang pagdugang og 'audio tags.' Kini nagtugot sa mga user nga ayohon kung unsaon pagsulti sa AI pinaagi sa pagdugang lang og mga instruksyon sa teksto, sama sa pagbag-o sa emosyon, bilis o aksen.Aron matubag ang mga kahadlok bahin sa nilukop nga sulod gikan sa AI, tanan nga tingog nga gihimo gamit ang modelo naglakip og tago nga SynthID watermark nga nag-ila niini isip gihimo sa AI.
0 Comments
Leave a Reply