IT之家 9 月 23 новини, 谷歌会日оголошено,Gemini 家家 нові дві нові версії нової версіїПерехід від статичних налаштувань до динамічної творчої студіїможе допомогти творцям, розробникам і підприємствам створювати більш насичений і виразний звук.

Дві моделі відповідно Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTSпозиціонування інше:
-
Gemini 3.8 Flash TTS: Для глибокого творчого керівництва та дизайну персонажа ви можете створити новий голос з нуля за допомогою природних мовних сигналів, надати персонажу життєвої сили в іграх, захоплюючому аудіочитанні, трансляції та інтерактивних медіа, а також точно налаштувати сигнали виконання, ритм і переклад.
-
Gemini 3.8 Flash-Lite TTS: Оптимізовано для масштабних сценаріїв великої ємності, високої продуктивності, дубляжу великої ємності, створення аудіовмісту та потужного представлення голосу
За даними IT之家电影Q, користувачі можутьВід 原有30 种去电识语手机在图像语语库До особливостей моделі відносяться:
-
电影式语语电影: ви можете використовувати підказки природною мовою, налаштовувати символи, 口音 і характеристики голосу понад 100 мовами та створювати власний голос із самого початку.
-
Розширена голосова бібліотека: ви можете отримати доступ до понад 2000 видів голосу, що охоплює широкий спектр мов, включаючи мексиканську іспанську, 魁北克法语, 苏格兰英語 тощо.
-
Відтворення голосу: лише 30 секунд аудіо зразків можна використовувати для відповідності характеристикам голосу, а вбудований ідентифікатор перевірки Synth ID використовується для захисту розробників і голосових талантів.
-
Зберігайте та розширюйте: Ви можете зберігати та керувати своїм власним голосом, щоб підтримувати послідовність у безперервному проекті
-
Голос: незабаром буде випущено, користувачі зможуть вибрати голос із голосової бібліотеки, точно налаштувати колір звуку, висоту, ритм і голос, а також використовувати функцію налаштування функцій.
Після вибору звуку можна використовувати дві моделі TTS电影手机手机可以行台词的演视机:
-
逐行 посібник із продуктивності:Користувачі можуть підготувати власні сценічні інструкції або дозволити Gemini керувати доставкою за допомогою природних підказок сценарію, незалежно від того, чи це спокійне обслуговування клієнтів, чи стримана напружена сцена.
-
长篇 створено:Зберігає високу якість голосу, природний ритм і колір звуку характеру протягом декількох годин безперервного аудіо, динамік дуже маленький, підходить для трансляцій і читання.
-
Оригінальна звукова сцена:Він може легко керувати кількома діалогами з одного сценарію, зберігаючи при цьому два голоси чітко розділеними.
-
Сценарій звуку вибуху та фонового зворотного зв’язку:Не можна додати до немовних підказок (如
、 、 ) і взяти на себе ініціативу, щоб вставити мову (如 mhm або так), щоб досягти точної 喜剧 машини часу та ритму реакції, 增添逼真电影质感.
з точки зору продуктивності,Gemini 3.8 Flash TTS У контрольному тесті дизайну голосу Hume AI (71,4 分) загальне перше місце, 60. (8 分) також займає лідируючу позицію.
Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS здатний досягти реальної продуктивності без шкоди для надійностізаймаючи перше і друге місце в загальному індексі якості Hume AI, порівняно з Gemini 3.1 Flash TTS, є значні покращення у довгоформатному вмісті та управлінні подвійним динаміком у широкому діапазоні випадків використання.
У сліпому людському оцінюванні Voice Arena Gemini 3.8 Flash і Flash-Lite TTS лідирують серед конкурентів на основних мовах (японській, бразильській португальській, в’єтнамській, сучасній стандартній арабській, мексиканській іспанській та 印地语). Завдяки підтримці понад 100 мов ці моделі можуть допомогти творцям, розробникам і компаніям створити високоякісну багатомовну голосову систему по всьому світу.
Google запровадив суворі заходи захисту у своїй функції створення та копіювання голосу, щоб допомогти захистити талант голосу, поважати особистість і забезпечити прозорість вмісту.Користувачеві необхідно надати голос власника та погодитися на запис.
Модель Gemini Audio генерує кожен аудіокліп都是 SynthID 水印Його важко виявити, і він безпосередньо вплетений в аудіовихід, щоб забезпечити виявлення мовлення, створеного штучним інтелектом, і допомогти запобігти неправдивій інформації.
即日起,розробники можуть випробувати ці нові функції створення голосу в Google AI Studio. Користувачі можуть створити новий голос або скопіювати свій власний голос, запропонувавши їм почати з початку, а потім поставити їх безпосередньо в подвійний динамік.
两博客成均已向资源推送,можна використовувати в API Gemini та Google AI Studio;для корпоративних користувачів,запущено 徆mini Enterprise中华API;для всіх користувачів,Gemini 3.8 Flash TTS можна використовувати в Gemini Notebook,Gemini 3.8 Flash-Lite TTS можна використовувати в Google Vids
Слід зазначити, що відтворення голосу AI Studio доступне в