Что создаём?
Создание переиспользуемого голоса Gemini Omni из пресета и описания тембра. Полученный голос можно добавить в Gemini Omni Video.
Что умеет Gemini Omni Audio
Gemini Omni Audio создаёт переиспользуемый голос для видеогенерации: выбираете базовый пресет, описываете тембр и характер словами — и получаете ресурс, который закрепляется за вашими персонажами в Gemini Omni Video. Создание бесплатно (от 0 токенов).
Смысл тот же, что у парного инструмента Character, только для звука: голос героя не меняется от ролика к ролику. Ведущий, маскот или рассказчик звучит одинаково во всей серии — это то, что отличает канал с узнаваемым персонажем от набора случайных генераций.
Для чего использовать
- Голос виртуального ведущего. В паре с Gemini Omni Character получается полноценный цифровой персонаж: внешность + голос.
- Фирменное звучание бренда. Маскот говорит одним и тем же тембром в любой рекламе.
- Рассказчик серии. Единый закадровый характер для цикла роликов.
Не путайте с TTS: Gemini Pro/Flash TTS озвучивают текст в аудиофайл, а Omni Audio — это голос, которым персонаж говорит внутри видео Omni Video. Полная связка «Character + Audio → Omni Video» собирается в Flow-конструкторе.
Как получить хороший результат
- Начните с пресета, ближайшего к цели, — описание тембра дорабатывает базу, а не создаёт голос с нуля.
- Описывайте звучание конкретно: темп, высота, характер, удачные сравнения.
- Добавьте пример диалога — реплика в характерном стиле заметно улучшает калибровку.
- Протестируйте голос на коротком ролике перед запуском серии.
Скопируйте и подставьте в форму выше — или измените под свою задачу.
Голос ведущего
Выберите базовый пресет и опишите тембр: "Тёплый мужской баритон, размеренный темп, лёгкая хрипотца, звучит как радиоведущий вечернего эфира". Добавьте пример реплики для калибровки.
Голос маскота
Пресет повыше + описание: "Задорный молодой голос, быстрый темп, всегда на позитиве, слегка мультяшная подача". Пример диалога: "Привет-привет! Сегодня у нас кое-что особенное!"
Голос рассказчика
Спокойный пресет и тембр: "Глубокий женский голос, неторопливый, доверительный, как в аудиокнигах — с мягкими паузами между фразами".
Сколько стоит создание голоса?
От 0 токенов — ресурс создаётся бесплатно. Платите только за генерацию роликов с этим голосом в Gemini Omni Video.
Как создаётся голос?
Выбираете базовый пресет из библиотеки, задаёте имя и описываете желаемый тембр и характер словами; можно добавить пример диалога — по нему модель калибрует подачу.
Зачем отдельный ресурс, если есть TTS-модели?
TTS (Gemini Pro/Flash TTS) озвучивает текст готовыми голосами — это отдельная аудиодорожка. Omni Audio создаёт закреплённый голос персонажа, которым герой говорит прямо в роликах Gemini Omni Video.
Можно ли использовать голос с любым персонажем?
Да — голос и персонаж (Gemini Omni Character) выбираются в форме Omni Video независимо: один голос можно давать разным героям и наоборот.
Что писать в описании тембра?
Пол и возраст звучания, темп, характер: «тёплый», «энергичный», «доверительный», сравнения («как радиоведущий») работают отлично.
Gemini Omni Video
Мультимодальное видео Gemini Omni: промпт, до 7 изображений и опциональный видео-клип. До 10 сек / 4K.
от 158 токенов
Gemini Omni Character
Создание переиспользуемого персонажа Gemini Omni из фото и описания. Полученный персонаж можно добавить в Gemini Omni Video.
от 0 токенов
Gemini 2.5 Pro TTS
Флагманская озвучка от Google: максимальное качество, глубокое понимание эмоций, темпа и стиля. 30 голосов, inline-теги эмоций.
~от 3 токенов/100 симв.