Какое видео создаём?
Wan 2.7 Reference-to-Video: видео по референсам изображений и видео с сохранением внешности и голоса. До 10 сек в 1080p.
Что умеет Wan 2.7 R2V
Wan 2.7 R2V (референс-в-видео) решает главную боль AI-видео — консистентность персонажей. Загрузите референсные изображения и видео героя, и модель сгенерирует новую сцену до 10 секунд в 1080p, сохранив его внешность. Уникальная возможность — референс голоса: персонаж в ролике будет звучать как в загруженном аудио.
В отличие от классических текст-в-видео моделей, где каждый запуск рождает нового «актёра», R2V позволяет снимать целые серии с одним героем: реклама с постоянным маскотом, эпизоды с одним персонажем, продуктовые ролики с узнаваемым товаром.
Когда выбирать Wan 2.7 R2V
- Серии с одним персонажем. Один набор референсов — одинаковая внешность во всех роликах.
- Голос героя. Референс-аудио сохраняет тембр и манеру речи — редкая возможность даже среди флагманов.
- Референсы-видео. Кроме картинок можно загрузить видео: модель считает с него и внешность, и пластику движения.
- Точный старт сцены. Опциональный первый кадр фиксирует композицию начала ролика.
Если нужно просто оживить один кадр — достаточно Wan 2.7 I2V, он проще. Сами референсы удобно готовить в Wan 2.7 Image: сгенерируйте персонажа в нескольких ракурсах и передайте в R2V — в App Flow это делается в пару кликов через Flow-конструктор.
Как получить хороший результат
- Давайте несколько референсов с разных ракурсов — так модель надёжнее удержит внешность.
- В промпте ссылайтесь на героя референсов и описывайте новую сцену: действие, окружение, камеру.
- Негативным промптом отсекайте типичные артефакты: искажения лица, лишние конечности.
- Отрабатывайте сцену на коротких роликах в низком разрешении, финал генерируйте в 1080p — посекундная цена делает итерации дешёвыми.
Скопируйте и подставьте в форму выше — или измените под свою задачу.
Персонаж по референсу
The character from the reference images walks through a rainy neon city at night, looks around curiously, camera tracks alongside, reflections on wet asphalt, cinematic mood.
Продукт в новой сцене
The product from the reference photo stands on a marble podium in a bright studio, camera slowly orbits it, soft shadows, premium commercial style, light particles in the air.
Сцена с голосом
The woman from the references sits at a cafe table and talks to the camera in her reference voice, natural gestures, warm afternoon light, shallow depth of field.
Сколько стоит генерация в Wan 2.7 R2V?
От 40 токенов за секунду видео — цена зависит от длительности и разрешения и показывается в форме до запуска. Оплата токенами по факту, без подписки.
Что такое R2V?
Reference-to-Video — «референс-в-видео»: вы загружаете изображения и видео с персонажем или объектом, а модель генерирует новую сцену, сохраняя внешность. Можно добавить и референс голоса.
Какие референсы принимает модель?
Изображения, видео, первый кадр сцены и аудио с голосом. Комбинируя их, вы фиксируете внешность персонажа, манеру движения и звучание речи.
Какая длительность и качество?
До 10 секунд в 1080p, соотношение сторон и разрешение выбираются в форме.
Чем R2V отличается от Wan 2.7 I2V?
I2V анимирует конкретный кадр — сцена начинается ровно с вашей картинки. R2V строит полностью новую сцену, беря из референсов только внешность и голос. Для серий роликов с одним героем нужен именно R2V.
Как сохранить одного персонажа в серии роликов?
Используйте один и тот же набор референсов в каждой генерации — модель будет воспроизводить ту же внешность. Референсы удобно подготовить в Wan 2.7 Image и вести всю цепочку через Flow-конструктор App Flow.
Wan 2.7 I2V
Wan 2.7 Image-to-Video: анимация первого/последнего кадра с опциональным драйвинг-аудио. До 15 сек в 1080p.
~от 40 токенов/сек
Wan 2.7 T2V
Флагман Wan 2.7: текст + опциональный аудиотрек.
~от 40 токенов/сек
Wan 2.7 Image
Генерация и редактирование изображений от Wan 2.7. Поддерживает до 9 входных изображений, thinking mode и цветовую палитру.
от 13 токенов/изображение