Wan 2.7 Reference to Video
wan2.7-r2v
Wan 2.7 Reference to Video адаптирует генерацию видео Wan по референсам для международных рабочих процессов. Она полезна для сохранения визуальной идентичности в кросс‑рыночных творческих черновиках.
Эндпоинты
POST /v1/queue/wan2.7-r2v # Создать задачуGET /v1/queue/wan2.7-r2v/requests/{request_id}/status # Проверить статусGET /v1/queue/wan2.7-r2v/requests/{request_id}/response # Получить результатPUT /v1/queue/wan2.7-r2v/requests/{request_id}/cancel # Отменить задачу
Параметры запроса
Заголовок раздела «Параметры запроса»curl --location "https://api.odirouter.ai/model/v1/queue/wan2.7-r2v" \ --header "Authorization: Bearer YOUR_API_KEY" \ --header "Content-Type: application/json" \ --data '{ "input": { "prompt": "Image 1 character walks through a warm studio scene with consistent appearance.", "media": [ { "type": "reference_image", "url": "https://xxx/character.png" } ] }, "parameters": { "resolution": "1080P", "ratio": "16:9", "duration": 5, "prompt_extend": true, "watermark": false, "seed": 12345 } }'Основная входная информация, например промпты.
Текстовый промпт, описывающий ожидаемые элементы и визуальные особенности в генерируемом видео.
Поддерживаются китайский и английский языки. Каждый китайский иероглиф, буква или знак пунктуации считается одним символом. Содержимое сверх лимита автоматически обрезается.
Ограничение длины: до 5000 символов.
Обозначение референсов: в английских промптах изображения обозначаются как Image 1, Image 2, а видео как Video 1, Video 2. Между английским словом и числом ставится пробел, первая буква заглавная. Порядок соответствует массиву media. Изображения и видео считаются отдельно.
Если есть только одно референсное изображение или одно референсное видео, можно упростить формулировку до reference image или reference video.
Описание сцены: можно напрямую использовать обозначения, например Image 1 plays in Image 2, или добавить субъект и сцену, например the cat from Image 1 plays in the room from Image 2.
Если референсное изображение является многокадровой storyboard-картинкой, описывайте ключевые кадры в многошотной форме. Модель автоматически распознает логику панелей и дополнит содержание кадров. Для лучшего результата используйте только одну storyboard-картинку за запрос.
Негативный промпт, описывающий то, что не должно появляться в кадрах видео. Он позволяет ограничивать видеоряд.
Поддерживаются китайский и английский языки. Максимальная длина — 500 символов. Содержимое сверх лимита автоматически обрезается.
Пример: низкое разрешение, ошибки, худшее качество, низкое качество, неполные детали, лишние пальцы, плохие пропорции и т. д.
Массив медиа-материалов. Материалы включают изображения, видео и аудио. Изображения или видео могут использоваться как визуальные референсы; изображения поддерживают multi-view референсы для персонажей, реквизита и сцен.
Каждый элемент массива — объект медиа с полями type и url.
Порядок массива задает порядок ссылок на роли в prompt. Изображения и видео считаются отдельно, поэтому Image 1 и Video 1 могут существовать одновременно.
Первый reference_video в массиве соответствует Video 1, второй — Video 2 и так далее.
Первый reference_image в массиве соответствует Image 1, второй — Image 2 и так далее.
Тип медиа-материала.
Возможные значения: reference_image — референсное изображение для субъекта и сцены; reference_video — референсное видео для субъекта и тембра голоса; first_frame — изображение первого кадра.
Для first_frame: если целевой субъект уже есть в первом кадре, можно добавить референсы субъекта для усиления консистентности или указать тембр голоса. Если целевого субъекта нет в первом кадре, референсы субъекта задают признаки субъекта, который появится в динамике видео.
Ограничения материалов: максимум 1 изображение первого кадра; минимум 1 референсное изображение или референсное видео; reference_image + reference_video ≤ 5; если референс является субъектом, он должен содержать только одну роль.
URL медиа-материала. Каждое значение может указывать на изображение или видео.
Передача референсного изображения (type=reference_image): URL референсного изображения или данные Base64. Изображение может быть субъектом или фоном. Если оно содержит субъект, должен быть только один персонаж.
Ограничения изображений: форматы JPEG, JPG, PNG без прозрачного канала, BMP, WEBP; ширина и высота в диапазоне [240, 8000] пикселей; соотношение сторон 1:8 - 8:1; размер файла не более 20MB.
Форматы ввода изображения: публичный URL по HTTP или HTTPS, например https://xxx/xxx.png; или строка Base64 в формате data:{MIME_type};base64,{base64_data}.
Передача референсного видео (type=reference_video): URL референсного видео. Видео желательно должно содержать субъект; фоновые или пустые видео не рекомендуются. Если оно содержит субъект, должен быть только один персонаж. Если в видео есть звук, можно также использовать тембр голоса.
Ограничения видео: форматы mp4, mov; длительность 1 - 30s; ширина и высота в диапазоне [240,4096] пикселей; соотношение сторон 1:8 - 8:1; размер файла не более 100MB.
Форматы ввода видео: публичный URL по HTTP или HTTPS, например https://xxx/xxx.mp4.
URL аудио для задания тембра голоса субъекта в референсном изображении или видео. Используется вместе с reference_image или reference_video. Это аудио служит только для референса тембра и не связано с содержанием речи.
Для лучшего совпадения рекомендуется, чтобы язык референсного аудио совпадал с языком prompt.
Поведение по умолчанию: если reference_video содержит аудио, а reference_voice не указан, по умолчанию используется оригинальный звук видео.
Приоритет: если одновременно переданы reference_video с аудио и reference_voice, приоритет имеет reference_voice, он заменяет оригинальный звук видео.
Ограничения аудио: форматы wav, mp3; длительность 1 - 10s; размер файла не более 15MB.
Форматы ввода аудио: публичный URL по HTTP или HTTPS, например https://xxx/xxx.mp3.
Параметры обработки видео, например разрешение видео.
Важно: resolution напрямую влияет на стоимость. Перед вызовом API проверьте цену модели.
Уровень разрешения генерируемого видео для управления четкостью через общее число пикселей.
Возможные значения: 720P, 1080P. По умолчанию: 1080P.
Соотношение сторон генерируемого видео.
Если первый кадр не передан, видео генерируется по указанному параметру ratio.
Если первый кадр передан, параметр ratio автоматически игнорируется, а видео генерируется с приблизительным соотношением сторон первого кадра.
Возможные значения: 16:9 (по умолчанию), 9:16, 1:1, 4:3, 3:4.
Важно: duration напрямую влияет на стоимость. Перед вызовом API проверьте цену модели.
Длительность генерируемого видео в секундах. По умолчанию: 5.
Если среди референсных материалов есть видео: целое число в диапазоне [2, 10].
Если среди референсных материалов нет видео: целое число в диапазоне [2, 15].
Включать ли интеллектуальное расширение prompt. При включении большая модель переписывает входной prompt. Для коротких prompt это заметно улучшает результат, но увеличивает задержку.
true: значение по умолчанию, включить расширение prompt.
false: выключить расширение prompt.
Добавлять ли водяной знак. Водяной знак расположен в правом нижнем углу видео, фиксированный текст — «AI生成».
false: значение по умолчанию, не добавлять водяной знак.
true: добавить водяной знак.
Случайное зерно. Диапазон: [0, 2147483647].
Если параметр не указан, система автоматически генерирует случайное зерно. Чтобы повысить воспроизводимость результата, рекомендуется фиксировать значение seed.
Примечание: генерация имеет вероятностный характер. Даже при одинаковом seed полное совпадение результата не гарантируется.
Параметры ответа
Заголовок раздела «Параметры ответа»{ "request_id": "mmsu_01hxyz...", "response_url": "https://api.odirouter.ai/model/v1/queue/wan2.7-r2v/requests/mmsu_01hxyz.../response", "status_url": "https://api.odirouter.ai/model/v1/queue/wan2.7-r2v/requests/mmsu_01hxyz.../status", "cancel_url": "https://api.odirouter.ai/model/v1/queue/wan2.7-r2v/requests/mmsu_01hxyz.../cancel", "queue_position": 0}| Поле | Тип | Описание |
|---|---|---|
request_id | string | Идентификатор задачи для последующей проверки статуса, получения результата и отмены |
response_url | string | URL для получения итогового результата |
status_url | string | URL для проверки статуса задачи |
cancel_url | string | URL для отмены задачи |
queue_position | int | Текущая позиция в очереди |