
wan-3.0-videoWan 3.0 (Ваньсян 3.0) — универсальная видеомодель Alibaba: одно имя модели закрывает text-to-video, image-to-video по первому или по первому и последнему кадру, а также «омни-референсную» генерацию по 10 референсным изображениям, 5 видеофрагментам и 5 аудиофрагментам — либо сразу по документу (PPTX, DOCX, XLSX, PDF, TXT, MD, до 50 страниц) или публичной веб-странице. На выходе — единый план длиной до 30 секунд при 30fps с синхронной звуковой дорожкой (её можно отключить, цена не меняется). Разрешения 480P / 720P / 1080P, шесть соотношений сторон. В омни-режиме промпт обращается к материалам по номеру («человек из видео 1 держит предмет с рисунка 3»), так что несколько персонажей и реквизит остаются согласованными внутри одного кадра. Оплата посекундная: 480p $0.045/с, 720p $0.09/с, 1080p $0.18/с. Референсные изображения, аудио, документы и веб-страницы не тарифицируются, но за референсное ВИДЕО (монтаж, продление, замена лица) оплачиваются и его секунды — длительность входного видео плюс длительность результата, как и у поставщика, где для таких задач действует ограничение «вход + выход ≤ 30 секунд». Режим mode:"prime" — быстрый уровень, дороже за секунду на 51–56% ($0.068 / $0.14 / $0.28): на одинаковой задаче он вернул результат за 58 секунд там, где стандартный шёл 356. Прямой доступ к Alibaba Model Studio требует китайской верификации по паспорту; через apimodels.app нужен только ваш обычный ключ. Своего слоя модерации мы не добавляем: промпты и референсные материалы идут насквозь, без изменений. Это не значит, что фильтра нет: встроенные механизмы безопасности самой модели работают и на практике срабатывают регулярно — проверяется и то, что вы отправили, и то, что получилось, а референсы с лицами реальных людей отклоняются часто. Проверять результат и отвечать за соблюдение закона и правил вашего собственного сервиса — ваша задача; снимайте только тех людей, которые дали на это согласие.
Prompt only
Document-to-video (PPTX / DOCX / XLSX / PDF) and web-page-to-video are API-only for now — see /docs/wan-3-0-video.
Generated video will appear here
Provide URLs and click Generate
Единый план до 30 с при 30fps — или передайте duration -1, и модель выберет длину сама
До 10 изображений + 5 видео + 5 аудио; промпт обращается к ним как «рисунок 1», «видео 1»
Передайте PPTX / DOCX / PDF или публичный URL — модель прочитает их и превратит в кадр
От $0.045/с в 480p ($0.09 в 720p, $0.18 в 1080p); картинки, аудио и документы бесплатны, а референсное видео добавляет свои секунды к счёту
mode:"prime" вернул результат за 58 с там, где стандартный шёл 356 с на той же задаче — на 51–56% дороже за секунду
К запуску Wan 3.0 команда Tongyi Wanxiang из Alibaba выпустила руководство для создателей с 64 парами «промпт — клип». Мы перенесли каждый клип на своё хранилище, сохранили каждый промпт дословно и измерили файлы: 64 клипа, 1 112 секунд видео в сумме, у каждого есть синхронная звуковая дорожка. Семнадцать клипов идут все 30 секунд, которые Wan 3.0 допускает в одном плане; пятнадцать — пятисекундные (правки и задания с референс-видео). Сорок девять клипов относятся к уровню 720P (1280×720 или вертикальный аналог), пятнадцать — к уровню 1080P (1920×1072 и похожие). Полный набор, разложенный по типам задач, лежит в нашей библиотеке промптов Wan 3.0; таблица ниже показывает, для чего модель используют по мнению самого издателя.
Распределение важно именно потому, что это взгляд издателя на назначение Wan 3.0. Текст-в-видео и референс по изображению дают половину кейсов, но одно только редактирование видео — это пятнадцать кейсов, столько же, сколько референс по изображению. Документ-в-видео, функция, которой нет ни у одной другой модели на этом сайте, получила пять кейсов, три из них по 30 секунд. На apimodels.app все восемь типов задач проходят через одно имя модели, wan-3.0-video, на том же видеоэндпоинте, что VEO, Kling и Seedance.
| Тип задачи | Кейсов | Длина клипа | Уровень разрешения | На что указывает промпт | Поля API |
|---|---|---|---|---|---|
| Wan 3.0 · Текст в видео | 17 | 15–30 с (12 по 30 с) | 9 × 720P, 8 × 1080P | только промпт | prompt, duration, resolution, aspect_ratio |
| Wan 3.0 · Референс по изображению | 15 | 8–30 с | 10 × 720P, 5 × 1080P | 图1 / 图2 … (до 10 изображений) | reference_image_urls |
| Wan 3.0 · Редактирование видео | 15 | 5–15 с | 14 × 720P, 1 × 1080P | 视频1 = редактируемый клип | reference_video_urls |
| Wan 3.0 · Документ / веб-страница | 5 | 23–30 с | 5 × 720P | DOCX, PPTX, XLSX или публичный URL | file_url или link_url |
| Wan 3.0 · Референс по аудио | 3 | 15 с | 3 × 720P | 音频1 / 音频2 для голоса или ритма | reference_audio_urls (+ изображения / видео) |
| Wan 3.0 · Референс по видео | 3 | 5 с | 3 × 720P | 视频1 для движения, камеры или эффекта | reference_video_urls (+ изображение) |
| Wan 3.0 · Продление видео | 3 | 10–20 с | 3 × 720P | 视频1 плюс направление продления | reference_video_urls |
| Wan 3.0 · Первый кадр | 3 | 15–30 с | 2 × 720P, 1 × 1080P | @Image1 как кадр номер один | first_frame_url |
По одному кейсу на тип задачи, подобранных так, чтобы каждый показывал свой вид входных данных, к которым обращается промпт. Все промпты ниже — оригинальный китайский текст издателя без правок; клип рядом — тот результат, который руководство опубликовало для этого промпта, а не наша перегенерация. Под каждым клипом есть цифры, чтобы посчитать такое же задание на Wan 3.0 у нас: длина, уровень разрешения, оплачиваемые секунды (вход плюс выход, если участвует референс-видео) и стоимость на стандартном тарифе. Режим prime, быстрый тариф, стоит на 51–56 % дороже за секунду и в нашем замере выдал то же задание за 58 секунд вместо 356.
Читайте промпты ради структуры, а не лексики. Руководство пишет длинные задания как таймлайн, обращается к материалам по номеру слота, помечает звук прямо в предложении и заканчивает каждую правку фразой о том, что не должно измениться. Эти четыре привычки переносятся на любое задание для Wan 3.0, которое вы напишете, на китайском или на русском.
Один промпт на 241 знак держит полный 30-секундный план Wan 3.0: больничный коридор в бледно-зелёном фильтре под холодными лампами, низкая насыщенность, высокий контраст, камера стартует из-за сестринского поста и следует за фигурой в тёмно-зелёном. К запросу ничего не приложено; вид, темп и звук целиком рождаются из описания. Обратите внимание, какая часть текста говорит о цвете и свете, а не о сюжете: одна фраза о зелёном фильтре задаёт всю цветокоррекцию.
Это самый недорогой в воспроизведении тип задания для Wan 3.0. Отправьте промпт с duration 30 и resolution 720P — платите за 30 секунд выхода, 2,70 $ на стандартном тарифе.
一段现代悬疑风格的电影感长镜头,整个画面呈现出强烈的淡绿色滤镜风格,营造出一种基于淡绿色系的清冷氛围。在散发着冰冷白光的荧光灯下,空无一人的医院走廊呈现出低饱和的色彩与极高对比的光影关系,锐利且非人情化。镜头从护士台后方开始,一名身穿墨绿色夹克的女子猛地从走廊尽头的门后冲入,沿着对称的中心线向镜头快速跑来,摄影机流畅地向后移动。她的脚步声急促而响亮,口中焦急地呼喊。最终,她冲到台前,双手用力拍在台面上,绝望地环顾四周,发出几近崩溃的求助呐喊,声音在只有微弱设备嗡鸣的寂静中回荡。Промпт начинается с 参考 @Image1 的分镜图 (используй раскадровку с изображения 1) и описывает три плана: общий план маленькой платформы под дождём с девушкой под синим зонтом, средний план, где она стоит напротив парня с рюкзаком через рельсы, и финальный план сквозь дождь. Wan 3.0 берёт из раскадровки композицию и мизансцену, а структуру трёх планов — из текста; 20-секундный клип проходит их по порядку.
В API это одна запись в reference_image_urls. Изображения на Wan 3.0 не стоят ничего сверху, так что счёт — только выход: 20 секунд в 720P, 1,80 $.
参考 @Image1 的分镜图,镜头1:雨夜小火车站台全景,长发女孩撑蓝色雨伞独自站在站台上,身后小站房透出暖光,远处青山隐没在雨雾中;镜头2:中景,女孩撑伞与背书包的短发男孩在站台上面对面站立,大雨倾盆,铁轨在两人之间延伸;镜头3:透过雨滴滑落的透明伞面拍摄女孩面部特写,她眼眶泛红,轻声说{到了那边记得发消息};镜头4:从男孩背后越肩拍向女孩方向,远处一列火车亮着车头灯缓缓驶来,雨幕中光晕扩散;镜头5:双手特写,女孩将一张折叠的纸条递到男孩手中,指尖微微颤抖;镜头6:女孩独自站在站台边,目送铁轨延伸向远方,男孩已不在身旁,雨势渐弱。Этот кейс показывает грамматику слотов яснее всего. Промпт объявляет 图片1 субъектом 1 и 图片2 субъектом 2, назначает 音频1 голосом субъекта 1 и 音频2 голосом субъекта 2, ставит обоих у беговой дорожки и пишет диалог в фигурных скобках: субъект 1 поворачивается и спрашивает, какую группу мышц сегодня качаем, субъект 2 отвечает, вытираясь полотенцем. Два коротких аудио, 5 и 6 секунд, несут два голоса; Wan 3.0 клонирует тембр и синхронизирует губы.
Изображения и аудио идут в reference_image_urls и reference_audio_urls, и ни то ни другое не добавляется к счёту. Пятнадцать секунд в 720P: 1,35 $.
将图片1中的女人定义为主体1,将图片2中的女人定义为主体2,主体1台词音色参考音频1,主体2台词音色参考音频2,在健身房内,主体1和主体2并排站在跑步机旁,主体1转头微笑对主体2说{今天练哪个部位},主体2一边用毛巾擦汗一边回应{练背吧,昨天腿还酸着呢},主体1笑着点头说{行,我陪你,先热身十分钟},主体2拿起水杯喝一口回应{走吧},背景是器械区和落地镜,写实拍摄,画面明亮通透,冷白色自然饱和度色调Пятисекундный клип со скейтом — источник движения; статичное изображение — источник личности. Промпт велит Wan 3.0 заменить мужчину из видео 1 на женщину и её одежду с изображения 1, а оставшиеся слова тратит на замок: меняется только человек, трюк, траектория и фон скейт-парка остаются ровно такими, какие есть. Результат сохраняет исходный тайминг кадр в кадр.
Поскольку участвует референс-видео, тарификация считает вход плюс выход: 5 секунд на входе, 5 на выходе, 10 оплачиваемых секунд в 720P, 0,90 $. Референс-видео на Wan 3.0 может длиться 1–15 секунд каждое и 15 секунд суммарно, максимум пять клипов.
参考视频,视频1 @Video 中的滑板男人替换为图片 @Image1 中的女人和衣服,注意:只替换人物,保留原视频中滑板动作、运动轨迹和滑板场背景完全保持不变。На входе — файл XLSX с месячным GMV трансграничной торговли, а промпт — самый длинный из восьми, 2 677 знаков, потому что он описывает 22-секундный монтаж как четыре пронумерованных сегмента на белом фоне с мягкими цветными блоками и чистыми линейными графиками и настаивает на фоновой музыке, которая начинается с нулевой секунды и нигде не пропадает. Wan 3.0 считывает цифры из таблицы и анимирует их; за темп, типографику и звук отвечает промпт.
Файл отправляется как file_url (принимаются DOCX, PPTX, XLSX, PDF, TXT и MD, до 50 страниц и 100 МБ), публичная страница — как link_url; одно исключает другое. Документы не стоят ничего сверху: 23 секунды в 720P — 2,07 $.
总时长22秒,4个片段顺序拼接。全片纯白底,柔色色块与简洁线条图表,Apple Keynote式极简商务风格,无衬线深灰字体。BGM(必须有,贯穿全片,音量清晰可闻):一段轻快的商务背景音乐,节奏稳定、旋律简洁,从第一秒开始就有音乐,全程不间断,旁白出现时音乐不消失、音量略低于人声。音效层:色块滑入时'嗖'的whoosh声、数字跳动时轻键盘'咔嗒'声、关键数据弹出时清脆的'叮'一声bell。旁白:英文男声或女声,明快自信,语速约2.5词/秒,像在季度会上做presentation的语气——专业但不冰冷,有节奏感,关键数字处微微加重。
H1-2026跨境电商月度GMV.xlsx
片段1:全景,中心构图,纯白底,柔光,极简商务风格,视觉参考参考图1的干净白底+柔和色块。纯白画面从中央展开,无数金色光粒子从画面四周向中心汇聚聚拢,粒子碰撞闪烁后凝结成标题文字'H1 2026 · Wan',文字表面泛着流动的数据流光效,边缘有微光粒子持续环绕飘散,整体炫酷而高级。停留片刻后标题化作粒子流散消失,下方同时滑入两组大号深灰数字——左侧是第7行B7单元格的值$1,580(1月GMV)、右侧是G7单元格的值$3,460(6月GMV),中间一个浅灰色箭头连接,箭头下方浮出浅灰小字'Monthly GMV Growth'。底部弹出一枚珊瑚色圆角标签,显示第8行H8单元格的值+45.7%(H1整体增幅),弹出时伴随清脆的'叮'一声。旁白明快自信地说道:'In the first half of 2026, monthly GMV grew from 15.8 to 34.6 million dollars.' BGM从画面第一秒起就清晰响起,轻快节奏贯穿,色块滑入时带轻微的'嗖'whoosh声。片段末尾色块向两侧平滑滑开,露出下一段画面。
片段2:全景,左侧Y轴+底部X轴构图,纯白底+浅灰点状网格,柔光,极简商务风格,视觉参考参考图2的趋势线图风格。画面底部X轴从左到右依次清晰标注六个月份标签:Jan、Feb、Mar、Apr、May、Jun,等距排列,浅灰色无衬线字体。左侧Y轴标注数值刻度。画面从左向右同时绘制三条趋势线——珊瑚色代表东南亚(数据取自第4行:B4=$580, C4=$640, D4=$750, E4=$880, F4=$1,050, G4=$1,280)、青蓝色代表北美(第5行:B5=$420, C5=$480, D5=$560, E5=$680, F5=$860, G5=$1,260)、琥珀色代表欧洲(第6行:B6=$580, C6=$610, D6=$680, E6=$750, F6=$830, G6=$920),三条线从Jan同一位置出发,随节奏向右上方延伸至Jun。线条下方各带30%透明度渐变填充。每个月份节点到达时,数据点轻弹一下,正上方浮出该点的精确数值标签——标签只显示美元数值,不显示百分比、不显示其他文字,数值必须与上述单元格完全一致。右上角滑出图例:三个色块配市场英文名。六个点全部到达后画面定格片刻。旁白节奏稳定地说道:'All three markets — Southeast Asia, North America, and Europe — showed consistent month-over-month growth, with no single dip.' BGM持续可闻,数字弹出时伴随细碎的'咔嗒'键盘音。6月终点标签放大填满画面后缩小重组,过渡至下一段。
片段3:全景,左60%柱状图+右40%数据列构图,纯白底,柔光,极简商务风格,视觉参考参考图1的柱状图风格。白底上从左到右依次升起6根青蓝色圆角柱体,分别对应1月至6月——必须完整展示6根柱子,柱体高度严格对应第5行North America各月数值:B5=$420, C5=$480, D5=$560, E5=$680, F5=$860, G5=$1,260,从低到高递增排列,呈现明显的逐月增长趋势。每根柱体升起时带轻微的'嗖'弹性音效,柱顶浮出对应的精确美元数值标签。柱体全部就位后,右侧纵向排列滑出5个北美逐月环比增长率,分别由相邻两月数值计算得出:Feb +14.3%(C5相对B5)、Mar +16.7%(D5相对C5)、Apr +21.4%(E5相对D5)、May +26.5%(F5相对E5)、Jun +46.5%(G5相对F5)。每个增长率显示为:翠绿色向上箭头图标 + 百分比数值(如↑+14.3%),整体呈阶梯状从上到下依次排列,绿色箭头强调增长态势,字体略大确保清晰可读。每个数字滑入时带一声细碎的'咔嗒'。最后,北美整体增幅用珊瑚色大号字体从中央弹出:+200%(由G5=$1,260相对B5=$420计算),伴随清脆的'叮'一声bell,停留片刻,数字周围散发轻微光晕。旁白在关键数据处微微加重语气:'North America was our growth engine — up two hundred percent in just six months, accelerating every single month.' BGM持续清晰,节奏逐渐推向高点。整体增幅数字居中放大,周围元素柔和淡出,过渡至尾段。
片段4:全景,中心构图偏上,纯白底,柔光,极简商务风格,视觉参考参考图3的环形图风格。白底中央浮现一个简约环形图(甜甜圈图),只有三段弧形,分别用珊瑚色、青蓝色、琥珀色渲染三个市场的H1占比——东南亚占比由H4=5180计算、北美由H5=4260计算、欧洲由H6=4370计算,三者总和H7=13810。三段弧形之间用白色间隙分隔,环形图整体干净简洁,图表上没有任何百分比符号、没有任何数字标注、没有任何散落的标签,只有纯粹的三段色弧。环形图以约10°/s的速度缓缓旋转。环形图正中央显示一个大号深灰数字,该数字从0快速跳动至H7单元格的值$138.1M(即13810万美元),跳动时伴随连续的细碎'咔嗒'声,最终数字落定时一声清脆的'叮'。下方淡入一行浅灰副标题'Three Markets · All Growing · Zero Downturn'。旁白沉稳收尾,说完留1秒静音:'138 million in total — all markets growing, zero downturns.' BGM持续可闻,最后缓缓衰减,1秒静音后全片结束。Те же кадры со скейтом, что в кейсе с референс-видео, но другое задание. Промпт начинается с 编辑视频 (отредактируй видео) и превращает мужчину из видео 1 в коротко стриженную женщину в спортивном топе и свободных карго, сохраняя бейсболку и защиту из оригинала, трюк, траекторию и скейт-парк. Выше «до» и «после» играют рядом; изменился только субъект. Пятнадцать из 64 кейсов руководства — правки такого рода: добавить элемент, заменить, удалить, переосветить, сменить стиль, переписать реплику или переделать сюжет.
Правки сохраняют длину входа, поэтому пятисекундный исходник возвращает пятисекундный результат и тарифицируется как 10 секунд: 0,90 $ в 720P.
编辑视频,视频1中的滑板男人替换为一位短发女人,穿运动背心和宽松工装裤,保留原视频中的棒球帽、护膝护肘等护具,滑板动作、运动轨迹和滑板场背景完全保持不变。Промпт начинается с 将视频1延长15s (продли видео 1 на 15 секунд), а затем делает то, о чём большинство забывает: называет двух персонажей из существующих кадров по одежде и реквизиту (мужчина в тёмно-серой китайской рубахе с чётками на левом запястье, мужчина в тёмной рубахе) и пишет новые биты вместе с диалогом, вплоть до реплики о том, когда товар придёт в порт. Wan 3.0 продолжает сцену с последнего кадра с теми же двумя людьми и той же комнатой, и новые 15 секунд несут написанный диалог.
Пятисекундный исходник, продлённый до 20-секундного результата, тарифицируется как 25 секунд (5 на входе, 20 на выходе): 2,25 $ в 720P. Провайдер ограничивает вход плюс выход 30 секундами — поэтому руководство продлевает пятисекундные клипы, а не пятнадцатисекундные.
将视频1延长15s。角色A为梳背头、穿深灰色中式长衫、左手腕佩戴棕色佛珠手串的男人,角色B为穿深色中式长衫的男人。角色B缓缓放下茶碗,目光微沉,用指尖轻叩桌面两下,不紧不慢说"价钱好讲,但货要几时到埠,你要畀个准数我。"角色A笑容不减,端起盖碗刮了刮茶沫。角色A呷一口茶,将茶碗搁回茶托,身体前倾压低声音,佛珠随手势轻晃,语气笃定"最迟月底,码头嗰边我已经打点好晒,一船货齐齐整整运到你仓库门口。"说罢右手掌心朝下往桌面一按,目光直视角色B。角色B沉吟片刻,视线扫向窗外"萬安當"牌匾,竹帘被街上微风轻轻掀起。他转回头,嘴角浮起笑意,拿起盖碗朝角色A微微一举,"好,月底交货,我等你好消息。"两人相视而笑。保持民国商战片的沉稳调性,对话节奏从容,茶馆环境音低沉衬底。Вертикальный кейс 720×1280. Промпт написан как список планов с таймкодами: 0:00–0:03 средний план, силуэт мечника в бамбуковой роще тушью с @Image1, рука на рукояти, падают листья; дальше биты нарастают. Поскольку изображение передано как первый кадр, а не как референс, Wan 3.0 считает его кадром номер один и анимирует от него; всё, что описывает промпт, — движение прочь от этой картинки.
На Wan 3.0 first_frame_url нельзя сочетать с полями reference_*, file_url и link_url; запрос отклоняется до запуска. Двадцать секунд в 720P: 1,80 $.
(0:00 - 0:03) 运镜:中景。
画面:沿用 @Image1 的水墨竹林场景。头戴斗笠、身着墨色长袍的刀客,其剪影伫立在浓雾环绕、竹影婆娑的中心。
动作:刀客左手轻按刀柄,竹叶随风飘落。
氛围:寂静,压抑,水墨晕染的颗粒感清晰可见。
(0:03 - 0:08) 剧情引入,运镜:特写。
剧情:刀客察觉杀气。
画面:镜头快速推进到刀客斗笠下的特写。
细节:斗笠边缘露出一双凌厉、决绝的眼睛,眼神如刀。水墨晕染的“汗珠”从额头滑落。
动作:刀客右手缓缓握紧刀柄,指关节泛白。竹叶飘落的速度加快。
(0:08 - 0:13) 运镜:快速环绕。
画面:镜头以刀客为中心快速环绕。
剧情:两名同样是水墨剪影的刺客从竹林深处杀出,手持双钩和短刃。
细节:刺客的动作也是水墨笔触构成的,如墨迹流动。镜头快速掠过刺客的身影,强调速度感。
(0:13 - 0:18) 运镜:手持感,高速捕捉。
打斗:刀客猛然拔刀,刀光是一道纯白色的水墨裂痕。刺客双钩攻来。
细节:
一击:刀客回身一斩,刀刃与刺客双钩碰撞,迸发出无数黑白相间、带有书法感的火花和墨点。
二击:刀客虚晃一枪,利用竹竿弹射,从高处劈下。刺客翻滚躲避。竹竿被打断,化作飞散的墨痕。
三击:刀客刀尖直指另一刺客咽喉,刺客以短刃格挡,镜头捕捉刀刃与短刃摩擦时细微的墨迹崩裂细节。
**(0:18 - 0:20) 运镜:慢镜头至定格。**
* **画面:** 刀客的刀停在刺客颈侧,刺客凝固。
* **细节:** 刀客的斗笠在打斗中略微倾斜。竹林归于平静,更多竹叶飞舞。
* **氛围:** 镜头慢慢拉远,回到中景,定格在刀客收刀、刺客倒地的画面。
* **文字(可选):** 画面下方显现水墨风文字:“江湖,不过一笔勾销。”
**风格说明:** 整个过程保持 `image_0.png` 的高度黑白、水墨画风格,动作必须有毛笔触感,速度要快,细节要足(墨滴、火花、墨痕裂口)。64 промпта занимают от 18 до 3 423 знаков, и длинные — не вода, а таймлайны. Ниже — восемь привычек, которые повторяются по всему набору, каждая с фрагментом из реального кейса, чтобы вы видели точную формулировку, на которую откликался Wan 3.0. Фрагменты на китайском, потому что руководство на китайском; структура не зависит от языка и работает на русском на той же модели.
Две из этих привычек важнее остальных. Нумерация материалов (图1, 视频1, 音频1) — единственный способ, которым Wan 3.0 понимает, какой файл играет какую роль, когда приложено несколько; а финальный замок — фраза о том, что должно остаться неизменным, — отделяет чистую правку от переосмысленного кадра.
| Привычка | Что даёт для Wan 3.0 | Цитата из кейса |
|---|---|---|
| Wan 3.0 · Нумеровать материалы | референс-изображения, видео и аудио адресуются по слоту, считаются отдельно | 将图片1中的女人定义为主体1,将图片2中的女人定义为主体2,主体1台词音色参考音频1 |
| Wan 3.0 · Писать таймлайн | любое задание длиннее 10 с делится на сегменты с временем, которые модель проходит по порядку | 镜头1 [0秒-30秒] 近景,平视视角,连续快速摇镜,一镜到底 |
| Wan 3.0 · Длина, формат и fps в первой фразе | первое предложение несёт спецификацию и совпадает с параметром duration | 生成一支10秒、16:9横版、1920×1080、30fps、单镜头连续完成的微缩奇幻高速追逐短片 |
| Wan 3.0 · Помечать звук внутри фразы | эффекты в угловых скобках, реплики в фигурных или кавычках; Wan 3.0 рендерит и то и другое | 用抹布仔细擦拭吧台<抹布摩擦声> |
| Wan 3.0 · Запирать то, что не меняется | каждая правка заканчивается перечнем элементов, которые остаются как есть | 女人的动作和画面其余部分保持不变 |
| Wan 3.0 · Называть персонажей по одежде | продления и правки заново опознают людей из кадров, прежде чем добавлять биты | 角色A为梳背头、穿深灰色中式长衫、左手腕佩戴棕色佛珠手串的男人 |
| Wan 3.0 · Давать референсу одну роль | клип назван источником движения, камеры или эффекта, а не всего сразу | 参考视频的运镜方式,场景更改为一杯咖啡放在天台咖啡桌上 |
| Wan 3.0 · Описывать движение от статичного кадра | промпты первого кадра пишут, что движется прочь от картинки, с таймкодами | (0:00 - 0:03) 运镜:中景。 画面:沿用 @Image1 的水墨竹林场景 |
Двенадцать из семнадцати кейсов «текст в видео» идут все 30 секунд, и у них общий скелет. Однострочный бриф задаёт жанр, длину и облик. Фраза о палитре и свете фиксирует цветокоррекцию. Дальше таймлайн: пронумерованные планы или диапазоны секунд, у каждого — камера, действие и звук, который идёт под ним. Длинные кейсы добавляют абзац о непрерывности: лицо, волосы и гардероб персонажа описаны один раз, чтобы каждый сегмент их переиспользовал. Порядок постоянен по всему руководству: сначала спецификация и облик, потом сюжет, чтобы читатель (или модель) получил ограничения по сдаче раньше истории.
Тот же скелет масштабируется вниз. Пятисекундная правка — это бриф, действие и замок. Пятнадцатисекундный продуктовый ролик — бриф, фраза о свете и три бита с временем. Чего в руководстве нет никогда — стены прилагательных без временной структуры: такой промпт выглядит вялым, потому что Wan 3.0 размазывает действие по клипу равномерно, если никто не сказал, когда что происходит.
| Блок | Назначение | Как выглядит в кейсах |
|---|---|---|
| Wan 3.0 · Бриф | жанр, длина, формат и облик в одну строку | 这是一段30秒的真实电影质感海上巨兽登场场景,整体氛围参考好莱坞灾难怪兽大片 |
| Wan 3.0 · Палитра и свет | одна фраза, которая решает цветокоррекцию | 整个画面呈现出强烈的淡绿色滤镜风格,营造出一种基于淡绿色系的清冷氛围 |
| Wan 3.0 · Лист непрерывности | лицо, волосы, гардероб — один раз, переиспользуется каждым сегментом | 严格保持男性角色的黑发高发髻、鬓角碎发被风吹起、锐利深色瞳 |
| Wan 3.0 · Таймлайн | пронумерованные планы или диапазоны секунд с камерой, действием, звуком | 分段1[0-5秒]:一个连续的、照片级写实的电影镜头 |
| Wan 3.0 · Звук | атмосфера, эффекты, диалог — там, где они происходят | BGM(必须有,贯穿全片,音量清晰可闻) |
| Wan 3.0 · Замок | для правок и продлений: что остаётся неизменным | 滑板动作、运动轨迹和滑板场背景完全保持不变 |
Каждый кейс выше — это один запрос POST /api/v1/video/generations с model wan-3.0-video. Промпт идёт как написан; материалы, которые промпт нумерует, кладутся в соответствующий массив в том же порядке, потому что 图1 — первая запись reference_image_urls, а 视频1 — первая reference_video_urls. У Wan 3.0 два режима входа, которые не смешиваются: режим кадра (first_frame_url, опционально last_frame_url) и режим референса (reference_image_urls, reference_video_urls, reference_audio_urls, file_url или link_url). Смешанный запрос мы отклоняем локально и называем обе стороны, так что до провайдера он не доходит.
Два параметра меняют результат, не трогая промпт. mode: prime переключает на быстрый тариф, на 51–56 % дороже за секунду при тех же возможностях. prompt_extend, включённый по умолчанию, разрешает Wan 3.0 переписывать короткие промпты; промпты из руководства достаточно длинные, чтобы его выключить и получить ровно то, что написано.
| Тип кейса | Какие поля отправлять | Ограничения Wan 3.0 |
|---|---|---|
| Wan 3.0 · Текст в видео | prompt, duration 2–30 (или -1, чтобы выбрала модель), resolution 480P / 720P / 1080P, aspect_ratio | один план до 30 с, 30 fps, звук включён по умолчанию |
| Wan 3.0 · Первый кадр / первый + последний | first_frame_url, last_frame_url | несовместимо со всеми полями референса |
| Wan 3.0 · Референс по изображению | reference_image_urls | до 10 изображений, без доплаты |
| Wan 3.0 · Референс по видео, правка, продление | reference_video_urls | до 5 клипов по 1–15 с, 15 с суммарно; оплачивается вход + выход; вход + выход ≤ 30 с |
| Wan 3.0 · Референс по аудио | reference_audio_urls | до 5 клипов, 15 с суммарно, wav или mp3, без доплаты |
| Wan 3.0 · Документ / веб-страница | file_url или link_url (одно из двух) | DOCX, PPTX, XLSX, PDF, TXT, MD… ≤ 50 страниц, ≤ 100 МБ; только публичный URL |
| Wan 3.0 · Скоростной тариф | mode: standard (по умолчанию) или prime | prime на 51–56 % дороже за секунду, возможности те же |
Wan 3.0 тарифицируется за секунду выхода по разрешению: 0,045 $ в 480P, 0,09 $ в 720P, 0,18 $ в 1080P на стандартном тарифе; prime — 0,068 $, 0,14 $ и 0,28 $. Референс-изображения, аудио, документы и веб-страницы бесплатны; референс-видео добавляет свою длину к оплачиваемым секундам. Списание только за успешные задания. В таблице каждый кейс оценён в том разрешении, в котором клип реально был выдан, так что клип в 720P считается по 720P, даже если автор руководства мог запросить 1080P.
Для планирования: весь набор из 64 кейсов — это 1 112 секунд выхода плюс 147 секунд входа от 22 заданий с референс-видео, всего 1 258 оплачиваемых секунд, около 113 $ по стандартному тарифу 720P. Столько стоит воспроизвести целое руководство к запуску на Wan 3.0.
| Кейс | Выход | Оплачиваемые секунды | Стандартный тариф | Тариф prime |
|---|---|---|---|---|
| Wan 3.0 · Больничный коридор, текст в видео | 30 с · 720P | 30 | 2,70 $ | 4,20 $ |
| Wan 3.0 · Прощание по раскадровке, референс по изображению | 20 с · 720P | 20 | 1,80 $ | 2,80 $ |
| Wan 3.0 · Разговор в спортзале, референс по аудио | 15 с · 720P | 15 | 1,35 $ | 2,10 $ |
| Wan 3.0 · Замена скейтера, референс по видео | 5 с · 720P (5 с на входе) | 10 | 0,90 $ | 1,40 $ |
| Wan 3.0 · Таблица GMV, документ в видео | 23 с · 720P | 23 | 2,07 $ | 3,22 $ |
| Wan 3.0 · Скейтер в женщину, редактирование | 5 с · 720P (5 с на входе) | 10 | 0,90 $ | 1,40 $ |
| Wan 3.0 · Переговоры за чаем, продление | 20 с · 720P (5 с на входе) | 25 | 2,25 $ | 3,50 $ |
| Wan 3.0 · Мечник тушью, первый кадр | 20 с · 720P | 20 | 1,80 $ | 2,80 $ |
Тридцать секунд — жёсткий потолок на задание, а с референс-видео он общий: вход плюс выход не могут превышать 30 секунд, поэтому каждое продление в руководстве начинается с пятисекундного клипа. Референс-видео ограничено 15 секундами суммарно максимум в пяти клипах, референс-аудио — 15 секундами суммарно, изображения — десятью, документы — 50 страницами. Режим кадра и режим референса не сочетаются, а file_url и link_url нельзя отправить вместе. Это не наши ограничения, а ограничения Wan 3.0, и мы применяем их до отправки запроса, так что отклонённое задание не стоит ни одного обращения к провайдеру.
То, чего руководство не показывает, говорит не меньше, чем то, что показывает. Ни один кейс не использует фотографию узнаваемого реального человека как референс, и ни один не полагается на рендер текста в кадре, кроме логотипа или подписи, уже присутствующих на входе. Считайте и то и другое непроверенным на Wan 3.0, а не поддерживаемым. Референс-изображения и документы, стоящие за референс-кейсами, вместе с руководством не публиковались, поэтому у тех карточек есть только промпт и результат.
Три модели на apimodels.app принимают референс-видео и аудио и генерируют 15 секунд и больше одним планом. Цифры — те, что заявлены на странице каждой модели; цены — наши посекундные прайсы на указанном уровне.
| Wan 3.0 | Seedance 2.5 | MiniMax H3 | |
|---|---|---|---|
| Длина одного плана | 2–30 с | 4–30 с | 5–15 с |
| Референсы на задание | 10 изображений + 5 видео + 5 аудио, или документ / веб-страница | 30 изображений + 10 видео + 10 аудио | 9 изображений + 3 видео + 3 аудио |
| Разрешения | 480P / 720P / 1080P | 480p / 720p | 768P / 2K |
| Цена за секунду у нас | 0,045 $ / 0,09 $ / 0,18 $ | 0,120 $ / 0,270 $ | 0,097 $ / 0,145 $ |
| Правка и продление видео | да, через референс-видео | да, отдельные типы задач | генеративное редактирование |
| Документ или веб-страница на входе | да | нет | нет |
| Нативный синхронный звук | да | да | да |
Wan 3.0 Video — это API категории «генерация видео» от Alibaba. Wan 3.0 (Ваньсян 3.0) — универсальная видеомодель Alibaba: одно имя модели закрывает text-to-video, image-to-video по первому или по первому и последнему кадру, а также «омни-референсную» генерацию по 10 референсным изображениям, 5 видеофрагментам и 5 аудиофрагментам — либо сразу по документу (PPTX, DOCX, XLSX, PDF, TXT, MD, до 50 страниц) или публичной веб-странице. На выходе — единый план длиной до 30 секунд при 30fps с синхронной звуковой дорожкой (её можно отключить, цена не меняется). Разрешения 480P / 720P / 1080P, шесть соотношений сторон. В омни-режиме промпт обращается к материалам по номеру («человек из видео 1 держит предмет с рисунка 3»), так что несколько персонажей и реквизит остаются согласованными внутри одного кадра. Оплата посекундная: 480p $0.045/с, 720p $0.09/с, 1080p $0.18/с. Референсные изображения, аудио, документы и веб-страницы не тарифицируются, но за референсное ВИДЕО (монтаж, продление, замена лица) оплачиваются и его секунды — длительность входного видео плюс длительность результата, как и у поставщика, где для таких задач действует ограничение «вход + выход ≤ 30 секунд». Режим mode:"prime" — быстрый уровень, дороже за секунду на 51–56% ($0.068 / $0.14 / $0.28): на одинаковой задаче он вернул результат за 58 секунд там, где стандартный шёл 356. Прямой доступ к Alibaba Model Studio требует китайской верификации по паспорту; через apimodels.app нужен только ваш обычный ключ. Своего слоя модерации мы не добавляем: промпты и референсные материалы идут насквозь, без изменений. Это не значит, что фильтра нет: встроенные механизмы безопасности самой модели работают и на практике срабатывают регулярно — проверяется и то, что вы отправили, и то, что получилось, а референсы с лицами реальных людей отклоняются часто. Проверять результат и отвечать за соблюдение закона и правил вашего собственного сервиса — ваша задача; снимайте только тех людей, которые дали на это согласие. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: 480p: $0.045, 720p: $0.09, 1080p: $0.18, 480p-prime: $0.068, 720p-prime: $0.14, 1080p-prime: $0.28.
Быстро собрать промо-видео бренда под рекламные кампании и продвижение в соцсетях.
Короткие вертикальные ролики для TikTok, Instagram и YouTube.
Показать возможности продукта и снять обучающие ролики, которые повышают конверсию.
Объяснения к курсам, разборы тем и обучающие видео — недорого и на потоке.
Wan 3.0 Video доступна через APIMODELS по цене: 480p: $0.045, 720p: $0.09, 1080p: $0.18, 480p-prime: $0.068, 720p-prime: $0.14, 1080p-prime: $0.28. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Wan 3.0 Video через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
Wan 3.0 (Ваньсян 3.0) — универсальная видеомодель Alibaba, выпущенная в августе 2026 года. Одно имя модели закрывает text-to-video, image-to-video по первому или по первому и последнему кадру и «омни-референсную» генерацию по 10 референсным изображениям, 5 видеофрагментам и 5 аудиофрагментам (по 15 секунд суммарно для видео и для аудио) — либо по документу (PPTX, DOCX, XLSX, PDF, TXT, MD, до 50 страниц) или публичной веб-странице. На apimodels.app вы отправляете POST на /api/v1/video/generations с model "wan-3.0-video", затем опрашиваете тот же эндпоинт по полученному task_id. Формат запроса тот же, что у VEO, Kling и Seedance здесь, так что смена модели — это замена одной строки, а один ключ покрывает их все.
Потому что большинству просто не открыть там аккаунт. Wan 3.0 сейчас отдаётся только из регионов Alibaba Model Studio в Китае (Пекин) и Сингапуре — мы проверили регион США (Вирджиния): модели там нет вовсе (в том рабочем пространстве 92 модели, и ни одна не видео). Китайская площадка требует верификации по паспорту материкового Китая, на чём иностранные разработчики и останавливаются. Через apimodels.app не нужны ни аккаунт Alibaba Cloud, ни верификация, ни отдельные расчёты: тот же ключ и тот же эндпоинт, что и для остальных моделей.
Тарифицируется каждая секунда. Стандартный уровень стоит на 10% ниже официального долларового прайса Alibaba: 480p $0.045/с, 720p $0.09/с, 1080p $0.18/с — 5-секундный клип в 720p обходится примерно в $0.45, 10-секундный в 1080p — около $1.80, 30-секундный в 1080p — около $5.40. Уровень mode:"prime" идёт по прайсу ($0.068 / $0.14 / $0.28), то есть на 51–56% дороже стандарта за секунду. Референсные изображения, аудио, документы и веб-страницы бесплатны; если вы передаёте референсное ВИДЕО (монтаж, продление, замена персонажа), к счёту добавляются секунды входного видео — так же считает и провайдер. Неудачные задачи не тарифицируются.
Да — duration принимает любое целое число от 2 до 30, и на выходе получается цельный план при 30fps, а не склейка из сегментов. Значение -1 включает режим умной длительности: модель сама выбирает длину от 2 до 30 секунд по промпту и материалам. Для -1 мы заранее резервируем худший случай в 30 секунд, а после отчёта провайдера списываем реальную длину и возвращаем разницу — модель, выбравшая 5 секунд, никогда не будет стоить как 30. Учтите: при референсном видео длина входного видео плюс длина выхода не должны превышать 30 секунд.
Отправьте материалы по порядку, и промпт сможет ссылаться на них позиционно: «рисунок 1», «рисунок 2», «видео 1», «аудио 1» — изображения, видео и аудио нумеруются независимо. Например: «человек из видео 1 держит предмет с рисунка 3 и играет на гитаре на стуле с рисунка 4». Так несколько персонажей, реквизит и окружение остаются согласованными в одном кадре. Одно жёсткое правило: референсные материалы (reference_image / video / audio, а также документ и веб-страница) несовместимы с first_frame / last_frame. Их смешение приводит к отказу у провайдера, поэтому мы отклоняем такой запрос ещё локально и сообщаем, какие две стороны столкнулись — лишний круг вы не тратите.
Передайте публичный URL файла PPTX, DOCX, XLSX, PDF, TXT или Markdown (до 50 страниц и 100 МБ) в поле file_url — модель прочитает содержимое и сгенерирует по нему видео, сворачивать документ в промпт вручную не нужно. Презентации, учебные материалы и отчёты идут прямо в видеопроизводство. Веб-страницы работают так же через link_url — для публично доступных страниц без входа. file_url и link_url взаимоисключающие: передавайте что-то одно.
Синхронная звуковая дорожка (диалоги, эффекты, атмосфера) генерируется по умолчанию; передайте audio: false, чтобы её убрать — цена не изменится. Разрешения: 480P / 720P / 1080P; пропорции: adaptive (по умолчанию — выводится из ваших материалов и замысла), 16:9, 4:3, 1:1, 3:4 и 9:16. Одно намеренное отличие от провайдера: если resolution не указано, мы ставим 720P, а не 1080P, как у Alibaba, — 1080P вдвое дороже, и никто не должен попадать на самый дорогой уровень, просто пропустив параметр. Запросите 1080P явно — и получите его.
Замер на стандартном уровне: 480P на 5 секунд вернулся примерно за 356 секунд (Alibaba обещает 1–5 минут). С mode:"prime" тот же промпт с теми же параметрами вернулся за 58 секунд — примерно в 6 раз быстрее. Эндпоинт асинхронный: создание, затем опрос каждые 10–15 секунд, либо передайте callback_url — мы отправим POST по завершении. Файлы результатов хранятся 30 дней и затем удаляются автоматически, так что скачайте или перенесите всё, что нужно сохранить.
В APIMODELS Wan 3.0 Video соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Text to Video, First / Last Frame, Omni Reference, Doc & Web to Video, Up to 30s @ 30fps, Native Audio; вы можете сравнить её по цене и возможностям с другими моделями категории «генерация видео» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «генерация видео» с актуальными ценами — на apimodels.app/models.
Wan 3.0 Video поддерживает: Text to Video, First / Last Frame, Omni Reference, Doc & Web to Video, Up to 30s @ 30fps, Native Audio. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Wan 3.0 Video через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Graduation-gown close-up: a worried monologue to camera
这是一个正面的近景镜头,画面主要呈现一位年轻黑人女孩的头部和上半身,她穿着一件蓝色的毕业袍。镜头稍微偏一点点,可以看到左边还有一个人,但背景被虚化处理了,看起来很模糊。女孩正对着镜头说话,嘴巴在动,眉头稍微皱着,表情看起来有点严肃和忧虑。光线从上方照下来,把她脸上的轮廓衬托得很自然,甚至能看到皮肤真实的质感。镜头虽然固定,但带着一点点人手持拍摄时的轻微呼吸感和晃动,视线从看着前面慢慢变成了低头看手里。
by Wan 3.0 视频创作者手册 · 通义万相

Suspense long take down an empty hospital corridor
一段现代悬疑风格的电影感长镜头,整个画面呈现出强烈的淡绿色滤镜风格,营造出一种基于淡绿色系的清冷氛围。在散发着冰冷白光的荧光灯下,空无一人的医院走廊呈现出低饱和的色彩与极高对比的光影关系,锐利且非人情化。镜头从护士台后方开始,一名身穿墨绿色夹克的女子猛地从走廊尽头的门后冲入,沿着对称的中心线向镜头快速跑来,摄影机流畅地向后移动。她的脚步声急促而响亮,口中焦急地呼喊。最终,她冲到台前,双手用力拍在台面上,绝望地环顾四周,发出几近崩溃的求助呐喊,声音在只有微弱设备嗡鸣的寂静中回荡。
by Wan 3.0 视频创作者手册 · 通义万相

One-take comedy: director versus leading lady on set
镜头1 [0秒-30秒] 近景,平视视角,连续快速摇镜,一镜到底(单镜头连续无缝运镜): 画面左侧是身穿黑色潮流导演马甲、戴着高档专业工作耳麦的导演,其左下方放置着一台巨大的专业电影摄像机。右侧是妆容精致、留着时尚韩式逗号刘海、身穿高定制西装的关系户小鲜肉。背景是宽敞的专业影棚拍摄现场,可见巨大的绿色幕布、数个高耸的影视级C型灯架、缠绕的电线,以及在背景中穿梭忙碌的灯光师和化妆师等工作人员。 专业影棚人工光。柔和的LED柔光箱光源从右侧洒入,将三位主角的面部均匀照亮,场景色彩饱满。背景的摄影器材与绿幕在充足的影棚灯光下投射出淡淡的阴影,呈现出真实而忙碌的现代化大制作片场质感。 镜头手持拍摄一镜到底,近景,镜头一开始,拍摄导演,导演无所谓的表情,瞥了一眼画面右侧斜前方画外的一眼关系户小鲜肉,对他下达指令,说道:“媒体故意黑你,做个表情看看”。说完后镜头快速右摇到关系户面部近景,镜头不要切镜,关系户小鲜肉,面部朝向画面左侧斜前方画外导演方向,神色自若,眼神真挚而自信。他嘴唇微动,神情专业地向对方阐述到““就这种事情来说,情绪可以有好几种”,说话时,头部伴有极其轻微的自然晃动,说完后镜头快速左摇到导演面部近景,镜头不要切镜,导演思索了一下,一边挑衅似地歪了歪头,向关系户小鲜肉说到““狗仔爆料你深夜幽会”,导演说完台词后,镜头迅速右摇到小鲜肉面部近景,不要切镜,关系户小鲜肉,面部朝向画面左侧斜前方画外导演方向,并快速进入表演状态,他眉头紧锁,眼神慌乱、焦急地快速游移,随后他狠狠地咬紧下唇,闭上双眼,整张脸(虽带着精致妆容)因极度的焦虑而紧绷,完美呈现出面对偶像生涯毁灭时,内心惊恐、紧张交织的挣扎状态。表演完后, 镜头再次迅速左摇到导演近景,不要切镜,导演面部表情微变,语速加快,说到““媒体又帮你洗白了,说那是你亲姐!”导演说完后,镜头再次迅速右摇到小鲜肉近景,镜头不要切镜,镜头中,关系户小鲜肉,面部朝向画面左侧斜前方画外导演方向,他的表情在千分之一秒内完成神级转换。他先是面部一滞,随后双眼猛地眯起,嘴角极大程度地咧开,露出一排白皙的牙齿,展露出一个极其夸张、甚至有些变形的狂喜笑容。这种“星途尽毁的绝望”与“彻底摆脱束缚”交织的疯魔情绪在他脸上扭曲呈现。角色表演完后,镜头再次迅速左摇到导演近景,镜头不要切镜,导演说到“你亲姐向媒体透露,你是领养的”,导演说完后,镜头再次迅速右摇到小鲜肉近景。镜头不要切镜,镜头内,关系户小鲜肉面部朝向画面左侧斜前方画外导演方向,只见他双眼暴睁,眼球凸出,精心修剪的眉毛高高扬起,嘴巴震惊地张成“O”形。紧接着,他的嘴角再次无法克制地向上拉扯,露出一副不可思议、惊魂未定却的复杂神态。 角色表演完后,镜头再次快速左摇到导演近景,镜头不要切镜,紧接着导演露出有点惊讶的表情说到“其实你是千亿豪门真少爷”。导演说完,镜头再次随即迅速右摇到小鲜肉近景,镜头不要切镜,镜头内,关系户小鲜肉面部朝向画面左侧斜前方画外导演方向,他瞬间爆发出极度魔性的狂喜。他整个人激动得微微颤抖,双眼笑得眯成了一条缝,双手甚至抬起至胸前,双手小幅度快速连续鼓掌,身体前倾摇晃,将一夜暴富、无法自持的癫狂喜悦演绎得淋漓尽致。 角色表演完后,镜头再次快速左摇到导演近景,镜头不要切镜,导演说到“你姐卷款跑路”导演说完,镜头再次迅速右摇到小鲜肉近景。小鲜肉面部朝向画面左侧斜前方画外导演方向,只见他的双眼再次瞪大,瞳孔颤抖,嘴角向下耷拉,神情在一秒钟之内从天堂坠入地狱,写满了惊愕、痛苦与不知所措。画面最后定格在这个表情上。
by Wan 3.0 视频创作者手册 · 通义万相
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.