Wan 2.7 AI 视频生成器 | 首尾帧控制 · 视频续写 · 原生音频

Wan 2.7 是阿里通义实验室最新一代视频模型:支持首尾帧控制、视频续写、音频驱动表演、720P/1080P 输出,时长可在 2 到 15 秒之间任意取整。

拖放图片到这里

或点击浏览

支持格式: JPEG, PNG, WEBP, GIF (每个最大 20MB)

0 / 1500

Optional public WAV/MP3 URL used for video audio guidance

Use DashScope prompt rewriting for better short-prompt results

视频生成通常需要1-3分钟

Wan 2.7 视频能力亮点

从端点控制到原生音频,Wan 2.7 覆盖的正是决定生成素材能否留在成片里的那几项控制。

首尾帧控制

给出起幅与落幅两张画面,中间的运动由模型求解,镜头的进出点正好落在剪辑需要的位置。

视频续写

把已有片段从切点继续往后延长,主体、光线与运镜保持连贯——素材比剪辑短的时候尤其好用。

原生音频与语音同步

对白、环境声与音乐随画面一起生成,也可以用你自己的 WAV/MP3(2 到 30 秒)来驱动表演。

2 到 15 秒任意时长

在 2 到 15 秒之间按整秒设定,而不是从几个固定档位里挑,成片时长可以直接对上现成的剪辑。

720P / 1080P 与五种画幅

16:9、9:16、1:1、4:3、3:4 在两个分辨率档位下均为原生输出,竖版与方版交付不用再重构图。

Wan 2.7 控制能力亮点

Wan 2.7 这次升级的重点是可控性,而不只是画质——端点控制、片段续写和音频对齐,把镜头中原本无法调度的部分变成了可以下手的参数。

锁定镜头两端

首尾帧生成让你同时固定起幅与落幅,镜头的进出点正好落在剪辑需要的位置上。

续写已有片段

视频续写基于你已有的片段继续往后生成,主体、光线与运镜保持一致,不会在接点处跳变。

音频驱动表演

上传一段 2 到 30 秒的 WAV 或 MP3,让人声或音乐来驱动节奏、口型与表情。

720P / 1080P 与五种画幅

16:9、9:16、1:1、4:3、3:4 均为原生支持,竖版与方版交付物不需要再单独做一次重构图。

时长精确到秒

2 到 15 秒之间任意整数,而不是几个固定档位,生成的片段可以直接对上现成的剪辑时长。

提示词扩写与负向提示

提示词自动扩写补齐运镜与光影细节,负向提示则用来压住反复出现的画面瑕疵。

什么是 Wan 2.7?

Wan 2.7 是阿里通义实验室于 2026 年 4 月推出的新一代万相视频模型,基于混合专家(MoE)架构,可从文本、图像、参考素材与音频生成视频,在运动稳定性与细节保持上相比 Wan 2.6 有明显提升。

最大的变化是端点控制。Wan 2.7 的图生视频在同一个模型里覆盖三类任务:首帧生视频、首尾帧生视频、视频续写。把一个镜头的两端都锁死,或者把已有片段继续往后生成,让视频生成从抽卡变成可以真正调度的环节。

音频是原生生成而非后期拼接。你可以提供一段驱动音频(WAV 或 MP3,2 到 30 秒)来驱动表演,也可以让模型直接生成与画面同步的对白、环境声与音乐。输出支持 720P 与 1080P 两档、五种画幅,时长可在 2 到 15 秒之间按整秒设定。

为什么选择 Wan 2.7?

Wan 2.7 把控制权交回到制作真正在意的地方:镜头从哪儿起、到哪儿收、跑多久、声音是什么。

🎨

首尾帧控制

固定起幅与落幅两张画面,中间的运动交给模型求解——这是让生成素材塞进现有剪辑最直接的办法。

视频续写

输入一段已有片段并向后延长,主体、光线与运镜在原切点之后保持连贯。

原生音频与语音同步

既可以用音频轨驱动生成,也可以让对白、环境声与音乐随画面一起生成,声画对齐不需要再单独做一遍。
📱

1080P 输出,2–15 秒时长

720P 或 1080P、五种画幅任选,时长在 2 到 15 秒之间按整秒设定,不用为了迁就固定档位而凑时长。

三步用 Wan 2.7 生成视频

先选好控制点,再用镜头语言把画面说清楚,最后定时长与声音。

1

选择生成模式

可以从文本开始,也可以从一张首帧、一组首尾帧,或者一段需要续写的片段开始。

2

写好提示词

写清主体、场景与镜头语言——景别、运镜、镜头质感、光线。反复出现的瑕疵用负向提示压住。

3

设定时长与音频

选好分辨率、画幅和精确到秒的时长。如果表演需要跟着人声或节拍走,再挂一段驱动音频。

Wan 2.7 应用场景

各行业团队如何把 Wan 2.7 的端点控制、片段续写与原生音频用在真实的交付物上。

影视与制作

品牌营销

教育与培训

社交媒体

面向影视、短片与商业制作:端点控制与片段续写让生成素材真正能被剪辑师拿去用。
能对上剪辑的镜头

锁定首尾帧,让生成的镜头正好从时间线需要的位置进、从需要的位置出。

补足偏短的镜头

当一条素材比剪辑需要的短了两秒时,用续写把它从切点继续往后延长。

对白与配乐同步

对白、环境声与音乐随画面一起生成,减少后期对轨与补声的工作量。

1080P 交付

以 1080P、五种画幅渲染,预演片与社媒切条可以在同一轮生成里出完。

常见问题

Wan 2.7 是什么?

Wan 2.7 是阿里通义实验室万相系列于 2026 年 4 月推出的最新一代视频生成模型。它可以从文本、图像、参考素材与音频生成视频,并在 Wan 2.6 的基础上新增了首尾帧控制与视频续写能力。

首尾帧控制是做什么的?

你同时提供镜头的起幅和落幅两张画面,模型负责生成中间的运动过程。因为两端都被固定住而不是交给模型自由发挥,这是让生成镜头能塞进现有剪辑最可靠的方式。

视频续写怎么用?

把一段已有的视频交给 Wan 2.7,它会从该片段结尾继续往后生成画面,主体、光线与运镜保持一致。当一条素材比时间线需要的时长短时特别有用。

支持哪些分辨率和画幅?

Wan 2.7 提供 720P 与 1080P 两个档位,默认 1080P。两个档位都支持 16:9、9:16、1:1、4:3 与 3:4,横版、竖版、方版都是原生输出。

Wan 2.7 视频最长能生成多久?

2 到 15 秒之间的任意整数秒,默认 5 秒。相比固定档位,这让生成结果可以精确对上剪辑里已有的时间槽位。

Wan 2.7 的音频是怎么处理的?

音频与画面一起生成,而不是事后拼接。你也可以提供自己的驱动音频——WAV 或 MP3,2 到 30 秒——让表演的节奏与语气跟着你的录音走。

怎么写出更好的 Wan 2.7 提示词?

把主体、场景和镜头语言写明确:景别、运镜、镜头质感、光线。反复出现的瑕疵用负向提示压住;提示词较短时,可以让自动扩写来补齐运镜与光影细节。

本页生成器目前可用的是哪些模型?

本页生成器当前接入的是官方 DashScope 的 Wan 2.6 与 Wan 2.5 模型。Wan 2.7 的 API 仍在接入中,上线后会直接出现在本页的模型列表里。页面上介绍的能力均指 Wan 2.7 官方公布的规格。

准备好用 Wan 2.7 创作了吗?

端点控制、片段续写、原生音频与精确定长——决定生成素材能否留在成片里的,正是这几项能力。