人工智能视频生成领域迎来了一项重要的技术突破。阿里云近日正式对外展示了全新升级的 Wan3.0视频大模型,实现了从早期只能生成数秒短片段到如今直接输出单条30秒长镜头的跨越,并重磅推出了支持导演级控制和最多引用五条视频的 omni-reference 核心能力。
回顾视频生成技术的发展历程,行业在过去很长一段时间里主要围绕5秒左右的短片段进行打磨,随后逐步延伸至15秒。而 Wan3.0的推出则标志着该技术开始真正适配影视行业的真实生产流程。在实际应用场景中,制作团队无需再像过去那样费力拼接成百上千个零散的短片段,而是可以直接通过模型生成连贯的长镜头,再根据剧本与故事走向进行后期剪辑,从而大幅提升了创作效率。

在核心功能方面,Wan3.0带来了两项显著的技术亮点:一是突破性的单条30秒视频直出能力,能够保持画面长时间的高质量与连贯性;二是强大的全能多视频参考(omni-reference)机制,支持同时引入多达五条视频作为参考素材,而不仅仅局限于以往的静态图片参考。这种导演级别的精细控制能力,让 AI 视频生成在复杂叙事和风格统一上达到了全新的高度。
目前,阿里云 Wan3.0的相关能力已经通过官方渠道面向开发者和企业用户开放。开发者和制作团队可以通过 Model Studio 以及 Qwen Cloud 访问其 API 接口,将这一前沿的视频生成能力接入到实际的影视制作工作流中。
更多 API 访问权限:
Model Studio: https://click.alibabacloud.com/m/20000002017/
Qwen Cloud: https://click.qwencloud.com/m/20000002025/