重磅!Wan3.0开启公测
生成时长增至30秒
此外,Wan3.0还支持智能时长功能,可根据提示词自动推荐合适时长;搭配视频延长功能,还能轻松延展故事走向与剧情发展,让创意自然生长。
万物皆可生视频
视频已经成为我们通用的表达方式。Wan3.0也正从视频生成模型,跃迁为信息的表达载体,让“万物皆可生视频”。
Wan3.0不只支持文本、图片、音频、视频的全能参考,还能读取文档、表格、网页等结构化信息。搭配提示词,即可生成教学课件、产品演示、动态图表、业务汇报等内容,意味着大量的办公素材可以直接转化为视频。
支持的输入格式包括doc、xls、ppt、pdf、txt、key、pages、numbers以及md,最多输入一个文件或链接,文件大小不超过100MB,页数不超过50页。
比如上传一个智能眼镜产品的ppt,配上提示词,就能得到一个完整的形象片。
“万物皆可生视频”的背后,源于Wan3.0强大的提示词工程与指令遵循能力。模型能够充分理解各种输入格式,将提示词转化为调度输入、实现功能、控制表达的中枢,让千差万别的信息转化为连贯的视频表达。
准确还原真实世界
视频生成模型正从内容生成升级为生产力工具,用户对画面的要求不止于清晰,更要真实。无论是真实世界还是数字化信息,Wan3.0都力求精准地复刻与呈现。
为告别AI人物的油腻感与千篇一律,Wan3.0文生视频模式中的人像力求“千人千面”:更敏锐地刻画五官与皮肤细节,人物情绪表达自然克制,微表情与肢体动作彼此联动;即便是群像场景,也能细腻呈现不同人物的复杂情绪。
一致性是生产力场景最为在意的指标。在全能参考任务中,Wan3.0可精准复刻参考细节,保持角色、道具、声音、空间关系、风格等关键维度的一致性。对于角色,五官、发型发色、形体、服饰、配饰等细粒度特征均可稳定保持,避免出戏;对于道具,多角度外观、硬件结构、Logo、材质细节均保持稳定;对于场景,准确处理角色站位与机位视角的关系;对于风格,精准渲染影视拍摄调性,多风格创作时也不易发生风格混淆。
对于数字化信息,Wan3.0提升了画面的审美水准,既注重色彩的和谐搭配,也保持信息呈现的流畅表达,让图表、数据与界面内容同样拥有质感。
此外,Wan3.0的视频编辑能力也有大幅度提升,支持修改画面、剧情与台词。Wan3.0在声音质感与文字准确度方面仍有进步空间。
Wan3.0的能力与效果升级,均基于行业的真实诉求。而能够理解更多信息、生成更完整内容的全新模型,也将回到真实的创作流程与生产链路中去。
影视创作
Wan3.0的30秒时长、真实场景还原与精准一致性,将为AI影视及短漫剧、音乐舞蹈MV、生活Vlog的创作带来更佳体验,帮助创作者以更低成本完成作品。
广告营销
广告业对高质量、定制化有着极高要求,Wan3.0的万能创作能力突破了图文载体的局限,让创意直接呈现。面向家电、彩妆、汽车、快消、3C、服饰、互联网软件等行业,Wan3.0可提供从产品展示到品牌叙事的创意集。
设计创意
无论是产品UI交互演示、软件功能动画,还是数据可视化展示,Wan3.0都能在保留设计的审美与质感的同时,将其直接升华为会讲故事的动态作品,省去繁琐的动画制作环节,让创意第一时间被看见。
文旅传播
借助Wan3.0的真实场景还原能力,无需大规模实拍,无论是自然风光、人文景观还是地方美食,城市形象片、文化场景数字化都能低成本、高效率完成,让“远方”来到眼前。
即日起,Wan3.0在千问AI平台开启公测,在千问APP灰度开放,480P/720P/1080P的API价格分别为0.3/0.6/1.2 元/秒,API接口将于近期全量开放。
立即体验:
千问AI平台:
https://www.qianwenai.com/models/wan3.0-video
千问AI平台-为Agent而生,驱动AI生产力
扫描下方二维码,直达千问AI平台体验

点击阅读原文即可体验!