阿里云今日宣布,其自主研发的视频生成模型Wan3.0已正式面向公众开放使用。这款经过全面升级的模型在视频时长、创作灵活性、参考功能及场景还原能力上实现突破性进展,单次最长可生成30秒连贯视频内容,并首次支持doc、xls、ppt、pdf、md等12种文档格式直接输入,能够精准解析文本信息并转化为动态影像。
技术团队透露,在为期两周的公测期间,Wan3.0以每日迭代的速度持续优化,重点提升了指令响应准确度、多镜头切换一致性、音频合成质量等核心指标。通过引入三维空间感知算法,模型对现实场景的还原精度较前代提升47%,尤其在光影变化、材质表现等细节处理上达到行业领先水平。
用户可通过阿里云百炼平台、万相官网、千问AI生态体系(含PC端、移动端及专业创作工具)等七大渠道体验服务。定价体系显示,480P至1080P分辨率的API调用费用分别为每秒0.3元、0.6元和1.2元,即日起至9月23日,在阿里云百炼及千问平台使用可享七折优惠。
商业合作方面,麦芽传媒旗下跳跃视界、Deevid数字内容平台、剧火影视工具、京东灵境数字人解决方案、美图影像实验室等二十余家机构已完成技术对接。这些合作伙伴将基于Wan3.0的底层能力,开发面向影视制作、电商营销、在线教育等场景的垂直应用。
















