通义万相发布视频生成模型，可一键创作影视级高清视频

人阅读

2024-09-19 14:16:44

来源：
相关关键词

9月 19 日，在杭州云栖大会上，阿里云CTO周靖人宣布通义万相全面升级，并发布全新视频生成模型，可生成影视级高清视频，可应用于影视创作、动画设计、广告设计等领域。即日起，所有用户可通过通义APP及通义万相官网免费体验。

图片1.jpg

据介绍，通义万相首批上线文生视频、图生视频功能，在文生视频功能中，用户输入任意文字提示词，即可生成一段高清视频，支持中英文多语言输入，并可以通过灵感扩写功能智能丰富视频内容表现力，支持16:9、9:16等多种比例生成；在图生视频功能中，支持用户将任意图片转化为动态视频，按照上传的图像比例或预设比例进行生成，同时可以通过提示词来控制视频运动。

现场，阿里云演示了该模型强大的运动生成和概念组合能力，输入「穿着滑冰鞋的小兔子在冰面上灵活移动的可爱场景」，通义万相仅用数分钟就能生成一段高清、逼真的视频。

通义万相视频生成大模型集成了多项创新技术，有效解决画面表现力和大幅度运动等视频生成技术难题。针对运动生成和物理模拟等难点优化算法，实现了大幅度主体运动和运镜控制，并有效模拟真实世界物理特性；设计了高压缩比、高质量视频VAE框架，有效降低视频信息冗余，并保持高质量视频重构能力；同时，基于轻量微调框架和精选数据集优化训练，在中式传统元素、风格化视频生成上表现更好。

去年7月，通义万相图像生成大模型首次亮相，目前已累计生成7500万张图片。云栖大会现场，通义万相宣布视觉生成大模型全面升级为Diffusion Transformer框架，同时结合通义千问复杂提示词解释能力，有效提升画面表现力、语义理解能力、可控生成能力。随着通义万相视频生成模型的发布，通义大模型已覆盖文本生成、图像理解、视频理解、音频理解、图像生成、视频生成等全模态场景。

（免责声明：本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿，凡在本网站出现的信息，均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性，但不保证有关资料的准确性及可靠性，读者在使用前请进一步核实，并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏，概不负任何法律责任。
任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时，应及时向本网站提出书面权利通知或不实情况说明，并提供身份证明、权属证明及详细侵权或不实情况证明。本网站在收到上述法律文件后，将会依法尽快联系相关文章源头核实，沟通删除相关内容或断开相关链接。）