9月19日消息(报道:李楠)今日,在杭州云栖大会上,阿里云CTO周靖人宣布通义万相全面升级,并发布全新视频生成模型,可生成影视级高清视频,可应用于影视创作、动画设计、广告设计等领域。即日起,所有用户可通过通义APP及通义万相官网免费体验。 据介绍,通义万相首批上线文生视频、图生视频功能,在文生视频功能中,用户输入...
9月19日消息(报道:李楠)今日,在杭州云栖大会上,阿里云CTO周靖人宣布通义万相全面升级,并发布全新视频生成模型,可生成影视级高清视频,可应用于影视创作、动画设计、广告设计等领域。即日起,所有用户可通过通义APP及通义万相官网免费体验。

据介绍,通义万相首批上线文生视频、图生视频功能,在文生视频功能中,用户输入任意文字提示词,即可生成一段高清视频,支持中英文多语言输入,并可以通过灵感扩写功能智能丰富视频内容表现力,支持16:9、9:16等多种比例生成;在图生视频功能中,支持用户将任意图片转化为动态视频,按照上传的图像比例或预设比例进行生成,同时可以通过提示词来控制视频运动。
现场,阿里云演示了该模型强大的运动生成和概念组合能力,输入「穿着滑冰鞋的小兔子在冰面上灵活移动的可爱场景」,通义万相仅用数分钟就能生成一段高清、逼真的视频。
通义万相视频生成大模型集成了多项创新技术,有效解决画面表现力和大幅度运动等视频生成技术难题。针对运动生成和物理模拟等难点优化算法,实现了大幅度主体运动和运镜控制,并有效模拟真实世界物理特性;设计了高压缩比、高质量视频VAE框架,有效降低视频信息冗余,并保持高质量视频重构能力;同时,基于轻量微调框架和精选数据集优化训练,在中式传统元素、风格化视频生成上表现更好。
去年7月,通义万相图像生成大模型首次亮相,目前已累计生成7500万张图片。云栖大会现场,通义万相宣布视觉生成大模型全面升级为Diffusion Transformer框架,同时结合通义千问复杂提示词解释能力,有效提升画面表现力、语义理解能力、可控生成能力。随着通义万相视频生成模型的发布,通义大模型已覆盖文本生成、图像理解、视频理解、音频理解、图像生成、视频生成等全模态场景。
(来源:速途网)
月薪2千员工开迈巴赫上班 老板破防
RTX 5090用一年拆开后惨不忍睹:导热凝胶大面积溢出布满PCB!
手机战报
科技透气 清凉一夏 名创优品短裤29.9元大促
长三角地区
5月中国电视销量大幅下滑 均价反而涨了500多元
AI巨头的Token补贴大战 快打完了吗?
全球首例!53岁脑死亡男子接受猪肝猪双肾移植
裁掉5万人 救得了当年“神车”吗?
电脑用内存、固态硬盘供货紧张:部分机型涨幅已超20%
看富二代破产求生 成了老百姓最爱的综艺?
比亚迪大唐:我要打十个
谷歌AI搜索强推引反弹 意外为对手无AI页面引流
小伙戴耳机睡觉确诊神经性耳聋 医生:不可逆听力损伤
乘联会秘书长崔东树:燃油车内销崩塌 20/30/40万国产车零售占比均超50%
最新研究:每天喝一杯酒会激增10种患癌风险!
下跌
AI支付
中国裁判马宁世界杯首秀丢出6张黄牌!网友:没有软肋的裁判最可怕
红米K90至尊版性能如何?
免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。
