比肩Sora!快手、北大开源,超高清10秒、24帧视频模型
相信很多大家对比肩Sora!快手、北大开源,超高清10秒、24帧视频模型还不知道吧,今天菲菲就带你们一起去了解一下~.~!
快手、北京大学和北京邮电大学的研究人员联合开源了超高清视频模型——Pyramid-Flow。yramid-Flow仅通过文本就能生成最多10秒、1280x768分辨率和24帧视频,在光影效果、运动动作一致性、视频质量、文本语义还原、色彩搭配等方面非常优秀,生成的视频很棒。
值得一提的是,Pyramid-Flow使用A100GPU在开源数据集上仅训练了20,700小时,其能耗和生成效率比市面上同类开源视频模型好很多,对于没有大量算力的中小企业和个人开发者来说帮助很大。
开源地址:https://github.com/jy0205/Pyramid-Flow
huggingface:https://huggingface.co/rain1011/pyramid-flow-sd3
在线demo:https://huggingface.co/spaces/Pyramid-Flow/pyramid-flow
Pyramid-Flow案例展示
以下是Pyramid-Flow生成的视频展示,整体非常惊艳有今天Sora那种感觉了。
一名女子的侧面照片,烟花在她身后的远处放了起来。
美丽的东京在雪中熙熙攘攘。镜头穿过繁忙的街道,跟随着几位享受美丽雪景并在附近店铺购物的人们。
一艘船沿着塞纳河悠闲地航行,背景是埃菲尔铁塔,黑白色彩。
海啸穿过保加利亚的一条小巷,动态效果。
鸡肉和青椒烤肉串的极端特写镜头在烧烤架上用火焰烤。浅焦点、轻烟、色彩鲜艳。
无人机拍摄的海浪拍打大苏尔加雷角海滩崎岖悬崖的景象。蔚蓝的海水激起白浪,夕阳的金色光芒照亮了岩石海岸。
Pyramid-Flow创新方法——金字塔流匹配
目前,文生视频领域有一个非常难的技术挑战,就是如何有效地处理和生成高维度的视频数据。这些数据不仅包含大量的空间信息,还涉及复杂的时间动态,而Pyramid-Flow使用了一种创新方法——金字塔流匹配。
金字塔流匹配算法的核心思想是将传统的单一分辨率生成过程转变为一个多阶段的金字塔结构。视频的生成不是一次性在全分辨率下完成,而是在不同的分辨率层次上逐步进行。
在金字塔流匹配算法中,视频生成过程被分解为多个阶段,每个阶段对应一个特定的分辨率。这些阶段从低分辨率开始,逐渐升级到高分辨率。在低分辨率阶段,算法首先生成一个粗糙的视频草图,然后逐步增加细节,直到在最高分辨率阶段生成最终的视频。
这种分阶段的方法极大减少了AI算力,因为它避免了在生成过程的早期阶段就处理大量的高分辨率数据,同时提高了生成流程的灵活性,可在不同的阶段对视频的不同方面进行精细控制。
每个金字塔阶段的生成过程被建模为一个从噪声到数据的连续流。这个流通过插值的方式来生成视频数据,在每个阶段的开始时从一个像素化的、噪声较多的潜在表示开始,逐步演化为一个清晰、干净的潜在表示。
这种流的设计允许不同阶段之间的连续性和一致性。在从一个阶段过渡到下一个阶段时,算法会重新引入噪声,以确保概率路径的连续性。而重新噪声化的过程是通过一个校正高斯噪声来实现的,有助于维持不同金字塔阶段之间的连续性。
此外,金字塔流匹配算法还引入了一个自回归的视频生成框架,通过时间金字塔来压缩全分辨率的历史信息。使得视频的每一帧都是基于之前生成的历史帧来预测的。这不仅提高了训练效率,因为它减少了训练过程中需要处理的数据量,而且还提高了生成视频的质量和一致性。
为了进一步优化性能,研究人员还使用了一种块状因果注意力机制。这种机制确保了在生成过程中,每一帧只能关注它之前的帧,而不能关注它之后的帧。有助于保持视频生成的连贯性和逻辑性,因为避免了在未来的帧中引入不相关或不一致的信息。
以上就是关于【比肩Sora!快手、北大开源,超高清10秒、24帧视频模型】的相关内容,希望对大家有帮助!
免责声明:本文由用户上传,与本网站立场无关。财经信息仅供读者参考,并不构成投资建议。投资者据此操作,风险自担。 如有侵权请联系删除!
-
奔驰GLE作为豪华SUV市场中的佼佼者,凭借其卓越的性能、豪华的内饰以及宽敞的空间,吸引了众多消费者的关注。...浏览全文>>
-
在2025年,安徽阜阳地区的帕萨特新能源汽车市场表现非常活跃。作为一款备受关注的新能源车型,帕萨特新能源凭...浏览全文>>
-
近日,滁州地区的大众汽车经销商传来好消息:备受瞩目的2025款T-ROC探歌正式上市,并且以极具竞争力的价格吸引...浏览全文>>
-
在选择一款新能源汽车时,了解其价格和配置是非常重要的一步。安徽淮南地区的长安启源E07作为2024款的新车型,...浏览全文>>
-
阜阳长安启源A05作为长安汽车旗下的全新车型,自推出以来便凭借其独特的设计风格和丰富的配置吸引了众多消费者...浏览全文>>
-
阜阳长安启源A07作为一款备受瞩目的新能源车型,以其豪华配置和亲民的价格在市场上引起了广泛关注。这款车型不...浏览全文>>
-
安徽淮南威然2024款价格及配置详解随着汽车市场的不断更新换代,上汽大众旗下的MPV车型——威然(Viloran)凭...浏览全文>>
-
QQ多米新车报价2025款,买车省钱秘籍随着汽车市场的不断发展,消费者在选购车辆时不仅关注车型的性能和配置,...浏览全文>>
-
滁州途观X 2024款最新价格及买车省钱秘籍随着汽车市场的不断发展,大众途观X作为一款兼具时尚与性能的中型SUV...浏览全文>>
-
随着汽车市场的不断发展,大众蔚揽以其优雅的设计和卓越的性能赢得了众多消费者的青睐。作为一款兼具实用性和...浏览全文>>
- Nvidia DLSS 4 有望将游戏性能提高 8 倍
- 人工智能在预测自身免疫性疾病进展方面显示出良好的前景
- 心理物理实验揭示皮肤水分感知是如何改变的
- 科茨沃尔德公司庆祝圣诞节圆满成功
- 南法纳姆学校被评为萨里郡表现最好的小学
- 约克区九所小学将削减招生人数
- 松下新款电动汽车电池为 Lucid Gravity 带来 450 英里续航里程
- 泰国旅游呈现新趋势
- 研究人员找到在细胞水平上饿死前列腺癌肿瘤的新方法
- 领先的人工智能聊天机器人在测试中表现出类似痴呆症的认知能力下降
- 庞大的 Project Zomboid build 42 终于可以玩了
- Steam Replay 回归向您展示 2024 年您玩得最多的 PC 游戏
- Jollyes 推出强化的人才支持和招聘措施
- Karen Millen 与 Simon Harrison 共同推出全新高级珠宝系列
- 奇瑞风云A8L电动轿车刷新续航里程世界纪录
- 虚拟艺术家将别克 Cascada 带回 2026 款车型
- OnePlus 宣布推出新计划解决绿线问题
- OnePlus Watch 3 将拥有更大的电池和更薄的机身
- 研究人员发现可变剪接与自身免疫性疾病遗传之间的细胞类型特异性联系
- 科学家确定脑细胞类型是排尿的主要控制者