中国首个Sora级大模型Vidu:文本生成16秒,1080p高清视频
来源:滚动-中文科技资讯 发布日期:2024-04-28
最新新闻:
清华团队国产Sora火了 背后创业公司已融资数亿元照片分享平台EyeEm被收购后 将用户照片用于训练人工智能模型敢想敢做的「白日梦想家」!Find X7全新配色今日开售谷歌计划投资 30 亿美元新建数据中心彭博:2024 年 AI GPU 销售额英伟达 400 亿美元清华团队发布视频大模型Vidu 可生成16 秒、1080P 视频PhysDreamer:让3D物体符合物理规律动起来Sora 支持的短片创作者解释了人工智能生成视频的优点和局限性微信发文件3小时内可撤回上热搜 网友:微信撤回能不能别提示中国首个Sora级大模型Vidu:文本生成16秒,1080p高清视频爱奇艺,长视频“慢”生意里的“快”公司iPhone充电切勿放枕头下 苹果警告:存在安全隐患头部主播退居幕后,企业家却抢着做网红北汽蓝谷发布年报,蓄势新周期算力重器DPU,火得猝不及防激进式押注AI手机的厂商一大堆,为什么登顶的是它家消息称苹果已恢复与 OpenAI 谈判,寻求在 iOS / iPadOS 18 中增加人工智能功能亚马逊宣布向第三方授权 Dash Carts“智能购物车”无人商店技术雷军回应武汉大学设“雷军班”:深感荣幸、无比珍惜苹果用户反馈设备突然退出 Apple ID 账号,被要求重置密码
4月27日,在2024中关村论坛-未来人工智能先锋论坛上,清华大学联合生数科技正式发布了,中国首个长时间、高一致性、高动态性视频大模型——Vidu。
据悉,Vidu采用了原创的Diffusion与Transformer融合的架构U-ViT,支持文本生成长达16秒、分辨率高达1080P的高清视频内容。
此外,Vidu不仅能够模拟真实物理世界,还具备丰富想象力,具备多镜头生成、时空一致性高等技术特点。这也是继Sora发布之后,全球率先取得重大突破的视频大模型,性能全面对标国际顶尖水平,并加速功能迭代中。
Vidu架构简单介绍
生数科技的研发和原创能力非常强悍,已在全球顶级期刊arxiv上发布了超过15篇技术论文,这也是其能原创Vidu架构的重要原因之一。
研究人员表示,Vidu的快速突破源自于团队在贝叶斯机器学习和多模态大模型的长期积累和多项原创性成果。
其核心技术U-ViT架构由团队于2022年9月提出,早于Sora采用的DiT架构,是全球首个Diffusion与Transformer融合的架构。
2023年3月,生数科技开源了全球首个基于U-ViT融合架构的多模态扩散模型UniDiffuser,并率先完成了U-ViT架构的大规模可扩展性验证。
基于对U-ViT架构的深入理解以及长期积累的工程与数据经验,研究人员在短短两个月里进一步突破了长视频表示与处理的多项关键技术,成功研发了Vidu视频大模型,显著提升视频的连贯性和动态性。
Vidu的发布不仅是U-ViT融合架构在大规模视觉任务中的又一次成功验证,也代表了生数科技在多模态原生大模型领域的持续创新能力和领先性。
作为通用视觉模型,Vidu能够支持生成更加多样化、更长时长的视频内容,同时面向未来,灵活架构将能够兼容更广泛的模态,进一步拓展多模态通用能力的边界。
除了Vidu视频大模型之外,生数科技还提供文生图片、文本或图片生成3D模型,已经提供在线使用,有兴趣的小伙伴可以去体验一下。
生数科技介绍
北京生数科技有限公司(简称“生数科技”)成立于2023年3月,核心团队成员来自清华大学人工智能研究院,此外 汇集了来自阿里、腾讯、字节等知名科技公司的顶尖人才,是全球范围内领先的深度生成式算法研究团队,拥有扩散概率模型底层创新研发能力。
生数科技致力打造世界领先的多模态大模型,融合文本、图像、视频、3D等多模态信息,探索生成式AI在艺术设计、游戏制作、影视后期、内容社交等场景的商业赋能,通过AI提升人类的创造力和生产力。
文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。
分享到微信
扩展阅读大模型 Sora 大模型 文本 视频
爱奇艺,长视频“慢”生意里的“快”公司车企的数智化“内功”,大模型帮修炼Adobe推出全新AI技术VideoGigaGAN:视频清晰度提升8倍大模型2024:追求变现,加速洗牌会颠勺的国产机器人来了:大模型加持,家务能力满分AI大模型蜂拥而至,PC准备好了吗?三星OneUI 6.1.1有望搭载“视频AI”功能,预计7月发布Sam Altman:GPT-5,将会比现在的大模型更智能大模型的现在进行时:走出对话框,走向产业端与纯血鸿蒙同台亮相!华为盘古大模型5.0六月发布
OPPO K12手机跑分曝光:骁龙7Gen3芯片+12GB内存
OPPO K12 近日现身 GeekBench 跑分库,型号为 PJR110,6.2.2 版本单核成绩为 1134 分,多核测试成绩为 2975 分。
又快又稳的六边形战士,中兴巡天BE5100路由器热销仅需229 AI PC之夏临近:高通发布骁龙X Plus芯片 演示笔记本AI功能
OPPO K12正式发布,开启百瓦闪充超长续航双普及时代 OPPO K12搭载超抗摔金刚石架构,十面耐摔耐弯折
敢闯技术无人区 TCL实业斩获多项AWE 2024艾普兰奖
近日,中国家电及消费电子博览会(AWE 2024)隆重开幕。全球领先的智能终端企业TCL实业携多款创新技术和新品亮相,以敢为精神勇闯技术无人区,斩获四项AWE 2024艾普兰大奖。
重庆创新公积金应用,“区块链+政务服务”显成效
“以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。
2024全球开发者先锋大会即将开幕
由世界人工智能大会组委会、上海市经信委、徐汇区政府、临港新片区管委会共同指导,由上海市人工智能行业协会联合上海人工智能实验室、上海临港经济发展(集团)有限公司、开放原子开源基金会主办的“2024全球开发者先锋大会”,将于2024年3月23日至24日举办。
-
元宇宙与数字藏品的联系
-
疫情时代,元宇宙旅游
-
妈祖文化|推进妈祖元宇宙建设!这份协议签了
-
金融元宇宙赋能实体经济-赵永新教授演讲
-
网站与新媒体监测:了解趋势,优化策略
-
中国正在加速进入元宇宙时代,预计2023年将会有大发展
-
消息称苹果已恢复与 OpenAI 谈判,寻求在 iOS / iPadOS 18 中增加人工智能功能
-
中国首个Sora级大模型Vidu:文本生成16秒,1080p高清视频
-
深圳市小洁机器人有限公司
-
我市召开城市精细化建设管理暨生活垃圾分类工作推进会 精细管理 优化服务 持续打造宜居韧性智慧城市
-
王忠林调研推进湖北实验室建设强调 聚焦未来所向现实所需自身所能 加快壮大战略科技力量 更好服务高水平科技自立自强促进新质生产力发展
-
我市召开城市精细化建设管理暨生活垃圾分类工作推进会 精细管理 优化服务 持续打造宜居韧性智慧城市 2024-04-26