虽然生成的视频只有10秒左右,但在清晰度、细节、角色一致性等方面看起来可以匹敌现有一切视频生成模型。
刚刚,AI视频生成初创公司Runway推出了新的视频生成基础模型Gen-3 Alpha。该模型可以创建具有复杂场景变化、多种电影风格和详细艺术指导的高精细视频。
Runway表示,Gen-3 Alpha是即将推出的一系列模型中的首个。系列模型是在为大规模多模态训练而构建的新基础设施上训练的。
与Gen-2相比,Gen-3 Alpha在保真度、一致性和运动性方面有了重大改进,并朝着构建通用世界模型迈出了重要一步。
在博客中,Runway重点强调,Demo的所有视频均使用 Gen-3 Alpha 生成,未经任何修改。
有许多网友表示,Runway果然让我们再次感到震撼:Runway回归!
Pytorch负责人Soumith Chintala认为其中一些生成质量达到了Sora级别。
接下来,让我们欣赏下Runway视频生成的效果。
提示:日本某城市高速行驶的火车窗户上,映出一位女性的微妙倒影.(Prompt: Subtle reflections of a woman on the window of a train moving at hyper-speed in a Japanese city.)提示:一名宇航员正在里约热内卢的一条小巷里奔跑。(Prompt: An astronaut running through an alley in Rio de Janeiro.)
从Demo中可以看到,Runway生成的10秒量级的视频在清晰度、细节、角色的一致性和保真度等方面做得非常好。让人直呼:什么时候能用上呢?
细粒度的时序控制
Gen-3 Alpha经过训练,具有高度的可描述性,时间密集字幕, 实现富有想象力的场景过渡。
提示:一只蚂蚁从巢穴中爬出的特写镜头。镜头拉远,露出山丘后面的街区。(Prompt: An extreme close-up shot of an ant emerging from its nest. The camera pulls back revealing a neighborhood beyond the hill.)提示:一架FPV无人机飞过悬崖上的一座城堡。(Prompt: A FPV drone shot through a castle on a cliff.)
生成更逼真的人类角色
Gen-3 Alpha 擅长创造具有多种动作、手势和情感的富有表现力的人类角色。
提示:这是一幅电影广角人像,一名男子的脸被光照亮。(Prompt: A cinematic wide portrait of a man with his face lit by the glow of a TV.)提示:一个中年悲伤的秃头男人突然变得快乐,因为一顶卷发和一副太阳镜突然落在他的头上。(Prompt: A middle-aged sad bald man becomes happy as a wig of curly hair and sunglasses fall suddenly on his head.)
艺术创作
Gen-3 Alpha 的训练工作是由研究科学家、工程师和艺术家组成的跨学科团队共同努力完成的,旨在让Gen-3 Alpha理解、解释各种艺术风格和电影术语。
提示:夜晚,窗外一个巨大的奇怪生物在破败的城市中行走,一盏路灯昏暗地亮着。(Prompt: View out a window of a giant strange creature walking in rundown city at night, one single street lamp dimly lighting the area.)提示:延时拍摄,穿过灯光闪烁的走廊,一条银色的织物飞过整个走廊。(Prompt: Hyperlapse shot through a corridor with flashing lights. A silver fabric flies through the entire corridor.)
行业定制
Runway表示 Gen-3 系列模型的定制化可以实现更加风格化的控制和更加一致的角色,并针对特定的艺术和叙事要求等进行优化。
提示:从肩上视角拍摄一个女人奔跑并观看远处火箭。(Prompt: Over the shoulder shot of a woman running and watching a rocket in the distance.)提示:一个女人的侧脸照片,烟花在她身后的远处绽放。(Prompt: A side profile shot of a woman with fireworks exploding in the distance beyond her.)
在Sora发布这几个月后,越来越多的视频生成模型出现,如近期发布的快手可灵、Luma、以及今天的Gen-3。但遗憾的是,很多产品我们还不能直接体验到。
相信接下来和文本大模型一样,视频生成模型会越来越多,我们也能自由尝试这些产品了。
博客链接:https://runwayml.com/blog/introducing-gen-3-alpha/
以上是Runway版Sora发布:高保真、超强一致性,Gen-3 Alpha震撼到网友了的详细内容。更多信息请关注PHP中文网其他相关文章!

随着AI应用的爆炸式增长,企业正从传统的搜索引擎优化(SEO)转向生成式引擎优化(GEO)。 谷歌正引领这一转变。其“AI概述”功能已服务于超过十亿用户,在用户点击链接之前提供完整的答案。[^2] 其他参与者也在迅速崛起。ChatGPT、微软Copilot和Perplexity正在创造一种全新的“答案引擎”类别,完全绕过了传统的搜索结果。 如果您的企业没有出现在这些AI生成的答案中,潜在客户可能永远不会发现您——即使您在传统的搜索结果中排名靠前。 从SEO到GEO——这究竟意味着什么? 几十年来

让我们探索人工通用智能(AGI)的潜在途径。 该分析是我正在进行的《福布斯》列的AI进步的一部分,并深入研究了实现AGI和人工超智慧(ASI)的复杂性。 (请参阅相关艺术

人机互动:一场互适应的微妙舞蹈 与AI聊天机器人互动,如同参与一场微妙的相互影响的舞蹈。你的提问、回应和偏好逐渐塑造着系统,使其更好地满足你的需求。现代语言模型通过显式反馈机制和隐式模式识别来适应用户的偏好。它们学习你的沟通风格,记住你的偏好,并逐渐调整其回应以符合你的预期。 然而,在我们训练数字伙伴的同时,同样重要的事情也在反向发生。我们与这些系统的互动正在微妙地重塑我们自身的沟通模式、思维过程,甚至对人际对话的期望。 我们与AI系统的互动已经开始重塑我们对人际互动的期望。我们适应了即时回应、

AI简化了野火恢复允许 澳大利亚科技公司Archistar的AI软件利用机器学习和计算机视觉,可以自动评估建筑计划,以遵守当地法规。这种验证前具有重要意义

爱沙尼亚的数字政府:美国的典范? 美国在官僚主义的效率低下方面挣扎,但爱沙尼亚提供了令人信服的选择。 这个小国拥有由AI支持的近100%数字化的,以公民为中心的政府。 这不是

计划婚礼是一项艰巨的任务,即使是最有条理的夫妇,也常常压倒了婚礼。 本文是关于AI影响的持续福布斯系列的一部分(请参阅此处的链接),探讨了生成AI如何彻底改变婚礼计划。 婚礼上

企业越来越多地利用AI代理商进行销售,而政府则将其用于各种既定任务。 但是,消费者倡导强调个人需要拥有自己的AI代理人作为对经常定位的辩护的必要性

Google正在领导这一转变。它的“ AI概述”功能已经为10亿用户提供服务,在任何人单击链接之前提供完整的答案。[^2] 其他球员也正在迅速获得地面。 Chatgpt,Microsoft Copilot和PE


热AI工具

Undresser.AI Undress
人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover
用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool
免费脱衣服图片

Clothoff.io
AI脱衣机

Video Face Swap
使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热门文章

热工具

适用于 Eclipse 的 SAP NetWeaver 服务器适配器
将Eclipse与SAP NetWeaver应用服务器集成。

SublimeText3 英文版
推荐:为Win版本,支持代码提示!

螳螂BT
Mantis是一个易于部署的基于Web的缺陷跟踪工具,用于帮助产品缺陷跟踪。它需要PHP、MySQL和一个Web服务器。请查看我们的演示和托管服务。

PhpStorm Mac 版本
最新(2018.2.1 )专业的PHP集成开发工具

mPDF
mPDF是一个PHP库,可以从UTF-8编码的HTML生成PDF文件。原作者Ian Back编写mPDF以从他的网站上“即时”输出PDF文件,并处理不同的语言。与原始脚本如HTML2FPDF相比,它的速度较慢,并且在使用Unicode字体时生成的文件较大,但支持CSS样式等,并进行了大量增强。支持几乎所有语言,包括RTL(阿拉伯语和希伯来语)和CJK(中日韩)。支持嵌套的块级元素(如P、DIV),