搜索
首页科技周边人工智能高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪

高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
请注意,上述动图完全是由多张照片渲染出来的 3D 场景。人类很难发现它们的破绽。

那让我们一起看看,这种场景是怎样实现的。

网格和点是最常见的三维场景表示法,因为它们是显式的,非常适合基于 GPU/CUDA 的快速光栅化。相比之下,最新的神经辐射场(NeRF)方法建立在连续场景表征的基础上,通常使用体积光线渲染优化多层感知器(MLP),对捕捉到的场景进行新视角合成。虽然这些方法的连续性有助于优化,但渲染所需的随机取样成本很高,而且会产生噪声。 

来自法国蔚蓝海岸大学的研究者引入了一种新方法,能够结合这两种方法的优点:3D 高斯表征有着 SOAT 视觉质量,并且在训练时间上也进行了优化,而基于 tile 的抛雪球算法(tile-based splatting)在几个数据集上以 1080p 分辨率实现 SOTA 实时渲染。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
论文地址:https://huggingface.co/papers/2308.04079
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
研究团队立下目标:对多张照片拍摄的场景进行实时渲染,并在典型真实场景中实现时间最优化。此前,Fridovich-Kei 等人提出的方法虽然实现了快速训练,但难以达到当前 SOTA NeRF 方法所获得的视觉质量,而后者需要长达 48 小时的训练时间。还有研究提出快速但质量较低的辐射场方法,可以根据场景实现交互式渲染(每秒 10-15 帧),但这种方法无法实现高分辨率下的实时渲染。

接下来,我们来看本文是如何实现的。

方法

研究团队的解决方案主要由三个部分组成。

第一,引入 3D 高斯作为一种灵活而富有表现力的场景表征。输入与 NeRF 方法类似,即使用结构 - 运动(SfM)校准像机,并且使用稀疏点云初始化 3D 高斯集合,点云来自 SfM 过程。此外,该研究只用 SfM 点作为输入就能获得高质量的结果。需要注意的是,对于 NeRF 合成数据集,即使采用随机初始化,本文方法也能获得高质量的结果。研究表明,3D 高斯是一个很好的选择。

第二,优化 3D 高斯属性,即 3D 位置、不透明度?、各向异性协方差和球谐波(SH)系数。优化过程产生了一个相当紧凑、非结构化和精确的场景表征。

第三,实时渲染解决方案,该研究使用快速 GPU 排序算法。不过,由于采用了 3D 高斯表征,可以在遵循可见度排序的情况下进行各向异性拼接,这要归功于排序和?- blending— 并通过跟踪所需的尽可能多排序拼接的遍历,实现快速准确的向后传递。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
方法概览

综上,本文做出了以下贡献:

  • 引入各向异性 3D 高斯作为辐射场的高质量、非结构化表征;
  • 3D 高斯属性的优化方法,与自适应密度控制交织在一起,为捕捉到的场景创建高质量的表征;
  • 针对 GPU 的快速可微分渲染方法,该方法具有可视性感知功能,允许各向异性拼接和快速反向传播,以实现高质量的新视图合成。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
实验

下图显示了本文的方法与以往方法效果的比较。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
场景自上而下依次为来自 Mip-NeRF360 数据集的自行车、花园、柜台和房间;来自深度混合数据集的游戏室(更多对比请阅读原文)。图中把不同方法产生的显着差异已经标出,如自行车的辐条、花园远处的房屋玻璃、铁篮子的杆子以及玩具小熊。

可以观察出,本文的方法相比以往的方法在细节上更具有优势。

高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
视频中可以看到更加明显的区别

除此之外,在图6 中我们可以看到,即使迭代7K 次(∼ 5 分钟),本文方法也能很好地捕捉列车的细节。在迭代 30K 次(∼35 分钟)时,背景伪影明显减少。对于花园场景,差异几乎不明显,7K 次迭代(∼8 分钟)已经是非常高的质量了。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
研究团队采用Mip-NeRF360 建议的方法,将数据集分为训练/ 测试两部分,每隔8 张照片进行测试,以便进行一致且有意义的比较,从而生成误差指标,并使用文献中最常用的标准PSNR、L-PIPS 和SSIM 指标,详细数据见表1。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
表 1 展现了通过三个数据集计算得出的新方法与之前的工作相比的定量评估。标有「†」的结果直接采用了原论文,其他结果均为该实验团队的实验结果。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
合成 NeRF 的 PSNR 分数。可以看到本文方法在多数情况下分数都较好,甚至达到最优。

消融实验

研究团队将所做的不同贡献和算法选择分离出来,并构建了一组实验来衡量它们的效果。对算法的以下几个方面进行了测试:从 SfM 初始化、致密化策略、各向异性协方差、允许无限数量的斑块具有梯度以及球谐波的使用。下表总结了每种选择的定量效果。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
我们来看看更直观的效果。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
使用 SfM 点进行初始化会产生更好的效果。
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
Clone 和 Split 两种情况下的消融致密化策略
高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪
限制接受渐变的点的数量,对视觉质量影响是显着的。左图:限制接收梯度的 10 个高斯点。右图:本文的完整方法。 

想要了解更多详细内容,请阅读原文。

以上是高清视频竟不是真的,几张照片渲染的3D场景让你难辨真伪的详细内容。更多信息请关注PHP中文网其他相关文章!

声明
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
拥抱面部是否7B型号奥林匹克赛车击败克劳德3.7?拥抱面部是否7B型号奥林匹克赛车击败克劳德3.7?Apr 23, 2025 am 11:49 AM

拥抱Face的OlympicCoder-7B:强大的开源代码推理模型 开发以代码为中心的语言模型的竞赛正在加剧,拥抱面孔与强大的竞争者一起参加了比赛:OlympicCoder-7B,一种产品

4个新的双子座功能您可以错过4个新的双子座功能您可以错过Apr 23, 2025 am 11:48 AM

你们当中有多少人希望AI可以做更多的事情,而不仅仅是回答问题?我知道我有,最近,我对它的变化感到惊讶。 AI聊天机器人不仅要聊天,还关心创建,研究

Camunda为经纪人AI编排编写了新的分数Camunda为经纪人AI编排编写了新的分数Apr 23, 2025 am 11:46 AM

随着智能AI开始融入企业软件平台和应用程序的各个层面(我们必须强调的是,既有强大的核心工具,也有一些不太可靠的模拟工具),我们需要一套新的基础设施能力来管理这些智能体。 总部位于德国柏林的流程编排公司Camunda认为,它可以帮助智能AI发挥其应有的作用,并与新的数字工作场所中的准确业务目标和规则保持一致。该公司目前提供智能编排功能,旨在帮助组织建模、部署和管理AI智能体。 从实际的软件工程角度来看,这意味着什么? 确定性与非确定性流程的融合 该公司表示,关键在于允许用户(通常是数据科学家、软件

策划的企业AI体验是否有价值?策划的企业AI体验是否有价值?Apr 23, 2025 am 11:45 AM

参加Google Cloud Next '25,我渴望看到Google如何区分其AI产品。 有关代理空间(此处讨论)和客户体验套件(此处讨论)的最新公告很有希望,强调了商业价值

如何为抹布找到最佳的多语言嵌入模型?如何为抹布找到最佳的多语言嵌入模型?Apr 23, 2025 am 11:44 AM

为您的检索增强发电(RAG)系统选择最佳的多语言嵌入模型 在当今的相互联系的世界中,建立有效的多语言AI系统至关重要。 强大的多语言嵌入模型对于RE至关重要

麝香:奥斯汀的机器人需要每10,000英里进行干预麝香:奥斯汀的机器人需要每10,000英里进行干预Apr 23, 2025 am 11:42 AM

特斯拉的Austin Robotaxi发射:仔细观察Musk的主张 埃隆·马斯克(Elon Musk)最近宣布,特斯拉即将在德克萨斯州奥斯汀推出的Robotaxi发射,最初出于安全原因部署了一支小型10-20辆汽车,并有快速扩张的计划。 h

AI震惊的枢轴:从工作工具到数字治疗师和生活教练AI震惊的枢轴:从工作工具到数字治疗师和生活教练Apr 23, 2025 am 11:41 AM

人工智能的应用方式可能出乎意料。最初,我们很多人可能认为它主要用于代劳创意和技术任务,例如编写代码和创作内容。 然而,哈佛商业评论最近报道的一项调查表明情况并非如此。大多数用户寻求人工智能的并非是代劳工作,而是支持、组织,甚至是友谊! 报告称,人工智能应用案例的首位是治疗和陪伴。这表明其全天候可用性以及提供匿名、诚实建议和反馈的能力非常有价值。 另一方面,营销任务(例如撰写博客、创建社交媒体帖子或广告文案)在流行用途列表中的排名要低得多。 这是为什么呢?让我们看看研究结果及其对我们人类如何继续将

公司竞争AI代理的采用公司竞争AI代理的采用Apr 23, 2025 am 11:40 AM

AI代理商的兴起正在改变业务格局。 与云革命相比,预计AI代理的影响呈指数增长,有望彻底改变知识工作。 模拟人类决策的能力

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

Video Face Swap

Video Face Swap

使用我们完全免费的人工智能换脸工具轻松在任何视频中换脸!

热工具

适用于 Eclipse 的 SAP NetWeaver 服务器适配器

适用于 Eclipse 的 SAP NetWeaver 服务器适配器

将Eclipse与SAP NetWeaver应用服务器集成。

Dreamweaver Mac版

Dreamweaver Mac版

视觉化网页开发工具

SublimeText3 英文版

SublimeText3 英文版

推荐:为Win版本,支持代码提示!

螳螂BT

螳螂BT

Mantis是一个易于部署的基于Web的缺陷跟踪工具,用于帮助产品缺陷跟踪。它需要PHP、MySQL和一个Web服务器。请查看我们的演示和托管服务。

WebStorm Mac版

WebStorm Mac版

好用的JavaScript开发工具