Python+AI让静态图片动起来-人工智能-PHP中文网

首页

科技周边

人工智能

Python+AI让静态图片动起来

王林

Apr 08, 2023 pm 11:41 PM

pythonai静态图片

哈喽，大家好。

大家在刷短视频的时候有没有刷到这样的视频，视频里一张静态的人物图片能动起来，如：歪歪头、眨眨眼。

类似于下面这种效果

最左侧的人物是原始的动作，上面是静态图片。通过AI技术便可以让最左侧人物的动作运用到上面的静态图片上，从而让张图都可以做出相同的动作。

这种技术一般是基于的GAN（生成对抗网络）来实现，今天我给大家分享一个开源项目，能够复现上面的效果，可以做些有趣的项目，也可以怀念故人。

1. 运行项目

项目地址：https://github.com/AliaksandrSiarohin/first-order-model

首先，git clone将项目下载到本地，进入项目安装依赖。

git clone https://github.com/AliaksandrSiarohin/first-order-model.git<br>cd first-order-model<br>pip install -r requirements.txt

然后，在项目首页Pre-trained checkpoint标题下，找到模型下载链接，下载模型文件，模型有很多，我用的是vox-adv-cpk.pth.tar。

准备好模型文件后，在项目根目录下执行下面命令即可。

python demo.py<br>--config config/vox-adv-256.yaml <br>--driving_video src_video.mp4 <br>--source_image src_img.jpg <br>--checkpoint weights/vox-adv-cpk.pth.tar

解释下参数：

--config：模型配置文件，在源文件中有
--driving_video：提供动作的视频
--source_image：需要加动效的静态图片
--checkpoint：刚刚下载的模型文件

运行完成后，会看到如下输入。

该项目使用PyTorch搭建神经网络，支持GPU和CPU运行，所以如果你的电脑只有CPU，运行会比较慢。

我是在CPU下运行的，从上图可以看到，driving_video只有 31 帧。如果你也是CPU运行，最好控制driving_video视频的时长，不然运行时长会比较长。

有了该项目，可以自己做些比较有意思的尝试。

2. Python API

上面教大家按照官网在命令行运行该项目。

有些朋友可能想在Python项目中调用，所以我在demo.py中抽取了核心代码，封装了一个Pyhton API。

有需要的朋友可以下载这个文件，放到与first-order-model同一级的目录下，按照下面代码调用即可。

fom = FOM()<br><span style="color: rgb(106, 115, 125); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);"># 查看驱动视频，驱动视频最好裁剪为480 x 640 大小的视频</span><br>driving_video = <span style="color: rgb(102, 153, 0); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);">''</span><br><span style="color: rgb(106, 115, 125); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);"># 被驱动的画面</span><br>source_image = <span style="color: rgb(102, 153, 0); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);">''</span><br><span style="color: rgb(106, 115, 125); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);"># 输出视频</span><br>result_video = <span style="color: rgb(102, 153, 0); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);">''</span><br><span style="color: rgb(106, 115, 125); margin: 0px; padding: 0px; background: none 0% 0% / auto repeat scroll padding-box border-box rgba(0, 0, 0, 0);"># 驱动画面</span><br>fom.img_to_video(driving_video, source_image, result_video)

以上是Python+AI让静态图片动起来的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文转载于：51CTO.COM。如有侵权，请联系admin@php.cn删除

AI游戏开发通过Upheaval的Dreamer Portal进入其代理时代May 02, 2025 am 11:17 AM

动荡游戏：与AI代理商的游戏开发彻底改变 Roupheaval是一家游戏开发工作室，由暴风雪和黑曜石等行业巨头的退伍军人组成，有望用其创新的AI驱动的Platfor革新游戏创作

Uber想成为您的Robotaxi商店，提供商会让他们吗？May 02, 2025 am 11:16 AM

Uber的Robotaxi策略：自动驾驶汽车的骑车生态系统在最近的Curbivore会议上，Uber的Richard Willder推出了他们成为Robotaxi提供商的乘车平台的策略。利用他们在

AI代理玩电子游戏将改变未来的机器人May 02, 2025 am 11:15 AM

事实证明，视频游戏是尖端AI研究的宝贵测试场所，尤其是在自主代理和现实世界机器人的开发中，甚至有可能促进人工通用智能（AGI）的追求。一个

创业公司工业综合体VC 3.0和James Currier的宣言May 02, 2025 am 11:14 AM

不断发展的风险投资格局的影响在媒体，财务报告和日常对话中显而易见。但是，对投资者，初创企业和资金的具体后果经常被忽略。风险资本3.0：范式

Adobe在Adobe Max London 2025更新创意云和萤火虫May 02, 2025 am 11:13 AM

Adobe Max London 2025对Creative Cloud和Firefly进行了重大更新，反映了向可访问性和生成AI的战略转变。该分析结合了事件前简报中的见解，并融合了Adobe Leadership。（注意：Adob

Llamacon宣布的所有元数据May 02, 2025 am 11:12 AM

Meta的Llamacon公告展示了一项综合的AI策略，旨在直接与OpenAI等封闭的AI系统竞争，同时为其开源模型创建了新的收入流。这个多方面的方法目标bo

关于AI仅仅是普通技术的主张的酿造争议May 02, 2025 am 11:10 AM

人工智能领域对这一论断存在严重分歧。一些人坚称，是时候揭露“皇帝的新衣”了，而另一些人则强烈反对人工智能仅仅是普通技术的观点。让我们来探讨一下。对这一创新性人工智能突破的分析，是我持续撰写的福布斯专栏文章的一部分，该专栏涵盖人工智能领域的最新进展，包括识别和解释各种有影响力的人工智能复杂性（请点击此处查看链接）。人工智能作为普通技术首先，需要一些基本知识来为这场重要的讨论奠定基础。目前有大量的研究致力于进一步发展人工智能。总目标是实现人工通用智能（AGI）甚至可能实现人工超级智能（AS