当前位置: 首页 > news >正文

人像动画制作教程:用 LivePortrait 三步让老照片开口说话

人像动画制作教程:用 LivePortrait 三步让老照片开口说话

【免费下载链接】LivePortraitBring portraits to life!项目地址: https://gitcode.com/GitHub_Trending/li/LivePortrait

LivePortrait 是一款来自快手团队的免费开源人像动画工具,只要给它一张静态照片和一段参考动作,就能让照片里的人物眨眼、微笑、开口说话,甚至转动头部。这篇人像动画制作教程面向零基础新手,不要求任何编程背景,跟着下面的步骤,你也能在十几分钟内做出第一条会动的人像视频。

别让老照片继续"沉默"下去

打开手机相册,那些泛黄的老照片、聚会时的合影、孩子的周岁照……大多只能静静躺在文件夹里。定格的一瞬间再美好,也总让人忍不住想:要是照片里的人能眨眨眼、笑一笑该多好。

这个愿望如今已经不再是特效公司的专利。LivePortrait 正是为这件事而生的开源人像动画工具——它把"让肖像动起来"做成了一种开箱即用的体验:无需复杂的影视后期,不要求会写代码,一张图加上一段参考动作,就能产出自然、流畅、几乎看不出生硬拼接痕迹的动画结果。

更重要的是,它免费、开源,背后有公开的技术论文支持,社区也在持续更新模型与功能。人像动画制作的门槛,第一次降到了普通人的手边。

一张图能"活"成什么样:三种典型想象

在动手之前,先看看这个工具能把你的素材变成什么。

给回忆补上动态。把全家福里爷爷的严肃表情换成微笑,让老照片里的人物冲你眨眨眼,静态的家族记忆瞬间有了温度——这大概是普通人最容易共情的玩法。

让创作多一种素材。短视频博主可以快速产出"名画开口说话""历史人物表情包"这类高传播内容;历史爱好者能让文物与画作里的面孔"活"过来,讲一段别开生面的故事。

给宠物做专属表情包。除了人类肖像,LivePortrait 还专门训练了动物模型,猫猫狗狗也能在你的驱动下做出眨眼、张嘴等表情。

下面这张对比图直观展示了表情迁移的威力:左侧人物的表情,被完整地"搬"到了右侧人物脸上,生成结果几乎看不到违和感。

零基础快速上手:跑通第一条人像动画

整个流程可以浓缩成四步:装环境、下模型、启动界面、点击生成。按顺序做就好。

第一步:准备基础环境

动手前请确认电脑上已经装好了三样东西:Git(用于拉取代码)、conda(用于创建独立的运行环境)和FFmpeg(用于视频的读取与合成)。前两者通常不难搞定,FFmpeg 是新手最容易卡住的环节——好消息是,不同系统都有现成的安装方案:Ubuntu 上执行sudo apt install ffmpeg,macOS 上用brew install ffmpeg,Windows 用户则可以把ffmpeg.exeffprobe.exe放进项目根目录。

第二步:克隆仓库并安装依赖

打开终端,依次执行下面的命令:

git clone https://gitcode.com/GitHub_Trending/li/LivePortrait cd LivePortrait conda create -n LivePortrait python=3.10 conda activate LivePortrait pip install -r requirements.txt

如果你使用的是搭载 Apple Silicon 的 Mac,官方提供了单独的依赖清单(requirements_macOS.txt),照着一并安装即可。NVIDIA 显卡用户记得先确认自己的 CUDA 版本,再安装与之匹配的 PyTorch——这一步版本不匹配,是新手最常见的翻车点之一。

第三步:下载预训练模型

代码只提供了"骨架",真正的"大脑"是预训练权重。执行下面的命令,把模型下载到项目的pretrained_weights目录:

huggingface-cli download KlingTeam/LivePortrait --local-dir pretrained_weights

若官方渠道访问不便,文档里也给出了镜像站与网盘等多种备选途径。

第四步:两种方式产出第一条动画

方式一:命令行直出。运行下面的命令,稍等片刻,就会在animations目录下得到一段名为s6--d0_concat.mp4的成品,画面里同时包含驱动视频、原始素材与生成结果三段对比:

python inference.py

你也可以换成自己的素材,例如用assets/examples/source/s9.jpg这张源图,配合assets/examples/driving/d0.mp4的动作去驱动。

方式二:图形界面操作。对零基础用户来说,更推荐这个方式。运行python app.py,浏览器会自动打开一个 Gradio 操作面板,整个流程被清晰拆成了三步:

  1. 选择源素材:上传你想"复活"的肖像图片或视频;
  2. 选择驱动素材:上传包含目标表情与动作的参考视频;
  3. 点击 Animate:一键生成动画,结果直接展示在页面底部。

从上传到出片,整个过程不超过一分钟,第一次成功的成就感来得非常快。

创意玩法合集:让照片"活"出六种花样

跑通基础流程后,你其实只解锁了 LivePortrait 的冰山一角。下面按玩法逐一拆解,每个都能单独组合进你的创作流程。

玩法一:用一张照片"偷学"另一张脸的表情

不想费心找驱动视频?LivePortrait 支持用单张图片作为驱动信号。在界面上切换到"Driving Image"模式,上传一张带着目标表情的人像,系统会自动提取其中的表情与姿态特征,并应用到你的源照片上。想让人物"学"一个惊讶脸,一张素材图就够了。

玩法二:像调音台一样手动"捏"表情

如果既不想找驱动素材,又想要精确到"嘴角上扬几分"的控制,那就试试表情编辑面板。它把面部变化拆解成了一个个可拖动的滑块:眼睛开合度、嘴唇开合度、微笑强度、眨眼程度……想要"微微笑"还是"笑不露齿",全凭你的手感。

玩法三:给头部装一个方向盘

表情之外,姿态同样可调。通过 yaw、pitch、roll 三个方向的控制,可以让画面中的人物向左看、向右看、微微仰头。把它和表情滑块组合使用,你就能"导演"出相当丰富的单人表演。

玩法四:让整段视频"换"一副表情

如果源素材本身就是一段视频,LivePortrait 同样支持——也就是业内常说的 v2v(视频到视频)编辑。上传一段人物说话的视频,再设定目标表情或姿态参数,就能在保持口型与动作节奏的基础上,对整段视频的表情进行重定向。

玩法五:给猫猫狗狗做专属表情包

动物模式是另一个宝藏功能。运行python app_animals.py打开动物版界面,上传一张宠物照片,再选择一个驱动动作(例如眨眼),就能得到专属的宠物表情动画。需要注意,动物模式需要 NVIDIA GPU 支持,并且首次使用时要编译一个 X-Pose 相关的算子,官方文档里写得很清楚。

玩法六:用动作模板提速并保护隐私

很多驱动素材其实是重复使用的。LivePortrait 支持把一段驱动视频"提炼"成.pkl动作模板文件,之后可以反复调用,既省去了重复处理的时间,也避免了反复上传他人视频带来的隐私顾虑——你需要的只是"动作",而不是那张脸。

进阶与避坑:从"能动"到"动得漂亮"

三个影响效果上限的素材习惯

同样的参数,有人出片自然,有人出片僵硬,差别往往在素材准备上:

  • 驱动视频尽量用 1:1 画幅,并让画面集中在头部区域,避免大面积的肩部移动干扰表情提取;
  • 保证第一帧是正面、中性表情,这是模型判断"表情基线"的重要依据;
  • 优先选择表情丰富、动作连贯的驱动片段,动作太少会让结果显得"没精神"。

生成面板里的关键旋钮

  • driving multiplier(驱动倍率):控制表情动作的夸张程度,值越大表情越明显,但过大会导致变形失真;
  • relative motion / paste-back / stitching:分别控制相对运动、背景回贴与边缘拼接,保持默认开启通常效果最稳;
  • motion smooth strength(运动平滑):针对视频重定向场景,数值越大,相邻帧之间的动作过渡越柔和。

初次使用建议全程默认参数出片,之后再按需微调,避免一开始就被参数劝退。

新手常见问题速查表

现象大概率原因建议做法
报错提示找不到 FFmpeg系统未安装 FFmpeg按系统类型安装 ffmpeg 后重试
生成速度偏慢未开启编译优化启动时加--flag_do_torch_compile,首次约一分钟预热,之后可提速 20%~30%
驱动效果"没精神"驱动视频首帧非中性表情换成正面、中性表情开头、头肩区域集中的素材
动物模式无法运行缺少 NVIDIA GPU 或未编译算子确认硬件条件,并按官方文档先编译 X-Pose 依赖
想保护他人隐私不想反复上传人脸视频将驱动视频提炼为.pkl动作模板复用

写在最后:素材、源码与下一步

到这里,你已经了解了 LivePortrait 的全部主干能力:从图像驱动、视频驱动,到表情编辑、姿态控制,再到动物模式与动作模板。它真正难得的地方在于——把专业级的人像动画能力,压缩进了普通人也愿意尝试的几分钟流程里

想进一步研究原理,可以去看项目核心实现 src/live_portrait_pipeline.py,模型配置在 src/config/models.yaml;想换一批素材试手,项目自带的 assets/examples/ 里有现成的源图与驱动视频;更多安装细节与更新记录,都收录在 assets/docs/ 目录中。

现在,去相册里挑一张最有故事的照片吧。把它拖进 LivePortrait,看着画面里的人慢慢眨起眼睛——你会发现,"让回忆动起来"这件事,真的没有想象中那么远。

【免费下载链接】LivePortraitBring portraits to life!项目地址: https://gitcode.com/GitHub_Trending/li/LivePortrait

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

http://www.jsqmd.com/news/1405778/

相关文章:

  • 新手 OpCore-Simplify 入门教程:把黑苹果 EFI 制作时间从几天压缩到半小时
  • ESP32开发从零到联网:Arduino-ESP32核心库完整入门指南
  • Libre Barcode实战指南:免费开源的条码生成方案
  • 点喷加盟店选址有什么讲究?三个原则要记牢 - 天下观知
  • 掌握AI教材写作技巧,专业教材编写不再愁,高效完成编写任务 - AI写论文
  • 算法题中排序题的思路、模板与cmp/qsort用法详解
  • 2026读懂大额事故出险报告实操教程,多平台报告对比,乐爱查车标注结构性损伤 - 资讯报道
  • 在AI信息噪音里,真正拉开开发者差距的技能鸿沟
  • 2026年大语言模型分类难题有解!“弱”模型“想象”分类法更经济
  • 消杀公司需要具备哪些资质才能投标?苏州木渎虫控服务商选型参考 - 康一科技
  • 北京东城区2026奢侈品回收白皮书发布,八步标准化流程首次对外公示 - 大牌科普时报
  • 跨平台翻译软件 pot-desktop 上手实战:让划词与 OCR 变成肌肉记忆
  • 普通汽修店师傅能学会点喷技术吗?标准化就是答案 - 天下观知
  • GroundingDINO 在土星云 SE110S 系列上的部署与实战
  • 点喷加盟店开业初期怎么宣传?三招快速打开局面 - 天下观知
  • SpaceX 600 亿美元收购 Cursor,Cursor 将参与 Grok AI 项目
  • PCO 企业规范四害消杀全流程操作,需遵循哪些行业合规标准?苏州木渎选型参考 - 康一科技
  • 网页媒体资源捕获神器:猫抓浏览器扩展安装与使用完整指南
  • DeepSeek Harness 架构拆解:没有“核心“的 Agent 运行时,“万物皆插件“是怎么做到的
  • 基于SpringBoot的仁爱医院信息管理系统的实现(源码+lw+部署文档+讲解等)
  • 告别千兆瓶颈:RTL8125驱动安装全流程与2.5G跑满实战指南
  • 奢二网实操攻略:西城区钻石饰品迭代更新服务详情解读 - 大牌科普时报
  • 2026 广州黄金回收避坑指南,奢二网拆解虚假高价陷阱做好闲置黄金变现 - 每日小知识
  • 北京东城区香奈儿CF黑金和粉色回收价差30%的数据分析 - 大牌科普时报
  • Gemini 3.7 Flash 今日向订阅用户开放:遵循指令、理解意图能力升级
  • 微信聊天记录备份与导出终极指南:用WeChatMsg把十年对话永久存下来
  • 谷歌允许去除AI内容可见水印,不可见标记仍可验证生成来源
  • 网易孵化谦合益邦获超20亿B轮融资,3D存算一体芯片赛道竞争再升级
  • Ventoy 多系统启动盘制作指南:如何用一个U盘装下所有系统镜像
  • 衢州小白学摄影去哪里好?推荐知美人摄影学校 - 港焙西点-知美人美学