AniPortrait 是腾讯开源的 AI 视频工具,能让静态肖像根据驱动视频做出表情和动作。本文深度评测其功能、优缺点、使用技巧,并给出 10 分制客观评分。功能完整但速度慢,适合有显卡的创作者。

你有没有想过,让一张静态照片开口说话?或者把一段舞蹈动作无缝迁移到另一个人身上?过去这得靠专业团队花几天时间做特效,现在有个叫 AniPortrait 的工具,普通人也能在几分钟内搞定。它到底怎么用?效果靠谱吗?我花了一周时间深度体验,下面全是实话。

它到底能做什么?

AniPortrait 是腾讯开源的 AI 视频生成工具,核心能力就两件事:面部重演姿态迁移。你可以上传一张人物肖像(照片或画作都行),再给一段驱动视频——比如你自己对着镜头说话,或者一段舞蹈——它就能让肖像里的人物做出跟驱动视频一模一样的表情和动作。

实际用下来,最惊艳的是嘴唇同步。我说“你好,今天天气不错”,生成的肖像嘴型几乎对得上,连牙齿的细节都有。另一个亮点是头部姿态控制,你歪头、点头,肖像也跟着动,不是那种僵硬的面具感。

适合谁用?短视频创作者做虚拟主播、游戏玩家让角色“活”起来、老照片修复后加上动态表情,甚至老师做课件时让历史人物“开口讲课”。

优点和缺点,一次说清

先说好的:

  1. 开源免费,部署灵活。代码全在 GitHub 上,你可以本地跑,也能用在线 Demo。对不想花钱买商业软件的人来说,这门槛低太多了。
  2. 动作迁移细腻。相比同类工具,AniPortrait 对眼睛眨动、眉毛挑动这些小表情捕捉得更准,不会出现“死鱼眼”。

但坑也不少:

  1. 对输入素材挑剔。如果肖像照片光线太暗或角度太偏,生成的脸容易扭曲。驱动视频里手部动作多了,它也会糊掉。
  2. 速度慢,吃显卡。我用 RTX 3060 跑 10 秒视频,花了将近 4 分钟。想实时?别想。而且显存低于 8GB 基本跑不动。

怎么用效果最好?三个私藏技巧

第一,肖像要“正”。 选一张正面、光线均匀、五官清晰的照片。别用侧脸或戴墨镜的,否则生成出来像恐怖片。

第二,驱动视频别太长。 先剪成 5~8 秒的片段测试,确认效果后再跑长的。不然等半天出来一坨废片,心态会崩。

第三,善用参考帧。 如果你想让肖像保持某个特定表情(比如微笑),可以在驱动视频开头加一帧那个表情,模型会跟着学。这个技巧官方文档没写,是我自己试出来的。

评分:10分制,它值多少?

以下评分基于我个人的使用体验,满分 10 分,权重分配为:功能完整性 25%、易用性 20%、生成质量 30%、速度与性能 15%、性价比 10%。

  • 功能完整性:8.5分。面部重演和姿态迁移都做得不错,但缺少音频驱动口型(得额外接其他模型),算个小遗憾。
  • 易用性:7.0分。在线 Demo 还行,但本地部署要配环境、下模型,对小白不友好。文档也偏简略。
  • 生成质量:8.0分。表情自然,嘴型同步好,但遇到复杂动作或遮挡时会有伪影。
  • 速度与性能:6.5分。这是最大短板。生成慢,显存要求高,实时交互基本无缘。
  • 性价比:10分。开源免费,还要啥自行车?

综合加权计算:(8.5×0.25 + 7.0×0.20 + 8.0×0.30 + 6.5×0.15 + 10×0.10) = 2.125 + 1.4 + 2.4 + 0.975 + 1.0 = 7.9分

维度分数理由
功能完整性8.5核心功能扎实,但缺音频驱动
易用性7.0本地部署门槛高,文档一般
生成质量8.0表情细腻,复杂场景有瑕疵
速度与性能6.5慢且吃显存,实时无望
性价比10完全免费开源
综合7.9/10有短板,但免费+质量在线,值得折腾

如果你手头有张好显卡,又不急着要实时结果,AniPortrait 绝对值得一试。但要是想开箱即用、秒出片,它可能让你抓狂。去官方网站看看 Demo 再决定吧。