人像照片如何變成會(huì)轉(zhuǎn)頭會(huì)說(shuō)話的動(dòng)態(tài)肖像)
LivePortrait 上手靜態(tài)人像照片如何變成會(huì)轉(zhuǎn)頭會(huì)說(shuō)話的動(dòng)態(tài)肖像【免費(fèi)下載鏈接】LivePortraitBring portraits to life!項(xiàng)目地址: https://gitcode.com/GitHub_Trending/li/LivePortrait你拍了一張很滿意的人像很想讓照片里的人轉(zhuǎn)頭、眨眼、甚至笑一下。LivePortrait 是一個(gè)開(kāi)源的人像動(dòng)畫(huà)工具給它一張靜態(tài)人像照片和一段驅(qū)動(dòng)素材它就能生成這張人臉跟隨動(dòng)作動(dòng)的動(dòng)態(tài)肖像。下面按我實(shí)際跑通的順序帶你從裝環(huán)境到出片再把效果調(diào)到位。效果先看看人、寵物、圖片驅(qū)動(dòng)都能做同一個(gè)流水線下面幾種效果都支持人類肖像動(dòng)畫(huà)人像 驅(qū)動(dòng)視頻輸出動(dòng)態(tài)肖像源也可以給視頻就變成 v2v 的視頻編輯——原視頻里的人做出驅(qū)動(dòng)動(dòng)作背景和人物保持一致。寵物模式單獨(dú)訓(xùn)練的貓狗權(quán)重寵物照片也能眨眼、轉(zhuǎn)頭。圖片驅(qū)動(dòng)與區(qū)域控制用一張圖當(dāng)驅(qū)動(dòng)信號(hào)還能把驅(qū)動(dòng)限制在表情、姿態(tài)、嘴、眼睛里的某一個(gè)區(qū)域比如只動(dòng)嘴、頭保持不動(dòng)。安裝運(yùn)行四步出第一張動(dòng)態(tài)肖像第 1 步拿代碼建環(huán)境前提裝好 git、conda、FFmpeg缺 FFmpeg 按倉(cāng)庫(kù)里的說(shuō)明裝一下git clone https://gitcode.com/GitHub_Trending/li/LivePortrait cd LivePortrait conda create -n liveportrait python3.10 conda activate liveportrait第 2 步裝依賴pip install -r requirements.txtApple Silicon 的 Mac 改用pip install -r requirements_macOS.txt啟動(dòng)前記得設(shè)置PYTORCH_ENABLE_MPS_FALLBACK1。動(dòng)物模式還要額外編譯 X-Pose 的 CUDA 算子進(jìn)入src/utils/dependencies/XPose/models/UniPose/ops目錄執(zhí)行一次python setup.py build install否則跑不起來(lái)。第 3 步下載預(yù)訓(xùn)練權(quán)重放到pretrained_weights/下pip install -U huggingface_hub[cli] huggingface-cli download KlingTeam/LivePortrait \ --local-dir pretrained_weights --exclude *.git* README.md docs連不上 HuggingFace 的話先設(shè)置一個(gè)HF_ENDPOINT鏡像環(huán)境變量再執(zhí)行同一條命令即可。第 4 步出片python inference.py # 用內(nèi)置示例素材直接跑不帶參數(shù) python app.py # 啟動(dòng) Gradio 可視化界面 python app_animals.py # 動(dòng)物模式界面第一條命令跑完animations/目錄會(huì)多出類似s6--d0_concat.mp4的文件里面把驅(qū)動(dòng)視頻、原圖、生成結(jié)果拼在一起方便你直接對(duì)照。三種最常用的玩法做動(dòng)態(tài)頭像源圖一張正面人像就夠。驅(qū)動(dòng)端可以直接用 assets/examples/driving/ 里現(xiàn)成的.pkl動(dòng)作模板比如wink.pkl、talking.pkl。模板是預(yù)先抽好的動(dòng)作、不含人臉畫(huà)面拿來(lái)驅(qū)動(dòng)自己的照片沒(méi)有隱私顧慮python inference.py -s 你的照片.jpg -d assets/examples/driving/wink.pkl在 Gradio 界面里則是拖文件、點(diǎn)Animate不確定效果時(shí)可以先從 Examples 里挑一張示例試跑。給寵物照片加動(dòng)畫(huà) 先確認(rèn)第 2 步里的 X-Pose 算子編譯過(guò)了然后運(yùn)行python inference_animals.py或python app_animals.py。第一張可以照抄官方示例python inference_animals.py -s assets/examples/source/s39.jpg -d assets/examples/driving/wink.pkl --driving_multiplier 1.75 --no_flag_stitching兩個(gè)細(xì)節(jié)寵物的驅(qū)動(dòng)幅度通常要調(diào)大官方示例是 1.75 倍driving_multiplier只在你選了expression-friendly驅(qū)動(dòng)模式時(shí)生效另外動(dòng)物源圖建議關(guān)掉 stitching--no_flag_stitching。Mac 上裝不了 X-Pose寵物模式只能在 NVIDIA GPU 的機(jī)器上跑。用一張照片驅(qū)動(dòng)另一張照片驅(qū)動(dòng)端-d不只能是視頻傳一張圖進(jìn)去輸出的也是一張圖python inference.py -s assets/examples/source/s5.jpg -d assets/examples/driving/d30.jpg默認(rèn)走相對(duì)運(yùn)動(dòng)只把驅(qū)動(dòng)圖相對(duì)其中性形態(tài)的差值作用到源圖上身份保持得比較好想要更強(qiáng)的表情可以加--no_flag_relative_motion但源圖特征可能會(huì)被串味。用--animation_region可以限制作用區(qū)域取exp、pose、lip、eyes、all比如只驅(qū)動(dòng)嘴部就加--animation_region lip。把效果調(diào)順的幾個(gè)旋鈕源圖正面、清晰、無(wú)遮擋分辨率 512×512 以上檢測(cè)框位置不理想時(shí)調(diào)--scale越大臉在裁剪框里越小和--vy_ratio微調(diào)。驅(qū)動(dòng)素材1:1 最好如 512×512第一幀要是中性表情的正臉肩部動(dòng)作盡量少。素材不是正方形時(shí)加--flag_crop_driving_video自動(dòng)裁剪或自己裁好再傳。幅度driving_multiplier是驅(qū)動(dòng)動(dòng)作的倍數(shù)默認(rèn) 1.0人類 0.8–1.2 之間比較穩(wěn)調(diào)大了夸張調(diào)小了僵硬。拼接--flag_stitching默認(rèn)開(kāi)啟負(fù)責(zé)把臉和背景的交界修干凈頭部運(yùn)動(dòng)小的時(shí)候效果最好頭部大角度轉(zhuǎn)動(dòng)或動(dòng)物源圖時(shí)建議關(guān)掉。速度與顯存Linux 上反復(fù)生成的話加--flag_do_torch_compile首次會(huì)多花約一分鐘做編譯之后快 20–30%Windows 和 macOS 不支持。顯存不夠就先降--source_max_dim默認(rèn) 1280設(shè)到 640–960同時(shí)保持 fp16 半精度開(kāi)啟、關(guān)掉其他占 GPU 的程序。所有參數(shù)的默認(rèn)值都能在 src/config/ 里找到配合python inference.py -h看參數(shù)說(shuō)明。容易踩的幾個(gè)坑輸出出現(xiàn)黑塊→ 多半是 GPU 對(duì) fp16 半精度不兼容 → 加--no_flag_use_half_precision重新生成代價(jià)是速度變慢一點(diǎn)。生成動(dòng)作不跟驅(qū)動(dòng)、頭部位置偏移→ 源圖檢測(cè)框沒(méi)對(duì)或驅(qū)動(dòng)視頻第一幀不是中性正臉 → 換一段第一幀干凈的驅(qū)動(dòng)視頻源圖側(cè)把--det_thresh調(diào)低重新檢測(cè)。動(dòng)物模式報(bào)導(dǎo)入或編譯錯(cuò)誤→ X-Pose 的 CUDA 算子沒(méi)裝或 torch 版本和本機(jī) CUDA 不匹配 → 用nvcc -V看 CUDA 版本裝對(duì)應(yīng)版本的 torch再回到 XPose 的 ops 目錄重新編譯。驅(qū)動(dòng)視頻自動(dòng)裁剪沒(méi)對(duì)準(zhǔn)人臉→ 自動(dòng)裁剪只是粗裁 → 用--scale_crop_driving_video、--vy_ratio_crop_driving_video微調(diào)或干脆手動(dòng)裁成 1:1 再傳入。macOS 想用動(dòng)物模式→ X-Pose 不支持 macOS → Mac 上走人類模式requirements_macOS.txt動(dòng)物模式留給帶 NVIDIA GPU 的機(jī)器。到這里主流程就走完了裝環(huán)境、跑通、調(diào)參數(shù)。后續(xù)版本的新功能說(shuō)明可以看 assets/docs/ 里的文檔每次迭代的更新記錄在 assets/docs/changelog/想深入某個(gè)行為src/config/ 里每個(gè)參數(shù)都有默認(rèn)值和注釋?!久赓M(fèi)下載鏈接】LivePortraitBring portraits to life!項(xiàng)目地址: https://gitcode.com/GitHub_Trending/li/LivePortrait創(chuàng)作聲明:本文部分內(nèi)容由AI輔助生成(AIGC),僅供參考