硬件条件:
gpu最低12G
软件:
cuda需支持
Python选择3.10+吧,我的版本3.11
源码: GitHub - fudan-generative-vision/hallo: Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation
models文件:
链接: https://pan.baidu.com/s/18eb13VskOhdNRNtUqUBXHA 提取码: dda8
在云gpu上下载代码,我用的web版本的:
git clone https://github.com/daswer123/hallo-webui.git
安装项目需要包
pip install -r requirements.txt
把上面百度网盘的models解压到项目的根目录下
如果需要修改监听ip和端口,可以修改文件app.py文件的demo.launch(inbrowser=True, share=share_url)调用代码把ip和端口带上
接下来可以开始启动web服务了
python app.py
最终会看到类似一个这样的界面:
开始具体操作:
图片素材——人物半镜
经过长时间的执行,最后得到
20240709-093349
如果是只有大头贴的张片可能效果还可以一点,不过也没网上说的那么多牛逼
体验:
12G显卡执行时间非常畅3s的视频就需要很长时间,如果10s 20s那就更长了,效率差
最终的到的效果也不怎么样,当然我想要的就是至少上半身的人物,而不是只有大头贴