多个角色的RVC/gsv3格式语音模型
与《幸运星角色语音模型》相关的《AI设计》
AI数字人生成模型(+语音模型)
1. AI数字人生成Sonic模型(当前热度最高)核心能力:只需一张人脸静态照片+一段音频,就能快速生成唇形精准、表情自然的说话人脸视频,是当前效果领先的开源数字人方案。技术特点:采用端到端生成方案,替代传统3D动捕/早期固定嘴型方案,能根据音频自动联动生成脸颊、眼周微表情,唇形同步精度极高。优势对比:表格对比项传统3D方案早期开源方案(如Wav2Lip)Sonic模型准备成本极高(需...
5 448 0
人脸检测识别模型
w600k_r50.onnx是InsightFace人脸检测识别项目**中,基于WIDER Face数据集训练的ResNet50骨干网络的ONNX格式人脸特征提取权重,用于人脸特征编码(人脸识别场景。核心参数解析w600k:模型基于包含60万张人脸的大规模数据集训练,覆盖更全面,对不同人种、姿态的人脸特征泛化能力更强。r50:代表骨干网络是ResNet50,是精度和速度的经典平衡选择。...
5 470 0
Al生成3D模型、视频模型、图片模型、图片模型、音乐模型合集
Al生成3D模型合集Al生成视频模型合集Al生成图片模型合集Al生成音乐模型合集Al语音克隆合集
15 102 0
腾讯MimicMotion人体动作迁移模型
MimicMotionMergedUnet_1-1-fp16.safetensors是腾讯MimicMotion人体动作迁移模型的FP16精度UNet权重文件,适配ComfyUI的MimicMotion插件工作流,用于将参考视频的人体动作迁移到参考图像生成对应动作视频。核心定位与特点它是MimicMotion 1.1版本的UNet合并权重,采用FP16半精度存储,兼顾性能和画质,主要特点:适...
5 445 0


