inswapper_128.onnx是开源AI换脸项目InsightFace Swap(原ROOP)的核心模型权重文件,基于ONNX格式,专门用于将一张源人脸图像无缝替换到目标视频或图像中。
核心信息解析
模型定位:它是InsightFace生态中专门用于单图换脸(One-Shot Face Swapping)的预训练模型。只需提供一张源人脸照片,即可将视频中所有出现的人脸替换为该源人脸,无需针对特定人物进行额外训练。
参数含义:
inswapper:指代 InsightFace Swapper 模型架构。128:代表模型处理的人脸裁剪分辨率为 128x128 像素。这是速度与精度的平衡点,既能保证面部特征清晰,又能实现实时或准实时的推理速度。.onnx:开放神经网络交换格式。这种格式具有极强的跨平台兼容性,可以在 CPU、GPU(NVIDIA/AMD)、甚至移动端设备上通过 ONNX Runtime高效运行,无需安装庞大的 PyTorch/TensorFlow 环境。
主要应用场景
视频换脸:在 ROOP、FaceFusion、ReActor等主流换脸软件中,该文件是必须加载的核心组件。
图像换脸:静态图片的人脸替换。
实时直播换脸:由于ONNX推理效率高,配合优化后的后端,可实现低延迟的实时换脸效果。
部署与使用注意
依赖环境:通常配合
insightface库和onnxruntime(推荐onnxruntime-gpu以加速)使用。配套模型:除了
inswapper_128.onnx,通常还需要搭配人脸检测模型(如buffalo_l或retinaface)来定位视频中的人脸位置。伦理与法律风险:请务必遵守当地法律法规,仅用于娱乐、艺术创作或获得明确授权的场景。严禁用于制作虚假新闻、诈骗、色情内容或侵犯他人肖像权的行为。
与《AI换脸模型》相关的《AI设计》
BOPBTL checkpoints模型
可用于老照片修复
5 821 0
多模态统一大模型 Florence-2模型
Florence-2是微软研究院推出的开源多模态统一大模型,采用文本Prompt统一所有计算机视觉任务,在零样本能力上表现突出。核心特点任务统一架构:打破传统多任务多模型的设计,用一个纯Transformer架构统一处理目标检测、实例分割、OCR、图像描述、VQA视觉问答、深度估计等数十种CV任务,所有任务都转化为文本生成问题,通过不同Prompt调用即可。极强零样本迁移能力:在126个...
5 820 0
TorchScript 格式的序列化模型
w-ll_ucoco_384_bs5.torchscript.pt 是 DWPose(DW-LL)姿态估计模型的一个特定优化版本,专门用于 ComfyUI ControlNet 等 AI 绘画工作流中的人体关键点检测。该文件是 TorchScript 格式的序列化模型,意味着它已经过编译优化,无需依赖完整的 Python 环境即可高效推理,显著提升了加载速度和运行稳定性。核心参数解析dw-...
5 828 0
基于SDXL框架开发的顶级写实风格AI绘画大模型
realvisxlV40_v40Bakedvae.safetensors是基于SDXL框架开发的顶级写实风格AI绘画大模型,已经内置烘焙好的匹配VAE,是目前SDXL生态中最受欢迎的写实底模之一,文件格式为安全的safetensors。核心特点与定位它主打极致照片级真实感,是RealVisXL系列的V4.0稳定版本,核心优势突出:内置匹配的 baked VAE,下载后直接加载即可使用,无需...
5 823 0
Stability AI基础大模型
sd_xl_base_1.0.safetensors是Stability AI官方发布的SDXL 1.0基础大模型的权重文件,采用安全的safetensors格式存储,是所有基于SDXL生态模型的官方基础基底。核心基础信息定位:作为SDXL架构的基础模型,是所有SDXL创作、二次微调的起点,负责根据文字提示生成初始图像框架,官方通常配合sd_xl_refiner_1.0.safetens...
5 856 0
AI数字人生成模型(+语音模型)
1. AI数字人生成Sonic模型(当前热度最高)核心能力:只需一张人脸静态照片+一段音频,就能快速生成唇形精准、表情自然的说话人脸视频,是当前效果领先的开源数字人方案。技术特点:采用端到端生成方案,替代传统3D动捕/早期固定嘴型方案,能根据音频自动联动生成脸颊、眼周微表情,唇形同步精度极高。优势对比:表格对比项传统3D方案早期开源方案(如Wav2Lip)Sonic模型准备成本极高(需...
5 822 0


