本文由 资源共享网 – ziyuan 发布,转载请注明出处,如有问题请联系我们!通义Wan2.1的720p高清图生视频大模型
通义Wan2.1的720p高清图生视频(I2V)大模型**,参数量14B,采用FP8_e4m3fn精度压缩,文件格式为安全的safetensors,是Wan2.1图生视频主流使用版本。
核心基础信息
功能定位:由阿里通义开源的视频生成模型,核心能力是将一张静态输入图转换为自然动态视频,支持最高720p分辨率输出。
精度优化:采用FP8_e4m3fn浮点精度压缩,相比bf16版本,显存占用降低约50%,仅需要16GB显存即可运行720p生成分辨率,适配更多消费级显卡,精度损失可以忽略。
部署路径:标准存放路径为ComfyUI的
models/diffusion_models/目录,除了该UNet权重,还需要额外配套下载文本编码器和VAE权重才能完整运行。
核心特性与支持能力
控制支持:支持多种ControlNet控制信号,包括Canny边缘、深度图、OpenPose人体姿态、MLSD线稿和相机轨迹,实现对视频生成内容的精准引导。
分辨率适配:官方原生支持720p高清输出,画面细节更清晰,动态连贯性优于480p版本,适合生成高质量创作视频。
社区资源丰富:Reddit的ComfyUI和Stable Diffusion社区有大量用户共享的优化工作流和参数调优技巧,新手可以直接复用成熟方案。
本地生成推荐参数(适配Mac 32GB)
参考社区实测方案,通用参数配置参考:
Sampler(采样器):euler
Scheduler(调度器):normal
Steps(步数):30(平衡速度与质量)
CFG Scale:7.5
Denoise(去噪强度):0.85
FPS:16,总生成帧数:81(对应生成约5秒视频)
与《通义Wan2.1的720p高清图生视频大模型》相关的《AI设计》
Al生成3D模型、视频模型、图片模型、图片模型、音乐模型合集
Al生成3D模型合集Al生成视频模型合集Al生成图片模型合集Al生成音乐模型合集Al语音克隆合集
15 174 0
视频生成模型Self Forcing
Self Forcing 是 Adobe Research 与德克萨斯大学奥斯汀分校联合推出的新型自回归视频生成算法,解决传统生成模型在训练与测试时的暴露偏差问题。通过在训练阶段模拟自生成过程,以先前生成的帧为条件生成后续帧,而非依赖真实帧,弥合训练与测试分布的差异。Self Forcing 引入滚动 KV 缓存机制,支持理论上无限长的视频生成,在单个 H100 GPU 上实现 17 FPS 的实...
5 1470 0
轻量级开源视频生成模型LTX-Video
ltx-video-2b-v0.9.5.safetensors是轻量级开源视频生成模型LTX-Video的0.9.5版本核心权重文件,采用safetensors格式存储,是目前LTX-Video在ComfyUI中部署的官方推荐版本。核心基础信息模型规模:参数量为2B(20亿),属于轻量级视频生成模型,相比大参数模型,对消费级显卡更友好。存储格式:使用安全的safetensors格式,...
5 514 0
SD1.5官方基础大模型
SD1.5官方基础大模型是Stable Diffusion生态中应用最广泛的基础模型,是绝大多数第三方SD模型的训练基底。核心基础信息发布时间与定位:2022年10月正式发布,是SD 1.x系列的成熟稳定版本,目前仍是社区生态最完善的基础模型。训练规格:基于512×512分辨率图像训练,通过先生成低分辨率再 upscale 的方式也支持更高分辨率出图,显存要求低,消费级显卡即可流畅...
5 522 0
虚拟试衣大模型CatVTON
CatVTON是一款开源的虚拟试衣大模型,由国内AI团队研发,能基于人物图像和目标衣物图像生成自然贴合人体的试衣效果,是目前效果领先的开源试衣方案。核心特点与能力支持任意试衣场景:支持多类别衣物(上衣、下装、连衣裙、外套等),适配任意人体姿势、复杂褶皱,衣物纹理和图案保留完整,贴合度远高于传统虚拟试衣方案。推理效率高:基于流匹配架构优化,单张试衣图生成速度快,在RTX 3090显卡上仅...
5 558 0
基于SDXL框架开发的顶级写实风格AI绘画大模型
realvisxlV40_v40Bakedvae.safetensors是基于SDXL框架开发的顶级写实风格AI绘画大模型,已经内置烘焙好的匹配VAE,是目前SDXL生态中最受欢迎的写实底模之一,文件格式为安全的safetensors。核心特点与定位它主打极致照片级真实感,是RealVisXL系列的V4.0稳定版本,核心优势突出:内置匹配的 baked VAE,下载后直接加载即可使用,无需...
5 522 0


