自由地在无限画布上生成图像、视频,用节点串联工作流支持文生图、图生图、AI 视频生成、GPT 多模态对话——所有操作在一个界面中无缝衔接可以自定义api
核心技术特性零样本克隆仅需5秒参考音频,即可复刻目标音色,微调模式下仅需10分钟人声数据,音色相似度可达99%。支持中英文混合语音克隆,针对中文多音字、生僻字做了专门优化,避免出现发音错误。可独立调整语音情感、语速,修改参数不会破坏克隆出的目标音色,生成语音自然度MOS值可达4.2,接近真人录音水平。硬件适配要求最低仅需2GB显存即可运行基础克隆功能,6-8GB显存的普通显卡可流畅生成48...
? 项目亮点? 高质量语音生成生成接近真人发音的语音支持多种语言和口音能够处理情感表达和语调变化?️ 先进的模型架构基于 Transformer 的端到端架构结合了最新的语音合成技术支持长文本合成?️ 功能丰富语音克隆:通过少量样本克隆特定声音多说话人支持背景音乐生成情感控制? 技术特点? 模型结构使用类似 GPT 的自回归架构软件结合声学模型和声码器支持条件生成(说话人、情感等)? 训练数据使用...
一、VoxCPM2.0 整合包基础信息VoxCPM2.0 是完全开源、支持免费商用的多语言语音合成工具,原生输出48kHz高清音频,核心能力覆盖30种语言合成、自然语言描述生成全新音色、可控声音克隆等,适配国内网络可通过ModelScope快速下载模型。二、适配显卡要求最低配置:NVIDIA 显卡显存≥6GB,RTX 3060 等入门级显卡即可运行基础合成任务推荐配置:RTX 4090 及以上显卡...
Wan2GP 是面向低显存用户打造的轻量化开源视频生成工具箱,核心优势是将原本需20-80GB显存的前沿视频模型,压缩至6-10GB显存即可流畅运行,适配GTX 10/20系等老旧显卡,搭配全功能Web界面实现开箱即用。支持MiniMax H3 JoyAI-Echo Bernini LTX-2.3 wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G 显卡就可以跑起来核心适配能力最低6...
MiniMax H3是MiniMax稀宇科技于2026年7月31日发布的通用全模态生成模型,8月3日正式开源,是其海螺视频系列的第三代产品。核心能力支持文本、图像、视频、音频的统一理解与生成,可输出原生双声道音视频,最高生成15秒2K分辨率内容,在Artificial Analysis视频编辑榜单、Arena图生视频排行榜中位列全球第一。开源生态开源24小时内就有超百家国内外芯片厂商、...
ComfyUI-BSAI_v010.rar
有200套,还有提示词
SolidWorks插件是为SolidWorks三维设计软件拓展功能、提升设计效率的辅助工具,分为官方原生插件和第三方开发插件两大类,能帮助工程师从重复繁琐的建模、出图等工作中解放出来。
Al生成3D模型合集Al生成视频模型合集Al生成图片模型合集Al生成音乐模型合集Al语音克隆合集