栏目分类:
不限 软件 插件 源文件 素材 经验教程 AI设计
AI设计分类
二级分类:
不限 AI软件 AI模型 AI教程
最新 人气 评论 积分
最新AI设计

无限画布ai生图像、视频工作流工具源码

无限画布ai生图像、视频工作流工具源码

自由地在无限画布上生成图像、视频,用节点串联工作流支持文生图、图生图、AI 视频生成、GPT 多模态对话——所有操作在一个界面中无缝衔接可以自定义api

IndexTTS语音克隆长文本本地整合包

IndexTTS语音克隆长文本本地整合包

‌核心技术特性‌零样本克隆仅需5秒参考音频,即可复刻目标音色,微调模式下仅需10分钟人声数据,音色相似度可达99%。支持中英文混合语音克隆,针对中文多音字、生僻字做了专门优化,避免出现发音错误。可独立调整语音情感、语速,修改参数不会破坏克隆出的目标音色,生成语音自然度MOS值可达4.2,接近真人录音水平。‌硬件适配要求‌最低仅需2GB显存即可运行基础克隆功能,6-8GB显存的普通显卡可流畅生成48...

5  168   TAG:语音本地克隆整合包TTS

声音克隆ai工具higgs

声音克隆ai工具higgs

? 项目亮点? 高质量语音生成生成接近真人发音的语音支持多种语言和口音能够处理情感表达和语调变化?️ 先进的模型架构基于 Transformer 的端到端架构结合了最新的语音合成技术支持长文本合成?️ 功能丰富语音克隆:通过少量样本克隆特定声音多说话人支持背景音乐生成情感控制? 技术特点? 模型结构使用类似 GPT 的自回归架构软件结合声学模型和声码器支持条件生成(说话人、情感等)? 训练数据使用...

5  182   TAG:工具克隆声音

多语言语音合成工具

多语言语音合成工具

一、VoxCPM2.0 整合包基础信息VoxCPM2.0 是完全开源、支持免费商用的多语言语音合成工具,原生输出48kHz高清音频,核心能力覆盖30种语言合成、自然语言描述生成全新音色、可控声音克隆等,适配国内网络可通过ModelScope快速下载模型。二、适配显卡要求最低配置:NVIDIA 显卡显存≥6GB,RTX 3060 等入门级显卡即可运行基础合成任务推荐配置:RTX 4090 及以上显卡...

Wan2GP 开源视频生成工具

Wan2GP 开源视频生成工具

Wan2GP 是面向低显存用户打造的轻量化开源视频生成工具箱,核心优势是将原本需20-80GB显存的前沿视频模型,压缩至6-10GB显存即可流畅运行,适配GTX 10/20系等老旧显卡,搭配全功能Web界面实现开箱即用。支持MiniMax H3 JoyAI-Echo Bernini LTX-2.3 wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G 显卡就可以跑起来‌核心适配能力‌最低6...

5  178   TAG:工具视频开源生成

MiniMax H3开源 视频模型(网盘下载)

MiniMax H3开源 视频模型(网盘下载)

‌MiniMax H3‌是MiniMax稀宇科技于2026年7月31日发布的通用全模态生成模型,8月3日正式开源,是其海螺视频系列的第三代产品。‌核心能力‌支持文本、图像、视频、音频的统一理解与生成,可输出原生双声道音视频,最高生成15秒2K分辨率内容,在Artificial Analysis视频编辑榜单、Arena图生视频排行榜中位列全球第一。‌开源生态‌开源24小时内就有超百家国内外芯片厂商、...

5  220   TAG:视频开源模型

comfyui_整合包

comfyui_整合包

ComfyUI-BSAI_v010.rar

5  212   TAG:整合包comfyui

Al生成3D模型、视频模型、图片模型、图片模型、音乐模型合集

Al生成3D模型、视频模型、图片模型、图片模型、音乐模型合集

Al生成3D模型合集Al生成视频模型合集Al生成图片模型合集Al生成音乐模型合集Al语音克隆合集

无限画布ai生图像、视频工作流工具源码

无限画布ai生图像、视频工作流工具源码

自由地在无限画布上生成图像、视频,用节点串联工作流支持文生图、图生图、AI 视频生成、GPT 多模态对话——所有操作在一个界面中无缝衔接可以自定义api

IndexTTS语音克隆长文本本地整合包

IndexTTS语音克隆长文本本地整合包

‌核心技术特性‌零样本克隆仅需5秒参考音频,即可复刻目标音色,微调模式下仅需10分钟人声数据,音色相似度可达99%。支持中英文混合语音克隆,针对中文多音字、生僻字做了专门优化,避免出现发音错误。可独立调整语音情感、语速,修改参数不会破坏克隆出的目标音色,生成语音自然度MOS值可达4.2,接近真人录音水平。‌硬件适配要求‌最低仅需2GB显存即可运行基础克隆功能,6-8GB显存的普通显卡可流畅生成48...

5  168   TAG:语音本地克隆整合包TTS

声音克隆ai工具higgs

声音克隆ai工具higgs

? 项目亮点? 高质量语音生成生成接近真人发音的语音支持多种语言和口音能够处理情感表达和语调变化?️ 先进的模型架构基于 Transformer 的端到端架构结合了最新的语音合成技术支持长文本合成?️ 功能丰富语音克隆:通过少量样本克隆特定声音多说话人支持背景音乐生成情感控制? 技术特点? 模型结构使用类似 GPT 的自回归架构软件结合声学模型和声码器支持条件生成(说话人、情感等)? 训练数据使用...

5  182   TAG:工具克隆声音

MiniMax H3开源 视频模型(网盘下载)

MiniMax H3开源 视频模型(网盘下载)

‌MiniMax H3‌是MiniMax稀宇科技于2026年7月31日发布的通用全模态生成模型,8月3日正式开源,是其海螺视频系列的第三代产品。‌核心能力‌支持文本、图像、视频、音频的统一理解与生成,可输出原生双声道音视频,最高生成15秒2K分辨率内容,在Artificial Analysis视频编辑榜单、Arena图生视频排行榜中位列全球第一。‌开源生态‌开源24小时内就有超百家国内外芯片厂商、...

5  220   TAG:视频开源模型

Al生成3D模型、视频模型、图片模型、图片模型、音乐模型合集

Al生成3D模型、视频模型、图片模型、图片模型、音乐模型合集

Al生成3D模型合集Al生成视频模型合集Al生成图片模型合集Al生成音乐模型合集Al语音克隆合集

二次元图像自动打标模型

二次元图像自动打标模型

wd-v1-4-moat-tagger-v2.onnx是基于WD 1.4标签器框架、采用MOAT骨干网络的二次元图像自动打标模型,ONNX格式适合跨框架部署推理,是目前AI绘画领域最常用的二次元图像自动打标工具之一。‌核心信息解析‌项目定位‌:该模型用于自动识别二次元图像内容,输出对应描述标签,可以直接作为Stable Diffusion绘图的正向提示词,大幅降低手动写prompt的成本。‌后缀含...

5  673   TAG:自动模型图像二次元

即梦提示词手册合集

即梦提示词手册合集

40套写作指令豆包68个润色指令 (2).xlsx豆包99个高效指令.xlsx豆包130个润色指令 (2).xlsx豆包160+个去AI味提示词.xlsx豆包高级润色指令.xlsx豆包润色 (1).xlsx豆包提问指令 .xlsx方案01 写作全流程.docx方案02 精读一篇论文文献.docx方案03 内容润色.docx方案04 高效润色.docx方案05 论文全过程高阶提示词.docx...

5  353   TAG:合集提示词即梦

AI漫剧创作,全流程技法教学

AI漫剧创作,全流程技法教学

[1.1]--人物角色的设计-AI漫剧全流程.mp4[1.2]--人物角色生成-AI漫剧全流程.mp4[1.3]--分镜和视频生成-AI漫剧全流程.mp4[1.4]--分镜元素详解-AI漫剧全流程.mp4[1.5]--TTS声音克隆控制音色一致性-AI漫剧全流程.mp4[1.6]--超级牛的即梦2.0(Seedance 2.0)推荐.mp4

免费  526   TAG:创作流程教学AI漫剧

Midjourney AI大型课程:AI绘图从初学者到精通-36节课-中英字幕

Midjourney AI大型课程:AI绘图从初学者到精通-36节课-中英字幕

01 - Introduction02 - Getting Started with Midjourney03 - Midjourney Parameters04 - Midjourney and ChatGPT Styles05 - Coloring Book06 - Multi Prompts07 - Pattern and Backgrounds08 - Creating a Portfol...


首页

栏目

搜索

会员