小红书出品 开源TTS新选择:FireRedTTS3 实现高质量 对话语音合成 声音克隆 +声音设计+ 语音编辑 一键整合包 v20260824

小红书出品 开源TTS新选择:FireRedTTS3 实现高质量 对话语音合成 声音克隆 +声音设计+ 语音编辑 一键整合包 v20260824

FireRedTTS 是一个开源的文本转语音(Text-to-Speech, TTS)项目,由 FireRedTeam 开发并维护。该项目致力于提供高质量、低延迟、易于集成的语音合成能力,适用于多种应用场景,如语音助手、有声读物生成、无障碍访问、智能客服等。项目基于深度学习技术,采用了先进的神经网络架构(如 Tacotron、FastSpee...
AI,开源 1.9万 0
0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v12.641 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v12.641 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

Wan2GP 是专为“显卡资源有限”的用户打造的**开源视频生成工具箱**。它把目前最先进的文生视频、图生视频、视频编辑模型(Wan 2.1、Hunyuan Video、LTX Video 等)做了重度优化和封装,让只有 6-8 GB 显存的旧显卡也能跑得动、跑得快,并提供了一整套 Web 界面与周边工具,做到“开箱即玩”。一句话总结:**把...
AI,开源 4.9万 164
开源 换脸工具 roop_unleashed v9.0 中文版 可支持批量换脸,直播换脸,整合包支持AMD显卡+N卡。速度超快 附视频教程演示

开源 换脸工具 roop_unleashed v9.0 中文版 可支持批量换脸,直播换脸,整合包支持AMD显卡+N卡。速度超快 附视频教程演示

昨天分享了roop的整合包支持AMD显卡来运行,今天分享的这个工具是roop的一个分支,虽然roop的作者已经弃更了,但是还有其他人继续更新。这就有产生了一个新的项目roop_unleashed。估计是这个项目出来并没有多久,所以知道的人不是很多,这2天我心血来潮就把这个项目也做了一个整合包,这个roop_unleashed是支持N卡的,但是...
AI,开源 8.7万 208
开源 免费 pyVideoTrans 视频翻译开源软件 自动识别并生成字幕后,翻译 + 配音 绿色免安装 v4.10

开源 免费 pyVideoTrans 视频翻译开源软件 自动识别并生成字幕后,翻译 + 配音 绿色免安装 v4.10

这个工具我用来很长一段时间了,只是我居然一直忘记给大伙分享出来,直到昨天群里有人在问这样的工具。我才想起来把这个分享出来给大伙。虽然这个工具的标题叫视频翻译,实际上远远不只这些功能,我一直用这个工具来做字幕识别,比如我以前的教程那些字幕很多都是这个工具帮我做的。识别率也很高,超级方便。本来想今天一早就分享出来,但是事情比较多,又是瞎折腾的一天...
AI,开源 1.8万 21
声音克隆、音乐生成、语音识别 一个工具全部搞定,支持MiniMax-Music3,AI音频处理的“瑞士军刀”支持49个模型,支持audio.cpp v0.6 解压就可以运行

声音克隆、音乐生成、语音识别 一个工具全部搞定,支持MiniMax-Music3,AI音频处理的“瑞士军刀”支持49个模型,支持audio.cpp v0.6 解压就可以运行

它能做什么? —— 一个功能强大的音频“百宝箱”audio.cpp 几乎集成了当下最热门的音频AI任务,堪称音频处理领域的“瑞士军刀”。它支持的功能包括但不限于:🎤 语音识别与理解ASR(语音识别):将语音精准地转为文字,支持多种语言。VAD(语音活动检测):智能检测人声的起始和结束。Diarization(说话人分离):识别“谁在...
AI 2.5万 5
IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话 附效果演示 20260816更新

IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话 附效果演示 20260816更新

IndexTTS是由B站推出的一款基于XTTS和Tortoise的GPT风格文本转语音(TTS)模型。该项目在中文文本转语音领域展现出显著的技术优势和应用,以下从项目背景、技术架构、应用场景、社区支持及未来挑战五个维度进行详细介绍。一、项目背景:重新定义中文TTS技术标杆IndexTTS的诞生旨在解决传统TTS系统在中文语音合成中的两大核心痛...
AI,软件 2.4万 44
 开源 免费 Koboldcpp 人人可玩的本地大模型 不管啥显卡,cpu也能跑 附视频演示 支持deepseek v1.118.1

开源 免费 Koboldcpp 人人可玩的本地大模型 不管啥显卡,cpu也能跑 附视频演示 支持deepseek v1.118.1

KoboldCpp是一款易于使用的人工智能文本生成软件,适用于GGML和GGUF模型。这是一个可从Concedo分发的单一自包含版本,它建立在llama.cpp的基础上,并添加了一个多功能的Kobold API端点、额外的格式支持、稳定的扩散图像生成、向后兼容性以及一个具有持久故事、编辑工具、保存格式、内存、世界信息、作者注释、人物、场景和K...
开源 1.5万 7
小米出品开源 MiDashengLM-Gen 只要写一段话,AI就能帮你生成一段完整的音频 一键整合包 v20260814

小米出品开源 MiDashengLM-Gen 只要写一段话,AI就能帮你生成一段完整的音频 一键整合包 v20260814

🎵 用AI凭空“捏造”声音?这个模型有点酷!输入文字描述,AI就能生成一段完整的音频——包括人声、音乐、环境音效!你有没有想过,只要写一段话,AI就能帮你生成一段完整的音频?不是简单的文字转语音,而是包含人声对话、背景音乐、环境音效、气氛渲染的完整声音场景。今天要介绍的 MiDashengLM-Gen,就是这样一个“声音魔法师”。它...
AI 6187 0
MiniMax H3 文生视频提示词增强器 —— 把你的"大概想法"变成"导演分镜稿" 一键整合包 v20260810

MiniMax H3 文生视频提示词增强器 —— 把你的"大概想法"变成"导演分镜稿" 一键整合包 v20260810

这是做什么的?你有没有过这种情况:脑子里有一个很酷的视频画面,比如"雨夜街头,霓虹灯倒映在积水里,一个穿风衣的人在等公交车",但当你把这句话丢给 AI 视频工具时,出来的效果总是差点意思?这个工具就是来解决这个问题的。它就像一个懂镜头的 AI 编剧,专门帮你把粗糙的创意描述,改写成一份专业的"拍摄指令书"...
AI 3270 0
一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

—— 高清图像修复、增强与风格化处理工具本系统基于先进的 qwen 图片编辑模型 与 Nunchaku 量化技术 构建,结合 LoRA 微调模型支持,提供强大且高效的图像编辑能力。无论是老照片修复、人像增强、风景优化,还是黑白图上色,都能一键实现高质量输出。🔧 核心功能✅ 高清图像修复与增强支持上传任意分辨率图像(最小边自动放大至 1024p...
AI 2万 17
 MiniMax-H3 文生视频,图生视频 AI视频生成一键整合包 8G 英伟达显卡即可运行 视频效果非常不错 27-video v2.0

MiniMax-H3 文生视频,图生视频 AI视频生成一键整合包 8G 英伟达显卡即可运行 视频效果非常不错 27-video v2.0

这是什么?这是一个AI视频生成工具,你只需要输入一段文字描述,它就能自动生成一段带声音的视频。就像用文字画画一样,现在你可以用文字拍视频了!它能做什么?1. 📝 文字直接生成视频输入你想看到的画面描述,AI就会生成对应的视频。比如:"一只可爱的小猫在冲浪""夕阳下的海滩,海浪轻轻拍打岸边""一...
AI 3957 8
新一代开源 AI换脸神器 FaceFusion v3.8.0 中文版 支持AMD显卡+N卡 速度更快 支持50系显卡+批量换脸,效果更惊艳 操作更简单 附视频演示 20260803 更新

新一代开源 AI换脸神器 FaceFusion v3.8.0 中文版 支持AMD显卡+N卡 速度更快 支持50系显卡+批量换脸,效果更惊艳 操作更简单 附视频演示 20260803 更新

FaceFusion这个AI换脸的项目已经太久没有更新了。作者终于在昨天更新了3.0,更新幅度大得惊人。这么久不更新,原来是一直在憋大招,这个CD冷却也太久了。。。我第一次时间就去做整合包了。本以为这还不是有手就行的事,但是有点难度。因为3.0更新太大了,所以之前版本的模型还有一些东西根本用不上了,我只能慢慢去研究了。搞半天最后把我的系统的c...
AI,开源 56.6万 2283
27image  AI文生图 一键整合包 支持Mage-Flow+Krea 2 Turbo+ERNIE-Image-Turbo+Qwen_Image+Ovis-Image+Lens-Turbo 解压即可使用,8G英伟达显卡就可以运行 v20260802 更新

27image AI文生图 一键整合包 支持Mage-Flow+Krea 2 Turbo+ERNIE-Image-Turbo+Qwen_Image+Ovis-Image+Lens-Turbo 解压即可使用,8G英伟达显卡就可以运行 v20260802 更新

一个让 AI 绘画变"傻瓜"的本地部署的AI生图工具——每行写一句话,它就能帮你批量出图你有没有这样的经历?想试试 AI 绘画,打开网页版要么排队、要么收费;想本地运行,又被满屏的英文参数和命令行劝退;好不容易跑起来了,发现每次只能生成一张图,换个提示词又要重新等半天……如果你只想安安静静地打字、批量出图、自动保存,那这个...
AI 2万 11
Audio8-TTS 智能语音合成工具,一键生成自然人声 上传一段音频,AI 学会用你的声音朗读任何文字 一键整合包 v20260801

Audio8-TTS 智能语音合成工具,一键生成自然人声 上传一段音频,AI 学会用你的声音朗读任何文字 一键整合包 v20260801

这是什么?这是一个智能语音合成工具,能把您输入的文字转换成自然流畅的语音。无论是几百字的短文还是几千字的长文章,它都能轻松处理。核心功能🎯 智能长文本处理自动分块:遇到长文本会自动切分成多个小段,一段一段合成无缝拼接:合成后自动拼接,使用智能淡入淡出技术,听起来流畅自然智能识别:自动判断文本是中文还是英文,调整最佳分割策略🎤 声音克隆功能参考...
AI 3414 2
一键克隆你的声音:higgs-audio-v3-tts AI语音生成工具 支持情绪标签,支持停顿,支持音速调整 中文一键整合包 v20260731

一键克隆你的声音:higgs-audio-v3-tts AI语音生成工具 支持情绪标签,支持停顿,支持音速调整 中文一键整合包 v20260731

HiggsAudio 是由 Boson AI 开发的开源文本转语音(TTS)系统,基于先进的深度学习技术,能够生成高质量、自然的人声。该项目在 GitHub 上开源,提供了强大的语音合成能力。🌟 项目亮点🎵 高质量语音生成生成接近真人发音的语音支持多种语言和口音能够处理情感表达和语调变化🏗️ 先进的模型架构基于 Transformer 的端到...
AI 6528 8
开源 Cherry Studio 一个支持多模型服务的桌面客户端工具 支持deepseek v2.0.0

开源 Cherry Studio 一个支持多模型服务的桌面客户端工具 支持deepseek v2.0.0

Cherry Studio是一款专为专业用户打造的桌面客户端,它支持多模型服务,集成了超过300多个大语言模型,涵盖了30多个行业,旨在帮助用户在多种场景下提升工作效率。这款软件的设计初衷是满足各行各业对GPT技术的需求,无论是开发者、设计师还是作家,都能从中受益。对于开发者而言,Cherry Studio是一个强大的代码伙伴。它可以进行代码...
开源 9052 0
Jan 一个功能强大的开源ChatGPT替代品 支持deepseek v0.8.4

Jan 一个功能强大的开源ChatGPT替代品 支持deepseek v0.8.4

Jan:开源的ChatGPT替代品项目概述:Jan是一个开源的ChatGPT替代品,允许用户在其计算机上100%离线运行。这意味着用户无需网络连接即可使用AI功能。项目托管在GitHub上,由janhq团队维护,遵循AGPL-3.0许可证。功能特点:离线运行:Jan支持在任何硬件上运行,从个人电脑到多GPU集群,无需外部服务器或网络连接。多平...
软件 6685 0
视频创作者的新宠:这个开源工具正在悄悄改变内容生产方式 一键整合包 MoneyPrinterPlus v1.3.2

视频创作者的新宠:这个开源工具正在悄悄改变内容生产方式 一键整合包 MoneyPrinterPlus v1.3.2

你可以把它想象成一个 “AI全自动视频工厂”。它最大的特点就是:输入一段文字,就能自动生成一个完整的高清视频。是不是有点像你写一篇作文,然后机器帮你拍成了短视频?没错,就是这个意思!🧠 它是怎么工作的?简单来说,它的流程是这样的:你告诉它要说什么内容(文字)比如:“今天教你怎么在家做蛋糕”它会自动找合适的画面素材比如网上免费的高清视频片段:打...
AI,开源 9196 3
自媒体人必备!支持图片 + 视频混用生成轮播视频,不要显卡,小巧不到200M,制作超方便,支持20+随机转场特效 27-lunbo 3.0

自媒体人必备!支持图片 + 视频混用生成轮播视频,不要显卡,小巧不到200M,制作超方便,支持20+随机转场特效 27-lunbo 3.0

做自媒体、做视频剪辑的朋友,肯定都遇到过这样的痛点:手里有几百上千张旅游照、产品图或者二次元壁纸,想做成一个带背景音乐、带炫酷转场的短视频。如果用传统的剪辑软件,一张张导入、手动加转场、对齐音乐节奏…… 没个几个小时根本下不来。如果图片比例和视频比例不一样,上下还会留下难看的黑边。今天,给大家带来一款完全本地运行的“图片转视频”效率神器!它底...
AI 3815 2
 AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

🎙️ 你的音视频“第二大脑”:AI 深度分析引擎,让每一段声音都变成可检索的智慧你有没有过这样的经历——收藏了几百个小时的播客,却再也没打开过第二期;开完一场两小时的会议,翻遍笔记也找不到那个关键数据;刷到一个干货满满的视频教程,一周后只记得“好像讲了个很厉害的东西”;听完一本有声小说,想和朋友分享某个情节,却怎么也想不起在第几章……信息爆炸...
AI 3702 3
 VisoMaster +VisoMaster-Fusion v1.0  基于rope的二次开发 一款功能强大、易于使用且高效的开源换脸工具 中文版 支持50系英伟达显卡运行 一键整合包

VisoMaster +VisoMaster-Fusion v1.0 基于rope的二次开发 一款功能强大、易于使用且高效的开源换脸工具 中文版 支持50系英伟达显卡运行 一键整合包

VisoMaster 还不错的一个换脸工具,界面也是简洁的很,花了一天的时间做了整合包+汉化。VisoMaster是一款功能强大且易于使用的面部替换与编辑工具,专为图像和视频设计。它利用先进的人工智能技术,能够以最少的努力产生自然逼真的效果,因此无论是普通用户还是专业人士都能轻松上手。这款软件以其独特的魅力和实用性,在图像与视频编辑领域脱颖而...
AI,开源 3.7万 61
开源 AI人脸替换工具离线版V8.7 兼容50系列显卡 CPU、显存占用优化,速度更快 一张图实现视频或者图片换脸,完全免费!附演示和教程视频

开源 AI人脸替换工具离线版V8.7 兼容50系列显卡 CPU、显存占用优化,速度更快 一张图实现视频或者图片换脸,完全免费!附演示和教程视频

这是热心网友万能君做的一个整合包,整合包里面已经包含了几个换脸项目和一些高清修复功能等,具体可以看下图截图所示。要顺利使用这个工具,必须做好以下几点第一个 这个工具只支持CPU+N卡。如果需要使用N卡,一定要先安装好驱动和CUDA。第二个 一定要安装好运行库。https://www.jian27.com/html/2290.html第三个 所...
AI 529.3万 7189
开源 Deep-Live-Cam v2.7-RC2 AI人工智能 图片视频换脸+直播换脸 汉化整合包 支持AMD+英伟达N卡50系

开源 Deep-Live-Cam v2.7-RC2 AI人工智能 图片视频换脸+直播换脸 汉化整合包 支持AMD+英伟达N卡50系

Deep-Live-Cam是一款由hacksider开发并维护的创新性软件,旨在为快速发展的AI生成媒体行业贡献一份力量。该软件的主要功能是通过深度学习技术,实现实时的人脸替换与增强,为艺术家、设计师以及内容创作者提供了一个强大的工具,帮助他们以全新的方式创作和表达。项目概述Deep-Live-Cam的核心价值在于其广泛的应用场景。艺术家可以...
AI,开源 2.3万 21
应群友要求,我把开源 AI人脸替换工具离线版之前发布的一些版本整理一下再分享出来

应群友要求,我把开源 AI人脸替换工具离线版之前发布的一些版本整理一下再分享出来

群里一些小伙伴老在讲什么之前的老版本如何如何好用,如何得心应手。说实话我自己没有什么感觉。估计他们这些都是幻觉。但是你们要是喜欢之前的版本,我也是可以再分享出来,时间也是过得好快啊。截图如下 版本如下估计差不多了吧,应该没什么遗漏了。喜欢老版本的可以去下载试试。如果全部收藏的话 大概有170多G。。。你们看截图写在最后的最后,如果对这个工具使...
软件 1.5万 11
这不是换脸,这是换头! 效果炸裂 AI 图片换头 HeadFusion v3.0 一键整合包 v20260601

这不是换脸,这是换头! 效果炸裂 AI 图片换头 HeadFusion v3.0 一键整合包 v20260601

本项目是一个基于 FLUX.2 Klein 模型开发的 AI 智能换头工具。通过集成 SDNQ (Spatial Dynamic Neural Quantization) 4-bit 动态量化技术,在显著降低显存占用的同时,保持了卓越的图像生成质量。配合 BFS (Best Face Swap) LoRA 模型,能够精准地实现人头替换,并完美...
AI,开源 2.3万 53
再次复活 魔搭 批量AI文生图工具 27pic-api v11 无需显卡,无需搭建解压即可运行。支持最新krea/Krea-2-Turbo 文生图

再次复活 魔搭 批量AI文生图工具 27pic-api v11 无需显卡,无需搭建解压即可运行。支持最新krea/Krea-2-Turbo 文生图

大伙都知道,我直接分享过挂机流工作流,还有批量提示词工具。但是考虑到平时电脑也还有别的用途,老是用显卡来挂机生图,也是很耽误事。所以我就想利用各大平台的API来生成图片,这样就不会占用本地的资源又可以实现批量文生图的需求。所以今天花了一点时间做出来这个 AI文生图工具 27pic-api,暂时就取这个名字吧。远程调用魔塔的API&n...
AI 1.7万 24
音乐卡点视频 一键生成 支持图片+视频素材  新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260629

音乐卡点视频 一键生成 支持图片+视频素材 新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260629

卡点视频生成器是一款基于 AI大模型 智能视频自动生成工具,专为音乐爱好者、短视频创作者、自媒体运营者设计。它能根据你上传的音乐节拍/鼓点,自动从指定图片或视频素材中智能选取片段,生成节奏精准、视觉流畅的“卡点”视频,适用于抖音、快手、B站、Instagram 等平台。无需剪辑经验,一键生成专业级卡点视频!🎯 核心功能1. 🖼️ 图片卡点模式...
AI 1.4万 0
视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

KrillinAI是一个基于AI大模型的视频翻译和配音工具,它提供了专业级的翻译服务以及一键部署的全流程解决方案。这个开源工具旨在帮助用户轻松实现视频内容的本地化与增强,使其能够适配多种内容平台,如YouTube、TikTok、Bilibili、抖音(国内版)、微信视频号、快手等。KrillinAI的核心功能包括视频翻译、配音与声音克隆、字幕...
安卓 5767 3
开源 Apt Full 绿色版 一个功能强大、操作便捷的AI生产力工具  v2.9.16.0

开源 Apt Full 绿色版 一个功能强大、操作便捷的AI生产力工具 v2.9.16.0

该项目集成了多种AI模型,特别是提供了私人专属的ChatGPT AI智能助理,能够处理各种文本任务,为用户提供智能辅助。此外,它还能一键批量智能处理图片和视频,包括但不限于图片无损放大、擦除水印、转换为卡通漫画风格、转制3D效果、上色修复、人脸修复等,以及视频的无损放大、擦除水印、转换为卡通漫画风格、转制3D、上色修复、插值补帧等功能。总之,...
软件 8852 5
开源 神器 Stability Matrix  一款功能强大、易于使用的Stable Diffusion管理工具 v2.16.1

开源 神器 Stability Matrix 一款功能强大、易于使用的Stable Diffusion管理工具 v2.16.1

Stability Matrix是由Lykos AI开发的一款革命性工具,专为简化Stable Diffusion的使用和管理而设计。作为一款多平台包管理器和推理用户界面,它极大地提升了Stable Diffusion的易用性和用户体验。核心功能多平台支持:Stability Matrix支持macOS、Windows和Linux系统,确保用...
AI,开源 7116 1
别再瞎试了!用这个神器,一键优化你的大模型提示词 Prompt Optimizer v2.11.7

别再瞎试了!用这个神器,一键优化你的大模型提示词 Prompt Optimizer v2.11.7

该项目聚焦于提升大语言模型(LLM)在实际应用中对提示语的理解与响应质量,旨在通过系统化的方法改进原始提示语的表达结构、清晰度和有效性,从而获得更准确、更稳定、更符合预期的模型输出。核心理念随着大模型在各类场景中的广泛应用,提示工程(Prompt Engineering)成为影响输出质量的关键因素。prompt-optimizer 的设计初衷...
AI,开源 3.2万 102
视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

🎬 剑二十七|视频反推提示词生成器让每一帧画面,都转化为可复用的创作语言🔮 核心定位这是一款面向专业内容创作者的智能视频理解工具。它不满足于简单的画面识别,而是以「镜头语言」为最小单元,深度解析视频内容,自动生成符合影视工业标准的中文提示词描述。不是「看图说话」,而是「读镜写意」。✨ 六大核心能力🎯 智能镜头分割精准识别场景切换点自适应阈值调...
AI 6576 9