自媒体人必备!支持图片 + 视频混用生成轮播视频(类似幻灯片),不要显卡,小巧不到400M,制作超方便,支持20+随机转场特效+炫酷字幕 27-lunbo v7.0

自媒体人必备!支持图片 + 视频混用生成轮播视频(类似幻灯片),不要显卡,小巧不到400M,制作超方便,支持20+随机转场特效+炫酷字幕 27-lunbo v7.0

做自媒体、做视频剪辑的朋友,肯定都遇到过这样的痛点:手里有几百上千张旅游照、产品图或者二次元壁纸,想做成一个带背景音乐、带炫酷转场的短视频。如果用传统的剪辑软件,一张张导入、手动加转场、对齐音乐节奏…… 没个几个小时根本下不来。如果图片比例和视频比例不一样,上下还会留下难看的黑边。今天,给大家带来一款完全本地运行的“图片转视频”效率神器!它底...
AI 5128 12
一键换头/换脸,毫无违和感!用心打造,效果远超市面上常见的同类工具,8g显卡就能流畅运行,最快10秒换头 Image21-bfs_head 一键整合包 v4.0

一键换头/换脸,毫无违和感!用心打造,效果远超市面上常见的同类工具,8g显卡就能流畅运行,最快10秒换头 Image21-bfs_head 一键整合包 v4.0

一、它能做什么?上传两张图片:基础图:提供身体、姿势、光照、背景参考头图:提供想要的脸型、头发、眼睛颜色点击生成,AI就会把参考头图的脸“移植”到基础图上,并且保持原来的光影和构图。换脸后的头部大小、位置、角度都会自动匹配原图,不会出现“头大”或“比例失调”的尴尬。二、两大风格模型,随心切换工具内置两种换脸风格:风格一:头部姿态更准适合大多数...
AI 6932 22
0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v17.01 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v17.01 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

Wan2GP 是专为“显卡资源有限”的用户打造的**开源视频生成工具箱**。它把目前最先进的文生视频、图生视频、视频编辑模型(Wan 2.1、Hunyuan Video、LTX Video 等)做了重度优化和封装,让只有 6-8 GB 显存的旧显卡也能跑得动、跑得快,并提供了一整套 Web 界面与周边工具,做到“开箱即玩”。一句话总结:**把...
AI,开源 5.5万 182
27image  AI文生图 一键整合包 支持Ming-Image+Mage-Flow+Krea 2 Turbo+ERNIE-Image-Turbo+Qwen_Image+Ovis-Image+Lens-Turbo 解压即可使用,8G英伟达显卡就可以运行 v20261005 更新

27image AI文生图 一键整合包 支持Ming-Image+Mage-Flow+Krea 2 Turbo+ERNIE-Image-Turbo+Qwen_Image+Ovis-Image+Lens-Turbo 解压即可使用,8G英伟达显卡就可以运行 v20261005 更新

一个让 AI 绘画变"傻瓜"的本地部署的AI生图工具——每行写一句话,它就能帮你批量出图你有没有这样的经历?想试试 AI 绘画,打开网页版要么排队、要么收费;想本地运行,又被满屏的英文参数和命令行劝退;好不容易跑起来了,发现每次只能生成一张图,换个提示词又要重新等半天……如果你只想安安静静地打字、批量出图、自动保存,那这个...
AI 2.2万 13
Memento 一个功能丰富的开源视频播放器,专为日语学习者设计 中文版 v2.0.2

Memento 一个功能丰富的开源视频播放器,专为日语学习者设计 中文版 v2.0.2

Memento 是一款基于 mpv 的开源视频播放器,专为学习日语而设计。它提供了多种功能,旨在帮助用户在观看视频的同时更有效地学习日语。功能特点语法感知字幕搜索:Memento 允许用户搜索字幕中的特定词汇或语法结构,这对于学习日语的用户来说非常有用。通过这种功能,用户可以轻松找到并学习视频中出现的特定语法点或词汇。Yomichan 风格的...
开源 7526 14
NWinfo 一款功能全面、易于使用且兼容性强的开源硬件信息检测工具 v1.6.6

NWinfo 一款功能全面、易于使用且兼容性强的开源硬件信息检测工具 v1.6.6

NWinfo是一款功能强大的Win32程序,专门用于获取系统和硬件的详细信息。这款软件提供了丰富的功能和特性,使得用户能够全面了解其计算机系统的硬件配置和运行状况。首先,NWinfo具有出色的硬件信息检测能力。它能够收集并显示关于SMBIOS、CPUID、SMART、PCI、EDID等硬件组件的详细信息。这些信息对于了解计算机硬件的规格、性能...
开源 2756 0
一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

—— 高清图像修复、增强与风格化处理工具本系统基于先进的 qwen 图片编辑模型 与 Nunchaku 量化技术 构建,结合 LoRA 微调模型支持,提供强大且高效的图像编辑能力。无论是老照片修复、人像增强、风景优化,还是黑白图上色,都能一键实现高质量输出。🔧 核心功能✅ 高清图像修复与增强支持上传任意分辨率图像(最小边自动放大至 1024p...
AI 2.2万 17
音乐卡点视频 一键生成 支持图片+视频素材  新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260929

音乐卡点视频 一键生成 支持图片+视频素材 新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260929

卡点视频生成器是一款基于 AI大模型 智能视频自动生成工具,专为音乐爱好者、短视频创作者、自媒体运营者设计。它能根据你上传的音乐节拍/鼓点,自动从指定图片或视频素材中智能选取片段,生成节奏精准、视觉流畅的“卡点”视频,适用于抖音、快手、B站、Instagram 等平台。无需剪辑经验,一键生成专业级卡点视频!🎯 核心功能1. 🖼️ 图片卡点模式...
AI 1.6万 0
阿里悄悄开源的AI绘画模型,效果吊打一众付费工具,生图效果非常惊艳 支持批量生图 +图片编辑 最低6G显卡 Qwen-Image-2.1 一键整合包 解压即可使用 v20260928

阿里悄悄开源的AI绘画模型,效果吊打一众付费工具,生图效果非常惊艳 支持批量生图 +图片编辑 最低6G显卡 Qwen-Image-2.1 一键整合包 解压即可使用 v20260928

我在自己电脑上,搭了一个免费的 AI 绘画工作台前言最近 AI 绘画领域发生了一件大事:阿里通义千问团队在 2026 年 9 月 20 日,开源了他们的最新图像生成模型——千问图像 2.1(Qwen-Image-2.1)。说实话,一开始我只是抱着试试看的心态。毕竟现在 AI 绘画模型太多了,几乎每周都有新东西出来。但真正用起来之后,我发现这个...
AI 4953 11
网易出品开源大模型 Confucius4-R2T2  AI 批量音视频字幕生成器+内容识别 一键整合包 解压即可使用 v2.0

网易出品开源大模型 Confucius4-R2T2 AI 批量音视频字幕生成器+内容识别 一键整合包 解压即可使用 v2.0

平时做视频剪辑、整理会议录音、或者上网课做笔记时,你是不是也经常为“听写转文字”和“打轴做字幕”而头疼?市面上的工具虽然多,但往往面临着几个让人抓狂的痛点: ❌隐私风险:机密会议、私人录音传到云端,总担心数据泄露。 ❌收费昂贵:好用的按时长收费,批量处理一次钱包就瘪了。 ❌反人类断句:生成的字幕经常在词语中间硬生生截断(比如“苹 / 果...
AI 3042 7
视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v6.0

视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v6.0

🎬 剑二十七|视频反推提示词生成器让每一帧画面,都转化为可复用的创作语言🔮 核心定位这是一款面向专业内容创作者的智能视频理解工具。它不满足于简单的画面识别,而是以「镜头语言」为最小单元,深度解析视频内容,自动生成符合影视工业标准的中文提示词描述。不是「看图说话」,而是「读镜写意」。✨ 六大核心能力🎯 智能镜头分割精准识别场景切换点自适应阈值调...
AI 7959 9
一键生成AI绘画提示词:让你的图片秒变顶级写真描述 会思考的图片反推提示词工具 一键整合包 解压即可使用  thinkpic-9.0-20260924

一键生成AI绘画提示词:让你的图片秒变顶级写真描述 会思考的图片反推提示词工具 一键整合包 解压即可使用 thinkpic-9.0-20260924

这个工具是做什么的?这个程序可以自动为你的人物照片生成一段“AI绘画提示词”。简单来说:你放一张人物照片进去,它就能写出一段详细、生动、充满吸引力的文字描述,这段文字可以直接用在 AI 绘画工具(比如 Stable Diffusion)中,让 AI 画出类似风格或效果的图片。例如,它会描述:人物有多美、眼睛多勾人、嘴唇多诱人;身材曲线多么火辣...
AI 1.8万 8
快如闪电-声音克隆、音乐生成、语音识别 一个工具全部搞定,支持yue2 MiniMax-Music3,AI音频处理的“瑞士军刀”支持49个模型,支持audio.cpp v0.81 解压就可以运行

快如闪电-声音克隆、音乐生成、语音识别 一个工具全部搞定,支持yue2 MiniMax-Music3,AI音频处理的“瑞士军刀”支持49个模型,支持audio.cpp v0.81 解压就可以运行

它能做什么? —— 一个功能强大的音频“百宝箱”audio.cpp 几乎集成了当下最热门的音频AI任务,堪称音频处理领域的“瑞士军刀”。它支持的功能包括但不限于:🎤 语音识别与理解ASR(语音识别):将语音精准地转为文字,支持多种语言。VAD(语音活动检测):智能检测人声的起始和结束。Diarization(说话人分离):识别“谁在...
AI 2.6万 5
一键克隆任意人声!VoxCPM 2.0.3 开源语音大模型,无需训练,3秒搞定声音复刻!支持30种语言,9种方言,支持情绪表达+语气标签+超长文本+音色一致性+批量文本合成+音色保存+预设保存+音质增强+洗稿。最低8G英伟达即可运行 剑二十七二开汉化整合包 v20260915

一键克隆任意人声!VoxCPM 2.0.3 开源语音大模型,无需训练,3秒搞定声音复刻!支持30种语言,9种方言,支持情绪表达+语气标签+超长文本+音色一致性+批量文本合成+音色保存+预设保存+音质增强+洗稿。最低8G英伟达即可运行 剑二十七二开汉化整合包 v20260915

VoxCPM 是一个支持中英文、零样本语音克隆、情感可控、音素/公式输入的统一端到端语音合成大模型。它不依赖传统 TTS 流水线(如文本分析 → 音素对齐 → 声码器),而是直接从文本生成高质量语音波形。🎯 目标:打造一个像大语言模型一样“通用、灵活、强大”的语音生成基础模型。🔧 核心特性(技术亮点)1. ✅ 端到端架构(End-to-End...
AI,开源 1.5万 13
AI 自动生成短剧解说视频 输入一段话就能生成短剧解说视频  一键整合包 NarratoAI v1.0.0

AI 自动生成短剧解说视频 输入一段话就能生成短剧解说视频 一键整合包 NarratoAI v1.0.0

这个工具是做什么的?你可以把 NarratoAI 理解成一个“AI自动剪辑视频的神器”,它最大的特点就是:输入一段文字或口播内容,就能自动生成一部短剧解说视频。是不是听起来像你写了个剧本,AI 就帮你拍成了短视频?没错,就是这样!🧠 它是怎么工作的?它的流程大概是这样的:你提供一段文字内容(比如口播文案、剧情简介)比如:“今天给大家讲一个爱情...
AI,开源 9290 3
一只奔跑小猫  RunCat 一款开源且极具创意的Windows桌面小工具 v3.5

一只奔跑小猫 RunCat 一款开源且极具创意的Windows桌面小工具 v3.5

软件简介:RunCat_for_windows是一款开源且极具创意的Windows桌面小工具,由GitHub上的开发者Kyome22创建。该软件通过一种独特而有趣的方式——使用跑动的小猫或鹦鹉来实时显示计算机的CPU占用情况,为用户提供了全新的系统监控体验。软件特点直观监控:RunCat最大的亮点在于其直观性。当CPU占用率较低时,小猫或鹦鹉...
软件 3654 0
开源 免费 AI无损图片放大工具 X.SuperResolution 绿色免安装 v1.0.9745.22

开源 免费 AI无损图片放大工具 X.SuperResolution 绿色免安装 v1.0.9745.22

本程序使用了来自腾讯ARC Lab提供的Real-ESRGAN模型,目前模型主要来自于人像,能对人像进行一个较快的处理,特别是动漫图片,进行一个很好的放大。功能说明支持多线程处理支持批量图片处理支持设置选项支持自定义输出格式和自定义输出路径支持AI引擎选择支持批量清理任务
开源 3891 2
图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印+自定义lora 剑二十七洗图专用  z-image-turbo-xitu v14

图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印+自定义lora 剑二十七洗图专用 z-image-turbo-xitu v14

🎨 Z-Image-Turbo 剑二十七·洗图专用版—— 神似而形不似,AI 重绘的终极答案"目前市面上能做到神似而形不似的类似图生图,在我面前一个能打的都没有"🔍 产品定位本工具专为「高质量图像重绘」场景打造,聚焦「洗图」核心需求:在保留原图构图、光影、神态的前提下,通过 AI 进行艺术化重绘,实现「神似而形不似」的进阶...
AI 1.4万 22
NSMusicS:强大功能、易用界面,打造你的专属音乐播放平台 v2.3.1

NSMusicS:强大功能、易用界面,打造你的专属音乐播放平台 v2.3.1

NSMusicS(Nine Song Music Super,九歌音乐)是一个跨平台、功能丰富、高度可扩展的开源音乐播放器和多媒体管理系统。它不仅支持本地音乐库播放,还兼容多种主流流媒体服务器,并提供 Docker Web 版本,适用于 Windows、macOS、Linux 等操作系统。该项目由开发者 Xiang Cheng主导开发,采用 ...
开源 3745 2
开源 Deep-Live-Cam v2.7.5-ultimate AI人工智能 图片视频换脸+直播换脸 汉化整合包 支持AMD+英伟达N卡50系

开源 Deep-Live-Cam v2.7.5-ultimate AI人工智能 图片视频换脸+直播换脸 汉化整合包 支持AMD+英伟达N卡50系

Deep-Live-Cam是一款由hacksider开发并维护的创新性软件,旨在为快速发展的AI生成媒体行业贡献一份力量。该软件的主要功能是通过深度学习技术,实现实时的人脸替换与增强,为艺术家、设计师以及内容创作者提供了一个强大的工具,帮助他们以全新的方式创作和表达。项目概述Deep-Live-Cam的核心价值在于其广泛的应用场景。艺术家可以...
AI,开源 2.5万 21
CopyQ – 开源、跨平台的高级剪贴板管理工具  绿色免安装 v16.0.0

CopyQ – 开源、跨平台的高级剪贴板管理工具 绿色免安装 v16.0.0

介绍CopyQ 是一款开源的剪贴板管理软件,它为用户提供了一个相当强大且易用的剪贴板增强体验。通过使用这个工具,用户可以对复制到剪贴板的内容进行保存,排序,以及进行更丰富的编辑。主要特性多样化的剪贴板条目储存:CopyQ 具备保存文本,HTML,图像或者其他自定义格式的内容的能力。搜索和过滤剪贴板列表:CopyQ对存储的每一个剪贴板条目都建立...
开源 3670 0
IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话+语音替换 附效果演示 20260906更新

IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话+语音替换 附效果演示 20260906更新

IndexTTS是由B站推出的一款基于XTTS和Tortoise的GPT风格文本转语音(TTS)模型。该项目在中文文本转语音领域展现出显著的技术优势和应用,以下从项目背景、技术架构、应用场景、社区支持及未来挑战五个维度进行详细介绍。一、项目背景:重新定义中文TTS技术标杆IndexTTS的诞生旨在解决传统TTS系统在中文语音合成中的两大核心痛...
AI,软件 2.6万 44
小红书出品 开源TTS新选择:FireRedTTS3 实现高质量 对话语音合成 声音克隆 +声音设计+ 语音编辑  支持24种语言+21种中文方言 支持超长文本,支持语速调整 一键整合包 v20260905

小红书出品 开源TTS新选择:FireRedTTS3 实现高质量 对话语音合成 声音克隆 +声音设计+ 语音编辑 支持24种语言+21种中文方言 支持超长文本,支持语速调整 一键整合包 v20260905

FireRedTTS 是一个开源的文本转语音(Text-to-Speech, TTS)项目,由 FireRedTeam 开发并维护。该项目致力于提供高质量、低延迟、易于集成的语音合成能力,适用于多种应用场景,如语音助手、有声读物生成、无障碍访问、智能客服等。项目基于深度学习技术,采用了先进的神经网络架构(如 Tacotron、FastSpee...
AI,开源 2万 2
开源 换脸工具 roop_unleashed v9.0 中文版 可支持批量换脸,直播换脸,整合包支持AMD显卡+N卡。速度超快 附视频教程演示

开源 换脸工具 roop_unleashed v9.0 中文版 可支持批量换脸,直播换脸,整合包支持AMD显卡+N卡。速度超快 附视频教程演示

昨天分享了roop的整合包支持AMD显卡来运行,今天分享的这个工具是roop的一个分支,虽然roop的作者已经弃更了,但是还有其他人继续更新。这就有产生了一个新的项目roop_unleashed。估计是这个项目出来并没有多久,所以知道的人不是很多,这2天我心血来潮就把这个项目也做了一个整合包,这个roop_unleashed是支持N卡的,但是...
AI,开源 9.1万 210
一个本地音视频 AI 工作台:会议纪要、课程笔记、视频字幕,全都自动搞定 audio-edit v2.0 一键整合包 解压即可使用

一个本地音视频 AI 工作台:会议纪要、课程笔记、视频字幕,全都自动搞定 audio-edit v2.0 一键整合包 解压即可使用

你是不是也遇到过这些场景?开完两小时的会,录音躺在手机里,整理纪要花了比开会还长的时间;报了网课没时间看,几十个视频在硬盘里吃灰,想复习却不知道从哪下手;剪视频想加字幕,对着软件一句一句听写,一条 10 分钟的视频磨掉一晚上;收藏了几十期播客,没时间听,但又怕错过里面的干货……这些问题的本质都一样:音视频里的信息很值钱,但提取信息的成本太高。...
AI 1.3万 0
不止AI抠图,更懂细节,应该是最强的AI抠图了,集合了15种抠图模型:BiRefNet 覆盖多场景图像抠除处理需求 一键整合包 v20260902

不止AI抠图,更懂细节,应该是最强的AI抠图了,集合了15种抠图模型:BiRefNet 覆盖多场景图像抠除处理需求 一键整合包 v20260902

BiRefNet 是一个专注于 高分辨率二值图像分割(Dichotomous Image Segmentation, DIS) 的开源深度学习模型。它在背景移除、前景提取、掩码生成等任务中表现出卓越性能,广泛应用于:图像编辑与合成视觉特效处理自动抠图(无需 Trimap)数字内容创作(如 Blender 插件、AI 绘画工具集成)🚀 核心特性...
AI,开源 1.1万 2
跨平台开源 SSH 桌面终端 Electerm 绿色免安装 v5.3.15

跨平台开源 SSH 桌面终端 Electerm 绿色免安装 v5.3.15

我记得我之前白嫖亚马逊Vps的时候,开通好了后就是用这个工具连接的,开源免费就是强。。。介绍通常,终端仿真器用于为某些计算机用户提供登录或/和直接访问大型机操作系统中的旧程序的能力。当前有大量这样的应用程序,但是有一个旨在颠覆规范的应用程序。它的名字叫 Electerm,尽管从本质上讲它是一个终端仿真器,但它也可以充当一个全面的 S...
开源 4100 0
受够了机械配音?这个开源TTS能笑会叹气,中文自然到离谱!声音设计+声音克隆+声音指导 Breeze-TTS-2 一键整合包 解压即可使用 v20260829

受够了机械配音?这个开源TTS能笑会叹气,中文自然到离谱!声音设计+声音克隆+声音指导 Breeze-TTS-2 一键整合包 解压即可使用 v20260829

不知道你有没有过这种困扰:想做短视频配音,但找不到合适的音色;想给有声书加旁白,但市面上的 TTS 机械感太重;或者想克隆某个角色的声音,却被商业 API 的昂贵价格劝退……最近,开源社区出现了一匹黑马——Breeze TTS 2。它在 Artificial Analysis 的 TTS 排行榜上,开源权重模型排名第一,Elo 评分高达 12...
AI 3712 0
开源 AstrOrz Player播放器  绿色版 一款功能强大、专业实用且设计极简的视频播放软件 v2.4.6

开源 AstrOrz Player播放器 绿色版 一款功能强大、专业实用且设计极简的视频播放软件 v2.4.6

介绍AstrOrz Player是一款功能强大、专业实用且设计极简的视频播放软件,它为用户提供了丰富的视频和音频播放体验。以下是对该软件的详细介绍:软件概述AstrOrz Player官方版基于WMP(Windows Media Player)和VLC(VideoLAN Client)内核开发,这意味着它能够支持多种视频和音频格式,包括mkv...
软件 3951 3
开源 OncePower 一款功能强大的文件和文件夹批量重命名工具 v3.2.3

开源 OncePower 一款功能强大的文件和文件夹批量重命名工具 v3.2.3

OncePower是一款功能强大的文件和文件夹批量重命名工具,它不仅能够帮助用户高效地管理大量文件,还提供了多种实用的附加功能。以下是关于OncePower的详细介绍:基本功能批量重命名:OncePower支持对多个文件和文件夹进行批量重命名,用户可以根据需要选择不同的匹配规则和命名方式,以达到最佳的整理效果。视图模式:针对图片文件,Once...
开源 4889 2
开源工具 告别命令行!FFmpegFreeUI 让视频转码更轻松 v6.1.39

开源工具 告别命令行!FFmpegFreeUI 让视频转码更轻松 v6.1.39

FFmpegFreeUI(简称 3FUI)是一个专为 Windows 平台设计的 FFmpeg 图形用户界面(GUI)工具。它基于 .NET 10 框架开发,使用 WinForm 技术,并结合 SunnyUI 和自定义绘制功能,打造了一个专业、高效的暗黑风格用户界面。该工具的设计目标是提供轻度专业的参数调整功能,帮助普通用户更轻松地进行视频转...
开源 5627 1
开源 简易语音工具包 用于语音识别、语音转录、语音转换等。Easy-Voice-Toolkit  v1.3.5

开源 简易语音工具包 用于语音识别、语音转录、语音转换等。Easy-Voice-Toolkit v1.3.5

🎙️ Easy-Voice-Toolkit —— 一体化开源语音处理工具箱将复杂的语音 AI 技术封装为直观易用的自动化工作流,零门槛构建从音频输入到语音合成的完整 pipeline。🔍 项目定位Easy-Voice-Toolkit 是一个模块化、全流程的语音处理平台,整合 Whisper、GPT-SoVITS 等主流开源技术,通过图形化界面...
开源 5500 1