0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v12.53 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v12.53 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

Wan2GP 是专为“显卡资源有限”的用户打造的**开源视频生成工具箱**。它把目前最先进的文生视频、图生视频、视频编辑模型(Wan 2.1、Hunyuan Video、LTX Video 等)做了重度优化和封装,让只有 6-8 GB 显存的旧显卡也能跑得动、跑得快,并提供了一整套 Web 界面与周边工具,做到“开箱即玩”。一句话总结:**把...
AI,开源 4.9万 164
IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话 附效果演示 20260816更新

IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话 附效果演示 20260816更新

IndexTTS是由B站推出的一款基于XTTS和Tortoise的GPT风格文本转语音(TTS)模型。该项目在中文文本转语音领域展现出显著的技术优势和应用,以下从项目背景、技术架构、应用场景、社区支持及未来挑战五个维度进行详细介绍。一、项目背景:重新定义中文TTS技术标杆IndexTTS的诞生旨在解决传统TTS系统在中文语音合成中的两大核心痛...
AI,软件 2.4万 44
 开源 免费 Koboldcpp 人人可玩的本地大模型 不管啥显卡,cpu也能跑 附视频演示 支持deepseek v1.118.1

开源 免费 Koboldcpp 人人可玩的本地大模型 不管啥显卡,cpu也能跑 附视频演示 支持deepseek v1.118.1

KoboldCpp是一款易于使用的人工智能文本生成软件,适用于GGML和GGUF模型。这是一个可从Concedo分发的单一自包含版本,它建立在llama.cpp的基础上,并添加了一个多功能的Kobold API端点、额外的格式支持、稳定的扩散图像生成、向后兼容性以及一个具有持久故事、编辑工具、保存格式、内存、世界信息、作者注释、人物、场景和K...
开源 1.5万 7
一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

—— 高清图像修复、增强与风格化处理工具本系统基于先进的 qwen 图片编辑模型 与 Nunchaku 量化技术 构建,结合 LoRA 微调模型支持,提供强大且高效的图像编辑能力。无论是老照片修复、人像增强、风景优化,还是黑白图上色,都能一键实现高质量输出。🔧 核心功能✅ 高清图像修复与增强支持上传任意分辨率图像(最小边自动放大至 1024p...
AI 2万 17
开源 Cherry Studio 一个支持多模型服务的桌面客户端工具 支持deepseek v2.0.0

开源 Cherry Studio 一个支持多模型服务的桌面客户端工具 支持deepseek v2.0.0

Cherry Studio是一款专为专业用户打造的桌面客户端,它支持多模型服务,集成了超过300多个大语言模型,涵盖了30多个行业,旨在帮助用户在多种场景下提升工作效率。这款软件的设计初衷是满足各行各业对GPT技术的需求,无论是开发者、设计师还是作家,都能从中受益。对于开发者而言,Cherry Studio是一个强大的代码伙伴。它可以进行代码...
开源 9051 0
别只截图——让AI看懂它!Snippai秒出翻译、表格、配色方案 v0.3.3

别只截图——让AI看懂它!Snippai秒出翻译、表格、配色方案 v0.3.3

Snippai 是一款开源的 AI 截图分析工具,主打“截一下,秒懂一切”。它把传统截图工具的功能边界彻底打破:截完图后,AI 会自动识别图片里的内容并给出“下一步”服务,而不是简单保存一张图片。核心能力一览公式识别:截图里的数学公式直接变成可编辑的 LaTeX。文字提取:OCR 精准抓字,支持多语言,抓完还能顺手翻译。表格识别:把图片中的表...
AI,开源 1.4万 13
视频创作者的新宠:这个开源工具正在悄悄改变内容生产方式 一键整合包 MoneyPrinterPlus v1.3.2

视频创作者的新宠:这个开源工具正在悄悄改变内容生产方式 一键整合包 MoneyPrinterPlus v1.3.2

你可以把它想象成一个 “AI全自动视频工厂”。它最大的特点就是:输入一段文字,就能自动生成一个完整的高清视频。是不是有点像你写一篇作文,然后机器帮你拍成了短视频?没错,就是这个意思!🧠 它是怎么工作的?简单来说,它的流程是这样的:你告诉它要说什么内容(文字)比如:“今天教你怎么在家做蛋糕”它会自动找合适的画面素材比如网上免费的高清视频片段:打...
AI,开源 9193 3
神器 开源 Sigma File Manager 一款功能丰富、易于使用的文件管理器 v2.2.0

神器 开源 Sigma File Manager 一款功能丰富、易于使用的文件管理器 v2.2.0

Sigma File Manager 是一款由 Aleksey Hoffman 设计、开发和维护的免费、开源的现代文件管理器(或称文件浏览器),旨在为 Windows 和 Linux 用户提供高效的文件管理和组织体验。这款软件以其快速演进和丰富的功能集而闻名,旨在显著提升用户的工作效率和文件管理体验。Sigma File Manager 的一...
软件 3224 0
自媒体人必备!支持图片 + 视频混用生成轮播视频,不要显卡,小巧不到200M,制作超方便,支持20+随机转场特效 27-lunbo 3.0

自媒体人必备!支持图片 + 视频混用生成轮播视频,不要显卡,小巧不到200M,制作超方便,支持20+随机转场特效 27-lunbo 3.0

做自媒体、做视频剪辑的朋友,肯定都遇到过这样的痛点:手里有几百上千张旅游照、产品图或者二次元壁纸,想做成一个带背景音乐、带炫酷转场的短视频。如果用传统的剪辑软件,一张张导入、手动加转场、对齐音乐节奏…… 没个几个小时根本下不来。如果图片比例和视频比例不一样,上下还会留下难看的黑边。今天,给大家带来一款完全本地运行的“图片转视频”效率神器!它底...
AI 3812 2
 AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

🎙️ 你的音视频“第二大脑”:AI 深度分析引擎,让每一段声音都变成可检索的智慧你有没有过这样的经历——收藏了几百个小时的播客,却再也没打开过第二期;开完一场两小时的会议,翻遍笔记也找不到那个关键数据;刷到一个干货满满的视频教程,一周后只记得“好像讲了个很厉害的东西”;听完一本有声小说,想和朋友分享某个情节,却怎么也想不起在第几章……信息爆炸...
AI 3702 3
音乐卡点视频 一键生成 支持图片+视频素材  新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260629

音乐卡点视频 一键生成 支持图片+视频素材 新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260629

卡点视频生成器是一款基于 AI大模型 智能视频自动生成工具,专为音乐爱好者、短视频创作者、自媒体运营者设计。它能根据你上传的音乐节拍/鼓点,自动从指定图片或视频素材中智能选取片段,生成节奏精准、视觉流畅的“卡点”视频,适用于抖音、快手、B站、Instagram 等平台。无需剪辑经验,一键生成专业级卡点视频!🎯 核心功能1. 🖼️ 图片卡点模式...
AI 1.4万 0
视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

KrillinAI是一个基于AI大模型的视频翻译和配音工具,它提供了专业级的翻译服务以及一键部署的全流程解决方案。这个开源工具旨在帮助用户轻松实现视频内容的本地化与增强,使其能够适配多种内容平台,如YouTube、TikTok、Bilibili、抖音(国内版)、微信视频号、快手等。KrillinAI的核心功能包括视频翻译、配音与声音克隆、字幕...
安卓 5765 3
balenaEtcher 一款功能强大、易于使用、开源的镜像烧录软件 v2.1.6

balenaEtcher 一款功能强大、易于使用、开源的镜像烧录软件 v2.1.6

Etcher是一款功能强大且易于使用的操作系统镜像烧录软件,它专为将OS镜像安全、快速地烧录到SD卡、USB驱动器等存储设备而设计。Etcher采用Web技术开发,确保用户体验流畅且直观,使得即便是非技术背景的用户也能轻松上手。Etcher的核心优势在于其安全性和稳定性。它能够有效防止用户在操作过程中意外写入到硬盘,从而保护用户的数据安全。同...
软件 3938 0
手机软件 安卓app Compass 一款功能实用、界面简洁的Android指南针应用 v2.0.1

手机软件 安卓app Compass 一款功能实用、界面简洁的Android指南针应用 v2.0.1

Compass是一款由Kr0oked开发的简洁而美观的Android指南针应用,它基于GPL-3.0许可协议发布,旨在为用户提供一种简单、直观且没有广告干扰的导航体验。这款应用以其清晰的界面设计、实用的功能以及对用户隐私的尊重,赢得了不少用户的喜爱。核心功能与特性Compass的核心功能是指南针导航。它不仅可以准确地指向磁北,还能够显示真北,...
安卓 3044 1
开源 神器 Stability Matrix  一款功能强大、易于使用的Stable Diffusion管理工具 v2.16.1

开源 神器 Stability Matrix 一款功能强大、易于使用的Stable Diffusion管理工具 v2.16.1

Stability Matrix是由Lykos AI开发的一款革命性工具,专为简化Stable Diffusion的使用和管理而设计。作为一款多平台包管理器和推理用户界面,它极大地提升了Stable Diffusion的易用性和用户体验。核心功能多平台支持:Stability Matrix支持macOS、Windows和Linux系统,确保用...
AI,开源 7116 1
别再瞎试了!用这个神器,一键优化你的大模型提示词 Prompt Optimizer v2.11.7

别再瞎试了!用这个神器,一键优化你的大模型提示词 Prompt Optimizer v2.11.7

该项目聚焦于提升大语言模型(LLM)在实际应用中对提示语的理解与响应质量,旨在通过系统化的方法改进原始提示语的表达结构、清晰度和有效性,从而获得更准确、更稳定、更符合预期的模型输出。核心理念随着大模型在各类场景中的广泛应用,提示工程(Prompt Engineering)成为影响输出质量的关键因素。prompt-optimizer 的设计初衷...
AI,开源 3.2万 102
视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

🎬 剑二十七|视频反推提示词生成器让每一帧画面,都转化为可复用的创作语言🔮 核心定位这是一款面向专业内容创作者的智能视频理解工具。它不满足于简单的画面识别,而是以「镜头语言」为最小单元,深度解析视频内容,自动生成符合影视工业标准的中文提示词描述。不是「看图说话」,而是「读镜写意」。✨ 六大核心能力🎯 智能镜头分割精准识别场景切换点自适应阈值调...
AI 6571 9
网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

想象一下这样的场景: 录一段自己说话的声音,AI 就能用你的音色,带着你的情绪,流利地说出英语、日语、韩语……而且完全听不出是外国人在说。这不是科幻电影,而是Confucius4-TTS正在做的事。Confucius4-TTS 是由网易有道开发的一款前沿语音合成(TTS)系统。它的核心理念可以用一句话概括:「 一种音色,任意语言 」简单来说...
AI 4000 0
小红书 开源配音神器 dots.tts 只需3秒音频,完美复刻你的声音! 一键整合包 v20260617 解压即可使用

小红书 开源配音神器 dots.tts 只需3秒音频,完美复刻你的声音! 一键整合包 v20260617 解压即可使用

dots.tts是由小红书人工智能实验室(RedNote Hilab)研发并免费开源的一款新一代 AI 语音合成(配音)系统。抛开复杂的技术术语,你可以把它简单理解为一个“拥有录音棚级音质的超级 AI 配音员”。你只需要输入一段文字,它就能用极其逼真、富有感情的声音把文字读出来,甚至能完美模仿任何人的声音。以下是它最核心的几个“超能力”,也是...
AI 1.2万 27
图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印 剑二十七洗图专用  z-image-turbo-xitu v12

图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印 剑二十七洗图专用 z-image-turbo-xitu v12

🎨 Z-Image-Turbo 剑二十七·洗图专用版—— 神似而形不似,AI 重绘的终极答案"目前市面上能做到神似而形不似的类似图生图,在我面前一个能打的都没有"🔍 产品定位本工具专为「高质量图像重绘」场景打造,聚焦「洗图」核心需求:在保留原图构图、光影、神态的前提下,通过 AI 进行艺术化重绘,实现「神似而形不似」的进阶...
AI 1.2万 22
 神器 开源 视频音频处理神器 FFmpeg 官网最新版 附安装教程 v2026-06-01

神器 开源 视频音频处理神器 FFmpeg 官网最新版 附安装教程 v2026-06-01

这个软件我以前做了几期教程,非常非常强大的视频音频处理工具,基本市面上绝大部分视频处理软件都是套它的壳https://www.jian27.com/html/ffmpeg.html一、ffmpeg介绍FFmpeg是一套可以用来记录、转换数字音频、视频,并能将其转化为流的开源计算机程序。采用LGPL或GPL许可证。它提供了录制、转换以及流化音视...
开源 6901 2
MOSS-TTS-v1.5+MOSS-TTSD+ MOSS-TTS-Nano 支持CPU运行,一个高质量的开源中文文本到语音合成系统 一键整合包 v20260604 支持免费商业使用 支持暂停

MOSS-TTS-v1.5+MOSS-TTSD+ MOSS-TTS-Nano 支持CPU运行,一个高质量的开源中文文本到语音合成系统 一键整合包 v20260604 支持免费商业使用 支持暂停

🎙️ MOSS-TTS:让文字拥有“千人千面”的超级嗓音一句话看懂:这是一个由复旦大学和模思智能联合开发的开源人工智能项目。它的核心本领就是把文字变成极其逼真、带有感情的真人声音。✨ 为什么它比传统的“机器朗读”更厉害?传统的配音软件听起来往往像没有感情的机器人,而 MOSS-TTS 拥有以下 5 大“超能力”:1. 🎭 神奇的“声音克隆”魔...
AI 1万 20
高德开源项目 PilotTTS - 让AI学会"说话"的语音生成开源项目,支持11种情绪+14种方言 一键整合包 v20260530 解压即可使用

高德开源项目 PilotTTS - 让AI学会"说话"的语音生成开源项目,支持11种情绪+14种方言 一键整合包 v20260530 解压即可使用

这是高德地图语音团队开发的一个AI语音合成工具,可以让电脑用自然的声音朗读文字,还能模仿不同人的声音、表达不同情绪。✨ 它能做什么?1️⃣模仿任何人说话只需录一段5-15秒的音频,AI就能学会这个人的声音比如:用你朋友的声音读你写的文字2️⃣带感情地朗读支持11种情绪:😊 开心、😢 悲伤、😠 生气😲 惊讶、😨 害怕、🤢 厌恶😐 严肃、🥺 关切...
AI 2674 0
轻量 高效 AI生图工具 基于 Stable Diffusion XL 模型二次开发,6G英伟达显卡就可以愉快玩耍 Diaomo v9.0 六秒出图 支持更换模型+图片超分+图生图

轻量 高效 AI生图工具 基于 Stable Diffusion XL 模型二次开发,6G英伟达显卡就可以愉快玩耍 Diaomo v9.0 六秒出图 支持更换模型+图片超分+图生图

基于 Stable Diffusion XL 的一站式 AI 绘画工作台,支持文生图、图生图与批量自动化生产,内置智能中文翻译,零门槛直接用中文描述生成高质量图像。一、三大核心创作模式1. 文生图(Text-to-Image)输入一段画面描述,AI 直接生成全新图像。智能中文提示词:输入中文即可,系统自动调用轻量翻译模型转为英文提示词;若输入...
AI,开源 1.7万 31
一句话画出动漫世界!支持中文的AI绘画神器来了 Anima文生动漫图片AI大模型 ,8G英伟达显卡即可愉快玩耍

一句话画出动漫世界!支持中文的AI绘画神器来了 Anima文生动漫图片AI大模型 ,8G英伟达显卡即可愉快玩耍

Anima 动漫文生图基于 circlestone-labs/Anima 模型的图像生成工具。支持中文提示词自动翻译,生成结果自动保存至本地 output 目录。✨ 主要特性🎨 高质量动漫风格生成 – 专精二次元、动漫、CG 渲染。🌐 中文提示词自动翻译 – 使用...
AI 4.2万 90
klein-edit AI图片编辑工具 摄影师狂喜:86个AI修图预设,从人像到风景全覆盖 v1.0 20260514更新记录 新增lora支持

klein-edit AI图片编辑工具 摄影师狂喜:86个AI修图预设,从人像到风景全覆盖 v1.0 20260514更新记录 新增lora支持

FLUX.2 Klein 图像编辑工具:86个一键预设,打造专业级本地 AI 图像处理工作站一、项目概述在 AI 图像生成与编辑领域,FLUX系列模型以其卓越的图像理解能力和编辑精度备受开发者青睐。本文介绍的这套基于FLUX.2-klein的本地图像编辑工具,通过Gradio构建了一个功能完备的 Web 界面,集成了86个实用预设功能,支持多...
AI 6372 7
京东开源 图片编辑AI大模型 JoyAI-Image-Edit v20260422 二次开发一键整合包 附演示和操作教程

京东开源 图片编辑AI大模型 JoyAI-Image-Edit v20260422 二次开发一键整合包 附演示和操作教程

JoyAI-Image-Edit 是京东开源的多模态基础模型,专注于指令引导的图像编辑任务。它基于 JoyAI-Image 多模态底座构建,通过自然语言指令实现对图像的精确、可控编辑。🔹 核心技术特点1. 强大的空间理解能力场景解析:自动识别图像中的物体、区域及空间关系关系定位:精准理解"物体A在物体B左侧"等空间描述指令...
AI 5672 0
一键生成AI绘画提示词:让你的图片秒变顶级写真描述 跟之前的图片反推工具不同的是这个会思考 thinkpic-6.0-20260420

一键生成AI绘画提示词:让你的图片秒变顶级写真描述 跟之前的图片反推工具不同的是这个会思考 thinkpic-6.0-20260420

这个工具是做什么的?这个程序可以自动为你的人物照片生成一段“AI绘画提示词”。简单来说:你放一张人物照片进去,它就能写出一段详细、生动、充满吸引力的文字描述,这段文字可以直接用在 AI 绘画工具(比如 Stable Diffusion)中,让 AI 画出类似风格或效果的图片。例如,它会描述:人物有多美、眼睛多勾人、嘴唇多诱人;身材曲线多么火辣...
AI 1.7万 8
开源 JamTools v0.14.1B 一个功能丰富的跨平台小工具集软件

开源 JamTools v0.14.1B 一个功能丰富的跨平台小工具集软件

JamTools 介绍JamTools 是一个功能丰富的跨平台小工具集软件,支持 Windows 7/8/10/11、MacOS 和 Ubuntu 系统,其他系统用户可直接从源码编译打包。这款软件集合了多种实用工具,如截屏、录屏、文字识别、多语言翻译、多媒体格式转换、鼠标键盘动作录制播放、局域网文件传输以及聊天机器人等功能,完全开源,方便用户...
开源 3180 1
效率工具 一键启动神器之1key.run v3.5.1

效率工具 一键启动神器之1key.run v3.5.1

1KeyRun 是一款免费的一键启动神器,轻便、高效、实用,助您提升工作效率。追求极致性能,拒绝臃肿,更加侧重系统工具的提供。软件特色干净利落,轻装简行:任何位置按下「Alt + 空格」呼出1key.run,「Esc」隐藏。不打断现有工作,输入所想,即可得到结果,支持中文拼音及缩写、智能分词。无需记忆繁琐的快捷键,使用中所涉及的快捷键,都会以...
开源 1409 0
本地部署 一键整合包FLUX.2-klein-9B-KV-LoRA-Studio 图像编辑大模型 海量lora支持 v3.0

本地部署 一键整合包FLUX.2-klein-9B-KV-LoRA-Studio 图像编辑大模型 海量lora支持 v3.0

FLUX.2-Klein-LoRA-Studio是一款基于 Gradio 构建的本地化图像编辑工作台,集成 Black Forest Labs 最新发布的FLUX.2-klein-9B多模态生成模型,支持通过 LoRA 适配器实现多样化图像编辑任务。⚡ 核心功能🔹 多图像输入编辑支持上传 1~2 张参考图:Picture 1(Base):作为...
AI 5339 8
你想怎么改图?它就怎么改 Qwen-Image-Edit-2511 实现真正可控的 AI 图片编辑 支持海量lora v20260413 一键整合包

你想怎么改图?它就怎么改 Qwen-Image-Edit-2511 实现真正可控的 AI 图片编辑 支持海量lora v20260413 一键整合包

Qwen-Image-Edit-2511 是由阿里云推出的新一代多模态图像编辑大模型,属于 Qwen 系列在视觉生成与编辑方向的重要迭代。该模型基于 Qwen-Image-Edit 系列的持续演进(如 2509、2511 版本),在保留原始图像语义结构和细节的前提下,支持高保真、高可控性的图像编辑任务。该模型主要特点包括:高保真图像编辑:在执...
AI 7766 16