0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v13.01支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v13.01支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

Wan2GP 是专为“显卡资源有限”的用户打造的**开源视频生成工具箱**。它把目前最先进的文生视频、图生视频、视频编辑模型(Wan 2.1、Hunyuan Video、LTX Video 等)做了重度优化和封装,让只有 6-8 GB 显存的旧显卡也能跑得动、跑得快,并提供了一整套 Web 界面与周边工具,做到“开箱即玩”。一句话总结:**把...
AI,开源 5.2万 175
一键克隆任意人声!VoxCPM 2.0.3 开源语音大模型,无需训练,3秒搞定声音复刻!支持30种语言,9种方言,支持情绪表达+语气标签+超长文本+音色一致性+批量文本合成+音色保存+预设保存+音质增强+洗稿。最低8G英伟达即可运行 剑二十七二开汉化整合包 v20260915

一键克隆任意人声!VoxCPM 2.0.3 开源语音大模型,无需训练,3秒搞定声音复刻!支持30种语言,9种方言,支持情绪表达+语气标签+超长文本+音色一致性+批量文本合成+音色保存+预设保存+音质增强+洗稿。最低8G英伟达即可运行 剑二十七二开汉化整合包 v20260915

VoxCPM 是一个支持中英文、零样本语音克隆、情感可控、音素/公式输入的统一端到端语音合成大模型。它不依赖传统 TTS 流水线(如文本分析 → 音素对齐 → 声码器),而是直接从文本生成高质量语音波形。🎯 目标:打造一个像大语言模型一样“通用、灵活、强大”的语音生成基础模型。🔧 核心特性(技术亮点)1. ✅ 端到端架构(End-to-End...
AI,开源 1.3万 13
AI 自动生成短剧解说视频 输入一段话就能生成短剧解说视频  一键整合包 NarratoAI v1.0.0

AI 自动生成短剧解说视频 输入一段话就能生成短剧解说视频 一键整合包 NarratoAI v1.0.0

这个工具是做什么的?你可以把 NarratoAI 理解成一个“AI自动剪辑视频的神器”,它最大的特点就是:输入一段文字或口播内容,就能自动生成一部短剧解说视频。是不是听起来像你写了个剧本,AI 就帮你拍成了短视频?没错,就是这样!🧠 它是怎么工作的?它的流程大概是这样的:你提供一段文字内容(比如口播文案、剧情简介)比如:“今天给大家讲一个爱情...
AI,开源 8835 3
手机软件 安卓pp FFShare 一款功能强大图像、视频和音频文件压缩工具 v2.0.0

手机软件 安卓pp FFShare 一款功能强大图像、视频和音频文件压缩工具 v2.0.0

FFShare是一款功能强大的Android应用程序,它专注于在分享前对图像、视频和音频文件进行压缩。这款应用利用了ffmpeg这一强大的多媒体处理工具,为用户提供了一个便捷、高效的文件压缩解决方案。首先,从用户的角度来看,FFShare的最大亮点在于其压缩功能。在日常使用中,我们经常会遇到因为文件过大而无法快速分享或上传的问题。FFShar...
安卓 2807 0
图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印+自定义lora 剑二十七洗图专用  z-image-turbo-xitu v14

图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印+自定义lora 剑二十七洗图专用 z-image-turbo-xitu v14

🎨 Z-Image-Turbo 剑二十七·洗图专用版—— 神似而形不似,AI 重绘的终极答案"目前市面上能做到神似而形不似的类似图生图,在我面前一个能打的都没有"🔍 产品定位本工具专为「高质量图像重绘」场景打造,聚焦「洗图」核心需求:在保留原图构图、光影、神态的前提下,通过 AI 进行艺术化重绘,实现「神似而形不似」的进阶...
AI 1.3万 22
音乐卡点视频 一键生成 支持图片+视频素材  新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260909

音乐卡点视频 一键生成 支持图片+视频素材 新增镜头分镜切割+人声分离+ MTV 模式+音频编辑 无显卡要求 剑二十七原创作品 KA v20260909

卡点视频生成器是一款基于 AI大模型 智能视频自动生成工具,专为音乐爱好者、短视频创作者、自媒体运营者设计。它能根据你上传的音乐节拍/鼓点,自动从指定图片或视频素材中智能选取片段,生成节奏精准、视觉流畅的“卡点”视频,适用于抖音、快手、B站、Instagram 等平台。无需剪辑经验,一键生成专业级卡点视频!🎯 核心功能1. 🖼️ 图片卡点模式...
AI 1.5万 0
神器 开源 Seelen UI 一款集美观、高效和可定制性于一身的win美化桌面环境软件 v2.8.4

神器 开源 Seelen UI 一款集美观、高效和可定制性于一身的win美化桌面环境软件 v2.8.4

Seelen UI 是一款专为Windows用户设计的全功能可定制桌面环境软件,它以其丰富的自定义选项和高效的生产力工具,为用户带来了前所未有的桌面体验。这款软件不仅支持70多种语言,还通过其无缝的系统集成,让用户能够轻松地将自己的桌面打造成既高效又个性化的工作空间。Seelen UI的核心优势在于其强大的可定制性。从菜单到小部件,用户可以自...
开源 5600 1
自媒体人必备!支持图片 + 视频混用生成轮播视频(类似幻灯片),不要显卡,小巧不到200M,制作超方便,支持20+随机转场特效 27-lunbo v5.0

自媒体人必备!支持图片 + 视频混用生成轮播视频(类似幻灯片),不要显卡,小巧不到200M,制作超方便,支持20+随机转场特效 27-lunbo v5.0

做自媒体、做视频剪辑的朋友,肯定都遇到过这样的痛点:手里有几百上千张旅游照、产品图或者二次元壁纸,想做成一个带背景音乐、带炫酷转场的短视频。如果用传统的剪辑软件,一张张导入、手动加转场、对齐音乐节奏…… 没个几个小时根本下不来。如果图片比例和视频比例不一样,上下还会留下难看的黑边。今天,给大家带来一款完全本地运行的“图片转视频”效率神器!它底...
AI 4488 12
IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话+语音替换 附效果演示 20260906更新

IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话+语音替换 附效果演示 20260906更新

IndexTTS是由B站推出的一款基于XTTS和Tortoise的GPT风格文本转语音(TTS)模型。该项目在中文文本转语音领域展现出显著的技术优势和应用,以下从项目背景、技术架构、应用场景、社区支持及未来挑战五个维度进行详细介绍。一、项目背景:重新定义中文TTS技术标杆IndexTTS的诞生旨在解决传统TTS系统在中文语音合成中的两大核心痛...
AI,软件 2.5万 44
小红书出品 开源TTS新选择:FireRedTTS3 实现高质量 对话语音合成 声音克隆 +声音设计+ 语音编辑  支持24种语言+21种中文方言 支持超长文本,支持语速调整 一键整合包 v20260905

小红书出品 开源TTS新选择:FireRedTTS3 实现高质量 对话语音合成 声音克隆 +声音设计+ 语音编辑 支持24种语言+21种中文方言 支持超长文本,支持语速调整 一键整合包 v20260905

FireRedTTS 是一个开源的文本转语音(Text-to-Speech, TTS)项目,由 FireRedTeam 开发并维护。该项目致力于提供高质量、低延迟、易于集成的语音合成能力,适用于多种应用场景,如语音助手、有声读物生成、无障碍访问、智能客服等。项目基于深度学习技术,采用了先进的神经网络架构(如 Tacotron、FastSpee...
AI,开源 2万 0
一个本地音视频 AI 工作台:会议纪要、课程笔记、视频字幕,全都自动搞定 audio-edit v2.0 一键整合包 解压即可使用

一个本地音视频 AI 工作台:会议纪要、课程笔记、视频字幕,全都自动搞定 audio-edit v2.0 一键整合包 解压即可使用

你是不是也遇到过这些场景?开完两小时的会,录音躺在手机里,整理纪要花了比开会还长的时间;报了网课没时间看,几十个视频在硬盘里吃灰,想复习却不知道从哪下手;剪视频想加字幕,对着软件一句一句听写,一条 10 分钟的视频磨掉一晚上;收藏了几十期播客,没时间听,但又怕错过里面的干货……这些问题的本质都一样:音视频里的信息很值钱,但提取信息的成本太高。...
AI 1.3万 0
一键生成AI绘画提示词:让你的图片秒变顶级写真描述 会思考的图片反推提示词工具 一键整合包 解压即可使用  thinkpic-8.0-20260902

一键生成AI绘画提示词:让你的图片秒变顶级写真描述 会思考的图片反推提示词工具 一键整合包 解压即可使用 thinkpic-8.0-20260902

这个工具是做什么的?这个程序可以自动为你的人物照片生成一段“AI绘画提示词”。简单来说:你放一张人物照片进去,它就能写出一段详细、生动、充满吸引力的文字描述,这段文字可以直接用在 AI 绘画工具(比如 Stable Diffusion)中,让 AI 画出类似风格或效果的图片。例如,它会描述:人物有多美、眼睛多勾人、嘴唇多诱人;身材曲线多么火辣...
AI 1.7万 8
开源 OncePower 一款功能强大的文件和文件夹批量重命名工具 v3.2.3

开源 OncePower 一款功能强大的文件和文件夹批量重命名工具 v3.2.3

OncePower是一款功能强大的文件和文件夹批量重命名工具,它不仅能够帮助用户高效地管理大量文件,还提供了多种实用的附加功能。以下是关于OncePower的详细介绍:基本功能批量重命名:OncePower支持对多个文件和文件夹进行批量重命名,用户可以根据需要选择不同的匹配规则和命名方式,以达到最佳的整理效果。视图模式:针对图片文件,Once...
开源 4740 2
开源工具 告别命令行!FFmpegFreeUI 让视频转码更轻松 v6.1.39

开源工具 告别命令行!FFmpegFreeUI 让视频转码更轻松 v6.1.39

FFmpegFreeUI(简称 3FUI)是一个专为 Windows 平台设计的 FFmpeg 图形用户界面(GUI)工具。它基于 .NET 10 框架开发,使用 WinForm 技术,并结合 SunnyUI 和自定义绘制功能,打造了一个专业、高效的暗黑风格用户界面。该工具的设计目标是提供轻度专业的参数调整功能,帮助普通用户更轻松地进行视频转...
开源 5470 1
开源 简易语音工具包 用于语音识别、语音转录、语音转换等。Easy-Voice-Toolkit  v1.3.5

开源 简易语音工具包 用于语音识别、语音转录、语音转换等。Easy-Voice-Toolkit v1.3.5

🎙️ Easy-Voice-Toolkit —— 一体化开源语音处理工具箱将复杂的语音 AI 技术封装为直观易用的自动化工作流,零门槛构建从音频输入到语音合成的完整 pipeline。🔍 项目定位Easy-Voice-Toolkit 是一个模块化、全流程的语音处理平台,整合 Whisper、GPT-SoVITS 等主流开源技术,通过图形化界面...
开源 5379 1
免费开源神器!像素动画艺术编辑器 —— PixiEditor v2.1.2.2

免费开源神器!像素动画艺术编辑器 —— PixiEditor v2.1.2.2

PixiEditor 是一款免费、开源、跨平台的像素艺术创作工具,专为像素艺术家、游戏开发者和像素爱好者设计。采用现代技术栈构建,界面简洁直观,功能强大且持续活跃开发中。🎨 核心特性✅ 专为像素艺术优化精确的像素级编辑支持透明背景和 Alpha 通道像素网格、对齐辅助线、缩放预览等专业功能✅ 多图层支持支持多个图层,可调整顺序、透明度、混合模...
开源 7740 7
开源 AiNiee:一键通杀全场景 AI 翻译!游戏 / 字幕 / 书籍 / 文档,高效搞定不费力 v7.2.3

开源 AiNiee:一键通杀全场景 AI 翻译!游戏 / 字幕 / 书籍 / 文档,高效搞定不费力 v7.2.3

AiNiee 是一款专注于 AI 翻译的工具,主打一键自动翻译复杂长文本内容,涵盖游戏、书籍、字幕、文档等多种场景。其核心目标是通过智能化技术提升翻译效率与质量,同时支持广泛的文件格式和使用场景。核心功能格式全能,覆盖广泛深度支持游戏文本翻译,兼容 Mtool、Renpy、Translator++ 等游戏文本导出工具。轻松处理多种文件类型:I...
开源 4113 0
小旺AI截图:AI加持,截图翻译、OCR文字提取一键搞定!v1.3.0

小旺AI截图:AI加持,截图翻译、OCR文字提取一键搞定!v1.3.0

一、产品概述小旺AI截图是一款集截图与录屏功能于一体的全能神器,作为首款接入DeepSeek大模型的AI截图软件,它以其轻巧、好用、功能强大的特点,赢得了广大用户的喜爱。无论是学习攻坚、办公助手、游戏娱乐、设计研发还是内容创作,小旺AI截图都能成为您的得力助手。二、核心功能截图功能任意截图:支持电脑任意区域截图,简单快捷,满足各种截图需求。A...
软件 4783 0
别只截图——让AI看懂它!Snippai秒出翻译、表格、配色方案 v0.3.5

别只截图——让AI看懂它!Snippai秒出翻译、表格、配色方案 v0.3.5

Snippai 是一款开源的 AI 截图分析工具,主打“截一下,秒懂一切”。它把传统截图工具的功能边界彻底打破:截完图后,AI 会自动识别图片里的内容并给出“下一步”服务,而不是简单保存一张图片。核心能力一览公式识别:截图里的数学公式直接变成可编辑的 LaTeX。文字提取:OCR 精准抓字,支持多语言,抓完还能顺手翻译。表格识别:把图片中的表...
AI,开源 1.4万 13
 开源 免费 Koboldcpp 人人可玩的本地大模型 不管啥显卡,cpu也能跑 附视频演示 支持deepseek v1.119

开源 免费 Koboldcpp 人人可玩的本地大模型 不管啥显卡,cpu也能跑 附视频演示 支持deepseek v1.119

KoboldCpp是一款易于使用的人工智能文本生成软件,适用于GGML和GGUF模型。这是一个可从Concedo分发的单一自包含版本,它建立在llama.cpp的基础上,并添加了一个多功能的Kobold API端点、额外的格式支持、稳定的扩散图像生成、向后兼容性以及一个具有持久故事、编辑工具、保存格式、内存、世界信息、作者注释、人物、场景和K...
开源 1.5万 12
一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

—— 高清图像修复、增强与风格化处理工具本系统基于先进的 qwen 图片编辑模型 与 Nunchaku 量化技术 构建,结合 LoRA 微调模型支持,提供强大且高效的图像编辑能力。无论是老照片修复、人像增强、风景优化,还是黑白图上色,都能一键实现高质量输出。🔧 核心功能✅ 高清图像修复与增强支持上传任意分辨率图像(最小边自动放大至 1024p...
AI 2.1万 17
开源 Cherry Studio 一个支持多模型服务的桌面客户端工具 支持deepseek v2.0.0

开源 Cherry Studio 一个支持多模型服务的桌面客户端工具 支持deepseek v2.0.0

Cherry Studio是一款专为专业用户打造的桌面客户端,它支持多模型服务,集成了超过300多个大语言模型,涵盖了30多个行业,旨在帮助用户在多种场景下提升工作效率。这款软件的设计初衷是满足各行各业对GPT技术的需求,无论是开发者、设计师还是作家,都能从中受益。对于开发者而言,Cherry Studio是一个强大的代码伙伴。它可以进行代码...
开源 9161 0
视频创作者的新宠:这个开源工具正在悄悄改变内容生产方式 一键整合包 MoneyPrinterPlus v1.3.2

视频创作者的新宠:这个开源工具正在悄悄改变内容生产方式 一键整合包 MoneyPrinterPlus v1.3.2

你可以把它想象成一个 “AI全自动视频工厂”。它最大的特点就是:输入一段文字,就能自动生成一个完整的高清视频。是不是有点像你写一篇作文,然后机器帮你拍成了短视频?没错,就是这个意思!🧠 它是怎么工作的?简单来说,它的流程是这样的:你告诉它要说什么内容(文字)比如:“今天教你怎么在家做蛋糕”它会自动找合适的画面素材比如网上免费的高清视频片段:打...
AI,开源 9399 3
神器 开源 Sigma File Manager 一款功能丰富、易于使用的文件管理器 v2.2.0

神器 开源 Sigma File Manager 一款功能丰富、易于使用的文件管理器 v2.2.0

Sigma File Manager 是一款由 Aleksey Hoffman 设计、开发和维护的免费、开源的现代文件管理器(或称文件浏览器),旨在为 Windows 和 Linux 用户提供高效的文件管理和组织体验。这款软件以其快速演进和丰富的功能集而闻名,旨在显著提升用户的工作效率和文件管理体验。Sigma File Manager 的一...
软件 3322 0
 AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

🎙️ 你的音视频“第二大脑”:AI 深度分析引擎,让每一段声音都变成可检索的智慧你有没有过这样的经历——收藏了几百个小时的播客,却再也没打开过第二期;开完一场两小时的会议,翻遍笔记也找不到那个关键数据;刷到一个干货满满的视频教程,一周后只记得“好像讲了个很厉害的东西”;听完一本有声小说,想和朋友分享某个情节,却怎么也想不起在第几章……信息爆炸...
AI 3808 3
视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

KrillinAI是一个基于AI大模型的视频翻译和配音工具,它提供了专业级的翻译服务以及一键部署的全流程解决方案。这个开源工具旨在帮助用户轻松实现视频内容的本地化与增强,使其能够适配多种内容平台,如YouTube、TikTok、Bilibili、抖音(国内版)、微信视频号、快手等。KrillinAI的核心功能包括视频翻译、配音与声音克隆、字幕...
安卓 5883 3
balenaEtcher 一款功能强大、易于使用、开源的镜像烧录软件 v2.1.6

balenaEtcher 一款功能强大、易于使用、开源的镜像烧录软件 v2.1.6

Etcher是一款功能强大且易于使用的操作系统镜像烧录软件,它专为将OS镜像安全、快速地烧录到SD卡、USB驱动器等存储设备而设计。Etcher采用Web技术开发,确保用户体验流畅且直观,使得即便是非技术背景的用户也能轻松上手。Etcher的核心优势在于其安全性和稳定性。它能够有效防止用户在操作过程中意外写入到硬盘,从而保护用户的数据安全。同...
软件 4037 0
手机软件 安卓app Compass 一款功能实用、界面简洁的Android指南针应用 v2.0.1

手机软件 安卓app Compass 一款功能实用、界面简洁的Android指南针应用 v2.0.1

Compass是一款由Kr0oked开发的简洁而美观的Android指南针应用,它基于GPL-3.0许可协议发布,旨在为用户提供一种简单、直观且没有广告干扰的导航体验。这款应用以其清晰的界面设计、实用的功能以及对用户隐私的尊重,赢得了不少用户的喜爱。核心功能与特性Compass的核心功能是指南针导航。它不仅可以准确地指向磁北,还能够显示真北,...
安卓 3144 1
开源 神器 Stability Matrix  一款功能强大、易于使用的Stable Diffusion管理工具 v2.16.1

开源 神器 Stability Matrix 一款功能强大、易于使用的Stable Diffusion管理工具 v2.16.1

Stability Matrix是由Lykos AI开发的一款革命性工具,专为简化Stable Diffusion的使用和管理而设计。作为一款多平台包管理器和推理用户界面,它极大地提升了Stable Diffusion的易用性和用户体验。核心功能多平台支持:Stability Matrix支持macOS、Windows和Linux系统,确保用...
AI,开源 7261 1
别再瞎试了!用这个神器,一键优化你的大模型提示词 Prompt Optimizer v2.11.7

别再瞎试了!用这个神器,一键优化你的大模型提示词 Prompt Optimizer v2.11.7

该项目聚焦于提升大语言模型(LLM)在实际应用中对提示语的理解与响应质量,旨在通过系统化的方法改进原始提示语的表达结构、清晰度和有效性,从而获得更准确、更稳定、更符合预期的模型输出。核心理念随着大模型在各类场景中的广泛应用,提示工程(Prompt Engineering)成为影响输出质量的关键因素。prompt-optimizer 的设计初衷...
AI,开源 3.3万 102
视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

🎬 剑二十七|视频反推提示词生成器让每一帧画面,都转化为可复用的创作语言🔮 核心定位这是一款面向专业内容创作者的智能视频理解工具。它不满足于简单的画面识别,而是以「镜头语言」为最小单元,深度解析视频内容,自动生成符合影视工业标准的中文提示词描述。不是「看图说话」,而是「读镜写意」。✨ 六大核心能力🎯 智能镜头分割精准识别场景切换点自适应阈值调...
AI 7178 9
网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

想象一下这样的场景: 录一段自己说话的声音,AI 就能用你的音色,带着你的情绪,流利地说出英语、日语、韩语……而且完全听不出是外国人在说。这不是科幻电影,而是Confucius4-TTS正在做的事。Confucius4-TTS 是由网易有道开发的一款前沿语音合成(TTS)系统。它的核心理念可以用一句话概括:「 一种音色,任意语言 」简单来说...
AI 4117 0