别只截图——让AI看懂它!Snippai秒出翻译、表格、配色方案 v0.3.5

别只截图——让AI看懂它!Snippai秒出翻译、表格、配色方案 v0.3.5

Snippai 是一款开源的 AI 截图分析工具,主打“截一下,秒懂一切”。它把传统截图工具的功能边界彻底打破:截完图后,AI 会自动识别图片里的内容并给出“下一步”服务,而不是简单保存一张图片。核心能力一览公式识别:截图里的数学公式直接变成可编辑的 LaTeX。文字提取:OCR 精准抓字,支持多语言,抓完还能顺手翻译。表格识别:把图片中的表...
AI,开源 0
0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v12.641 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

0 基础也能当导演:输入一句话,AI 自动生成视频 Wan2GP 中文版 v12.641 支持 LTX-2.5 MiniMax H3 JoyAI-Echo Bernini wan2.2等数字人文生视频+图生视频+批量生成 英伟达6G显卡就可以跑起来,有这个你其他视频生成的整合包都可以删了

Wan2GP 是专为“显卡资源有限”的用户打造的**开源视频生成工具箱**。它把目前最先进的文生视频、图生视频、视频编辑模型(Wan 2.1、Hunyuan Video、LTX Video 等)做了重度优化和封装,让只有 6-8 GB 显存的旧显卡也能跑得动、跑得快,并提供了一整套 Web 界面与周边工具,做到“开箱即玩”。一句话总结:**把...
AI,开源 0
声音克隆、音乐生成、语音识别 一个工具全部搞定,支持MiniMax-Music3,AI音频处理的“瑞士军刀”支持49个模型,支持audio.cpp v0.6 解压就可以运行

声音克隆、音乐生成、语音识别 一个工具全部搞定,支持MiniMax-Music3,AI音频处理的“瑞士军刀”支持49个模型,支持audio.cpp v0.6 解压就可以运行

它能做什么? —— 一个功能强大的音频“百宝箱”audio.cpp 几乎集成了当下最热门的音频AI任务,堪称音频处理领域的“瑞士军刀”。它支持的功能包括但不限于:🎤 语音识别与理解ASR(语音识别):将语音精准地转为文字,支持多种语言。VAD(语音活动检测):智能检测人声的起始和结束。Diarization(说话人分离):识别“谁在...
AI 0
IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话 附效果演示 20260816更新

IndexTTS v2.5 重新定义中文语音合成,让AI发音比真人更懂‘断句’!AI文本转语音一键整合包 新增支持多人对话 附效果演示 20260816更新

IndexTTS是由B站推出的一款基于XTTS和Tortoise的GPT风格文本转语音(TTS)模型。该项目在中文文本转语音领域展现出显著的技术优势和应用,以下从项目背景、技术架构、应用场景、社区支持及未来挑战五个维度进行详细介绍。一、项目背景:重新定义中文TTS技术标杆IndexTTS的诞生旨在解决传统TTS系统在中文语音合成中的两大核心痛...
AI,软件 0
小米出品开源 MiDashengLM-Gen 只要写一段话,AI就能帮你生成一段完整的音频 一键整合包 v20260814

小米出品开源 MiDashengLM-Gen 只要写一段话,AI就能帮你生成一段完整的音频 一键整合包 v20260814

🎵 用AI凭空“捏造”声音?这个模型有点酷!输入文字描述,AI就能生成一段完整的音频——包括人声、音乐、环境音效!你有没有想过,只要写一段话,AI就能帮你生成一段完整的音频?不是简单的文字转语音,而是包含人声对话、背景音乐、环境音效、气氛渲染的完整声音场景。今天要介绍的 MiDashengLM-Gen,就是这样一个“声音魔法师”。它...
AI 0
一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

一键修复老照片、智能上色、高清修复,去除水印 ,转动漫等48个超强预设-全能AI图像编辑神器来了!beterpic v20260809

—— 高清图像修复、增强与风格化处理工具本系统基于先进的 qwen 图片编辑模型 与 Nunchaku 量化技术 构建,结合 LoRA 微调模型支持,提供强大且高效的图像编辑能力。无论是老照片修复、人像增强、风景优化,还是黑白图上色,都能一键实现高质量输出。🔧 核心功能✅ 高清图像修复与增强支持上传任意分辨率图像(最小边自动放大至 1024p...
AI 0
 MiniMax-H3 文生视频,图生视频 AI视频生成一键整合包 8G 英伟达显卡即可运行 视频效果非常不错 27-video v2.0

MiniMax-H3 文生视频,图生视频 AI视频生成一键整合包 8G 英伟达显卡即可运行 视频效果非常不错 27-video v2.0

这是什么?这是一个AI视频生成工具,你只需要输入一段文字描述,它就能自动生成一段带声音的视频。就像用文字画画一样,现在你可以用文字拍视频了!它能做什么?1. 📝 文字直接生成视频输入你想看到的画面描述,AI就会生成对应的视频。比如:"一只可爱的小猫在冲浪""夕阳下的海滩,海浪轻轻拍打岸边""一...
AI 0
新一代开源 AI换脸神器 FaceFusion v3.8.0 中文版 支持AMD显卡+N卡 速度更快 支持50系显卡+批量换脸,效果更惊艳 操作更简单 附视频演示 20260803 更新

新一代开源 AI换脸神器 FaceFusion v3.8.0 中文版 支持AMD显卡+N卡 速度更快 支持50系显卡+批量换脸,效果更惊艳 操作更简单 附视频演示 20260803 更新

FaceFusion这个AI换脸的项目已经太久没有更新了。作者终于在昨天更新了3.0,更新幅度大得惊人。这么久不更新,原来是一直在憋大招,这个CD冷却也太久了。。。我第一次时间就去做整合包了。本以为这还不是有手就行的事,但是有点难度。因为3.0更新太大了,所以之前版本的模型还有一些东西根本用不上了,我只能慢慢去研究了。搞半天最后把我的系统的c...
AI,开源 0
27image  AI文生图 一键整合包 支持Mage-Flow+Krea 2 Turbo+ERNIE-Image-Turbo+Qwen_Image+Ovis-Image+Lens-Turbo 解压即可使用,8G英伟达显卡就可以运行 v20260802 更新

27image AI文生图 一键整合包 支持Mage-Flow+Krea 2 Turbo+ERNIE-Image-Turbo+Qwen_Image+Ovis-Image+Lens-Turbo 解压即可使用,8G英伟达显卡就可以运行 v20260802 更新

一个让 AI 绘画变"傻瓜"的本地部署的AI生图工具——每行写一句话,它就能帮你批量出图你有没有这样的经历?想试试 AI 绘画,打开网页版要么排队、要么收费;想本地运行,又被满屏的英文参数和命令行劝退;好不容易跑起来了,发现每次只能生成一张图,换个提示词又要重新等半天……如果你只想安安静静地打字、批量出图、自动保存,那这个...
AI 0
Audio8-TTS 智能语音合成工具,一键生成自然人声 上传一段音频,AI 学会用你的声音朗读任何文字 一键整合包 v20260801

Audio8-TTS 智能语音合成工具,一键生成自然人声 上传一段音频,AI 学会用你的声音朗读任何文字 一键整合包 v20260801

这是什么?这是一个智能语音合成工具,能把您输入的文字转换成自然流畅的语音。无论是几百字的短文还是几千字的长文章,它都能轻松处理。核心功能🎯 智能长文本处理自动分块:遇到长文本会自动切分成多个小段,一段一段合成无缝拼接:合成后自动拼接,使用智能淡入淡出技术,听起来流畅自然智能识别:自动判断文本是中文还是英文,调整最佳分割策略🎤 声音克隆功能参考...
AI 0
一键克隆你的声音:higgs-audio-v3-tts AI语音生成工具 支持情绪标签,支持停顿,支持音速调整 中文一键整合包 v20260731

一键克隆你的声音:higgs-audio-v3-tts AI语音生成工具 支持情绪标签,支持停顿,支持音速调整 中文一键整合包 v20260731

HiggsAudio 是由 Boson AI 开发的开源文本转语音(TTS)系统,基于先进的深度学习技术,能够生成高质量、自然的人声。该项目在 GitHub 上开源,提供了强大的语音合成能力。🌟 项目亮点🎵 高质量语音生成生成接近真人发音的语音支持多种语言和口音能够处理情感表达和语调变化🏗️ 先进的模型架构基于 Transformer 的端到...
AI 0
手机软件 安卓APP 开源 Trail-Sense 野外探险生存、户外徒步旅行、地理寻宝必备的神器 v8.1.0

手机软件 安卓APP 开源 Trail-Sense 野外探险生存、户外徒步旅行、地理寻宝必备的神器 v8.1.0

Trail Sense 是一款专为户外活动设计的多功能应用程序,由开发者 Kyle Corry 打造。该应用程序旨在为徒步旅行、背包旅行、露营和地理寻宝等活动提供全面的工具支持。以下是对 Trail Sense 的详细介绍。功能特点:导航工具:Trail Sense 提供了强大的导航工具,包括数字指南针、GPS 定位和离线地图。无论你身处何地...
软件 0
 AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

AI 音视频深度分析引擎 audio-think v1.0 生成字幕+音频内容分析+转录文本 一键整合包 解压即可使用

🎙️ 你的音视频“第二大脑”:AI 深度分析引擎,让每一段声音都变成可检索的智慧你有没有过这样的经历——收藏了几百个小时的播客,却再也没打开过第二期;开完一场两小时的会议,翻遍笔记也找不到那个关键数据;刷到一个干货满满的视频教程,一周后只记得“好像讲了个很厉害的东西”;听完一本有声小说,想和朋友分享某个情节,却怎么也想不起在第几章……信息爆炸...
AI 0
开源 AI人脸替换工具离线版V8.7 兼容50系列显卡 CPU、显存占用优化,速度更快 一张图实现视频或者图片换脸,完全免费!附演示和教程视频

开源 AI人脸替换工具离线版V8.7 兼容50系列显卡 CPU、显存占用优化,速度更快 一张图实现视频或者图片换脸,完全免费!附演示和教程视频

这是热心网友万能君做的一个整合包,整合包里面已经包含了几个换脸项目和一些高清修复功能等,具体可以看下图截图所示。要顺利使用这个工具,必须做好以下几点第一个 这个工具只支持CPU+N卡。如果需要使用N卡,一定要先安装好驱动和CUDA。第二个 一定要安装好运行库。https://www.jian27.com/html/2290.html第三个 所...
AI 0
开源 Deep-Live-Cam v2.7-RC2 AI人工智能 图片视频换脸+直播换脸 汉化整合包 支持AMD+英伟达N卡50系

开源 Deep-Live-Cam v2.7-RC2 AI人工智能 图片视频换脸+直播换脸 汉化整合包 支持AMD+英伟达N卡50系

Deep-Live-Cam是一款由hacksider开发并维护的创新性软件,旨在为快速发展的AI生成媒体行业贡献一份力量。该软件的主要功能是通过深度学习技术,实现实时的人脸替换与增强,为艺术家、设计师以及内容创作者提供了一个强大的工具,帮助他们以全新的方式创作和表达。项目概述Deep-Live-Cam的核心价值在于其广泛的应用场景。艺术家可以...
AI,开源 0
应群友要求,我把开源 AI人脸替换工具离线版之前发布的一些版本整理一下再分享出来

应群友要求,我把开源 AI人脸替换工具离线版之前发布的一些版本整理一下再分享出来

群里一些小伙伴老在讲什么之前的老版本如何如何好用,如何得心应手。说实话我自己没有什么感觉。估计他们这些都是幻觉。但是你们要是喜欢之前的版本,我也是可以再分享出来,时间也是过得好快啊。截图如下 版本如下估计差不多了吧,应该没什么遗漏了。喜欢老版本的可以去下载试试。如果全部收藏的话 大概有170多G。。。你们看截图写在最后的最后,如果对这个工具使...
软件 0
这不是换脸,这是换头! 效果炸裂 AI 图片换头 HeadFusion v3.0 一键整合包 v20260601

这不是换脸,这是换头! 效果炸裂 AI 图片换头 HeadFusion v3.0 一键整合包 v20260601

本项目是一个基于 FLUX.2 Klein 模型开发的 AI 智能换头工具。通过集成 SDNQ (Spatial Dynamic Neural Quantization) 4-bit 动态量化技术,在显著降低显存占用的同时,保持了卓越的图像生成质量。配合 BFS (Best Face Swap) LoRA 模型,能够精准地实现人头替换,并完美...
AI,开源 0
再次复活 魔搭 批量AI文生图工具 27pic-api v11 无需显卡,无需搭建解压即可运行。支持最新krea/Krea-2-Turbo 文生图

再次复活 魔搭 批量AI文生图工具 27pic-api v11 无需显卡,无需搭建解压即可运行。支持最新krea/Krea-2-Turbo 文生图

大伙都知道,我直接分享过挂机流工作流,还有批量提示词工具。但是考虑到平时电脑也还有别的用途,老是用显卡来挂机生图,也是很耽误事。所以我就想利用各大平台的API来生成图片,这样就不会占用本地的资源又可以实现批量文生图的需求。所以今天花了一点时间做出来这个 AI文生图工具 27pic-api,暂时就取这个名字吧。远程调用魔塔的API&n...
AI 0
视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

视频创作者必备!KrillinAI提供从翻译到配音的全流程解决方案,智能分段与精确字幕,打造专业级视频内容 v2.1.0

KrillinAI是一个基于AI大模型的视频翻译和配音工具,它提供了专业级的翻译服务以及一键部署的全流程解决方案。这个开源工具旨在帮助用户轻松实现视频内容的本地化与增强,使其能够适配多种内容平台,如YouTube、TikTok、Bilibili、抖音(国内版)、微信视频号、快手等。KrillinAI的核心功能包括视频翻译、配音与声音克隆、字幕...
安卓 0
开源 Apt Full 绿色版 一个功能强大、操作便捷的AI生产力工具  v2.9.16.0

开源 Apt Full 绿色版 一个功能强大、操作便捷的AI生产力工具 v2.9.16.0

该项目集成了多种AI模型,特别是提供了私人专属的ChatGPT AI智能助理,能够处理各种文本任务,为用户提供智能辅助。此外,它还能一键批量智能处理图片和视频,包括但不限于图片无损放大、擦除水印、转换为卡通漫画风格、转制3D效果、上色修复、人脸修复等,以及视频的无损放大、擦除水印、转换为卡通漫画风格、转制3D、上色修复、插值补帧等功能。总之,...
软件 0
网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

想象一下这样的场景: 录一段自己说话的声音,AI 就能用你的音色,带着你的情绪,流利地说出英语、日语、韩语……而且完全听不出是外国人在说。这不是科幻电影,而是Confucius4-TTS正在做的事。Confucius4-TTS 是由网易有道开发的一款前沿语音合成(TTS)系统。它的核心理念可以用一句话概括:「 一种音色,任意语言 」简单来说...
AI 0
专为无显卡的小伙伴打造的AI语音生成工具,小巧,免费,无字数限制,速度超快,解压即可使用 Edge-TTS-Text-to-Speech-3.0

专为无显卡的小伙伴打造的AI语音生成工具,小巧,免费,无字数限制,速度超快,解压即可使用 Edge-TTS-Text-to-Speech-3.0

🎙️ Edge TTS 文本转语音 - 功能说明一、核心功能表格功能说明文本转语音使用微软 Edge TTS 引擎,将输入文本转换为自然流畅的 MP3 音频长文本支持自动分段处理(每段 ≤800 字符),支持超长文本合成音频合并自动将分段音频合并为单一文件输出多国语言支持中文、英语、日语、韩语、法语、德语等数十种语言二、语音选择系统两级联动选...
AI 0
图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印 剑二十七洗图专用  z-image-turbo-xitu v12

图生图新的选择 AI 重绘 支持批量图生图 新增动作和姿态控制+滤镜+自动关机+自动去水印 剑二十七洗图专用 z-image-turbo-xitu v12

🎨 Z-Image-Turbo 剑二十七·洗图专用版—— 神似而形不似,AI 重绘的终极答案"目前市面上能做到神似而形不似的类似图生图,在我面前一个能打的都没有"🔍 产品定位本工具专为「高质量图像重绘」场景打造,聚焦「洗图」核心需求:在保留原图构图、光影、神态的前提下,通过 AI 进行艺术化重绘,实现「神似而形不似」的进阶...
AI 0
给你配了个“AI配音导演”:阿里这款新模型,能直接给电影配音了! Fun-CineForge 一键整合包 v20260603 解压即可使用

给你配了个“AI配音导演”:阿里这款新模型,能直接给电影配音了! Fun-CineForge 一键整合包 v20260603 解压即可使用

Fun-CineForge是阿里通义实验室(FunAudioLLM 团队)推出的一款非常强大的AI影视配音模型。如果用一句话来概括:它就像一个不知疲倦的“AI配音导演+全能配音演员”,能够直接给电影、电视剧或各类视频进行高质量的自动配音,而且对口型、分角色都不在话下。为了让你轻松了解这个模型,我们从它的核心能力、应用场景以及背后的黑科技三个方...
AI 0
Marlin-2B 一个会"看懂"视频的AI大模型 能精确描述视频中每一个镜头 一键整合包 v20260602 解压即可使用

Marlin-2B 一个会"看懂"视频的AI大模型 能精确描述视频中每一个镜头 一键整合包 v20260602 解压即可使用

Marlin-2B 是一个会"看懂"视频的小助手,它能自动告诉你视频里发生了什么、什么时候发生的,还能根据你的描述快速定位到具体片段。🤔 它能帮你做什么?✅ 自动写视频"解说词"把一段视频交给它,它会像解说员一样,用文字告诉你:🎞️场景:办公室里,一位穿白衬衫的男士坐在电脑前工作⏱️事件:<0.0...
AI 0
高德开源项目 PilotTTS - 让AI学会"说话"的语音生成开源项目,支持11种情绪+14种方言 一键整合包 v20260530 解压即可使用

高德开源项目 PilotTTS - 让AI学会"说话"的语音生成开源项目,支持11种情绪+14种方言 一键整合包 v20260530 解压即可使用

这是高德地图语音团队开发的一个AI语音合成工具,可以让电脑用自然的声音朗读文字,还能模仿不同人的声音、表达不同情绪。✨ 它能做什么?1️⃣模仿任何人说话只需录一段5-15秒的音频,AI就能学会这个人的声音比如:用你朋友的声音读你写的文字2️⃣带感情地朗读支持11种情绪:😊 开心、😢 悲伤、😠 生气😲 惊讶、😨 害怕、🤢 厌恶😐 严肃、🥺 关切...
AI 0
自媒体人的AI音乐工坊:打字描述,自动生成专属BGM stable-audio-3 AI音乐自动生成一键整合包 v20260524

自媒体人的AI音乐工坊:打字描述,自动生成专属BGM stable-audio-3 AI音乐自动生成一键整合包 v20260524

Stable Audio 3 是 Stability AI(就是出 Stable Diffusion 那家公司)做的一款AI 音乐/音效生成工具。你只需要打字描述,它就能帮你生成一段音频——可以是一段背景音乐、一个音效、甚至是一首完整的歌。这个增强版把原来的英文界面全部翻译成了中文,还加了一些方便国内用户使用的功能。它能做什么?举几个例子你想...
AI 0
造相 Z-Image-Turbo AI生图大模型 高性能AI图像生成工具 5秒一张图片 支持批量生图+人物一致性图片+自定义lora 一键整合包 20260519 v19

造相 Z-Image-Turbo AI生图大模型 高性能AI图像生成工具 5秒一张图片 支持批量生图+人物一致性图片+自定义lora 一键整合包 20260519 v19

Z-Image-Turbo Generator 是一个基于 Tongyi-MAI/Z-Image-Turbo 模型的高性能AI图像生成应用。通过简洁直观的Gradio界面,用户可以轻松生成高质量的图像,特别擅长生成具有中国传统文化元素与现代风格融合的艺术作品。✨ 核心特性⚡ 极致性能优化8步极速生成:仅需8个推理步骤即可完成高质量图像生成零指...
AI,开源 0
轻量 高效 AI生图工具 基于 Stable Diffusion XL 模型二次开发,6G英伟达显卡就可以愉快玩耍 Diaomo v9.0 六秒出图 支持更换模型+图片超分+图生图

轻量 高效 AI生图工具 基于 Stable Diffusion XL 模型二次开发,6G英伟达显卡就可以愉快玩耍 Diaomo v9.0 六秒出图 支持更换模型+图片超分+图生图

基于 Stable Diffusion XL 的一站式 AI 绘画工作台,支持文生图、图生图与批量自动化生产,内置智能中文翻译,零门槛直接用中文描述生成高质量图像。一、三大核心创作模式1. 文生图(Text-to-Image)输入一段画面描述,AI 直接生成全新图像。智能中文提示词:输入中文即可,系统自动调用轻量翻译模型转为英文提示词;若输入...
AI,开源 0
一句话画出动漫世界!支持中文的AI绘画神器来了 Anima文生动漫图片AI大模型 ,8G英伟达显卡即可愉快玩耍

一句话画出动漫世界!支持中文的AI绘画神器来了 Anima文生动漫图片AI大模型 ,8G英伟达显卡即可愉快玩耍

Anima 动漫文生图基于 circlestone-labs/Anima 模型的图像生成工具。支持中文提示词自动翻译,生成结果自动保存至本地 output 目录。✨ 主要特性🎨 高质量动漫风格生成 – 专精二次元、动漫、CG 渲染。🌐 中文提示词自动翻译 – 使用...
AI 0
klein-edit AI图片编辑工具 摄影师狂喜:86个AI修图预设,从人像到风景全覆盖 v1.0 20260514更新记录 新增lora支持

klein-edit AI图片编辑工具 摄影师狂喜:86个AI修图预设,从人像到风景全覆盖 v1.0 20260514更新记录 新增lora支持

FLUX.2 Klein 图像编辑工具:86个一键预设,打造专业级本地 AI 图像处理工作站一、项目概述在 AI 图像生成与编辑领域,FLUX系列模型以其卓越的图像理解能力和编辑精度备受开发者青睐。本文介绍的这套基于FLUX.2-klein的本地图像编辑工具,通过Gradio构建了一个功能完备的 Web 界面,集成了86个实用预设功能,支持多...
AI 0
网文作者的 AI 外挂:日更万字还能保证剧情连贯的秘密武器 AI自动写小说  AI_NovelGenerator V1.4.4

网文作者的 AI 外挂:日更万字还能保证剧情连贯的秘密武器 AI自动写小说 AI_NovelGenerator V1.4.4

AI_NovelGenerator 是由 YILING0013 开发并开源在 GitHub 上的一款 基于大语言模型的 AI 长篇小说自动生成工具。它专注于解决 AI 写作中最棘手的长文本连贯性问题,能够创作多章节长篇小说,并确保剧情连贯、设定统一、伏笔合理呼应。核心定位"让 AI 从写作玩具变成生产力工具"传统 AI 写...
AI,开源 0