手机软件 安卓app Breezy Weather 一款开源功能全面、设计优雅且注重隐私的天气APP v6.2.1

手机软件 安卓app Breezy Weather 一款开源功能全面、设计优雅且注重隐私的天气APP v6.2.1

Breezy Weather是一款专注于设计的天气应用,以其简洁明了的用户界面(UX)、流畅的动画效果以及全面融入的Material Design风格而著称。它不仅提供了丰富的天气信息,还允许用户进行高度的个性化定制,为用户带来前所未有的使用体验。核心功能与特性Breezy Weather的核心功能在于其全面的天气数据展示。它提供了每日及每小...
安卓 3154 0
手机软件 安卓app Feeder 一个开源的Android平台上的RSS/Atom/JSONFeed阅读器 v2.21.1

手机软件 安卓app Feeder 一个开源的Android平台上的RSS/Atom/JSONFeed阅读器 v2.21.1

Feeder是一个开源的Android平台上的RSS/Atom/JSONFeed阅读器,它允许用户阅读来自他们最喜欢网站的最新新闻和帖子。这个工具自2014年起被创建并维护至今,以其独特的本地运行、无需注册账号以及完全保护用户数据隐私的特点,赢得了不少用户的青睐。首先,Feeder的最大亮点在于它的数据隐私保护。与许多其他的新闻阅读器或聚合器...
安卓 4139 0
视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

视频反推提示词生成器 分镜处理+镜头设定 + 场景描述 + 主体动作 + 角色细节 + 运镜方式 + 风格美学+去水印+高清修复 thinkvideo v5.0

🎬 剑二十七|视频反推提示词生成器让每一帧画面,都转化为可复用的创作语言🔮 核心定位这是一款面向专业内容创作者的智能视频理解工具。它不满足于简单的画面识别,而是以「镜头语言」为最小单元,深度解析视频内容,自动生成符合影视工业标准的中文提示词描述。不是「看图说话」,而是「读镜写意」。✨ 六大核心能力🎯 智能镜头分割精准识别场景切换点自适应阈值调...
AI 5949 10
网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

网易开源AI语音克隆大模型Confucius4-TTS 极速克隆 支持14种语言 支持情感迁移 一键整合包 v20260621 解压即可使用

想象一下这样的场景: 录一段自己说话的声音,AI 就能用你的音色,带着你的情绪,流利地说出英语、日语、韩语……而且完全听不出是外国人在说。这不是科幻电影,而是Confucius4-TTS正在做的事。Confucius4-TTS 是由网易有道开发的一款前沿语音合成(TTS)系统。它的核心理念可以用一句话概括:「 一种音色,任意语言 」简单来说...
AI 3835 0
专为无显卡的小伙伴打造的AI语音生成工具,小巧,免费,无字数限制,速度超快,解压即可使用 Edge-TTS-Text-to-Speech-3.0

专为无显卡的小伙伴打造的AI语音生成工具,小巧,免费,无字数限制,速度超快,解压即可使用 Edge-TTS-Text-to-Speech-3.0

🎙️ Edge TTS 文本转语音 - 功能说明一、核心功能表格功能说明文本转语音使用微软 Edge TTS 引擎,将输入文本转换为自然流畅的 MP3 音频长文本支持自动分段处理(每段 ≤800 字符),支持超长文本合成音频合并自动将分段音频合并为单一文件输出多国语言支持中文、英语、日语、韩语、法语、德语等数十种语言二、语音选择系统两级联动选...
AI 4891 0
小红书 开源配音神器 dots.tts 只需3秒音频,完美复刻你的声音! 一键整合包 v20260617 解压即可使用

小红书 开源配音神器 dots.tts 只需3秒音频,完美复刻你的声音! 一键整合包 v20260617 解压即可使用

dots.tts是由小红书人工智能实验室(RedNote Hilab)研发并免费开源的一款新一代 AI 语音合成(配音)系统。抛开复杂的技术术语,你可以把它简单理解为一个“拥有录音棚级音质的超级 AI 配音员”。你只需要输入一段文字,它就能用极其逼真、富有感情的声音把文字读出来,甚至能完美模仿任何人的声音。以下是它最核心的几个“超能力”,也是...
AI 1.2万 31
开源 PDFsam Basic 一款专业且免费的开源PDF处理软件 v6.0.1

开源 PDFsam Basic 一款专业且免费的开源PDF处理软件 v6.0.1

PDFsam Basic是一款专业且免费的开源PDF处理软件,它提供了多种强大的功能,旨在帮助用户轻松地进行PDF文件的编辑和管理。以下是关于PDFsam Basic的详细介绍:一、软件概述PDFsam Basic是一款跨平台的PDF编辑器,支持在Windows、Mac OS及Linux等多个操作系统上运行。它以其免费、开源的特点,以及丰富的...
软件 4525 0
开源 Converseen 一款非常实用的批量图像格式转换工具 v0.15.2.5

开源 Converseen 一款非常实用的批量图像格式转换工具 v0.15.2.5

Converseen是一款功能强大的批量图像转换器和调整尺寸工具,旨在帮助用户快速、高效地处理大量图像文件。它支持多种图像格式之间的转换,包括但不限于常见的JPG、PNG、GIF等,让用户能够轻松地将图像文件从一个格式转换为另一个格式,以满足不同的需求和应用场景。除了基本的图像格式转换功能外,Converseen还提供了丰富的图像调整选项。用...
软件 3437 0
开源 免费 直播必备 实时流媒体和屏幕录制软件  OBS Studio v32.1.2

开源 免费 直播必备 实时流媒体和屏幕录制软件 OBS Studio v32.1.2

软件简介:OBS Studio(Open Broadcaster Software)是一款免费且开源的多平台流媒体软件,它为用户提供了强大的功能和灵活性,使用户能够创建高质量的流媒体内容。无论是游戏直播、视频教程、网络会议还是专业直播活动,OBS Studio 都是一个功能强大且易于使用的选择。首先,OBS Studio 提供了广泛的流媒体设...
开源 5206 2
 神器 开源 视频音频处理神器 FFmpeg 官网最新版 附安装教程 v2026-06-01

神器 开源 视频音频处理神器 FFmpeg 官网最新版 附安装教程 v2026-06-01

这个软件我以前做了几期教程,非常非常强大的视频音频处理工具,基本市面上绝大部分视频处理软件都是套它的壳https://www.jian27.com/html/ffmpeg.html一、ffmpeg介绍FFmpeg是一套可以用来记录、转换数字音频、视频,并能将其转化为流的开源计算机程序。采用LGPL或GPL许可证。它提供了录制、转换以及流化音视...
开源 6775 2
MOSS-TTS-v1.5+MOSS-TTSD+ MOSS-TTS-Nano 支持CPU运行,一个高质量的开源中文文本到语音合成系统 一键整合包 v20260604 支持免费商业使用 支持暂停

MOSS-TTS-v1.5+MOSS-TTSD+ MOSS-TTS-Nano 支持CPU运行,一个高质量的开源中文文本到语音合成系统 一键整合包 v20260604 支持免费商业使用 支持暂停

🎙️ MOSS-TTS:让文字拥有“千人千面”的超级嗓音一句话看懂:这是一个由复旦大学和模思智能联合开发的开源人工智能项目。它的核心本领就是把文字变成极其逼真、带有感情的真人声音。✨ 为什么它比传统的“机器朗读”更厉害?传统的配音软件听起来往往像没有感情的机器人,而 MOSS-TTS 拥有以下 5 大“超能力”:1. 🎭 神奇的“声音克隆”魔...
AI 9820 20
给你配了个“AI配音导演”:阿里这款新模型,能直接给电影配音了! Fun-CineForge 一键整合包 v20260603 解压即可使用

给你配了个“AI配音导演”:阿里这款新模型,能直接给电影配音了! Fun-CineForge 一键整合包 v20260603 解压即可使用

Fun-CineForge是阿里通义实验室(FunAudioLLM 团队)推出的一款非常强大的AI影视配音模型。如果用一句话来概括:它就像一个不知疲倦的“AI配音导演+全能配音演员”,能够直接给电影、电视剧或各类视频进行高质量的自动配音,而且对口型、分角色都不在话下。为了让你轻松了解这个模型,我们从它的核心能力、应用场景以及背后的黑科技三个方...
AI 4041 0
Marlin-2B 一个会"看懂"视频的AI大模型 能精确描述视频中每一个镜头 一键整合包 v20260602 解压即可使用

Marlin-2B 一个会"看懂"视频的AI大模型 能精确描述视频中每一个镜头 一键整合包 v20260602 解压即可使用

Marlin-2B 是一个会"看懂"视频的小助手,它能自动告诉你视频里发生了什么、什么时候发生的,还能根据你的描述快速定位到具体片段。🤔 它能帮你做什么?✅ 自动写视频"解说词"把一段视频交给它,它会像解说员一样,用文字告诉你:🎞️场景:办公室里,一位穿白衬衫的男士坐在电脑前工作⏱️事件:<0.0...
AI 3681 1
高德开源项目 PilotTTS - 让AI学会"说话"的语音生成开源项目,支持11种情绪+14种方言 一键整合包 v20260530 解压即可使用

高德开源项目 PilotTTS - 让AI学会"说话"的语音生成开源项目,支持11种情绪+14种方言 一键整合包 v20260530 解压即可使用

这是高德地图语音团队开发的一个AI语音合成工具,可以让电脑用自然的声音朗读文字,还能模仿不同人的声音、表达不同情绪。✨ 它能做什么?1️⃣模仿任何人说话只需录一段5-15秒的音频,AI就能学会这个人的声音比如:用你朋友的声音读你写的文字2️⃣带感情地朗读支持11种情绪:😊 开心、😢 悲伤、😠 生气😲 惊讶、😨 害怕、🤢 厌恶😐 严肃、🥺 关切...
AI 2552 0
自媒体人的AI音乐工坊:打字描述,自动生成专属BGM stable-audio-3 AI音乐自动生成一键整合包 v20260524

自媒体人的AI音乐工坊:打字描述,自动生成专属BGM stable-audio-3 AI音乐自动生成一键整合包 v20260524

Stable Audio 3 是 Stability AI(就是出 Stable Diffusion 那家公司)做的一款AI 音乐/音效生成工具。你只需要打字描述,它就能帮你生成一段音频——可以是一段背景音乐、一个音效、甚至是一首完整的歌。这个增强版把原来的英文界面全部翻译成了中文,还加了一些方便国内用户使用的功能。它能做什么?举几个例子你想...
AI 4835 0
轻量 高效 AI生图工具 基于 Stable Diffusion XL 模型二次开发,6G英伟达显卡就可以愉快玩耍 Diaomo v9.0 六秒出图 支持更换模型+图片超分+图生图

轻量 高效 AI生图工具 基于 Stable Diffusion XL 模型二次开发,6G英伟达显卡就可以愉快玩耍 Diaomo v9.0 六秒出图 支持更换模型+图片超分+图生图

基于 Stable Diffusion XL 的一站式 AI 绘画工作台,支持文生图、图生图与批量自动化生产,内置智能中文翻译,零门槛直接用中文描述生成高质量图像。一、三大核心创作模式1. 文生图(Text-to-Image)输入一段画面描述,AI 直接生成全新图像。智能中文提示词:输入中文即可,系统自动调用轻量翻译模型转为英文提示词;若输入...
AI,开源 1.6万 31
一句话画出动漫世界!支持中文的AI绘画神器来了 Anima文生动漫图片AI大模型 ,8G英伟达显卡即可愉快玩耍

一句话画出动漫世界!支持中文的AI绘画神器来了 Anima文生动漫图片AI大模型 ,8G英伟达显卡即可愉快玩耍

Anima 动漫文生图基于 circlestone-labs/Anima 模型的图像生成工具。支持中文提示词自动翻译,生成结果自动保存至本地 output 目录。✨ 主要特性🎨 高质量动漫风格生成 – 专精二次元、动漫、CG 渲染。🌐 中文提示词自动翻译 – 使用...
AI 4.1万 105
klein-edit AI图片编辑工具 摄影师狂喜:86个AI修图预设,从人像到风景全覆盖 v1.0 20260514更新记录 新增lora支持

klein-edit AI图片编辑工具 摄影师狂喜:86个AI修图预设,从人像到风景全覆盖 v1.0 20260514更新记录 新增lora支持

FLUX.2 Klein 图像编辑工具:86个一键预设,打造专业级本地 AI 图像处理工作站一、项目概述在 AI 图像生成与编辑领域,FLUX系列模型以其卓越的图像理解能力和编辑精度备受开发者青睐。本文介绍的这套基于FLUX.2-klein的本地图像编辑工具,通过Gradio构建了一个功能完备的 Web 界面,集成了86个实用预设功能,支持多...
AI 5963 7
百度开源图片大模型 文生图 ERNIE-Image-Turbo 一键整合包 8G英伟达 16秒出图 文字理解能力超强 v20260416

百度开源图片大模型 文生图 ERNIE-Image-Turbo 一键整合包 8G英伟达 16秒出图 文字理解能力超强 v20260416

🎨 ERNIE-Image-Turbo 模型介绍【核心定位】• 极速生成:基于单流 Diffusion Transformer 架构,仅需 8 步推理即可完成高质量图像生成,速度提升 6 倍以上• 精准可控:强调对复杂指令的准确还原,适合需要内容精确落地的实用型创作任务• 轻量化部署:经蒸馏优化,可在 消费级显卡上流畅运行,大幅降低商用门槛【...
AI 4196 7
网文作者的 AI 外挂:日更万字还能保证剧情连贯的秘密武器 AI自动写小说  AI_NovelGenerator V1.4.4

网文作者的 AI 外挂:日更万字还能保证剧情连贯的秘密武器 AI自动写小说 AI_NovelGenerator V1.4.4

AI_NovelGenerator 是由 YILING0013 开发并开源在 GitHub 上的一款 基于大语言模型的 AI 长篇小说自动生成工具。它专注于解决 AI 写作中最棘手的长文本连贯性问题,能够创作多章节长篇小说,并确保剧情连贯、设定统一、伏笔合理呼应。核心定位"让 AI 从写作玩具变成生产力工具"传统 AI 写...
AI,开源 7635 0
输入歌词,AI自动作曲:你的音乐创作助手 HeartMuLa 一键中文整合包 v20260507

输入歌词,AI自动作曲:你的音乐创作助手 HeartMuLa 一键中文整合包 v20260507

HeartMuLa/heartlib:开源音乐基础模型家族深度解析项目定位与愿景HeartMuLa是一个全面的开源音乐基础模型家族,旨在推动跨任务与多模态的大规模音乐理解与生成技术发展。该项目不仅仅是一个单一的模型,而是一个完整的生态系统,涵盖了从音乐理解到完整曲目生成的全链条能力。其核心目标是为研究社区和开发者提供可复现、可扩展的音乐AI工...
AI,开源 9121 9
索尼开源AI模型 Woosh 一句话生成音效,一键为视频配音 一键AI整合包 解压即可使用 v20260424

索尼开源AI模型 Woosh 一句话生成音效,一键为视频配音 一键AI整合包 解压即可使用 v20260424

索尼人工智能研究院(Sony AI)发布的音效生成基础模型📌 项目定位Woosh是专为音效生成(Sound Effects)优化的多模态生成式 AI 模型套件,旨在为音频研究社区提供高质量的开源基座模型,支持文本到音频(T2A)和视频到音频(V2A)两大核心任务。🔗 技术报告:arXiv:2604.01929🧩 核心模块组成1️⃣ Woosh...
AI 3574 0
京东开源 图片编辑AI大模型 JoyAI-Image-Edit v20260422 二次开发一键整合包 附演示和操作教程

京东开源 图片编辑AI大模型 JoyAI-Image-Edit v20260422 二次开发一键整合包 附演示和操作教程

JoyAI-Image-Edit 是京东开源的多模态基础模型,专注于指令引导的图像编辑任务。它基于 JoyAI-Image 多模态底座构建,通过自然语言指令实现对图像的精确、可控编辑。🔹 核心技术特点1. 强大的空间理解能力场景解析:自动识别图像中的物体、区域及空间关系关系定位:精准理解"物体A在物体B左侧"等空间描述指令...
AI 5556 0
一键生成AI绘画提示词:让你的图片秒变顶级写真描述 跟之前的图片反推工具不同的是这个会思考 thinkpic-6.0-20260420

一键生成AI绘画提示词:让你的图片秒变顶级写真描述 跟之前的图片反推工具不同的是这个会思考 thinkpic-6.0-20260420

这个工具是做什么的?这个程序可以自动为你的人物照片生成一段“AI绘画提示词”。简单来说:你放一张人物照片进去,它就能写出一段详细、生动、充满吸引力的文字描述,这段文字可以直接用在 AI 绘画工具(比如 Stable Diffusion)中,让 AI 画出类似风格或效果的图片。例如,它会描述:人物有多美、眼睛多勾人、嘴唇多诱人;身材曲线多么火辣...
AI 1.4万 8
开源免费 gridplayer 0.5.4 网格播放器,同时播放多个视频 64位便携版

开源免费 gridplayer 0.5.4 网格播放器,同时播放多个视频 64位便携版

简单的基于VLC的媒体播放器,可以同时播放多个视频。你可以随心所欲地播放视频,唯一的限制是你的硬件。它支持VLC支持的所有视频格式(即所有视频格式)。您可以保存播放列表,保留位置、音量、循环、纵横比等信息。软件截图我最多一次播放27个视频,太卡了,基本10个以内 还是很流畅的。如果你的电脑硬件配置高 可能好点
开源 4671 3
本地部署 一键整合包FLUX.2-klein-9B-KV-LoRA-Studio 图像编辑大模型 海量lora支持 v3.0

本地部署 一键整合包FLUX.2-klein-9B-KV-LoRA-Studio 图像编辑大模型 海量lora支持 v3.0

FLUX.2-Klein-LoRA-Studio是一款基于 Gradio 构建的本地化图像编辑工作台,集成 Black Forest Labs 最新发布的FLUX.2-klein-9B多模态生成模型,支持通过 LoRA 适配器实现多样化图像编辑任务。⚡ 核心功能🔹 多图像输入编辑支持上传 1~2 张参考图:Picture 1(Base):作为...
AI 4976 8
你想怎么改图?它就怎么改 Qwen-Image-Edit-2511 实现真正可控的 AI 图片编辑 支持海量lora v20260413 一键整合包

你想怎么改图?它就怎么改 Qwen-Image-Edit-2511 实现真正可控的 AI 图片编辑 支持海量lora v20260413 一键整合包

Qwen-Image-Edit-2511 是由阿里云推出的新一代多模态图像编辑大模型,属于 Qwen 系列在视觉生成与编辑方向的重要迭代。该模型基于 Qwen-Image-Edit 系列的持续演进(如 2509、2511 版本),在保留原始图像语义结构和细节的前提下,支持高保真、高可控性的图像编辑任务。该模型主要特点包括:高保真图像编辑:在执...
AI 7557 16
AI 提示词智能增强工具 可生成一致性强的文生图提示词,可直接用于图像生成的专业级提示词,专为AI图像生成创作者打造 27PromptEnhancer v2.0

AI 提示词智能增强工具 可生成一致性强的文生图提示词,可直接用于图像生成的专业级提示词,专为AI图像生成创作者打造 27PromptEnhancer v2.0

本工具基于 Qwen3 系列轻量化大模型(Qwen3-0.6B 与 Qwen3-1.7B,GPTQ Int8 量化版本),专为图像生成(如 Stable Diffusion、Midjourney 等)用户设计,帮助你将简单粗糙的提示词自动优化为高细节、高表现力、风格明确的专业级描述。🔧 核心功能双模型可选Qwen3-0.6B:轻量快速,适合日...
AI 4316 2
小米开源大模型AI语音合成,600种语言+声音克隆,生成速度提升40倍 不限字数 支持自动语气标签 OmniVoice v20260407 一键整合包

小米开源大模型AI语音合成,600种语言+声音克隆,生成速度提升40倍 不限字数 支持自动语气标签 OmniVoice v20260407 一键整合包

OmniVoice:600+语种的语音合成新纪元剑二十七 · 技术前沿🔹一句话了解由小米下一代 Kaldi 团队(k2-fsa)打造的超大规模多语言零样本 TTS 模型,支持600+ 语种,以卓越音质与极速推理,重新定义语音合成体验。✨ 核心能力一览🗣️全球语种覆盖支持 600+ 语言与方言,从英语、中文到低资源语种,一模型通全球。🔁声音克隆...
AI 4371 0
DeepSeek 本地部署一键运行 DeepSeek-tool v18,解压即可使用 最低支持2G显卡 支持99%的语言大模型 支持联网搜索+知识库

DeepSeek 本地部署一键运行 DeepSeek-tool v18,解压即可使用 最低支持2G显卡 支持99%的语言大模型 支持联网搜索+知识库

琢磨了一天,把DeepSeek的本地部署彻底完成了,并测试了一下午基本完美运行了。当然AI环境你们必须要先安装好。然后下载这个这个本地部署压缩,解压即可完美运行。我的4070ti spuer 运行32b已经是极限了,所以我也只能把模型下载到32b了,如果你们有更牛的显卡,可以继续下载模型。这是我运行14b的截图 你们看看显...
AI,开源 1.7万 36
 一键克隆任意音色,生成自然口语级语音  1B/3.5B 双模型自由切换,还原你最真实的声音  LongCat-AudioDiT v1.0 20260402 更新 一键整合包

一键克隆任意音色,生成自然口语级语音 1B/3.5B 双模型自由切换,还原你最真实的声音 LongCat-AudioDiT v1.0 20260402 更新 一键整合包

LongCat-AudioDiT 语音合成工具 - 功能说明🎯 主要功能本工具基于美团开源的 LongCat-AudioDiT 扩散模型,提供高质量的文本到语音合成,并支持零样本语音克隆(只需几秒参考音频即可克隆音色)。界面采用 Gradio 构建,操作直观,适用于中文和英文混合文本。📌 核心功能模块1. 模型选择支持 1B&nbs...
AI 3559 2
TTS开源新王炸!Ming-omni-tts:一个模型搞定语音/音乐/音效,还能听懂你的情绪指令 新增支持长文本 一键整合包 v20260327

TTS开源新王炸!Ming-omni-tts:一个模型搞定语音/音乐/音效,还能听懂你的情绪指令 新增支持长文本 一键整合包 v20260327

Ming-omni-tts是一款高性能的统一音频生成模型,能够在单通道中实现语音、环境音和音乐的协同合成,并支持对语音属性的精细化控制。其核心创新在于将多种音频模态统一建模,同时保持高效的推理速度与专业的文本处理能力。🚀 核心能力1️⃣ 精细化语音控制支持通过简单指令精确调控语速、音量、音高、情绪、方言等属性粤语方言控制准确率达93%,情绪控...
AI 9234 16