AI 绘万象,细节见真章:Qwen-Image-2512 专业AI图像生成 支持批量生成图片 一键整合包 v20260105

AI 绘万象,细节见真章:Qwen-Image-2512 专业AI图像生成 支持批量生成图片 一键整合包 v20260105

Qwen-Image-2512 图像生成器 一键整合包基于 Qwen3 大模型的专业级 AI 图像生成工具采用 BNB-NF4 4-bit 量化优化技术,在保障超高图像质量的同时显著降低硬件资源消耗,为创作者提供流畅、高效、稳定的 AI 绘图体验。搭载直观的 Gradio Web 界面,告别命令行,一键生成专业级图像。⚙️ 系统要求显卡:NV...
AI 4587 5
GPT-SoVITS2507+SAVA46 一个强大的开源工具,专注于少样本语音转换和文本到语音(TTS)的合成 一键整合包

GPT-SoVITS2507+SAVA46 一个强大的开源工具,专注于少样本语音转换和文本到语音(TTS)的合成 一键整合包

GPT-SoVITS是一个强大的开源工具,专注于少样本语音转换和文本到语音(TTS)的合成。该工具由RVC-Boss团队开发,并在GitHub上公开分享,为用户提供了一个灵活且功能丰富的平台,以满足语音合成的多样化需求。核心功能GPT-SoVITS的核心功能包括零样本和少样本TTS。零样本TTS允许用户仅通过输入一个5秒的语音样本,就能即时体...
AI,开源 1.1万 4
FlorisBoard 一款适用于 Android 7.0 及以上设备的免费开源输入法APP v0.5.2

FlorisBoard 一款适用于 Android 7.0 及以上设备的免费开源输入法APP v0.5.2

FlorisBoard 是一款适用于 Android 7.0 及以上设备的免费开源键盘应用。它以现代化、用户友好、可定制以及完全尊重用户隐私为目标,目前处于早期测试阶段(early-beta)。以下是关于该软件的详细介绍:软件概述FlorisBoard 是一款专为 Android 用户设计的键盘应用,旨在提供一个既美观又实用的输入工具,同时确...
安卓 3168 0
人工智能AI相关工具软件 合集整理

人工智能AI相关工具软件 合集整理

一键修复老照片、智能上色、超清还原,去除水印 ,转动漫 ——全能AI图像编辑神器来了!beterpic造相 Z-Image-Turbo AI生图大模型 高性能AI图像生成工具 5秒一张图片 支持批量生图 一键整合包一键生成AI绘画提示词:让你的图片秒变顶级写真描述 跟之前的图片反推工具不同的是这个会思考 thinkpic视频4倍高清修复,一键...
AI,软件 4.6万 16
视频4倍高清修复,一键搞定!清华团队开源实时视频超分模型 FlashVSR 一键整合包 v20251231

视频4倍高清修复,一键搞定!清华团队开源实时视频超分模型 FlashVSR 一键整合包 v20251231

🎥 FlashVSR 是什么?FlashVSR 是一个能让模糊、低清视频“秒变高清”的智能工具。它专门用来做一件事:把低分辨率的视频,快速、高质量地放大成 4 倍清晰度的高清视频。比如:把 480p 的老视频 → 变成接近 4K 的清晰视频让手机拍的模糊视频 → 变得锐利、细节丰富⚡ 它有什么厉害的地方?过去很多“视频超分”(放大变清晰)工具...
AI,开源 6169 2
手机软件 安卓app Fossify Calendar 一款功能强大且注重隐私的开源日程管理app v1.9.0

手机软件 安卓app Fossify Calendar 一款功能强大且注重隐私的开源日程管理app v1.9.0

Fossify Calendar是一款功能强大且注重隐私的开源日程管理软件,它致力于为用户提供一个干净、无广告且安全的日程规划环境。这款软件的设计初衷是为了解决传统日历应用中普遍存在的隐私问题和界面杂乱无章的问题,通过开放源代码的方式,让用户能够拥有一个真正属于自己的日程管理工具。Fossify Calendar的核心优势在于其无广告和完全私...
安卓 2280 0
手机软件 安卓app ReadYou 一款功能强大、界面优雅且高度自定义的 开源RSS阅读器应用 v0.15.3

手机软件 安卓app ReadYou 一款功能强大、界面优雅且高度自定义的 开源RSS阅读器应用 v0.15.3

ReadYou是一款专为Android平台打造的开源RSS阅读器应用,以其独特的Material You设计风格、丰富的功能以及高度的自定义性,赢得了众多用户的喜爱。这款应用不仅为用户提供了一个便捷的信息获取渠道,还通过其优雅的界面和智能的阅读体验,极大地提升了用户的阅读效率。以下是对ReadYou软件的详细介绍:一、软件概述ReadYou项...
安卓 4141 0
手机软件 安卓app Fossify Gallery 一款专注于隐私保护和用户体验的照片与视频管理app v1.10.0

手机软件 安卓app Fossify Gallery 一款专注于隐私保护和用户体验的照片与视频管理app v1.10.0

Fossify Gallery 是一款专注于隐私保护和用户体验的照片与视频管理应用程序。这款应用旨在让用户能够不受干扰地浏览他们的记忆,同时确保用户的个人数据得到充分的保护。它适用于那些希望在享受强大功能的同时,不牺牲自己隐私的用户。首先,Fossify Gallery 提供了一个基础但强大的照片编辑工具,用户可以直接在应用中对图片进行裁剪、...
安卓 2651 0
手机软件 安卓app AnkiDroid  一款功能强大、灵活高效的记忆训练工具 v2.23.1

手机软件 安卓app AnkiDroid 一款功能强大、灵活高效的记忆训练工具 v2.23.1

AnkiDroid是一款基于Anki闪卡系统开发的Android应用程序,它将间隔重复算法应用于记忆训练中,帮助用户高效地记忆各种信息。作为一款半官方的开源项目,AnkiDroid不仅继承了Anki的强大功能,还针对Android平台进行了深度优化,使其成为广大学习者提升记忆效率的首选工具。以下是对AnkiDroid的详细介绍:一、软件概述A...
安卓 2612 0
手机软件 安卓app aves 一个开源的照片和视频管理应用APP v1.13.12

手机软件 安卓app aves 一个开源的照片和视频管理应用APP v1.13.12

Aves是一个开源的照片和视频管理应用程序,旨在为用户提供一个强大且灵活的工具来组织、查看和编辑他们的多媒体内容。该项目托管在GitHub上,由deckerst维护,主要目标是提供一个高效、易于使用并且注重用户隐私的解决方案。Aves的核心功能包括浏览照片和视频库、搜索特定项目以及对媒体进行标记和分类。该应用支持通过标签(tags)、收藏夹(...
安卓 3003 0
手机软件 安卓APP Salt Player(椒盐音乐)一款功能强大且用户体验极佳的音乐播放器软件 v10.10.2

手机软件 安卓APP Salt Player(椒盐音乐)一款功能强大且用户体验极佳的音乐播放器软件 v10.10.2

椒盐音乐是一款功能强大且用户体验极佳的音乐播放器软件,它不仅具备丰富的音乐资源和多种音频格式支持,还提供了多项实用的功能和独特的设计,让用户能够享受更加便捷、个性化的音乐体验。首先,椒盐音乐拥有庞大的音乐库,涵盖了流行、摇滚、古典、爵士等多种音乐风格,以及华语、海外、内地港台等地区的歌曲资源,满足了不同用户的多样化需求。用户可以通过搜索功能快...
安卓 3698 0
开源 手机软件 安卓APP Nekogram  一款创新的Telegram第三方客户端应用 v12.2.10

开源 手机软件 安卓APP Nekogram 一款创新的Telegram第三方客户端应用 v12.2.10

Nekogram是一款创新第三方客户端应用,它为用户提供了更加丰富和个性化的Telegram使用体验。以下是对Nekogram的详细介绍:一、应用背景与定位Nekogram是基于Telegram这一跨平台即时通讯软件开发的第三方客户端。Telegram以其强大的加密功能和跨平台特性广受欢迎,而Nekogram则在此基础上进行了多项优化和创新,...
安卓 5542 0
手机软件 安卓app KeePassDX 一款专为Android平台设计的轻量级密码管理器 v4.2.4

手机软件 安卓app KeePassDX 一款专为Android平台设计的轻量级密码管理器 v4.2.4

KeePassDX是一款专为Android平台设计的轻量级密码管理器,它以其高效、安全的特点受到了广大用户的青睐。该软件允许用户在单个KeePass格式的文件中编辑加密数据,并能以安全的方式填充表单,极大地简化了密码管理的复杂性。KeePassDX的核心功能在于其强大的加密能力和便捷的操作体验。用户可以将所有密码存储在一个数据库中,该数据库通...
安卓 3061 0
OnionMedia 一款功能全面、操作简便、开源免费的媒体转换器和下载器 v1.2.22.0

OnionMedia 一款功能全面、操作简便、开源免费的媒体转换器和下载器 v1.2.22.0

OnionMedia是一款功能强大的开源媒体转换器和下载器,专为追求高效、便捷媒体处理体验的用户设计。以下是对该软件的详细介绍:核心功能:媒体转换:OnionMedia支持将视频和音频文件转换为多种不同的编码格式,如H.264等,满足用户在不同设备上的播放需求。硬件加速:利用硬件加速技术,OnionMedia能够大幅提升视频文件的编码速度,减...
软件 3252 0
"方言通+翻译官:一个AI,能说18种中国方言和9国语言" Fun-CosyVoice3-0.5B AI语音生成工具 一键整合包 v20251217

"方言通+翻译官:一个AI,能说18种中国方言和9国语言" Fun-CosyVoice3-0.5B AI语音生成工具 一键整合包 v20251217

CosyVoice:基于大语言模型的先进语音合成系统CosyVoice 是一个由 FunAudioLLM 团队开发的开源文本到语音(TTS)系统,目前已迭代至Fun-CosyVoice 3.0版本。该项目基于大语言模型(LLM)架构,在语音合成领域实现了多项技术突破。核心技术特点Fun-CosyVoice 3.0作为最新版本,在内容一致性、说...
AI,开源 5201 1
开源 Magpie 窗口全屏工具:提升画质,让不支持全屏化的游戏也能全屏显示 v0.12.1

开源 Magpie 窗口全屏工具:提升画质,让不支持全屏化的游戏也能全屏显示 v0.12.1

Magpie是一个轻量级的窗口缩放工具,它集成了多种高效的缩放算法和过滤器,旨在提升游戏图形质量,并使非全屏游戏能够以全屏模式显示。这款软件以其丰富的功能和用户友好的界面而脱颖而出。Magpie的核心功能包括能够将任意窗口缩放至全屏模式,同时提供了多种内置的缩放算法,如Lanczos、Anime4K、FSR、自适应锐化等,以及多种CRT着色器...
软件 1.2万 0
GLM-TTS 大语言模型重塑语音合成 3秒克隆人声?GLM-TTS 做到了!声音克隆相似度极高 一键整合包 v20251212

GLM-TTS 大语言模型重塑语音合成 3秒克隆人声?GLM-TTS 做到了!声音克隆相似度极高 一键整合包 v20251212

GLM-TTS是由ZAI 组织开发并开源的高质量文本转语音(Text-to-Speech, TTS)系统。它基于大语言模型(LLM),专注于实现可控、富有情感表达的零样本语音克隆,并通过多奖励强化学习框架显著提升传统 TTS 系统的自然度与表现力。核心特性🗣️ 零样本语音克隆仅需3–10 秒的目标说话人提示音频,即可克隆任意声音,无需微调或说...
AI,开源 4675 6
"90分钟不间断!微软新AI能把你的文字变成专业播客 一键整合包 VibeVoice v20251211

"90分钟不间断!微软新AI能把你的文字变成专业播客 一键整合包 VibeVoice v20251211

🎙️ VibeVoice:你的超级AI配音员"把文字变成自然对话的魔法工具"🌟 什么是VibeVoice?想象一下,有一位永不疲倦的配音员,能一口气生成90分钟不间断的语音内容,还能在对话中自如切换不同角色的声音——这就是微软开发的VibeVoice,一款革命性的AI语音生成工具!💡 它能为你做什么?(实用场景)场景用途效...
AI,开源 8025 18
AI音乐生成工具v2.0 基于 DiffRhythm 二次开发。webui界面 不卡死,速度快 英伟达显卡6g即可运行, 一键整合包

AI音乐生成工具v2.0 基于 DiffRhythm 二次开发。webui界面 不卡死,速度快 英伟达显卡6g即可运行, 一键整合包

DiffRhythm:基于差分节奏建模的通用音乐流派分类开源项目DiffRhythm是由ASLP实验室提出的开源项目,旨在通过创新的差分节奏建模(Differential Rhythm Modeling)框架解决音乐流派分类任务。该项目结合传统信号处理与深度学习技术,从节奏这一音乐核心要素出发,构建了具有强解释性和泛化能力的分类模型。其代码已...
AI,开源 6056 6
开源 blossom 一个功能丰富的云端双链笔记软件 v1.17.1

开源 blossom 一个功能丰富的云端双链笔记软件 v1.17.1

Blossom是一个功能丰富的云端双链笔记软件,它支持私有部署,允许用户将笔记、图片及个人计划安排安全地保存在自己的服务器中,实现跨设备的实时同步。这一特性使得Blossom不仅是一个强大的知识管理工具,还兼顾了数据隐私保护的需求。Blossom的核心特点之一是其完善的文件关系管理。它内置了图床功能,不依赖第三方存储服务,用户可以直接在应用中...
软件 3560 1
开源安卓投屏工具 QtScrcpy 中文免费版 v3.3.3

开源安卓投屏工具 QtScrcpy 中文免费版 v3.3.3

QtScrcpy是一个开源项目,它基于Scrcpy进行重构,旨在提供一个功能强大且易于使用的工具,用于通过电脑控制Android设备。QtScrcpy不仅支持实时预览和录制手机屏幕,还具备跨平台、轻量级和非侵入性等特点,使其成为开发者调试、游戏玩家分享游戏过程或教师进行在线教学的理想选择。QtScrcpy的核心功能包括实时显示安卓设备的屏幕内...
软件 3878 0
告别灵感枯竭?试试 AI-Writing 的智能创作能力 AI智能写作辅导软件 v1.2

告别灵感枯竭?试试 AI-Writing 的智能创作能力 AI智能写作辅导软件 v1.2

AI-Writing 是一个旨在利用人工智能模型来辅助文本创作的开源项目。它可以帮助用户提高写作效率,适用于文章撰写、文案生成、内容润色、创意激发等多种场景。该项目可能整合了当前主流的自然语言处理(NLP)模型,比如 GPT、ChatGLM、BERT 等,以实现以下功能:✨ 主要功能特性自动续写根据用户输入的开头段落或句子,自动生成后续内容。...
AI,开源 3867 0
图像生成神器:用AI画图,零代码也能玩,拖拽操作就能生成精美图片ComfyUI 官方英伟达显卡版 v0.3.70

图像生成神器:用AI画图,零代码也能玩,拖拽操作就能生成精美图片ComfyUI 官方英伟达显卡版 v0.3.70

ComfyUI 是一个基于节点(Node-based)的图形界面工具,专为使用 Stable Diffusion及其衍生模型进行图像生成而设计。它通过可视化的流程图方式,让用户无需编写代码即可构建复杂的生成工作流。🧩 1. 可视化流程图系统节点式编辑器:将每一个操作(如加载模型、输入提示词、图像采样等)封装为独立节点,用户可以通过拖拽连接这些...
AI,开源 8273 3
一键整合包 Step-Audio-EditX  v20251112 解压即用,支持情绪/方言/语气词!让AI说话像真人一样“有血有肉”

一键整合包 Step-Audio-EditX v20251112 解压即用,支持情绪/方言/语气词!让AI说话像真人一样“有血有肉”

🧠 什么是 Step-Audio-EditX?Step-Audio-EditX 是由 StepFun AI 团队开源的一款 30 亿参数(3B)的大语言模型(LLM)驱动的先进音频编辑系统,专注于 高表现力、可迭代、细粒度的语音编辑与零样本语音合成(TTS)。它不仅能高质量克隆任意人声,还能对语音的情绪、说话风格、副语言特征(如笑声、叹息等)...
AI,开源 4787 2
输入一段歌词,AI 自动生成带人声+伴奏的歌(支持中文) 腾讯开源“AI 作曲” SongGeneration v20251109 一键整合包

输入一段歌词,AI 自动生成带人声+伴奏的歌(支持中文) 腾讯开源“AI 作曲” SongGeneration v20251109 一键整合包

腾讯 AI Lab 推出的一个 “AI 自动生成完整歌曲” 的免费工具。你只需要提供一段歌词,它就能帮你自动配上人声 + 伴奏,生成一首像模像样的歌,支持中文和英文!🎤 它能做什么?你写歌词,AI 唱出来:你只要写下带结构的歌词(比如“[主歌]……[副歌]……”),AI 会自动配上旋律、人声和背景音乐。支持风格定制:你可以指定歌曲风格(比如“...
AI,开源 7268 13
中文错别字检测与修正工具(基于 MacBERT模型)jiucuo v1.0 一键整合包,有英伟达显卡就能运行 不限字数

中文错别字检测与修正工具(基于 MacBERT模型)jiucuo v1.0 一键整合包,有英伟达显卡就能运行 不限字数

剑二十七 · 基于 ModelScope 模型 Macadam/macbert4mdcspell_v2 二次开发本系统采用先进的 MacBERT 预训练语言模型,专为中文文本拼写与语法错误检测与修正设计,支持任意长度文本、智能分段处理,并严格保留原始格式(包括换行、空行、标点等),适用于论文、公文、OCR 识别结果、手写转录等多种场景。✅ 核...
AI 2.5万 65
 AI 播客 :一键生成多角色对话音频 SoulX-Podcast 剑二十七二次开发 一键整合包 v20251103

AI 播客 :一键生成多角色对话音频 SoulX-Podcast 剑二十七二次开发 一键整合包 v20251103

SoulX-Podcast是由 Soul AI Lab 开源的一个面向播客场景的高质量、长篇、多说话人对话式语音合成(TTS)系统,专为生成自然、富有表现力、支持方言与副语言特征的播客音频而设计。🔍 项目核心特点1. 长篇多轮多说话人对话生成支持生成多人交替对话的播客内容(如主持人 + 嘉宾);能处理长文本输入,保持语音连贯性和角色一致性;适...
AI,开源 5349 1
支持图像、动图、短视频、PDF:AI逐页/逐帧分析,AI不仅能看懂,还能回答你的问题  Qwen3-VL 一键整合包 v20251024

支持图像、动图、短视频、PDF:AI逐页/逐帧分析,AI不仅能看懂,还能回答你的问题 Qwen3-VL 一键整合包 v20251024

基于 Qwen3-VL-4B-Instruct 的多模态智能交互平台📌 简介本应用是一个基于 通义千问 Qwen3-VL-4B-Instruct 大模型的多模态推理系统,支持对 图像、视频、PDF 文档、GIF 动图 等多种媒体内容进行智能理解与分析,并能自动生成精准描述、解答问题或提取关键信息。借助 Gradio 构建的直观 Web 界面,...
AI,开源 4346 0
DeepSeek-OCR 可视化工具:支持自由OCR、Markdown转换、图表解析与目标定位 一键整合包 v20251023

DeepSeek-OCR 可视化工具:支持自由OCR、Markdown转换、图表解析与目标定位 一键整合包 v20251023

🐳 DeepSeek-OCR 智能图像文字识别工具 — 使用说明🌟 这是什么?这是一个智能图像处理工具,可以自动从你上传的图片中:识别文字内容把文档转成 Markdown 格式(适合写博客、笔记)解析图表数据(比如柱状图、折线图里的数字)定位图片中的特定内容(比如“找出老师在哪里”)它基于先进的 AI 模型(DeepSeek-OCR),由剑二...
AI,开源 4051 3
一句话改图,两张图参考——DreamOmni2 让 AI 理解你的编辑意图 一键整合包优化版 v20251014 支持风格迁移、物体替换、光照调整等全能图像编辑

一句话改图,两张图参考——DreamOmni2 让 AI 理解你的编辑意图 一键整合包优化版 v20251014 支持风格迁移、物体替换、光照调整等全能图像编辑

DreamOmni2 是一个“万能图像编辑器” —— 你给它两张图 + 一句指令,它就能智能地把第一张图“改”成你想要的样子,参考第二张图的风格、内容、细节等。🖼️ 它能做什么?(举几个例子)你想做什么DREAMOMNI2 能做到把照片里的衣服换成另一件✅ 上传原图 + 新衣服图 + 指令:“把第一张图的衣服换成第二张的”让人物发型和参考图一...
AI,开源 4136 0
AI 一键换装 + 换姿势:你的虚拟造型师来了! Leffa v20251010 一键整合包

AI 一键换装 + 换姿势:你的虚拟造型师来了! Leffa v20251010 一键整合包

🎯 这个工具能做什么?这是一个 AI 换装 + 换姿势 的智能图像生成工具,名字叫 Leffa。它能帮你完成两件很酷的事情:1️⃣ 虚拟试衣(AI 换衣服) 👗你只需要提供:一张你自己的全身照片(人像)一张你喜欢的衣服照片AI 就会自动把这件衣服“穿”到你身上,生成一张逼真的试穿效果图!✅ 支持上衣、裤子、连衣裙等多种服装类型✅ 衣服纹理、褶...
AI,开源 8724 1
Kani TTS:轻量、流式、类人 — 开源AI语音合成系统一键整合包  v20251008

Kani TTS:轻量、流式、类人 — 开源AI语音合成系统一键整合包 v20251008

🎙️ Kani TTS — 高质量、模块化、类人语音合成开源项目Kani TTS 是一个由 nineninesix-ai维护的开源文本到语音(TTS)系统,致力于从文本输入生成高质量、自然流畅的语音。项目支持本地独立运行与Web 流式服务,适用于开发、研究及个性化 TTS 场景。GitHub 仓库地址:https://github.com/n...
AI,开源 5554 0