小米开源大模型AI语音合成,600种语言+声音克隆,生成速度提升40倍 不限字数 支持自动语气标签 OmniVoice v20260407 一键整合包

小米开源大模型AI语音合成,600种语言+声音克隆,生成速度提升40倍 不限字数 支持自动语气标签 OmniVoice v20260407 一键整合包

OmniVoice:600+语种的语音合成新纪元剑二十七 · 技术前沿🔹一句话了解由小米下一代 Kaldi 团队(k2-fsa)打造的超大规模多语言零样本 TTS 模型,支持600+ 语种,以卓越音质与极速推理,重新定义语音合成体验。✨ 核心能力一览🗣️全球语种覆盖支持 600+ 语言与方言,从英语、中文到低资源语种,一模型通全球。🔁声音克隆...
AI 4524 0
DeepSeek 本地部署一键运行 DeepSeek-tool v18,解压即可使用 最低支持2G显卡 支持99%的语言大模型 支持联网搜索+知识库

DeepSeek 本地部署一键运行 DeepSeek-tool v18,解压即可使用 最低支持2G显卡 支持99%的语言大模型 支持联网搜索+知识库

琢磨了一天,把DeepSeek的本地部署彻底完成了,并测试了一下午基本完美运行了。当然AI环境你们必须要先安装好。然后下载这个这个本地部署压缩,解压即可完美运行。我的4070ti spuer 运行32b已经是极限了,所以我也只能把模型下载到32b了,如果你们有更牛的显卡,可以继续下载模型。这是我运行14b的截图 你们看看显...
AI,开源 1.8万 28
 一键克隆任意音色,生成自然口语级语音  1B/3.5B 双模型自由切换,还原你最真实的声音  LongCat-AudioDiT v1.0 20260402 更新 一键整合包

一键克隆任意音色,生成自然口语级语音 1B/3.5B 双模型自由切换,还原你最真实的声音 LongCat-AudioDiT v1.0 20260402 更新 一键整合包

LongCat-AudioDiT 语音合成工具 - 功能说明🎯 主要功能本工具基于美团开源的 LongCat-AudioDiT 扩散模型,提供高质量的文本到语音合成,并支持零样本语音克隆(只需几秒参考音频即可克隆音色)。界面采用 Gradio 构建,操作直观,适用于中文和英文混合文本。📌 核心功能模块1. 模型选择支持 1B&nbs...
AI 4001 2
DbGate:全能开源数据库管理工具,跨平台操作,高效便捷 v7.1.6

DbGate:全能开源数据库管理工具,跨平台操作,高效便捷 v7.1.6

DbGate是一个功能强大的开源(no)SQL数据库客户端工具,它旨在为用户提供简单且高效的方式来管理和操作多种数据库。DbGate支持跨平台运行,包括Windows、Linux和Mac,并且还能在Docker容器中作为Web应用运行,满足用户在不同环境下的使用需求。该工具设计之初就考虑到了用户可能需要同时管理多个数据库的情况,因此提供了丰富...
开源 2849 0
开源 AiNiee:一键通杀全场景 AI 翻译!游戏 / 字幕 / 书籍 / 文档,高效搞定不费力 v7.1.2

开源 AiNiee:一键通杀全场景 AI 翻译!游戏 / 字幕 / 书籍 / 文档,高效搞定不费力 v7.1.2

AiNiee 是一款专注于 AI 翻译的工具,主打一键自动翻译复杂长文本内容,涵盖游戏、书籍、字幕、文档等多种场景。其核心目标是通过智能化技术提升翻译效率与质量,同时支持广泛的文件格式和使用场景。核心功能格式全能,覆盖广泛深度支持游戏文本翻译,兼容 Mtool、Renpy、Translator++ 等游戏文本导出工具。轻松处理多种文件类型:I...
开源 3952 0
FastGestures 鼠标/触控板/屏手势 绿色免安装 v2.2.67

FastGestures 鼠标/触控板/屏手势 绿色免安装 v2.2.67

FastGestures 是一款鼠标手势软件,借助它,用户可以通过自定义简明的鼠标动作来控制和管理电脑的操作,极大地提高了效率和工作流程的速度。主要特性自定义鼠标手势:FastGestures允许用户自定义鼠标手势,以控制各种常见的电脑操作,如打开文件,关闭窗口,翻页,前后浏览等。操作简便:使用FastGestures进行鼠标手势操作非常简单...
软件 6121 1
一键式效率倍增器 定时/热键自动化任务工具 zTasker v2.3.7 免费  绿色免安装

一键式效率倍增器 定时/热键自动化任务工具 zTasker v2.3.7 免费 绿色免安装

zTasker是一个定时/热键自动化任务工具,可以采用定时或热键的方式执行多种自动化任务,支持50+种任务类型,20+种定时/条件执行方法,任务列表随意编辑、排列、移动、更改类型,支持任务执行日志,支持任务列表等数据的备份,支持任务日志,支持数据备份,支持自动更新。使用技巧★ 可以在托盘菜单或者主界面下拉菜单,或者用热键,进入快速提醒、快速定...
软件 5738 0
语音识别 + 声音克隆 + 模型训练,一个工具全搞定!Easy-Voice-Toolkit v1.3.5

语音识别 + 声音克隆 + 模型训练,一个工具全搞定!Easy-Voice-Toolkit v1.3.5

Easy-Voice-Toolkit 是由 Spr-Aachen开发的一款开源、用户友好的 AI 语音工具箱,旨在为开发者、研究人员和爱好者提供一站式、本地化部署的语音处理解决方案。项目设计注重易用性与功能性,支持多种主流语音任务,适用于科研实验、产品原型开发、语音助手构建等多种应用场景。🌟 核心特性本地部署:所有功能均可在本地运行,保障数据...
AI,开源 5334 0
EditMGT 用文字"指挥"AI修图,想改哪里改哪里 5秒即可完成编辑 一键整合包 v20260219

EditMGT 用文字"指挥"AI修图,想改哪里改哪里 5秒即可完成编辑 一键整合包 v20260219

EditMGT(Masked Generative Transformer for Image Editing)是一个基于掩码生成式变压器的先进图像编辑框架,由字节跳动(ByteDance)主导研发,联合上海交通大学、新加坡国立大学、香港科技大学(广州)等高校共同完成。✨ 核心特点1. 技术创新采用**掩码生成式变压器(Masked Gene...
AI 3766 3
电商降本增效神器:FASHN VTON v1.5 模特图自动生成 新一代开源虚拟试衣黑科技 一键整合包 v20260210

电商降本增效神器:FASHN VTON v1.5 模特图自动生成 新一代开源虚拟试衣黑科技 一键整合包 v20260210

FASHN VTON v1.5 是由 Fashn AI 推出的开源虚拟试衣项目。该项目基于先进的扩散模型技术,旨在解决电商、时尚设计和图像生成领域中“模特换装”的核心需求。它能够将任意一张服装图片逼真地“穿”在指定人物身上,同时保持人物的面部、姿态和背景环境高度一致。以下是该项目的详细介绍:1. 项目概述FASHN VTON v1.5 是一个...
AI,开源 5239 6
ACE-Step-1.5 解锁音乐创作无限可能,以技术革新重塑音乐生成生态,AI生成音乐 翻唱音乐 重绘音乐 支持中文 v20260206

ACE-Step-1.5 解锁音乐创作无限可能,以技术革新重塑音乐生成生态,AI生成音乐 翻唱音乐 重绘音乐 支持中文 v20260206

ACE-Step是一个开源的音乐生成基础模型项目,旨在通过全面的架构设计克服现有音乐生成方法的局限性,并实现最先进的性能。以下是对该项目的详细介绍:项目背景与目标:ACE-Step项目针对当前音乐生成方法中存在的生成速度、音乐连贯性和可控性之间的权衡问题,提出了一种新的解决方案。项目的目标是建立一个快速、通用、高效且灵活的音乐AI基础模型,使...
AI 6102 5
影像重获新生 SeedVR2 图片+视频批量超分神器 一键整合包 AI 超分,让每一帧都惊艳 v20260205

影像重获新生 SeedVR2 图片+视频批量超分神器 一键整合包 AI 超分,让每一帧都惊艳 v20260205

SeedVR2 图像/视频超分工具这是一款基于 ComfyUI-SeedVR2_VideoUpscaler 官方推理 CLI 开发的图形化 Web 封装工具。它提供了一个现代化、汉化且高度可配置的网页界面,使用户无需编写命令行代码即可轻松对图片和视频进行高质量的 AI 超分辨率处理。核心功能1. 多模态与批量处理图片超分:支持单张图片或批量上...
AI,开源 4129 2
一款轻量、安全、无侵入性的开源游戏加速工具 OpenSpeedy v1.7.9

一款轻量、安全、无侵入性的开源游戏加速工具 OpenSpeedy v1.7.9

OpenSpeedy是一个基于 Windows 平台的开源免费游戏变速工具,它通过修改游戏中的时间控制函数来实现对游戏运行速度的加速。无论是单机游戏还是模拟器游戏,只要依赖系统时间进行帧率控制,OpenSpeedy 都可以对其进行变速处理,从而提升游戏体验。🧰 主要功能与特点特性描述✅ 完全免费 & 开源可自由查看、使用和修改源码,遵...
开源 7589 0
免费开源神器!像素动画艺术编辑器 —— PixiEditor v2.0.1.19

免费开源神器!像素动画艺术编辑器 —— PixiEditor v2.0.1.19

PixiEditor 是一款免费、开源、跨平台的像素艺术创作工具,专为像素艺术家、游戏开发者和像素爱好者设计。采用现代技术栈构建,界面简洁直观,功能强大且持续活跃开发中。🎨 核心特性✅ 专为像素艺术优化精确的像素级编辑支持透明背景和 Alpha 通道像素网格、对齐辅助线、缩放预览等专业功能✅ 多图层支持支持多个图层,可调整顺序、透明度、混合模...
开源 7239 7
Qwen3-TTS:让文字拥有灵魂的声音艺术家 文字生成语音 语音克隆 新增多人对话 一键整合包 v20260130

Qwen3-TTS:让文字拥有灵魂的声音艺术家 文字生成语音 语音克隆 新增多人对话 一键整合包 v20260130

Qwen3-TTS 开源项目介绍Qwen3-TTS 是由 Qwen 团队开发的一系列强大语音生成模型,于 2026 年 1 月 22 日正式发布。该项目提供全面的语音生成能力,包括语音克隆、语音设计、超高质量类人语音生成和基于自然语言的语音控制,为开发者和用户提供了目前最广泛的语音生成功能集。核心特性1. 多语言支持Qwen3-TTS 覆盖 ...
AI 7752 4
Z-Image(造相)AI文生图  v20260128 一键整合包,支持批量生成图片,可直接用于生产的一键整合包

Z-Image(造相)AI文生图 v20260128 一键整合包,支持批量生成图片,可直接用于生产的一键整合包

Z-Image(造相)是阿里巴巴通义实验室(Tongyi MAI)推出的高效图像生成基础模型家族,以"小参数、高质量、极速推理"为核心设计理念,在开源图像生成领域树立了新的性能标杆。核心技术特点参数规模与架构:采用 60 亿参数(6B)的轻量级设计,基于创新的可扩展单流扩散 Transformer(S3-DiT)架构,将文...
AI 6501 10
免费 开源的效率神器 Rubick 基于 Electron 开源的插件化电脑工具箱  效率神器 v4.3.8

免费 开源的效率神器 Rubick 基于 Electron 开源的插件化电脑工具箱 效率神器 v4.3.8

基于 electron 的开源工具箱,自由集成丰富插件,打造极致的桌面端效能工具。Rubick(拉比克) 是 dota 里面的英雄之一,其核心技能是插件化使用其他英雄的技能,用完即走。非常符合本工具的设计理念,所以取名 Rubick。 基于 npm 包模式的插件管理,安装插件和安装 npm 包一样简单 支持系统插件,只要在...
开源 5774 1
开源 简易语音工具包 用于语音识别、语音转录、语音转换等。Easy-Voice-Toolkit  v1.3.4

开源 简易语音工具包 用于语音识别、语音转录、语音转换等。Easy-Voice-Toolkit v1.3.4

🎙️ Easy-Voice-Toolkit —— 一体化开源语音处理工具箱将复杂的语音 AI 技术封装为直观易用的自动化工作流,零门槛构建从音频输入到语音合成的完整 pipeline。🔍 项目定位Easy-Voice-Toolkit 是一个模块化、全流程的语音处理平台,整合 Whisper、GPT-SoVITS 等主流开源技术,通过图形化界面...
开源 5239 1
开源工具 告别命令行!FFmpegFreeUI 让视频转码更轻松 v5.2

开源工具 告别命令行!FFmpegFreeUI 让视频转码更轻松 v5.2

FFmpegFreeUI(简称 3FUI)是一个专为 Windows 平台设计的 FFmpeg 图形用户界面(GUI)工具。它基于 .NET 10 框架开发,使用 WinForm 技术,并结合 SunnyUI 和自定义绘制功能,打造了一个专业、高效的暗黑风格用户界面。该工具的设计目标是提供轻度专业的参数调整功能,帮助普通用户更轻松地进行视频转...
开源 5362 1
Duplicati:开源跨平台加密备份利器,安全守护你的云端数据之旅 v2.2.0.3

Duplicati:开源跨平台加密备份利器,安全守护你的云端数据之旅 v2.2.0.3

Duplicati是一个免费、开源的备份客户端,它允许用户将加密的、增量的、压缩的备份安全地存储在云存储服务和远程文件服务器上。以下是对Duplicati的详细介绍:支持的存储服务:Duplicati支持多种云存储服务,包括Amazon S3、IDrive e2、Backblaze (B2)、Box、Dropbox、FTP、Google Cl...
开源 5055 0
深度整合 FLUX.2-klein-base-9B:一款为内容创作者打造的本地化 AI 绘图+多图片编辑工具 一键整合包 v20260123

深度整合 FLUX.2-klein-base-9B:一款为内容创作者打造的本地化 AI 绘图+多图片编辑工具 一键整合包 v20260123

🎨 FLUX.2 Klein 本地图像生成与编辑工具 —— 功能详解这是一款基于FLUX.2 Klein 模型的本地化 AI 图像生成与编辑工具,专为内容创作者、自媒体运营者和设计师打造。无需联网,完全离线运行,支持文生图与图生图编辑,界面简洁直观,开箱即用。🖼️ 功能一:文生图(Text-to-Image)输入一段中文或英文提示词,即可生成...
AI 6104 21
开源 OncePower 一款功能强大的文件和文件夹批量重命名工具 v2.40.0

开源 OncePower 一款功能强大的文件和文件夹批量重命名工具 v2.40.0

OncePower是一款功能强大的文件和文件夹批量重命名工具,它不仅能够帮助用户高效地管理大量文件,还提供了多种实用的附加功能。以下是关于OncePower的详细介绍:基本功能批量重命名:OncePower支持对多个文件和文件夹进行批量重命名,用户可以根据需要选择不同的匹配规则和命名方式,以达到最佳的整理效果。视图模式:针对图片文件,Once...
开源 4596 2
神器 uTools (效率工具集)  中文官方版 v7.5.1

神器 uTools (效率工具集) 中文官方版 v7.5.1

介绍uTools是一个极简、插件化、跨平台的现代化桌面软件。通过自由选配丰富的插件,打造你得心应手的工具集合。通过快捷键(默认alt+space)就可以快速呼出这个搜索框。它相当聪明,可以支持输入、拖拽、自动粘贴等作为输入源,相应的插件也早已准备就绪,统一的设计风格和操作方式,助你高效的得到结果。当你熟悉它后,能够为你节约大量时间,让你可以更...
软件 5153 2
多图预览 老牌浏览器 傲游浏览器 便携版 v 7.5.2.4800 Beta

多图预览 老牌浏览器 傲游浏览器 便携版 v 7.5.2.4800 Beta

这个浏览器其实在多年前就经常在用那时候还叫myie 和当时的theworld。基本都是电脑里面必装的浏览器。时间过得是真快啊。现在theworld早就已经没有更新了,还好还有傲游在,偶尔也会安装回来再看看,因为里面有我的青春啊。。。为了让你们更好的了解这个浏览器,我就多截图一点。介绍傲游浏览器(Maxthon Browser)介绍傲游浏览器(...
软件 4685 1
Qwen3-TTS 通义千问推出的高质量文本转语音工具,API调用,无字数限制,批量生成,小巧,轻量,无需显卡即可快速生成语音,剑二十七二次开发 一键整合包 v2060119 4.0

Qwen3-TTS 通义千问推出的高质量文本转语音工具,API调用,无字数限制,批量生成,小巧,轻量,无需显卡即可快速生成语音,剑二十七二次开发 一键整合包 v2060119 4.0

一、什么是 TTS?TTS(Text-To-Speech)是一种将文字转换为自然语音的技术,广泛应用于语音助手、有声书、导航播报、智能客服等场景。二、Qwen-TTS功能简介该项目提供了一个简单的 Web 界面(基于 Gradio),用户可以输入任意文本,并通过 Qwen 的 TTS 模型生成对应的语音文件。该工具支持中文和英文的语音合成。🔧...
AI 1万 7
功能全面,操作便捷的免费文件改名工具 zRenamer v1.7.0 绿色免安装

功能全面,操作便捷的免费文件改名工具 zRenamer v1.7.0 绿色免安装

zRenamer是一款功能强大且操作便捷的文件批量重命名工具,它的诞生源于开发者对之前同类软件MiniRenamer的不懈追求与改进。zRenamer在界面设计上参考了老牌改名工具拖把改名,并在此基础上进行了多项优化,使得软件在加载和执行速度、右键菜单支持等方面都有了显著提升。软件追求轻巧不冗余、页面直观、功能简洁、操作便捷高效的理念,为用户...
软件 3720 0
AI 图像魔法: 图片超分辨率 无损放大 x2x4 v1.0

AI 图像魔法: 图片超分辨率 无损放大 x2x4 v1.0

基于 image_gen_aux 和 Gradio 开发的通用图像增强工具。本项目集成了大量由 Phips 训练的高性能 AI 模型,支持图像去噪、去 JPEG 压缩痕迹、无损/有损放大以及动漫风格化处理。✨ 核心功能🤖 多模型支持:内置 60+ 种精选模型,涵盖 1x(修复)、2x(双倍放大)、4x(四倍放大)等多种分辨率增强需求。📱 移动...
AI 3003 0
 VoiceSculptor:基于指令驱动的下一代语音合成开源框架——让AI语音拥有精准的情感与音色控制能力 v20260108 一键整合包

VoiceSculptor:基于指令驱动的下一代语音合成开源框架——让AI语音拥有精准的情感与音色控制能力 v20260108 一键整合包

🎵 VoiceSculptor - 指令驱动的语音合成模型📌 项目概述VoiceSculptor是由ASLP实验室(Audio, Speech and Language Processing Laboratory)开发的一款先进的指令式文本到语音(instruct text-to-speech)开源模型。2该项目代表了语音合成技术的前沿发展方...
开源 3052 0
Win10 五笔助手 让 Win10/Win11 微软五笔更强大 wubiLex v12.1.0

Win10 五笔助手 让 Win10/Win11 微软五笔更强大 wubiLex v12.1.0

软件简介:平心而论,现在用五笔的人实在太少了,以往遍地开花的五笔输入法,现如今已经门可罗雀。好在微软还是很良心地在 Win10 里保留了这款输入法,并一直予以更新。但微软毕竟不同于第三方厂商,很多细节照顾得还是不够,于是便有了这款 wubiLex 五笔输入法增强器。该版特点:这是一个WIN10系统自带五笔的码表与短语词库安装、管理工具,并可增...
软件 3003 0
GPT-SoVITS2507+SAVA46 一个强大的开源工具,专注于少样本语音转换和文本到语音(TTS)的合成 一键整合包

GPT-SoVITS2507+SAVA46 一个强大的开源工具,专注于少样本语音转换和文本到语音(TTS)的合成 一键整合包

GPT-SoVITS是一个强大的开源工具,专注于少样本语音转换和文本到语音(TTS)的合成。该工具由RVC-Boss团队开发,并在GitHub上公开分享,为用户提供了一个灵活且功能丰富的平台,以满足语音合成的多样化需求。核心功能GPT-SoVITS的核心功能包括零样本和少样本TTS。零样本TTS允许用户仅通过输入一个5秒的语音样本,就能即时体...
AI,开源 1.1万 4
FFmpeg小白助手 音视频批量处理工具 【小白救星、懒人福音】

FFmpeg小白助手 音视频批量处理工具 【小白救星、懒人福音】

这个软件适合不想去学ffmpeg命令的小伙伴了。直接拿来就可以用了,如果想进一步了解学习 可以去看看我之前发布的ffmpeg教程 FFmpeg】FFmpeg是一款开源软件,可以处理多种多媒体媒体数据程序。是目前最受欢迎的视频和图像处理软件。FFmpeg小白助手】在FFmpeg基础上开发的一款自动化处理软件,以最简单的方式快速批量处理...
软件 4105 2
视频4倍高清修复,一键搞定!清华团队开源实时视频超分模型 FlashVSR 一键整合包 v20251231

视频4倍高清修复,一键搞定!清华团队开源实时视频超分模型 FlashVSR 一键整合包 v20251231

🎥 FlashVSR 是什么?FlashVSR 是一个能让模糊、低清视频“秒变高清”的智能工具。它专门用来做一件事:把低分辨率的视频,快速、高质量地放大成 4 倍清晰度的高清视频。比如:把 480p 的老视频 → 变成接近 4K 的清晰视频让手机拍的模糊视频 → 变得锐利、细节丰富⚡ 它有什么厉害的地方?过去很多“视频超分”(放大变清晰)工具...
AI,开源 6424 2