腾讯AI会“配音”了!给视频能自动配上声音+音乐 一键整合包 HunyuanVideo-Foley v20250830

腾讯AI会“配音”了!给视频能自动配上声音+音乐 一键整合包 HunyuanVideo-Foley v20250830

HunyuanVideo-Foley 是一个基于深度学习的音效生成系统,能够根据输入的视频内容,自动识别其中的视觉动作和场景(如脚步、关门、物体碰撞等),并生成与之同步、逼真的环境音效或动作音效。这类技术在影视后期、短视频制作、游戏开发、虚拟现实等领域具有广泛的应用前景,能够显著降低人工配音效的成本和时间。🔧 核心功能视频驱动音效生成(Vid...
AI,开源 5425 13
Ovis2图片反推提示词工具v5.0 基于AI大模型反推图片+视频批量生成提示词 英伟达6G显卡即可愉快玩耍

Ovis2图片反推提示词工具v5.0 基于AI大模型反推图片+视频批量生成提示词 英伟达6G显卡即可愉快玩耍

本工具基于Ovis2-4B和Ovis2-2B 这2个大模型制作而成。其实早之前我就有分享过反推提示词工具 moondream,但是我昨天遇到了这个大模型,发现功能更加强大,反推出来的提示更加丰富,更多细节描述。这个工具要求显卡比较低,英伟达显卡6g及以上就可以愉快玩耍了我用同一张图片反推提示词下面是Ovis2-4B生成的提示词The...
AI,开源 2.1万 49
AI 视频生成新突破:FramePack 开源项目引领视频扩散技术变革 一键汉化整合包 FramePack-F1 20250716更新 支持magcache加速 支持50系显卡

AI 视频生成新突破:FramePack 开源项目引领视频扩散技术变革 一键汉化整合包 FramePack-F1 20250716更新 支持magcache加速 支持50系显卡

FramePack 是一个开源项目,旨在通过创新的神经网络结构实现高效的视频生成。以下是对其的详细介绍:项目概述FramePack 是 “Packing Input Frame Contexts in Next - Frame Prediction Models for Video Generation” 论文的官方实现和桌面软件。它采用逐帧...
AI,开源 2.1万 39
开源 FastFlix v5.12.4一个开源的视频转码和预处理工具

开源 FastFlix v5.12.4一个开源的视频转码和预处理工具

FastFlix是一个开源的视频转码和预处理工具,旨在为视频创作者提供快速、简单且高度可定制的转换体验。FastFlix基于业界广泛认可的多媒体处理框架FFmpeg,通过强大的技术核心,将复杂的命令行操作简化为直观的图形用户界面,使用户即使没有编程知识也能充分利用FFmpeg的功能。主要特点批处理处理:支持批量转换,用户可以一次性处理多个视频...
开源 3189 0
MiniMax-Remover:基于 Minimax 优化的高效视频物体移除工具 v20250621 一键整合包

MiniMax-Remover:基于 Minimax 优化的高效视频物体移除工具 v20250621 一键整合包

MiniMax-Remover是一个基于 minimax 优化的视频物体移除工具,旨在高效、高质量地从视频中移除指定对象,并生成视觉上无缝的修复结果。该项目由 Bojia Zi 等人开发,核心目标是实现 快速(Fast)、有效(Effective)和鲁棒(Robust)的视频内容编辑。核心特性两阶段训练策略第一阶段:使用简化版的 DiT(Di...
AI,开源 5832 0
图片加音乐转视频,傻瓜卡点神器 人工智障全自动卡点神器 v3.9

图片加音乐转视频,傻瓜卡点神器 人工智障全自动卡点神器 v3.9

简介: “图片加音乐转视频,傻瓜卡点神器”是一款专为视频创作者设计的工具,旨在简化将图片和音乐结合生成视频的过程。这款工具特别适合那些在视频编辑软件中进行卡点操作时感到困难的用户。它提供了一种简单、直观的方式来创建具有音乐节奏的视频,无需复杂的编辑技巧。功能特点:时长控制:用户可以根据音频的长度和可用图片的数量,灵活控制视频的时长。如果音频时...
软件 5247 0
视频自动分镜工具,一键智能分割画面 视频自动分割分镜工具

视频自动分镜工具,一键智能分割画面 视频自动分割分镜工具

视频自动分割(分镜)工具介绍说明这是一款基于Python和PyQt5开发的桌面应用程序,名为“视频自动分割(分镜)工具”。它主要用于通过检测画面变化来自动分割视频片段,帮助用户快速实现视频的分镜处理。主要功能自动分割视频工具能够分析视频内容,根据画面变化进行智能分割,将视频分成多个独立片段。支持多种视频格式支持常见的视频文件格式,无需额外转换...
软件 2680 0
多图预览 全媒体格式转换 格式工厂 FormatFactory v5.21.0去广告绿色版

多图预览 全媒体格式转换 格式工厂 FormatFactory v5.21.0去广告绿色版

标题:格式工厂——全能多媒体文件转换工具引言】在数码时代,我们常常会遇到多媒体文件格式不兼容的问题。有时我们想播放一段音频或视频,却发现播放器无法识别文件格式,这给我们的使用带来很大的不便。为了解决这个问题,开发人员推出了一个强大的软件工具——格式工厂(Format Factory)。本文将向您介绍格式工厂的基本信息、功能特点、操作流程以及使...
软件 5799 8
BEN2 v1.1 AI人工智能 图片批量抠图+视频抠像工具 一键整合包 视频可以输出透明通道

BEN2 v1.1 AI人工智能 图片批量抠图+视频抠像工具 一键整合包 视频可以输出透明通道

虽然我已经分享了不少的抠图和视频抠像的工具,但是谁又会嫌弃好工具多呢?所以抽空做了这个BEN2的整合包,这个整合包最大的特点就是可以输出带有透明通道的webm视频格式。在图像和视频处理领域,前景分割技术一直是研究和应用的热点。无论是视频编辑、特效制作,还是人工智能驱动的内容生成,精准的前景分割都是实现高质量输出的关键。而今天我们要介绍的,是一...
AI,开源 7833 5
LatentSync v1.5 字节跳动联合北京交通大学推出AI数字人工具,汉化一键整合包

LatentSync v1.5 字节跳动联合北京交通大学推出AI数字人工具,汉化一键整合包

LatentSync是由字节跳动联合北京交通大学推出的端到端唇形同步框架,基于音频条件潜在扩散模型(Latent Diffusion Models),旨在实现语音与唇形运动的高精度同步。该项目通过结合Stable Diffusion的生成能力与音视频联合建模技术,解决了传统方法依赖中间表示(如3D模型或2D关键点)的复杂性问题,直接生成动态逼...
AI,开源 8933 13
MatAnyone v1.0.0 人工智能AI 自定义视频抠图 一键汉化整合包 附视频演示

MatAnyone v1.0.0 人工智能AI 自定义视频抠图 一键汉化整合包 附视频演示

MatAnyone是一个专注于人类视频抠图(Matting)的实用框架,其独特之处在于支持目标分配功能,并能在核心区域语义和精细边界细节上表现出稳定的性能。该项目由Peiqing Yang等人在2025年提出,并在CVPR(Conference on Computer Vision and Pattern Recognition)这一顶级计算...
AI,开源 9889 12
MMAudio  v0.1 AI视频生成背景声音  文生生成声音 一键整合包 8G英伟达显卡可用,无需安装环境,解压即可使用

MMAudio v0.1 AI视频生成背景声音 文生生成声音 一键整合包 8G英伟达显卡可用,无需安装环境,解压即可使用

MMAudio是一个开源项目,旨在通过多模态联合训练生成高质量的同步音频。以下是关于这个项目的详细介绍:项目概述MMAudio由香港中文大学的程浩基(Ho Kei Cheng)等人开发,主要功能是根据视频和/或文本输入生成同步音频。其核心创新在于多模态联合训练方法,能够在广泛的音视频和音文本数据集上进行训练。此外,同步模块可以将生成的音频与视...
AI,开源 6158 0
开源 Video2X v6.4.0 一个基于 Python 编写的视频、GIF 和图像放大及帧插值软件

开源 Video2X v6.4.0 一个基于 Python 编写的视频、GIF 和图像放大及帧插值软件

这个软件主要用于提升视频的质量,通过升频和提高分辨率来实现。对于那些希望改善老旧或低分辨率视频视觉效果的用户来说,它提供了一个强大的解决方案。video2x 的主要功能是将视频升频到更高的分辨率。它运用先进的算法来分析和处理视频的每一帧,增加像素数量,从而提升整体的清晰度和细节。这对于提升旧的 VHS 录像带、DVD 转制视频或其他低质量视频...
软件 4075 0
开源 DCT-Net_Webui v20250116 修改增强版 一款将图片/视频转绘漫画效果工具 支持批量处理 附三倍快乐演示

开源 DCT-Net_Webui v20250116 修改增强版 一款将图片/视频转绘漫画效果工具 支持批量处理 附三倍快乐演示

视频转动漫的工具貌似有不少,之前我也分享了,但是今天分享的这个,操作是极其简单,我顺手还做了个批量处理。这样就更方便了。Q群一个小伙伴提供了一台远程4060显卡的机器给我远程测试,所以也顺手把N卡包也整合好了。N卡的效率确实是超级高啊,我用CPU跑10秒的视频大概要3-5分钟,但是N卡的话 一分钟不到就搞定了。确实是爽。下面是截图一下给你们看...
AI,开源 9683 10
神器 小丸工具箱 v236 一款用于处理音视频等多媒体文件的软件

神器 小丸工具箱 v236 一款用于处理音视频等多媒体文件的软件

早些年我还没学FFmpeg的时候,经常会用这个小丸工具箱确实是神器,但是我后来会了FFmpeg就没怎么用了。介绍小丸工具箱是一款用于处理音视频等多媒体文件的软件。是一款x264、ffmpeg等命令行程序的图形界面。它的目标是让视频压制变得简单、轻松。软件截图软件特点高质量的H264+AAC视频压制ASS/SRT字幕内嵌到视频AAC/WAV/F...
软件 2782 0
吾爱出品 图片视频压缩工具 Eric v1.0.0

吾爱出品 图片视频压缩工具 Eric v1.0.0

吾爱大神xiaoaipojie出品主要功能:图片压缩: 允许用户通过拖放功能轻松压缩图片文件,减少文件大小,同时保持图片质量。视频压缩: 支持视频文件的压缩,通过调整压缩率来优化视频大小,以适应不同的存储和传输需求。压缩率调整: 提供100%的压缩率选项,用户可以根据需要调整压缩率,以找到最佳的文件大小和质量平衡点。拖放操作: 用户可以通过拖...
软件 2975 0
开源 Tailor v0.1.5  一款功能强大的视频智能裁剪、生成及优化工具

开源 Tailor v0.1.5 一款功能强大的视频智能裁剪、生成及优化工具

Tailor 是一款功能强大的视频智能裁剪、生成及优化工具。这款软件集成了最先进的人工智能技术,为用户提供了前所未有的视频处理体验。Tailor涵盖了视频剪辑、视频生成和视频优化三大核心功能,共包含10种不同的处理方法。在视频剪辑方面,Tailor拥有精准的人脸识别技术,能够自动捕捉视频中的精彩人脸瞬间,并允许用户轻松选择关注的人脸进行裁剪,...
软件 5865 8
开源 CogVideoX 文字生成视频 整合包

开源 CogVideoX 文字生成视频 整合包

CogVideoX是智谱AI推出的一款开源视频生成模型,该项目在视频生成领域引起了广泛关注。以下是对CogVideoX开源项目的详细介绍:一、项目背景与简介CogVideoX作为智谱AI的创新成果,旨在通过深度学习技术将文本或图像转换为高质量的视频内容。该项目不仅推动了视频生成技术的边界,还为创作者提供了全新的创作工具和平台。CogVideo...
AI,开源 5439 3
神器 开源 CodeFormer v20240114 图片+视频+人脸高清修复 解压即用

神器 开源 CodeFormer v20240114 图片+视频+人脸高清修复 解压即用

CodeFormer是一个基于AI技术的深度学习项目,由南洋理工大学和商汤科技联合研究中心共同开发。该项目专注于人脸复原领域,通过深度学习模型提升模糊或受损人脸图像的质量。CodeFormer结合了VQGAN和Transformer两种先进的神经网络架构,其中VQGAN利用向量量化技术将图像编码为一系列离散的向量,并通过解码器恢复成图像,而T...
软件 6284 4
开源 NotEnoughAV1Encodes v2.1.7 一款功能强大的视频重新编码软件

开源 NotEnoughAV1Encodes v2.1.7 一款功能强大的视频重新编码软件

介绍NotEnoughAV1Encodes是一款功能强大的视频重新编码软件,专为需要高效处理视频文件的用户设计。以下是对该软件的详细介绍:一、软件概述NotEnoughAV1Encodes基于ffmpeg开发,是一款免费开源的视频编码工具。它支持多种视频和音频编码库,如aomenc、rav1e、svt-av1以及vp9等,能够智能地处理视频文...
软件 3212 0
开源 DiffSynth-Studio 视频风格转绘,视频转动漫 一键整合包 附模型 附官方视频演示

开源 DiffSynth-Studio 视频风格转绘,视频转动漫 一键整合包 附模型 附官方视频演示

写在最前面,这个开源项目我早就关注了,但是一直没有合适的硬件来折腾,但是不折腾又不甘心。这不群里傻木小伙伴提供了一台机器暂时折腾一下,我就用这个机器昨天抽空弄了这个的开源整合包,模型是真的多啊。下载了我半夜。。。虽然整合包是做好了可惜很遗憾,这个视频重绘还是太耗显卡。我估计最低都需要12G 显存,否则一点运行就直接爆了显存。不信的可以看后面的...
软件 7435 3
开源 免费 AI工具 视频补帧 速度超快 让视频更丝滑 附视频演示 附下载地址

开源 免费 AI工具 视频补帧 速度超快 让视频更丝滑 附视频演示 附下载地址

首先先说明一下,这个工具不是提升视频高清质量的工具,而是补帧工具。我这里简单说下什么补帧,比如有些运动画面。看起来会有点一卡一卡的。播放不是很丝滑流畅,就可以用这个补帧工具来补帧,这样处理好后的视频就会更丝滑了。这个工具没有N卡也可以跑,我用cpu跑速度也不错。解压即可食用,简单方便。下面是详细介绍 你们看看随着高清和超高清视频的普及,对于视...
开源 6610 11
视频处理器 v1.2 视频批量横转竖工具 绿色免安装

视频处理器 v1.2 视频批量横转竖工具 绿色免安装

视频处理器 v1.2 是一款由是貔貅呀开发的视频编辑和处理工具,提供高效便捷的视频批量横转竖,主要功能:导入与删除文件:轻松导入多个视频文件,删除不必要的文件。暂停与继续处理:随时暂停和继续处理。设置输出文件夹:选择视频处理后的存放文件夹。FFmpeg 配置:自定义输出格式、视频编码器、音频编码器和线程数。日志记录:实时记录处理日志。使用步骤...
软件 2322 0
开源 免费 FFBox v4.0 一个多媒体转码百宝箱

开源 免费 FFBox v4.0 一个多媒体转码百宝箱

FFBox是一个由ttqftech团队开发的开源项目,主要定位为多媒体转码百宝箱,它基于FFmpeg的图形用户界面(GUI)工具。一、项目背景与定位随着多媒体内容的日益丰富,对多媒体文件的转码和处理需求也逐渐增多。FFBox作为一个专注于多媒体转码的工具,为用户提供了一个直观、易用的图形界面,使得用户无需深入了解FFmpeg的复杂命令,即可轻...
安卓 3307 0
AI 开源 视频高清修复 放大工具 特点就是速度快 效果好 操作简单 Anime4KCPP GUI v1.12.0-2.5.0-Win64-msvc

AI 开源 视频高清修复 放大工具 特点就是速度快 效果好 操作简单 Anime4KCPP GUI v1.12.0-2.5.0-Win64-msvc

今天在逛github的时候,想找一款视频高清修复放大之类的工具,找了不少,但是感觉操作都是有点小复杂,不是需要搭建各种环境就是各种复杂参数或者是各种模型,看的我头晕目眩。太复杂的工具已经不适合我这样的老年人了,我就喜欢那种解压就能用而且还不要复杂操作。还真让我找到一个。现分享出来下面看图片演示这是原始视频从上面的参数 可以看出来 原始视频的大...
开源 2万 49
教程三,巧用ffmpeg,一键批量加字幕实现循环播放和随机水印效果

教程三,巧用ffmpeg,一键批量加字幕实现循环播放和随机水印效果

这是以前发布的一些ffmpeg的教程,对入门想学这个的小伙伴还是有点帮助的。以前发布在头条,现在还有些小伙伴在问,就放到我自己的网站上来吧ffmpeg 官方地址,有大量的帮助文档可以学习,如果英文差点 可以翻译下http://ffmpeg.org/下载地址: 因为发布时间比较久了 相关代码我也没有保存,如有需要 可以截屏自己打出来吧
素材 2430 1
教程二 利用ffmpeg 一键批量旋转视频并修改好视频的大小尺寸

教程二 利用ffmpeg 一键批量旋转视频并修改好视频的大小尺寸

这是以前发布的一些ffmpeg的教程,对入门想学这个的小伙伴还是有点帮助的。以前发布在头条,现在还有些小伙伴在问,就放到我自己的网站上来吧ffmpeg 官方地址,有大量的帮助文档可以学习,如果英文差点 可以翻译下http://ffmpeg.org/下载地址: 因为发布时间比较久了 相关代码我也没有保存,如有需要 可以截屏自己打出来吧
素材 2272 1
教程一自媒体视频必备工具ffmpeg:绿色免费快速高效视频处理工具 附上代码

教程一自媒体视频必备工具ffmpeg:绿色免费快速高效视频处理工具 附上代码

这是以前发布的一些ffmpeg的教程,对入门想学这个的小伙伴还是有点帮助的。以前发布在头条,现在还有些小伙伴在问,就放到我自己的网站上来吧ffmpeg 官方地址,有大量的帮助文档可以学习,如果英文差点 可以翻译下http://ffmpeg.org/下载地址: @echo off cd /d "...
素材 2804 0
开源 免费 VideoManager v1.2.5  视频裁剪,标记与搜索结合一体的软件

开源 免费 VideoManager v1.2.5 视频裁剪,标记与搜索结合一体的软件

   VideoManager 视频裁剪,标记与搜索结合一体的软件设计初衷做剪辑往往需要存放大量的素材,通常的方法是直接把源视频放到pr裁剪的。但这样并不会有素材积累,不利于长期发展。 素材用了就丢就忘,想整理但是没有好的裁剪工具,效率太低。分类和搜索太麻烦 如果你很多时间和精力都花在了找素材上,可以试试此软件VideoM...
软件 3796 1
20231221换脸视频演示,几近完美,可远可近,感觉没有什么进步空间了

20231221换脸视频演示,几近完美,可远可近,感觉没有什么进步空间了

演示如上,还是老规矩,换的人脸为AI生成并非真人,上次的演示感觉还是有点毛躁,没有仔细打磨,导致效果还是不是很好,部分路人也被换脸了就有点搞笑了。这次演示耗费了我一下午时间,感觉已近完美了,没有什么进步空间了。连人物的表情都已经很充分了没有那种很僵硬的感觉了。已经顺眼太多了。我感觉已经是这个工具的天花板了。。。上次演示的炫技视频,有不少LS...
开源 3975 2