774
402
1907
163
Spark-TTS语音克隆工具,更好的情绪情感克隆,中文汉化版,新增快速选择参考音频,ASR语音识别,本地一键部署整合包,免安装,解压即用。 夸克网盘下载连接:https://pan.quark.cn/s/f18574e19656 整合包聚合链接:https://exmzfs7zve.feishu.cn/docx/FuPxdArRaofVMWxke2tc8IO9nCh?from=from_copylink 官方项目地址:https://github.com/SparkAudio/Spark-TTS 希望大家多多一键三连,感谢大家的支持。
一个喜欢捣鼓AI的野生UP主
文抑青年
1/47
loading
加载中...
playing
Spark-TTS语音克隆工具,更好的情绪情感克隆,中文汉化版,新增快速选择参考音频,ASR语音识别,本地一键部署整合包,免安装,解压即用。
3.3万播放
F5-TTS-V6.5版本更新,新增了API接口,支持GET/POST方法调用,接入开源阅读,新增了参考音频快速选择,本地一键免安装部署整合包
1.6万播放
自己写的一个内存清理优化工具,可后台自动清理堆积分页文件,释放内存,再也不怕因为内存堆积导致燕云十六帧了
3.5万播放
FaceFusion3.1.1换脸最新版本,支持表情编辑,图片&视频换脸,画质增强,禁用了内容检测,全中文汉化,一键本地部署整合包,解压即用
9509播放
CosyVoice2-0.5BAPI版本,新增API功能,接入了开源阅读,有POST与GET两种API模式,下载增量包覆盖更新即可,一键本地部署整合包
1.5万播放
CosyVoice2-0.5B修复版本,修复了合成长文本输出,启动端口与ASR路径问题,新增了手动识别音频文本功能,支持修改启动端口,一键本地部署整合包
1.5万播放
CosyVoice2-0.5B版本,超强自然语言控制,支持提示词引导,支持多国语言,支持多地方言,支持音色保存,本地一键部署整合包
3万播放
MMAudio-AI生成视频音效配音工具,支持视频提示词生成,文本提示词生成,可自动识别生成音效并合成,创作神器,一键本地部署整合包
6196播放
F5-TTS-V6版本,接入ollama本地大模型,支持语音聊天,字幕翻译/校对,独家功能更新,一键本地部署整合包。
2万播放
Fish-speech-v1.5版本更新,显存占用优化,合成质量提升,新增推理种子固定,优化了参考音频上传,本地一键部署整合包
1.2万播放
F5-TTS-V5.1版本,新增多人多音色字幕配音,新增推理种子固定,增强字幕编辑工具,一键本地部署整合包,下期准备接入本地ollama大模型
6281播放
Open-web-UI-0.4.7版本,更新了提示词补全,新增断网离线使用,开放了局域网访问,添加了一键更新版本功能,无需Docker容器一键本地部署整合包
1.2万播放
CUDA与cuDNN安装教程,总是出现下载整合包后启动出现找不到CUDA的问题,一个视频教会你如何自己安装CUDA加速工具包,内含所需安装包与文档教程。
8765播放
F5-TTS-V5版本 新增中文文本规范化 适配老显卡 解决了阿拉伯英文发音问题,字幕配音新增了AI翻译AI文本校对,接入了智谱大模型API,一键本地部署整合包
5226播放
CatVTON虚拟换装,优化了显存占用,开启显存共享6G可运行,美化了界面,解除了内容检测,一键本地部署整合包中文汉化版
3330播放
F5-TTS-V4版本,新增字幕配音功能,支持提取视频音频,识别语音生成字幕,使用F5进行配音,支持字幕/视频导出,一键本地部署整合包
7015播放
MagicQuill魔术笔图像编辑工具,智能识别,局部重绘,消除,效果非常NICE的图像编辑工具,一键本地部署整合包
4831播放
F5-TTS-V3版本,独家更新按标点符号切分功能,优化了长文本生成出现的杂音电流吞字的问题,更换了界面主题,更改了垃圾缓存目录,一键本地部署增量更新整合包
5530播放
InvokeAI-图像编辑工具,支持SD3.5,FLUX,XL,SD1.5等多种模型,抠图,扩图,文生图,图生图多种功能,一键本地部署整合包
5291播放
HelloMeme 视频表情迁移,图片一键生成表情动画,本地一键部署整合包,解压即用
3426播放
loading
加载中...
客服
顶部