【DynamiCrafter】一键包 超强视频生成项目
【SenseVoice】一键包 阿里开源语音识别 高精度、多语言、情感辨识和音频事件检测
【HeyGem】一键包 windows直接运行 无需docker 硅基开源数字人
OpenAvatarChat 一键包 api版 阿里开源实时交互数字人 低延迟、多模态模型、模块化设计
【CogAgent】一键包 带Agent能力的视觉模型
【ChatGLM3-6B】本地部署一键包 带训练版
Z-Image 一键包 终于开源,说到做到 阿里开源Z的基座模型 4G显存可用 支持50系 支持旧显卡
【Qwen2】一键包 阿里开源新模型 5种参数任君选择
【二维码】AI优化教程(封面就是成品图)
【GLM-4】一键包 智谱AI开源新模型 已添加自适配代码
【MagicAnimate】本地部署一键包 pose生成版 点开即用
【Langchain-Chatchat】本地部署一键包 支持ChatGLM3
IndexTTS2 一键包 B站超强音频克隆更新啦 8G显存可用 支持旧显卡 支持50系 在情感表达和时长控制方面取得突破的自回归零样本文本合成系统
随变 SD2
【Whisper-WebUI】本地部署一键包 离线识别字幕
VoxCPM2 20亿参数,30种语言,音色设计与可控声音克隆,48kHz 音频输出!
SD2
HyperFrames 一句话生成视频
daVinci-MagiHuman 人称小sd2.0的达芬奇-魔法人