项目竞品
共找到 20 个竞品AUTOMATIC1111/stable-diffusion-webui
Stable Diffusion网页界面
Comfy-Org/ComfyUI
最强大且模块化的扩散模型图形用户界面、应用程序接口及后端,提供基于图或节点的交互界面。
unslothai/unsloth
大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存
DrewThomasson/ebook2audiobook
从电子书生成有声书,支持语音克隆及1107种以上语言!
NVIDIA-NeMo/NeMo
专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架
OpenBMB/VoxCPM
VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统
GetStream/Vision-Agents
Stream 推出的开放视觉智能体平台。使用任意模型或视频提供商快速构建视觉智能体。利用 Stream 的边缘网络实现超低延迟。
hao-ai-lab/FastVideo
面向加速视频生成的统一推理与训练后处理框架
Tencent-Hunyuan/HunyuanImage-3.0
HunyuanImage-3.0:一个强大的原生多模态图像生成模型
GVCLab/PersonaLive
[CVPR 2026] PersonaLive!:面向直播的富有表现力肖像图像动画
HKUDS/ViMax
ViMax:全能型智能体视频生成系统(集成导演、编剧、制片与视频生成功能)
mudler/LocalAI
🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。
mcmonkeyprojects/SwarmUI
SwarmUI(前称StableSwarmUI),一款模块化Stable Diffusion网络用户界面,重点实现功能工具的便捷访问、高性能与可扩展性。
mastra-ai/mastra
TypeScript AI智能体框架 ⚡ 支持助手、RAG和可观测性。兼容所有大语言模型:GPT-4、Claude、Gemini、Llama
readest/readest
Readest是一款功能丰富的现代电子书阅读器,专为热爱阅读的用户设计,提供无缝跨平台访问、强大工具和直观界面,以提升您的阅读体验。
duixcom/Duix-Avatar
🚀 真正开源的 AI 数字人工具包,支持离线视频生成与数字人克隆
rhasspy/piper
一款快速、本地的神经文本转语音系统
krillinai/KrillinAI
基于大语言模型的视频翻译配音工具,支持99种语言双向翻译,提供一键式全流程部署,可生成适配YouTube、TikTok和Shorts等平台的内容
LykosAI/StabilityMatrix
稳定扩散跨平台包管理器
leejet/stable-diffusion.cpp
纯C/C++实现的扩散模型(SD/Flux/Wan等)推理框架
相关项目推荐
public-apis/public-apis
免费API资源汇总列表
EbookFoundation/free-programming-books
📚 免费提供的编程书籍
donnemartin/system-design-primer
学习如何设计大规模系统。为系统设计面试做准备。包含Anki记忆卡片。
vinta/awesome-python
精心整理的优质Python框架、库、软件及资源列表
TheAlgorithms/Python
所有算法均使用Python实现
Significant-Gravitas/AutoGPT
AutoGPT致力于实现人人可用的普惠AI,让每个人都能使用和构建AI。我们的使命是提供工具,让您专注于重要事务。