tts

共找到 10 个相关项目

unslothai/unsloth

大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存

52k
4.4k
129
+538
排名 #19
2月22日
查看详情

mudler/LocalAI

🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。

43k
3.6k
69
+49
排名 #16
2月23日
查看详情

mastra-ai/mastra

TypeScript AI智能体框架 ⚡ 支持助手、RAG和可观测性。兼容所有大语言模型:GPT-4、Claude、Gemini、Llama

21k
1.5k
60
+309
排名 #15
2月12日
查看详情

DrewThomasson/ebook2audiobook

从电子书生成有声书,支持语音克隆及1107种以上语言!

18k
1.5k
63
+622
排名 #13
2月15日
查看详情

readest/readest

Readest是一款功能丰富的现代电子书阅读器,专为热爱阅读的用户设计,提供无缝跨平台访问、强大工具和直观界面,以提升您的阅读体验。

18k
976
82
+494
排名 #15
2月23日
查看详情

NVIDIA-NeMo/NeMo

专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架

16k
3.3k
51
+11
排名 #7
2月19日
查看详情

rhasspy/piper

一款快速、本地的神经文本转语音系统

10k
911
76
+51
排名 #20
2月23日
查看详情

OpenBMB/VoxCPM

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

5.9k
707
101
+1.5k
排名 #11
2月10日
查看详情

GetStream/Vision-Agents

Stream 推出的开放视觉智能体平台。使用任意模型或视频提供商快速构建视觉智能体。利用 Stream 的边缘网络实现超低延迟。

5.8k
462
40
+953
排名 #11
2月14日
查看详情

Blaizzy/mlx-audio-swift

一个用于在Apple Silicon上使用MLX进行音频处理的模块化Swift SDK

209
26
67
+82
排名 #10
2月15日
查看详情
助手