项目竞品

共找到 14 个竞品
k2-fsa

k2-fsa/sherpa-onnx

10.3k 1.2k

基于新一代Kaldi与onnxruntime的离线语音转文字、文字转语音、说话人日志、语音增强、源分离及语音活动检测技术。支持嵌入式系统、Android、iOS、HarmonyOS、树莓派、RISC-V架构、x86_64服务器、WebSocket服务端/客户端,兼容12种编程语言。

C++ text-to-speech
相似度
33%
+34
OpenBMB

OpenBMB/VoxCPM

5.9k 707

VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统

Python speech-synthesis text-to-speech tts
相似度
100%
+1.5k
unslothai

unslothai/unsloth

52.6k 4.4k

大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存

Python text-to-speech tts
相似度
67%
+538
NVIDIA-NeMo

NVIDIA-NeMo/NeMo

16.8k 3.3k

专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架

Python speech-synthesis tts
相似度
67%
+11
espeak-ng

espeak-ng/espeak-ng

6.1k 1.2k

eSpeak NG是开源语音合成器,支持上百种语言和口音

C speech-synthesis text-to-speech
相似度
67%
+34
Blaizzy

Blaizzy/mlx-audio

5.7k 411

一个基于苹果MLX框架构建的文本转语音、语音转文本及语音转语音库,可在Apple Silicon芯片上实现高效语音分析。

Python speech-synthesis text-to-speech
相似度
67%
+2.0k
Blaizzy

Blaizzy/mlx-audio-swift

209 26

一个用于在Apple Silicon上使用MLX进行音频处理的模块化Swift SDK

Swift text-to-speech tts
相似度
67%
+82
mudler

mudler/LocalAI

43.0k 3.6k

🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。

Go tts
相似度
33%
+49
mastra-ai

mastra-ai/mastra

21.1k 1.5k

TypeScript AI智能体框架 ⚡ 支持助手、RAG和可观测性。兼容所有大语言模型:GPT-4、Claude、Gemini、Llama

TypeScript tts
相似度
33%
+309
DrewThomasson

DrewThomasson/ebook2audiobook

18.2k 1.5k

从电子书生成有声书,支持语音克隆及1107种以上语言!

Python tts
相似度
33%
+622
readest

readest/readest

18.1k 976

Readest是一款功能丰富的现代电子书阅读器,专为热爱阅读的用户设计,提供无缝跨平台访问、强大工具和直观界面,以提升您的阅读体验。

TypeScript tts
相似度
33%
+494
GetStream

GetStream/Vision-Agents

5.8k 462

Stream 推出的开放视觉智能体平台。使用任意模型或视频提供商快速构建视觉智能体。利用 Stream 的边缘网络实现超低延迟。

Python tts
相似度
33%
+953
huggingface

huggingface/speech-to-speech

4.4k 500

语音转语音:致力于构建开源模块化GPT4-o的项目

Python speech-synthesis
相似度
33%
+35
stakira

stakira/OpenUtau

3.5k 448

开放歌声合成平台/开源UTAU后继项目

C# speech-synthesis
相似度
33%
+3
助手