项目竞品
共找到 20 个竞品Blaizzy/mlx-audio
一个基于苹果MLX框架构建的文本转语音、语音转文本及语音转语音库,可在Apple Silicon芯片上实现高效语音分析。
dinoki-ai/osaurus
原生支持Apple Silicon的LLM服务器,具备MCP支持。
ml-explore/mlx-swift-examples
MLX Swift 使用示例集
unslothai/unsloth
大语言模型微调与强化学习 🦥 以2倍速度训练OpenAI gpt-oss、Qwen3、Llama 4、DeepSeek-R1、Gemma 3,节省70%显存
rhasspy/piper
一款快速、本地的神经文本转语音系统
k2-fsa/sherpa-onnx
基于新一代Kaldi与onnxruntime的离线语音转文字、文字转语音、说话人日志、语音增强、源分离及语音活动检测技术。支持嵌入式系统、Android、iOS、HarmonyOS、树莓派、RISC-V架构、x86_64服务器、WebSocket服务端/客户端,兼容12种编程语言。
OpenBMB/VoxCPM
VoxCPM:面向上下文感知语音生成与逼真音色克隆的无分词器文本转语音系统
GetStream/Vision-Agents
Stream 推出的开放视觉智能体平台。使用任意模型或视频提供商快速构建视觉智能体。利用 Stream 的边缘网络实现超低延迟。
pluja/whishper
通过网页界面100%本地化地将任意音频转录为文本,翻译并编辑字幕。由whisper模型驱动!
ggml-org/whisper.cpp
OpenAI Whisper模型的C/C++移植版本
mudler/LocalAI
🤖 开源免费的OpenAI、Claude及其他AI平台的替代方案。支持自主托管且本地优先,可作为OpenAI的即插即用替代方案运行于消费级硬件,无需GPU。兼容gguf、transformers、diffusers等多种模型架构。功能包括:文本生成、音频处理、视频制作、图像生成、语音克隆、分布式点对点推理。
ml-explore/mlx
MLX:适用于 Apple 芯片的数组框架
mastra-ai/mastra
TypeScript AI智能体框架 ⚡ 支持助手、RAG和可观测性。兼容所有大语言模型:GPT-4、Claude、Gemini、Llama
m-bain/whisperX
WhisperX:具备词级时间戳标注的自动语音识别系统
DrewThomasson/ebook2audiobook
从电子书生成有声书,支持语音克隆及1107种以上语言!
readest/readest
Readest是一款功能丰富的现代电子书阅读器,专为热爱阅读的用户设计,提供无缝跨平台访问、强大工具和直观界面,以提升您的阅读体验。
NVIDIA-NeMo/NeMo
专为从事大语言模型、多模态和语音人工智能(自动语音识别与文本转语音)的研究人员和开发者打造的可扩展生成式AI框架
cjpais/Handy
完全离线的免费开源可扩展语音转文本应用程序
Zackriya-Solutions/meeting-minutes
一款免费开源、基于人工智能的自托管实时会议记录与纪要生成工具,可完全在本地设备运行(已支持Mac OS和Windows系统,即将新增Linux支持)https://meetily.zackriya.com/ 这就是meetly ai
espeak-ng/espeak-ng
eSpeak NG是开源语音合成器,支持上百种语言和口音
相关项目推荐
vsouza/awesome-ios
精选的优质 iOS 生态系统列表,包含 Objective-C 和 Swift 项目
iina/iina
适用于 macOS 的现代视频播放器。
Alamofire/Alamofire
Swift 中的优雅 HTTP 网络框架
exelban/stats
菜单栏内的 macOS 系统监视器
utmapp/UTM
适用于 iOS 与 macOS 的虚拟机
MonitorControl/MonitorControl
🖥 像控制原生苹果显示器那样控制 Mac 的显示器亮度和音量。使用苹果键盘按键或自定义快捷键,显示原生 macOS 屏幕显示控件