Swift调用顶尖开源模型实现语音转文字和识别
FluidInference/FluidAudio
📱 移动开发 · 用 Swift 写的
Frontier CoreML audio models in your apps — text-to-speech, speech-to-text, voice activity detection, and speaker diarization. In Swift, powered by SOTA open source.
✨ AI 亮点解析
📦 是什么
用Swift调AI模型做语音转文字和识别
🩹 解决什么
苹果设备上做语音识别太麻烦又贵
🎯 适合谁
想给iPhone/iPad加语音功能的开发者
苹果付费语音API的免费替代方案
🛠 上手成本:需装 Docker 或依赖(中等)
- 支持说话人分离,能分清谁在说话
- 自动检测语音活动,省电又省流量
- 集成最新开源模型,效果接近商业级
- 纯Swift实现,苹果设备上跑得流畅
你可以用它在苹果App里加语音转文字、语音助手、录音转笔记等功能,不用交苹果年费,还能离线使用。