GitHub 热搜 小白版
← 返回榜单

Swift调用顶尖开源模型实现语音转文字和识别

FluidInference/FluidAudio
★★☆☆☆ 1.9/5 新手推荐度 · 上手成本中等 · 热度适中 · 中文简介

📱 移动开发  · 用 Swift 写的

Frontier CoreML audio models in your apps — text-to-speech, speech-to-text, voice activity detection, and speaker diarization. In Swift, powered by SOTA open source.
2757 热度
409 分支
+6 今日新增
去 GitHub 看看 ↗

✨ AI 亮点解析

📦 是什么
用Swift调AI模型做语音转文字和识别
🩹 解决什么
苹果设备上做语音识别太麻烦又贵
🎯 适合谁
想给iPhone/iPad加语音功能的开发者
苹果付费语音API的免费替代方案
🛠 上手成本:需装 Docker 或依赖(中等)
  • 支持说话人分离,能分清谁在说话
  • 自动检测语音活动,省电又省流量
  • 集成最新开源模型,效果接近商业级
  • 纯Swift实现,苹果设备上跑得流畅
你可以用它在苹果App里加语音转文字、语音助手、录音转笔记等功能,不用交苹果年费,还能离线使用。

📈 热度增长趋势