speech-recognition
标记 speech-recognition 主题、收录中的开源项目,按星标数排序。
- #31
JAX 版 OpenAI Whisper 模型实现,可在 TPU 上提升至 70 倍速度
★ 4,679+0近 7 天星标变化 - #32
一个小型语音识别器
★ 4,337+0近 7 天星标变化 - #33
精简版 Whisper,语音识别速度提升 6 倍,体积缩小 50%,字错误率下降至 1% 内。
★ 4,114+0近 7 天星标变化 - #34
OpenAI Whisper ASR 网络服务 API
★ 3,328+0近 7 天星标变化 - #35
适合不想折腾 Python 的用户的 Whisper 与 Faster-Whisper 独立可执行文件。
★ 3,171+0近 7 天星标变化 - #36★ 3,101+0近 7 天星标变化
- #37★ 3,068+0近 7 天星标变化
- #38★ 2,864+0近 7 天星标变化
- #39
支持词级时间戳和置信度的多语言自动语音识别
★ 2,842+0近 7 天星标变化 - #40★ 2,606+0近 7 天星标变化
- #41
实时语音运行时,让 Agent 保持对话、运作与在线状态。AI Agent 的实时语音运行时。
★ 2,400+58近 7 天星标变化 - #42
使用 tensorflow 深度学习框架与 sequence-to-sequence 神经网络的语音识别
★ 2,173+0近 7 天星标变化 - #43★ 2,048+0近 7 天星标变化
- #44
支援普通话、中文方言与英语的开源工业级 ASR 模型,在公开的普通话 ASR 基准测试中达到全新的 SOTA,同时提供出色的歌唱歌词辨识能力。
★ 1,975+0近 7 天星标变化 - #45★ 1,968+0近 7 天星标变化
- #46★ 1,935+0近 7 天星标变化
- #47
精选的 Speaker Diarization 相关论文、库、数据集和其他资源列表。
★ 1,894+0近 7 天星标变化 - #48
您应用的自我编码系统 — 用于 iOS 的 Alan AI SDK
★ 1,878+0近 7 天星标变化 - #49
为你的应用程序打造的自我编码系统 — 适用于 Android 的 Alan AI SDK
★ 1,807+0近 7 天星标变化 - #50
跨平台、GPU 加速的 Whisper 🏎️
★ 1,794+0近 7 天星标变化 - #51
使用新一代 Kaldi 与 ncnn 在无网络连接下进行实时语音识别与语音活动检测(VAD)。支持 iOS、Android、Linux、macOS、Windows、Raspberry Pi、VisionFive2、LicheePi4A 等。
★ 1,777+0近 7 天星标变化 - #52
应用程序的自我编码系统 — 用于 Flutter 的 Alan AI SDK
★ 1,756+0近 7 天星标变化 - #53
应用程序的自我编码系统 — 适用于 Ionic 的 Alan AI SDK
★ 1,649+0近 7 天星标变化 - #54★ 1,622+0近 7 天星标变化
- #55
使用 AI 进行本地语音识别与字幕生成的 OBS 插件
★ 1,597+0近 7 天星标变化 - #56★ 1,591+0近 7 天星标变化
- #57
扩展 ComfyUI 功能的自定义节点
★ 1,525+0近 7 天星标变化 - #58★ 1,521+0近 7 天星标变化
- #59★ 1,512+0近 7 天星标变化
- #60★ 1,449+0近 7 天星标变化