asr
標記 asr 主題、收錄中的開源專案,依星數排序。
相關主題
常跟 asr 一起出現在同一個專案上的主題。
近期新秀
近 90 天內建立、標記 asr 主題的專案。
- #1★ 2,214
- #2★ 1,014
- #3
Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.
★ 502 - #4
早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.
★ 327
- #1★ 23,864+61近 7 天星數變化
- #2★ 20,136+64近 7 天星數變化
- #3★ 18,379+21近 7 天星數變化
- #4★ 15,101+17近 7 天星數變化
- #5
使用次世代 Kaldi 與 onnxruntime 的語音轉文字、文字轉語音、說話者分離、語音增強、聲源分離與 VAD,支援離線運行。支援嵌入式系統、Android、iOS、HarmonyOS、Raspberry Pi、RISC‑V、RK NPU、Axera NPU、Ascend NPU、x86_64 伺服器、WebSocket 伺服器/客戶端,支援 12 種程式語言
★ 14,575+95近 7 天星數變化 - #6
易用的語音工具包,包含自監督學習模型、SOTA/串流 ASR(含標點)、串流 TTS(含文字前端)、說話者驗證系統、端到端語音翻譯與關鍵詞偵測。榮獲 NAACL2022 最佳示範獎
★ 12,676+5近 7 天星數變化 - #7
基於 PyTorch 的語音工具包
★ 11,802+10近 7 天星數變化 - #8
開源 SenseVoiceSmall 模型,支援中文(普通話、粵語)、英文、日文與韓文的語音辨識、語言識別、情緒辨識與音訊事件偵測。
★ 9,209+37近 7 天星數變化 - #9
這是一個 Python API,可取得指定 YouTube 影片的文字稿/字幕,支援自動產生的字幕,且不需要 API 金鑰或無頭瀏覽器,與其他基於 Selenium 的解決方案不同
★ 8,143+14近 7 天星數變化 - #10
🤖 wukong-robot 是一個簡單、靈活、優雅的中文語音對話機器人/智能音箱專案,支援 ChatGPT 多輪對話功能,亦可能是首個支援腦機交互的開源智能音箱專案
★ 7,126+2近 7 天星數變化 - #11★ 6,210+13近 7 天星數變化
- #12
基於 OpenAI Whisper 的自動語音識別與說話者分離
★ 5,634+1近 7 天星數變化 - #13
html5 js 录音 mp3 wav ogg webm amr g711a g711u 格式,支持 PC 和 Android、iOS 部分 Web 浏览器、Hybrid App(提供 Android iOS App 源码)、微信,提供 ASR 语音识别转文字 H5 版语音通话聊天示例 DTMF 编码解码
★ 5,631+3近 7 天星數變化 - #14★ 5,229+1近 7 天星數變化
- #15★ 4,070+12近 7 天星數變化
- #16
Streamer-Sales 销冠 —— 卖货主播 LLM 大模型🛒🎁,一個能夠根據給定的商品特點從激發用戶購買意願角度出發進行商品解說的賣貨主播大模型。🚀⭐內含詳細的數據生成流程❗ 📦另外還集成了 LMDeploy 加速推理🚀、RAG檢索增強生成 📚、TTS文字轉語音🔊、數字人生成 🦸、Agent 使用網路查詢實時資訊🌐、ASR 語音轉文字🎙️、Vue 生態搭建前端🍍、FastAPI 搭建後端🗝️、Docker-compose 打包部署🐋
★ 3,764+1近 7 天星數變化 - #17★ 3,403+44近 7 天星數變化
- #18
OpenAI Whisper ASR 網路服務 API
★ 3,328+2近 7 天星數變化 - #19
適合不想折騰 Python 的使用者的 Whisper 與 Faster-Whisper 獨立執行檔。
★ 3,171+2近 7 天星數變化 - #20★ 3,061+164近 7 天星數變化
- #21
使用 PySide6 的 faster_whisper 圖形使用者介面
★ 2,995+4近 7 天星數變化 - #22★ 2,864+0近 7 天星數變化
- #23
支援字詞級時間戳記與信心度的多語言自動語音辨識
★ 2,842+1近 7 天星數變化 - #24
在你的應用程式中使用前沿的 CoreML 音訊模型——文字轉語音、語音轉文字、語音活動偵測與發言者分離。使用 Swift 開發,由 SOTA 開源技術驅動。
★ 2,723+13近 7 天星數變化 - #25★ 2,606+1近 7 天星數變化
- #26
快速提取音視頻內容,整理成一份結構化的markdown筆記
★ 2,483+7近 7 天星數變化 - #27★ 2,214+115近 7 天星數變化
- #28
支援普通話、中文方言與英語的開源工業級 ASR 模型,在公開的普通話 ASR 基準測試中達到全新的 SOTA,同時提供出色的歌唱歌詞辨識能力。
★ 1,975+2近 7 天星數變化 - #29
支援 16 種以上模型家族的 ggml 語音轉文字推理
★ 1,872+19近 7 天星數變化 - #30★ 1,816+5近 7 天星數變化