跳到主要內容
buildradar
登入
主題 · speech-recognition

speech-recognition

標記 speech-recognition 主題、收錄中的開源專案,依星數排序。

共 156 個專案
  • whisper-jax@sanchit-gandhi

    JAX 版 OpenAI Whisper 模型實作,可在 TPU 上提升至 70 倍速度

    4,679+0近 7 天星數變化
  • pocketsphinx@cmusphinx

    一個小型語音辨識器

    4,337+0近 7 天星數變化
  • distil-whisper@huggingface

    精簡版 Whisper,語音辨識速度提升 6 倍,體積縮小 50%,字錯誤率下降至 1% 內。

    4,114+0近 7 天星數變化
  • OpenAI Whisper ASR 網路服務 API

    3,328+0近 7 天星數變化
  • 適合不想折騰 Python 的使用者的 Whisper 與 Faster-Whisper 獨立執行檔。

    3,171+0近 7 天星數變化
  • willow@HeyWillow

    開源、本地、可自託管的 Amazon Echo/Google Home 競爭性語音助手替代品

    3,101+0近 7 天星數變化
  • whishper@pluja

    透過網頁 UI 100% 在本地將任何音訊轉錄為文字、翻譯並編輯字幕。由 whisper 模型驅動!

    3,068+0近 7 天星數變化
  • lingvo@tensorflow

    Lingvo

    2,864+0近 7 天星數變化
  • whisper-timestamped@linto-ai

    支援字詞級時間戳記與信心度的多語言自動語音辨識

    2,842+0近 7 天星數變化
  • STT@coqui-ai

    🐸STT - 用於語音轉文字的深度學習工具組。訓練與部署 STT 模型從未如此簡單。

    2,606+0近 7 天星數變化
  • qwen-audio-agent@QwenAudio

    即時語音執行階段,讓 Agent 保持對話、運作與在線狀態。AI Agent 的即時語音執行階段。

    2,379+58近 7 天星數變化
  • 使用 tensorflow 深度學習框架與 sequence-to-sequence 神經網路的語音辨識

    2,173+0近 7 天星數變化
  • parlor@fikrikarim

    具備類似 GPT-Live 功能的裝置端即時多模態 AI

    2,048+0近 7 天星數變化
  • FireRedASR@FireRedTeam

    支援普通話、中文方言與英語的開源工業級 ASR 模型,在公開的普通話 ASR 基準測試中達到全新的 SOTA,同時提供出色的歌唱歌詞辨識能力。

    1,975+0近 7 天星數變化
  • masr@nobody132

    中文語音識別;Mandarin Automatic Speech Recognition;

    1,968+0近 7 天星數變化
  • julius@julius-speech

    開源的大詞彙量連續語音辨識引擎

    1,935+0近 7 天星數變化
  • 精選的 Speaker Diarization 相關論文、函式庫、資料集與其他資源清單。

    1,894+0近 7 天星數變化
  • alan-sdk-ios@alan-ai

    您應用的自我編碼系統 — 用於 iOS 的 Alan AI SDK

    1,878+0近 7 天星數變化
  • 為你的應用程式打造的自我編碼系統 — 適用於 Android 的 Alan AI SDK

    1,807+0近 7 天星數變化
  • whisper-turbo@FL33TW00D

    跨平台、GPU 加速的 Whisper 🏎️

    1,794+0近 7 天星數變化
  • sherpa-ncnn@k2-fsa

    使用新一代 Kaldi 與 ncnn 在無網路連線下進行即時語音辨識與語音活動檢測(VAD)。支援 iOS、Android、Linux、macOS、Windows、Raspberry Pi、VisionFive2、LicheePi4A 等。

    1,777+0近 7 天星數變化
  • 應用程式的自我編碼系統 — 用於 Flutter 的 Alan AI SDK

    1,756+0近 7 天星數變化
  • alan-sdk-ionic@alan-ai

    應用程式的自我編碼系統 — 適用於 Ionic 的 Alan AI SDK

    1,649+0近 7 天星數變化
  • dsnote@mkiol

    Speech Note Linux 應用程式。具備離線語音轉文字、文字轉語音以及機器翻譯的筆記、閱讀與翻譯功能。

    1,622+0近 7 天星數變化
  • 使用 AI 進行本機語音辨識與字幕產生的 OBS 外掛模組

    1,597+0近 7 天星數變化
  • amica@semperai

    Amica 是一個開源介面,用於透過語音合成與語音辨識與 3D 角色進行互動通訊。

    1,591+0近 7 天星數變化
  • 擴充 ComfyUI 功能的自訂節點

    1,525+0近 7 天星數變化
  • SALMONN@bytedance

    SALMONN 系列:一套先進的多模態 LLM

    1,521+0近 7 天星數變化
  • Fun-ASR@QwenAudio

    開源基於 LLM 的中文、方言、口音及多語種語音 ASR 模型家族,具備 FunASR、vLLM、串流與 llama.cpp 執行階段。

    1,512+0近 7 天星數變化
  • SpeechT5@microsoft

    用於口語語言處理的統一模態語音文字預訓練

    1,449+0近 7 天星數變化
← 返回主題列表