跳到主要內容
buildradar
登入
主題 · speech-recognition

speech-recognition

標記 speech-recognition 主題、收錄中的開源專案,依星數排序。

共 156 個專案
  • 💎 適用於 ASR、TTS 及其他語音技術的無障礙語音語料庫清單

    1,399+0近 7 天星數變化
  • mlx-tune@ARahim3

    在配備 Apple Silicon 的 Mac 上微調 LLMs。支援 SFT、DPO、GRPO、Vision、TTS、STT、Embedding 與 OCR 微調 —— 基於 MLX 原生實現。相容 Unsloth API。

    1,398+0近 7 天星數變化
  • CrisperWhisper@nyrahealth

    可控制的轉錄。逐字(包含每個填補詞、停頓、口吃、聲音)或意圖(說話者想表達的意思,針對可讀性優化),並帶有單詞級別的時間戳記。

    1,371+0近 7 天星數變化
  • whisper-ctranslate2@Softcatala

    基於 CTranslate2、相容於原始 OpenAI 用戶端的 Whisper 命令列用戶端。

    1,346+0近 7 天星數變化
  • J.A.R.V.I.S@GauravSingh9356

    使用 Python 庫建構的個人助理。它幾乎可以做任何事情,包括傳送電子郵件、光學文字辨識、透過 API 整合隨時動態播報新聞、待辦事項清單產生器、僅透過語音指令開啟任何網站、播放音樂、維基百科搜尋、具有智慧感知功能的辭典(即自動拼字檢查)、天氣報告(即溫度、風速、濕度)

    1,341+0近 7 天星數變化
  • voxtype@peteonrails

    適用於 Wayland 複合管理器的按住發言語音轉文字工具

    1,338+0近 7 天星數變化
  • StreamSpeech@ictnlp

    StreamSpeech 是一個用於離線與同步語音辨識、語音翻譯及語音合成的「一體化」無縫模型。

    1,288+0近 7 天星數變化
  • pruna@PrunaAI

    Pruna 是一個為開發者打造的模型優化框架,讓你能以極低的額外開銷交付更快、更高效的模型。

    1,274+0近 7 天星數變化
  • vosk-server@alphacep

    基於 Vosk 與 Kaldi 庫的 WebSocket、gRPC 和 WebRTC 語音辨識伺服器

    1,262+0近 7 天星數變化
  • Whisper-Finetune@yeyupiaoling

    微調 Whisper 語音辨識模型,支援無時間戳資料訓練、有時間戳資料訓練以及無語音資料訓練。加速推論並支援 Web 部署、Windows 桌面部署與 Android 部署

    1,222+0近 7 天星數變化
  • quillman@modal-labs

    一個語音聊天應用程式

    1,212+0近 7 天星數變化
  • Treasure-of-Transformers@ashishpatel26

    💁 自然語言處理 Transformers 模型精選寶庫,包含論文、影片、部落格、官方儲存庫以及 Colab 筆記本。 🛫☑️

    1,179+0近 7 天星數變化
  • 使用 Apple Foundation Models 框架建構、測試與評估應用程式的實作實驗室。

    1,178+0近 7 天星數變化
  • lotti@matthiasn

    配備個人 AI 助理團隊的私人日誌。AI 會讀取你的記錄並建議下一步行動——由你批准變更。在你的裝置之間進行端對端加密同步——伺服器永遠只能看到密文。可選用本機 AI。

    1,168+0近 7 天星數變化
  • speech-swift@soniqo

    適用於 Apple Silicon 的 AI 語音工具組 — 由 MLX 與 CoreML 驅動的 ASR、TTS、語音轉語音、VAD 與說話者分段

    1,161+0近 7 天星數變化
  • Irina - 離線執行的俄語語音助理。透過外掛程式支援技能。

    1,153+0近 7 天星數變化
  • lhotse@lhotse-speech

    用於在機器學習專案中處理多模態資料的工具。

    1,149+0近 7 天星數變化
  • 應用程式的自我編碼系統 — 適用於 Cordova 的 Alan AI SDK

    1,132+0近 7 天星數變化
  • conformer@sooftware

    [非官方] 「Conformer: Convolution-augmented Transformer for Speech Recognition」(INTERSPEECH 2020) 的 PyTorch 實作

    1,132+0近 7 天星數變化
  • sglang-omni@sgl-project

    SGLang-Omni 為 TTS、ASR、語音與全能模型提供高效能服務。

    1,118+56近 7 天星數變化
  • AI-Waifu-Vtuber@ardha27

    用於在 Youtube/Twitch 上進行串流直播的 AI Vtuber

    1,116+3近 7 天星數變化
  • Whisperboard@Saik0s

    這是一款開源的 iOS 應用程式,讓行動裝置上的高品質語音轉錄變得更容易取得。

    1,102+6近 7 天星數變化
  • whisper-writer@savbell

    💬📝 使用 OpenAI 的 Whisper 語音辨識模型的輕量語音聽寫應用程式。

    1,100+0近 7 天星數變化
  • 基於 Kaldi 工具包與 GStreamer 架構的即時全雙工語音辨識伺服器。

    1,094+1近 7 天星數變化
  • 使用 Vosk 函式庫為 Android 提供離線語音辨識。

    1,057+1近 7 天星數變化
  • pykaldi@pykaldi

    Kaldi 的 Python 包裝器

    1,040+1近 7 天星數變化
  • TensorFlowASR@TensorSpeech

    ⚡ TensorFlowASR:Tensorflow 2 中幾乎達 SOTA 的自動語音辨識。支援使用字元或子字的語言

    1,010+0近 7 天星數變化
  • StoryToolkitAI@octimot

    使用 AI 進行逐字稿轉錄、內容理解與影片中任意內容搜尋的編輯工具,已整合 ChatGPT 與其他 AI 模型

    1,009+1近 7 天星數變化
  • sherpa@k2-fsa

    基於新一代 Kaldi 的語音轉文字伺服器框架

    985+4近 7 天星數變化
  • VoiceStreamAI@alesaccoia

    使用自託管 Whisper 與 WebSocket 在 Python/JS 中實現近即時音訊轉錄。

    960+0近 7 天星數變化
← 返回主題列表