跳到主要內容
buildradar
Sign in
主題 · speech

speech

標記 speech 主題、收錄中的開源專案,依星數排序。

專案數
74
總星數
379,927
平均星數
5,134
佔比
0.02%

常跟 speech 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 speech 主題的專案。

近 90 天內還沒有新專案標記這個主題。

  • TTS@coqui-ai

    🐸💬 - 用於文字轉語音的深度學習工具包,已在研究與生產環境中驗證

    45,985+18近 7 天星數變化
  • MockingBird@babysor

    🚀在 5 秒內克隆聲音,實時產生任意語音

    36,912+0近 7 天星數變化
  • VoxCPM@OpenBMB

    VoxCPM2:無需分詞器的多語言語音合成、創意語音設計與真實感克隆

    36,595+345近 7 天星數變化
  • whisperX@m-bain

    WhisperX:具備單字層級時間戳記(及說話者分割)的自動語音辨識

    23,864+61近 7 天星數變化
  • datasets@huggingface

    🤗 最大的 AI 模型即用資料集中心,提供快速、易用且高效的資料操作工具

    21,888+10近 7 天星數變化
  • Grounded-Segment-Anything@IDEA-Research

    Grounded SAM:結合 Grounding DINO、Segment Anything、Stable Diffusion 與 Recognize Anything,自動偵測、分割與生成任意內容。

    17,719+6近 7 天星數變化
  • kaldi@kaldi-asr

    kaldi-asr/kaldi 是 Kaldi 專案的官方位置。

    15,474+3近 7 天星數變化
  • speech-to-speech@huggingface

    使用開源模型構建語音代理

    13,015+82近 7 天星數變化
  • AudioGPT@AIGC-Audio

    AudioGPT:理解與生成語音、音樂、聲音與虛擬人物影像

    10,168+2近 7 天星數變化
  • silero-vad@snakers4

    Silero VAD:預訓練的企業級語音活動偵測器

    10,112+29近 7 天星數變化
  • modelscope@modelscope

    ModelScope:將模型即服務(Model-as-a-Service)的概念落實。

    9,121+4近 7 天星數變化
  • EmotiVoice@netease-youdao

    EmotiVoice 😊:多聲音與提示控制的文字轉語音引擎

    8,522-1近 7 天星數變化
  • models@PaddlePaddle

    官方維護,由 PaddlePaddle 支援,涵蓋 CV、NLP、語音、推薦、時間序列、大模型等領域

    6,933+1近 7 天星數變化
  • annyang@TalAter

    💬 你網站的語音識別

    6,815-1近 7 天星數變化
  • silero-models@snakers4

    Silero 模型:讓預訓練文字轉語音模型變得極度簡單

    6,084-1近 7 天星數變化
  • cactus@cactus-compute

    量化、核心、執行時與推論引擎,適用於行動裝置、穿戴裝置、智慧家庭與機器人。

    5,975+20近 7 天星數變化
  • whisper-diarization@MahmoudAshraf97

    基於 OpenAI Whisper 的自動語音識別與說話者分離

    5,634+1近 7 天星數變化
  • stt@jianchang512

    語音辨識轉文字工具 / 一個離線運行的本地音視頻轉字幕工具,輸出 json、srt 字幕、純文字格式

    4,780+9近 7 天星數變化
  • DeepFilterNet@Rikorose

    使用深度過濾的噪音抑制

    4,655+19近 7 天星數變化
  • ultravox@fixie-ai

    一個快速的多模態 LLM,用於實時語音

    4,562+6近 7 天星數變化
  • ClearerVoice-Studio@modelscope

    一套 AI 驅動的語音處理工具包與開源 SOTA 預訓練模型,支援語音增強、分離與目標說話人提取等功能

    4,458+9近 7 天星數變化
  • metavoice-src@metavoiceio

    面向人類般表達式TTS的基礎模型

    4,203-1近 7 天星數變化
  • Applio@IAHispano

    A simple, high-quality voice conversion tool focused on ease of use and performance.

    3,674+14近 7 天星數變化
  • Amazing-Python-Scripts@avinashkranjan

    🚀 精選 Python 腳本,從基礎到進階,包含自動化任務腳本

    3,664+1近 7 天星數變化
  • OpenAI Whisper ASR 網路服務 API

    3,328+2近 7 天星數變化
  • iOS-10-Sampler@shu223

    iOS 10 新 API 的程式碼範例。

    3,272-1近 7 天星數變化
  • audio@pytorch

    基於 PyTorch 的音訊信號處理數據操作與轉換

    2,933+2近 7 天星數變化
  • lingvo@tensorflow

    Lingvo

    2,864+0近 7 天星數變化
  • aeneas@readbeyond

    aeneas 是一個 Python/C 函式庫與工具集,用於自動同步音訊與文字(即強制對齊)

    2,862+0近 7 天星數變化
  • whisper-timestamped@linto-ai

    支援字詞級時間戳記與信心度的多語言自動語音辨識

    2,842+1近 7 天星數變化
← 返回主題列表