跳到主要內容
buildradar
登入
主題 · tts

tts

標記 tts 主題、收錄中的開源專案,依星數排序。

共 191 個專案
  • alexandria-audiobook@Finrandojin

    AI 驅動的多語音有聲書產生器 — LLM 腳本註解、語音複製、語音設計、LoRA 訓練、逐行風格控制,以及匯出為 MP3、分章 M4B 或 Audacity 多軌。基於 Qwen3-TTS 構建。

    1,003+10近 7 天星數變化
  • lobe-vidol@lobehub

    🧸 Lobe Vidol - 讓虛擬偶像觸手可及

    986+1近 7 天星數變化
  • Step-Audio-EditX@stepfun-ai

    強大的 3B 參數、基於 LLM 的強化學習音訊編輯模型,擅長編輯情感、說話風格與副語言學,並具備強大的零樣本文字轉語音功能

    974+1近 7 天星數變化
  • NISQA@gabrielmittag

    NISQA - 非侵入式語音品質與 TTS 自然度評估

    974+4近 7 天星數變化
  • epub2tts@aedocw

    將 epub 或文字檔案轉換為有聲書

    957-1近 7 天星數變化
  • audio-ai-hub@BinWang28

    語音 AI 研究中樞:涵蓋語音 LLM、語音識別、TTS、音樂與語音生成的論文、開源模型、基準測試與資料集。

    953+2近 7 天星數變化
  • 讓任何相容 SAPI 5 的應用程式都能使用 Azure 自然 TTS 語音。

    936+7近 7 天星數變化
  • FireRedTTS@FireRedTeam

    一個由 LLM 驅動的開源基礎 TTS 系統

    919-1近 7 天星數變化
  • SmartJavaAI@geekwenjie

    🔥🔥🔥Java免費離線AI演算法工具箱,支援人臉識別、活體檢測、表情識別、目標檢測、實例分割、行人檢測、OCR文字識別、車牌識別、表格識別、ASR+TTS、機器翻譯等功能,Maven引用即可使用。支援PyTorch、Tensorflow,已整合 Mtcnn、InsightFace、SeetaFace6、YOLOv8~v12、PaddleOCR(PPOCRv5)、Whisper等主流模型

    911+4近 7 天星數變化
  • mosec@mosecorg

    高效能的 ML 模型服務框架,提供動態批次處理與 CPU/GPU 管線,充分發效能。

    902+0近 7 天星數變化
  • xtts-webui@daswer123

    用於使用 XTTS 及其微調的 Webui

    896+1近 7 天星數變化
  • diffwave@lmnt-com

    DiffWave 是一個快速、高品質的神經聲碼器與波形合成器。

    884-1近 7 天星數變化
  • pdf-to-podcast@NVIDIA-AI-Blueprints

    將 PDF 轉換為 AI 播客,以製作引人入勝的隨身音訊內容。

    875+0近 7 天星數變化
  • Easy-Voice-Toolkit@Spr-Aachen

    一個使用者友善的語音辨識、轉錄、轉換等工具箱 | 简单易用的语音工具箱

    873+0近 7 天星數變化
  • bark.cpp@PABannier

    C/C++ 版本的 Suno AI Bark 模型,用於快速文字轉語音生成

    868+2近 7 天星數變化
  • esp-ai@wangzongming

    最簡單且成本最低的 AI 整合方案。如果你喜歡這個專案,請給它一個 Star~

    856+1近 7 天星數變化
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    835+11近 7 天星數變化
  • anything2explainer@Vincentwei1021

    Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.

    830近 7 天星數變化
  • Kokoros@lucasjinreal

    🔥🔥 用 Rust 實現的 Kokoro。https://huggingface.co/hexgrad/Kokoro-82M 有史以來速度極快、即時且高品質的 TTS。

    822+4近 7 天星數變化
  • 在原生環境與瀏覽器中執行的 Voxtral ASR 與 TTS。使用 Burn ML 框架實作的 Mistral Voxtral mini 即時 ASR / TTS 的 Rust 版本

    819+1近 7 天星數變化
  • gitpodcast@BandarLabs

    將任何 git 儲存庫轉換為引人入勝的 podcast

    814-1近 7 天星數變化
  • 無需 ROOT 的開源 Android 螢幕即時翻譯工具,適合遊戲、視覺小說和漫畫。支援端側與雲端 OCR、離線 LLM、多種翻譯服務和文字朗讀(TTS),譯文可直接顯示在畫面上。

    809+73近 7 天星數變化
  • CloneTTS@sipeter

    執行於 Android 本地的輕量級文字轉語音 (TTS) 引擎,支援無縫的系統級全域語音複製與高傳真文字朗讀。

    807+5近 7 天星數變化
  • lue@paulilaaso

    具備有聲書品質文字轉語音功能的終端機電子書閱讀器 — 支援 EPUB、PDF、DOCX、HTML、RTF、TXT 與 MD。

    806+1近 7 天星數變化
  • lobe-tts@lobehub

    🎤 Lobe TTS - 適用於伺服器與瀏覽器的高品質且可靠的 TTS/STT 程式庫

    805-1近 7 天星數變化
  • 語音轉文字再轉語音。歌曲正在播放中。將文字作為 OSC 訊息傳送至 VRChat 以顯示在虛擬化身上。(STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    805+5近 7 天星數變化
  • ZerolanLiveRobot@AkagawaTsurunaki

    結合 LLM、ASR、TTS、OCR、CV 等技術的 AI VTuber,可與你直播或遊玩 Minecraft。

    803+2近 7 天星數變化
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS:多語言與跨語言 Zero-Shot TTS 引擎

    793+6近 7 天星數變化
  • mlx-audio-swift@Blaizzy

    一個用於在 Apple Silicon 上透過 MLX 進行音訊處理的模組化 Swift SDK。

    774+5近 7 天星數變化
  • dla@markovka17

    用於音訊處理的深度學習

    763-1近 7 天星數變化
← 返回主題列表