メインコンテンツへスキップ
buildradar
Sign in
トピック · text-to-speech

text-to-speech

text-to-speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

150 件のリポジトリ
  • abogen@denizsafak

    同期キャプション付きで、EPUB、PDF、およびテキストからオーディオブックを生成します。

    5,831+0直近 7 日のスター増減
  • dograh@dograh-hq

    オープンソースの音声AIプラットフォーム。VapiやRetellのセルフホスト型代替品。Speech to SpeechまたはLLM/STT/TTSに対応したオンプレミス、BYOK環境。ビジュアルワークフロービルダー、MCPネイティブ、テレフォニーサポート付き。

    5,568+0直近 7 日のスター増減
  • YouDub-webui@liuzhao1225

    オープンソースのAI動画ローカライゼーションツール:YouTube/Bilibili動画のダウンロード、字幕認識と翻訳、音声クローン吹き替え、音源ミキシング、字幕エンコードを自動実行。

    5,404+0直近 7 日のスター増減
  • Kokoro-FastAPI@remsky

    Kokoro-82M テキスト読み上げのための Docker化された OpenAI互換ラッパー(マルチプラットフォーム対応の CPU、AMD、NVIDIA GPU PyTorchを使用;マルチスピーカー、ボイスミキシング、自動ステッチング、キャプションタイムスタンプ、SSML、リードアロングWeb UI付き)

    5,399+0直近 7 日のスター増減
  • DiffSinger@MoonInTheRiver

    DiffSinger: シャロー拡散メカニズムによる歌声合成 (SVS & TTS); AAAI 2022; 公式コード

    4,855+0直近 7 日のスター増減
  • fastrtc@gradio-app

    リアルタイム通信のためのpythonライブラリ。

    4,624+0直近 7 日のスター増減
  • WhisperLive@collabora

    OpenAIのWhisperのほぼライブ実装。

    4,246+0直近 7 日のスター増減
  • metavoice-src@metavoiceio

    人間的で表現力豊かなTTSのための基盤モデル。

    4,203+0直近 7 日のスター増減
  • MOSS-TTS@OpenMOSS

    MOSS‑TTSファミリーは、MOSI.AIとOpenMOSSチームによるオープンソースの音声・音響生成モデルファミリーです。高忠実度、高表現力、複雑な実世界シナリオ向けに設計されており、安定した長尺音声、マルチスピーカー対話、ボイス/キャラクターデザイン、環境音エフェクト、リアルタイムストリーミングTTSを網羅しています。

    4,058+0直近 7 日のスター増減
  • RealtimeTTS@KoljaB

    テキストをリアルタイムで音声に変換

    4,021+0直近 7 日のスター増減
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: TensorFlow 2向けのリアルタイム最先端音声合成(英語、フランス語、韓国語、中国語、ドイツ語に対応しており、他の言語への適応が容易)

    3,996+0直近 7 日のスター増減
  • Applio@IAHispano

    使いやすさとパフォーマンスに重点を置いた、シンプルで高品質な音声変換ツール

    3,674+0直近 7 日のスター増減
  • TTS-WebUI@rsxdalv

    ACE-Step、OmniVoice、Kimi Audio、Piper TTS、GPT-SoVITS、CosyVoice、XTTSv2、DIA、Kokoro、OpenVoice、ParlerTTS、Stable Audio、MMS、StyleTTS2、MAGNet、AudioGen、MusicGen、Tortoise、RVC、Vocos、Demucs、SeamlessM4T、Barkに対応した拡張機能付きの単一Gradio + React WebUI!

    3,250+0直近 7 日のスター増減
  • elevenlabs-python@elevenlabs

    ElevenLabs API の公式 Python SDK

    3,083+0直近 7 日のスター増減
  • GPA@AutoArk

    [AutoArk] GPA (General Purpose Audio) は、1つの小型モデルで ASR、TTS、および音声変換を実行可能!

    3,061+0直近 7 日のスター増減
  • aeneas@readbeyond

    aeneas は、音声とテキストを自動的に同期(強制アライメント)するための Python/C ライブラリおよびツール群です。

    2,862+0直近 7 日のスター増減
  • MARS5-TTS@Camb-ai

    CAMB.AI の MARS5 音声モデル (TTS)

    2,818+0直近 7 日のスター増減
  • gTTS@pndurette

    Google 翻訳のテキスト読み上げ API と連携するための Python ライブラリおよび CLI ツール

    2,628+0直近 7 日のスター増減
  • ChatTTS_colab@6drf21e

    🚀 ワンクリックデプロイ(オフライン統合パッケージを含む)!ChatTTS をベースにし、ストリーミング出力、音声ガチャ、長文音声生成、およびロール別朗読をサポート。シンプルで使いやすく、複雑なインストールは不要。

    2,593+0直近 7 日のスター増減
  • marytts@marytts

    純粋な Java で書かれたオープンソースの多言語音声合成システム「MARY TTS」

    2,583+0直近 7 日のスター増減
  • pyttsx3@nateshmbhat

    Python 向けオフライン音声合成(TTS)。

    2,530+0直近 7 日のスター増減
  • VieNeu-TTS@pnnbao97

    インスタント音声クローンを備えたベトナム語TTS • オンデバイス • リアルタイムCPU推論 • 24kHz音声品質 • ベトナム語音声合成

    2,468+0直近 7 日のスター増減
  • qwen-audio-agent@QwenAudio

    エージェントの対話、作業、存在感を維持するリアルタイム音声ランタイム。AI エージェント向けのリアルタイム音声ランタイム

    2,379+58直近 7 日のスター増減
  • hifi-gan@jik876

    HiFi-GAN:効率的かつ高忠実度な音声合成のための積層型敵対的生成ネットワーク(GAN)

    2,367+0直近 7 日のスター増減
  • vall-e@lifeiteng

    VALL-E(ゼロショット音声合成)のPyTorch実装、再現デモ https://lifeiteng.github.io/valle/index.html

    2,215+0直近 7 日のスター増減
  • audio.cpp@0xShug0

    ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。

    2,214+0直近 7 日のスター増減
  • IMS-Toucan@DigitalPhonetics

    7,000以上の言語に対応する、制御可能で高速なテキスト読み上げ(TTS)!

    2,207+0直近 7 日のスター増減
  • openai-edge-tts@travisvn

    OpenAI、Azure、ElevenLabs の代替となる、無料かつ高品質なテキスト読み上げ(TTS)API エンドポイント

    2,075+0直近 7 日のスター増減
  • parlor@fikrikarim

    GPT-Live と同様の機能を備えた、デバイス上のリアルタイムマルチモーダル AI

    2,048+0直近 7 日のスター増減
  • claude-code-video-toolkit@digitalsamba

    Claude Code向けのAIネイティブな動画制作ツールキット

    2,036+0直近 7 日のスター増減
← トピック一覧に戻る