メインコンテンツへスキップ
buildradar
ログイン
トピック · text-to-speech

text-to-speech

text-to-speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

150 件のリポジトリ
  • flutter_tts@dlutton

    Flutter 用テキスト読み上げ(Text to Speech)パッケージ

    753+0直近 7 日のスター増減
  • kokoro-web@eduardolat

    🔊 Kokoro Web: 無料のAIテキスト読み上げ、オンラインまたはセルフホスト、OpenAI互換!

    733+2直近 7 日のスター増減
  • voice-ai@rapidaai

    Rapidaは、音声ストリーミング、STT、TTS、VAD、マルチチャネル統合、エージェント状態管理、オブザーバビリティを備えたリアルタイム会話型音声エージェントを構築するための、オープンソースのエンドツーエンド音声AIオーケストレーションプラットフォームです。

    723+4直近 7 日のスター増減
  • curses@mmpneo

    OBS、VRChat、Twitchチャット、Discord向けの音声認識(Speech to Text)およびKB入力字幕

    718-1直近 7 日のスター増減
  • voicebox-pytorch@lucidrains

    PyTorch による、MetaAI の新しい SOTA Text-to-speech ネットワーク Voicebox の実装

    703+0直近 7 日のスター増減
  • podcast-maker@FelippeChemello

    モーショングラフィックスと音声合成を使用し、ニュースレターを毎日のYouTube動画に自動変換するフルオート動画メーカー

    703+0直近 7 日のスター増減
  • OpenAI Whisper と TensorFlow Lite を使用した Android 向けオフライン音声認識

    689+0直近 7 日のスター増減
  • chatterbox-tts-api@travisvn

    Chatterboxを使用したローカルなOpenAI互換の音声合成(TTS)API。OpenAI APIが使用されるあらゆる場所(Open WebUI、AnythingLLMなど)で音声クローンによる音声生成を可能にします

    677+1直近 7 日のスター増減
  • dictionariez@pnlpal

    📚 20以上の言語、1000以上の辞書でのダブルクリック検索、音声読み上げ、翻訳、Anki連携をサポートするカスタマイズ可能な辞書拡張機能。

    671+1直近 7 日のスター増減
  • LLaSA_training@zhenye234

    LLaSA: LLaMA ベースの音声合成に向けた学習時および推論時の計算のスケーリング

    658+1直近 7 日のスター増減
  • f5-tts-mlx@lucasnewman

    MLXでのF5-TTSの実装

    644+0直近 7 日のスター増減
  • examples@elevenlabs
    626+2直近 7 日のスター増減
  • Pandrator@lukaszliniewicz

    PDF や EPUB をオーディオブックに、字幕や動画を(翻訳を含む)吹き替え動画に変換するなど。無料で使用できます。Pandrator は、音声クローン(インスタント、RVC 拡張、XTTS ファインチューニング)や LLM 処理などのローカルモデルを使用します。GUI、インストーラー、オールインワンパッケージを備えた、ユーザーフレンドリーなアプリを目指しています。

    620+3直近 7 日のスター増減
  • tiktok-voice@oscie57

    TikTok TTS APIと連携するシンプルなPythonスクリプト

    611+0直近 7 日のスター増減
  • ComfyUI-VibeVoice@wildminder

    VibeVoice TTS用のComfyUIカスタムノード。表現豊かで長文、マルチスピーカーの対話型オーディオ

    596-1直近 7 日のスター増減
  • テキストファイルを入力として受け付け、文字数制限のない Chatterbox の改造版です。主に子供向けのオーディオブックを作成するために使用しています。

    575-1直近 7 日のスター増減
  • アプリのためのセルフコーディングシステム — React Native 向け Alan AI SDK

    575+0直近 7 日のスター増減
  • Mac(M1/M2/M3/M4)でQwen3-TTSテキスト読み上げをローカル実行。音声クローン、音声デザイン、カスタム音声に対応。MLXを使用した100%オフライン動作。

    561+2直近 7 日のスター増減
  • 🔥🔥🔥 LLMベースのマルチモーダル生成(画像、動画、3D、音声)に関する厳選された論文リスト

    552+0直近 7 日のスター増減
  • orpheus-tts-local@isaiahbjork

    LM Studioを使用してOrpheus 3Bをローカルで実行する

    549+0直近 7 日のスター増減
  • vits2_pytorch@p0p4k

    PyTorch による非公式の vits2-TTS 実装

    549+1直近 7 日のスター増減
  • payload-ai@ashbuilds

    AI Pluginは、Payload CMS向けの強力な拡張機能であり、高度なAI機能を統合してコンテンツの作成と管理を強化します。

    547-1直近 7 日のスター増減
  • ComfyUI-OmniVoice-TTS@Saganaki22

    ComfyUI用のOmniVoice TTSノード - 音声クローン、音声デザイン、マルチスピーカー対話に対応したゼロショット多言語音声合成

    545+5直近 7 日のスター増減
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    544+11直近 7 日のスター増減
  • EDDI@EDCD

    Elite Dangerous用コンパニオンアプリケーション。

    525+2直近 7 日のスター増減
  • e2-tts-pytorch@lucidrains

    E2-TTS(「Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS」)の PyTorch による実装

    517+0直近 7 日のスター増減
  • vixtts-demo@thinhlpg

    ベトナム語の音声クローン作成テキスト読み上げモデル ✨

    516+0直近 7 日のスター増減
  • WebRTC、REST、WSを介してASR/STT、TTS、LLMをサポートする、オープンソースかつローカル、セルフホスト型の高度に最適化された言語推論サーバー

    512+0直近 7 日のスター増減
  • ComfyUI-VoxCPM@wildminder

    表現力豊かな音声とリアルなゼロショット音声クローンを実現する ComfyUI ノード

    509-1直近 7 日のスター増減
  • openreader@richardr1126

    An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.

    506+5直近 7 日のスター増減
← トピック一覧に戻る