メインコンテンツへスキップ
buildradar
ログイン
トピック · text-to-speech

text-to-speech

text-to-speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

150 件のリポジトリ
  • TTS-Audio-Suite@diodiogod

    ローカルでのマルチエンジン・多言語の音声合成(TTS)および音声変換を行うためのComfyUIカスタムノード統合。RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(クラシックおよび多言語)、F5-TTS、Higgs Audio 2、3、VibeVoiceをサポートし、無制限のテキスト長、SRTタイミング、キャラクターサポート、および多数のオーディオツールを備えています。

    1,187+0直近 7 日のスター増減
  • Apple の Foundation Models フレームワークを使用したアプリの構築、テスト、評価のための実践的なラボ。

    1,178+0直近 7 日のスター増減
  • dia2@nari-labs

    リアルタイムで会話音声をストリーミングできるTTSモデル

    1,173+0直近 7 日のスター増減
  • speech-swift@soniqo

    Apple Silicon 向け AI 音声ツールキット — MLX と CoreML を活用した ASR、TTS、音声対音声、VAD、話者分離

    1,161+0直近 7 日のスター増減
  • アプリのためのセルフコーディングシステム — Cordova 用 Alan AI SDK

    1,132+0直近 7 日のスター増減
  • sglang-omni@sgl-project

    SGLang-Omni は、TTS、ASR、音声、およびオムニモデルの高性能なサービングを実現します。

    1,118+56直近 7 日のスター増減
  • Uncensored-Local-Studio@techjarves

    Windows、Linux、macOS向けの検閲なしローカル AI スタジオ。画像生成、GGUF LLM、音声認識・合成のためのセットアップ不要な GUI

    1,118+13直近 7 日のスター増減
  • Patter@PatterAI

    オープンソースの音声AI SDK。スタックを自社所有したい開発者向けの Vapi/Retell 代替ソリューション。4行のコードでAIエージェントに電話番号を付与 — Python と TypeScript、MITライセンス、Twilio、Telnyx、Plivoに対応。

    1,051+7直近 7 日のスター増減
  • Cognitive-Speech-TTS@Azure-Samples

    Cognitive Services の一部である、複数言語による Microsoft Text-to-Speech API のサンプルコード。

    1,014+1直近 7 日のスター増減
  • alexandria-audiobook@Finrandojin

    AIを活用したマルチボイスオーディオブックジェネレーター — LLMスクリプトアノテーション、音声クローン、音声デザイン、LoRAトレーニング、行ごとのスタイル制御、MP3・章付きM4B・Audacityマルチトラックへのエクスポート。Qwen3-TTSをベースに構築。

    1,000+10直近 7 日のスター増減
  • Step-Audio-EditX@stepfun-ai

    感情、話し方、パラ言語の編集に優れ、堅牢なゼロショットTTS機能を備えた、強力な3BパラメータのLLMベース強化学習オーディオ編集モデル

    973+1直近 7 日のスター増減
  • NISQA@gabrielmittag

    NISQA - 非侵入型音声品質およびTTS自然性評価

    972+4直近 7 日のスター増減
  • botium-speech-processing@codeforequity-at

    Botium 音声処理

    943+0直近 7 日のスター増減
  • Azure の自然な音声合成(TTS)音声を、SAPI 5 互換のアプリケーションから利用できるようにする

    934+7直近 7 日のスター増減
  • PHP 用 Vonage REST API クライアント。SMS、音声、テキスト読み上げ、番号、認証 (2FA) などをサポート。

    931-1直近 7 日のスター増減
  • FireRedTTS@FireRedTeam

    オープンソースのLLMを活用した基盤TTSシステム

    919-1直近 7 日のスター増減
  • EDDiscovery@EDDiscovery

    Elite Dangerous 用の船長日誌および 3D スターマップ

    900+4直近 7 日のスター増減
  • diffwave@lmnt-com

    DiffWave は、高速で高品質なニューラルボコーダーおよび波形シンセサイザーです。

    884-1直近 7 日のスター増減
  • bark.cpp@PABannier

    高速なテキスト読み上げ生成を実現する、C/C++版の Suno AI Bark モデル

    868+2直近 7 日のスター増減
  • lue@paulilaaso

    オーディオブック品質の音声読み上げ機能を備えたターミナル向け電子書籍リーダー — EPUB、PDF、DOCX、HTML、RTF、TXT、MD をサポート。

    805+1直近 7 日のスター増減
  • lobe-tts@lobehub

    🎤 Lobe TTS - サーバーおよびブラウザ向けの高品質で信頼性の高いTTS/STTライブラリ

    805-1直近 7 日のスター増減
  • CloneTTS@sipeter

    システム全体でのシームレスな音声クローンと高忠実度なテキスト読み上げを可能にする、軽量なオフライン Android Text-to-Speech (TTS) エンジン。

    804+5直近 7 日のスター増減
  • 音声からテキスト、そして音声へ。現在再生中の楽曲。テキストをOSCメッセージとしてVRChatに送信し、アバター上に表示します。(STTTS) (Speech to TTS) (VRC STTシステム) (VTuber TTS)

    804+5直近 7 日のスター増減
  • ai-video-editor@MartinDelophy

    クリエイターとAIエージェントが同じリアルタイムラインを共同編集できる、オープンソースでローカルファーストな動画エディタ

    798+82直近 7 日のスター増減
  • ROOT権限不要のオープンソースAndroid画面リアルタイム翻訳ツール。ゲーム、ビジュアルノベル、マンガに最適です。オンデバイスおよびクラウドOCR、オフラインLLM、多様な翻訳サービス、音声読み上げ(TTS)をサポートし、画面上に直接翻訳を表示できます。

    794+73直近 7 日のスター増減
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: 多言語・クロスリンガル対応のゼロショットTTSエンジン

    794+6直近 7 日のスター増減
  • june@mezbaul-h

    Ollama、Hugging Face Transformers、Coqui TTS Toolkitを活用した、対話を楽しむためのローカル音声チャットボット

    788+1直近 7 日のスター増減
  • mlx-audio-swift@Blaizzy

    Apple Silicon上のMLXで音声処理を行うためのモジュール式Swift SDK

    774+5直近 7 日のスター増減
  • vui@fluxions-ai

    リアルタイム音声アシスタント — WebRTC ストリーミング、faster-whisper ASR、ローカル LLM、Vui Nano (300M) TTS。OpenAI Realtime API 互換。音声クローン、発話割り込み (barge-in)、RTX 4090 で約 9 倍のリアルタイム処理。Apache 2.0 ライセンス。

    759+7直近 7 日のスター増減
  • cboard@cboard-org

    ブラウザ向けのテキスト読み上げ機能付き拡大・代替コミュニケーション(AAC)システム

    756+9直近 7 日のスター増減
← トピック一覧に戻る