text-to-speech
text-to-speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #121
Flutter 用テキスト読み上げ(Text to Speech)パッケージ
★ 753+0直近 7 日のスター増減 - #122
🔊 Kokoro Web: 無料のAIテキスト読み上げ、オンラインまたはセルフホスト、OpenAI互換!
★ 733+2直近 7 日のスター増減 - #123
Rapidaは、音声ストリーミング、STT、TTS、VAD、マルチチャネル統合、エージェント状態管理、オブザーバビリティを備えたリアルタイム会話型音声エージェントを構築するための、オープンソースのエンドツーエンド音声AIオーケストレーションプラットフォームです。
★ 723+4直近 7 日のスター増減 - #124★ 718-1直近 7 日のスター増減
- #125
PyTorch による、MetaAI の新しい SOTA Text-to-speech ネットワーク Voicebox の実装
★ 703+0直近 7 日のスター増減 - #126
モーショングラフィックスと音声合成を使用し、ニュースレターを毎日のYouTube動画に自動変換するフルオート動画メーカー
★ 703+0直近 7 日のスター増減 - #127
OpenAI Whisper と TensorFlow Lite を使用した Android 向けオフライン音声認識
★ 689+0直近 7 日のスター増減 - #128
Chatterboxを使用したローカルなOpenAI互換の音声合成(TTS)API。OpenAI APIが使用されるあらゆる場所(Open WebUI、AnythingLLMなど)で音声クローンによる音声生成を可能にします
★ 677+1直近 7 日のスター増減 - #129
📚 20以上の言語、1000以上の辞書でのダブルクリック検索、音声読み上げ、翻訳、Anki連携をサポートするカスタマイズ可能な辞書拡張機能。
★ 671+1直近 7 日のスター増減 - #130
LLaSA: LLaMA ベースの音声合成に向けた学習時および推論時の計算のスケーリング
★ 658+1直近 7 日のスター増減 - #131
MLXでのF5-TTSの実装
★ 644+0直近 7 日のスター増減 - #132★ 626+2直近 7 日のスター増減
- #133
PDF や EPUB をオーディオブックに、字幕や動画を(翻訳を含む)吹き替え動画に変換するなど。無料で使用できます。Pandrator は、音声クローン(インスタント、RVC 拡張、XTTS ファインチューニング)や LLM 処理などのローカルモデルを使用します。GUI、インストーラー、オールインワンパッケージを備えた、ユーザーフレンドリーなアプリを目指しています。
★ 620+3直近 7 日のスター増減 - #134
TikTok TTS APIと連携するシンプルなPythonスクリプト
★ 611+0直近 7 日のスター増減 - #135
VibeVoice TTS用のComfyUIカスタムノード。表現豊かで長文、マルチスピーカーの対話型オーディオ
★ 596-1直近 7 日のスター増減 - #136
テキストファイルを入力として受け付け、文字数制限のない Chatterbox の改造版です。主に子供向けのオーディオブックを作成するために使用しています。
★ 575-1直近 7 日のスター増減 - #137
アプリのためのセルフコーディングシステム — React Native 向け Alan AI SDK
★ 575+0直近 7 日のスター増減 - #138
Mac(M1/M2/M3/M4)でQwen3-TTSテキスト読み上げをローカル実行。音声クローン、音声デザイン、カスタム音声に対応。MLXを使用した100%オフライン動作。
★ 561+2直近 7 日のスター増減 - #139
🔥🔥🔥 LLMベースのマルチモーダル生成(画像、動画、3D、音声)に関する厳選された論文リスト
★ 552+0直近 7 日のスター増減 - #140
LM Studioを使用してOrpheus 3Bをローカルで実行する
★ 549+0直近 7 日のスター増減 - #141
PyTorch による非公式の vits2-TTS 実装
★ 549+1直近 7 日のスター増減 - #142
AI Pluginは、Payload CMS向けの強力な拡張機能であり、高度なAI機能を統合してコンテンツの作成と管理を強化します。
★ 547-1直近 7 日のスター増減 - #143
ComfyUI用のOmniVoice TTSノード - 音声クローン、音声デザイン、マルチスピーカー対話に対応したゼロショット多言語音声合成
★ 545+5直近 7 日のスター増減 - #144
Lightning-fast, free, local first voice dictation for macOS with on-device transcription
★ 544+11直近 7 日のスター増減 - #145★ 525+2直近 7 日のスター増減
- #146
E2-TTS(「Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS」)の PyTorch による実装
★ 517+0直近 7 日のスター増減 - #147
ベトナム語の音声クローン作成テキスト読み上げモデル ✨
★ 516+0直近 7 日のスター増減 - #148
WebRTC、REST、WSを介してASR/STT、TTS、LLMをサポートする、オープンソースかつローカル、セルフホスト型の高度に最適化された言語推論サーバー
★ 512+0直近 7 日のスター増減 - #149
表現力豊かな音声とリアルなゼロショット音声クローンを実現する ComfyUI ノード
★ 509-1直近 7 日のスター増減 - #150
An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.
★ 506+5直近 7 日のスター増減