tts
tts がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #61
AIを活用したクロスプラットフォームの電子書籍リーダー。セマンティック検索、RAGチャット、ローカルベクトルストア、メモ、TTS、WebDAV同期を備えています。
★ 2,305+24直近 7 日のスター増減 - #62★ 2,296+7直近 7 日のスター増減
- #63★ 2,215+0直近 7 日のスター増減
- #64
ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。
★ 2,214+115直近 7 日のスター増減 - #65
7,000以上の言語に対応する、制御可能で高速なテキスト読み上げ(TTS)!
★ 2,207-1直近 7 日のスター増減 - #66
OpenAI、Azure、ElevenLabs の代替となる、無料かつ高品質なテキスト読み上げ(TTS)API エンドポイント
★ 2,075+5直近 7 日のスター増減 - #67
Audiobookshelf 向けに最適化され、WebUI が付属する EPUB からオーディオブックへの変換ツール
★ 2,064+1直近 7 日のスター増減 - #68
Arduino ESP32向けの100種類以上のモデルを搭載したリアルタイム音声AIトイ。セキュアなWebsocketとAIコンパニオン・デバイス向けのEdge Functionsに対応。
★ 1,938+5直近 7 日のスター増減 - #69
Home Assistant から Alice を使って Yandex.Station やその他のスマートホームデバイスを管理する
★ 1,917-1直近 7 日のスター増減 - #70★ 1,912+1直近 7 日のスター増減
- #71
ワークフローからアプリへ、画面共有&フローティングビデオ、GPT & 3D、音声認識&TTS
★ 1,861-2直近 7 日のスター増減 - #72★ 1,836+1直近 7 日のスター増減
- #73
Kokoroモデルを使用したCLIテキスト読み上げツール。多言語、音声(ブレンド機能付き)、EPUBやPDFなどの多様な入力フォーマットをサポート
★ 1,835+14直近 7 日のスター増減 - #74★ 1,760+3直近 7 日のスター増減
- #75
百聆(Bailing)はGPT-4oに類似した音声対話ボットであり、ASR+LLM+TTSを通じて実現されています。DeepSeek R1などの優れた大規模モデルを統合し、openClawに接続した真の個人用音声アシスタントです。遅延は800msと低く、Macなどの低スペック環境でも動作し、割り込みをサポートしています。
★ 1,759+2直近 7 日のスター増減 - #76★ 1,749+14直近 7 日のスター増減
- #77
字幕ファイルに基づいて動画のテキストを自動翻訳し、AI音声サービスを使用して新しい吹き替えおよび翻訳されたオーディオトラックを作成します。音声は字幕のタイミングに同期されます。
★ 1,746-1直近 7 日のスター増減 - #78
1つのトピックからVoxスタイルのペーパーコラージュ解説/広告動画を作成 — Atlas Cloud + ffmpegでエンドツーエンドを自動化。エージェントスキル。
★ 1,698+67直近 7 日のスター増減 - #79★ 1,687+4直近 7 日のスター増減
- #80
WhatsAppエージェント、Avaのご紹介
★ 1,675+2直近 7 日のスター増減 - #81
PyTorch による非公式の Parallel WaveGAN(+ MelGAN、Multi-band MelGAN、HiFi-GAN、StyleMelGAN)
★ 1,646+1直近 7 日のスター増減 - #82
Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。
★ 1,622+8直近 7 日のスター増減 - #83★ 1,591-2直近 7 日のスター増減
- #84
MicrosoftのVibeVoice音声合成モデル向けの包括的なComfyUI統合。ComfyUIのワークフロー内で直接、高品質なシングルおよびマルチスピーカーの音声合成を実現します。
★ 1,555+4直近 7 日のスター増減 - #85★ 1,548+60直近 7 日のスター増減
- #86
Android用Dicioアシスタントアプリ
★ 1,463+3直近 7 日のスター増減 - #87★ 1,449+1直近 7 日のスター増減
- #88
人間の声を簡単に合成するための Python/PyTorch アプリケーション
★ 1,440+0直近 7 日のスター増減 - #89★ 1,437+0直近 7 日のスター増減
- #90
強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。
★ 1,427+1直近 7 日のスター増減