tts
tts がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
tts と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、tts がタグ付けされたリポジトリ。
- #1
ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。
★ 2,214 - #2
1つのトピックからVoxスタイルのペーパーコラージュ解説/広告動画を作成 — Atlas Cloud + ffmpegでエンドツーエンドを自動化。エージェントスキル。
★ 1,698 - #3
SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.
★ 828 - #4
ROOT権限不要のオープンソースAndroid画面リアルタイム翻訳ツール。ゲーム、ビジュアルノベル、マンガに最適です。オンデバイスおよびクラウドOCR、オフラインLLM、多様な翻訳サービス、音声読み上げ(TTS)をサポートし、画面上に直接翻訳を表示できます。
★ 768 - #5
コーディングエージェントをビデオスタジオに変える:プレーンテキストで動画を説明すると、エージェントがタイムラインを作成し、ファイルを生成します。
★ 525
- #1
Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUXなどを含むLLMおよび拡散モデルを実行・学習するためのローカルUI。
★ 75,515+337直近 7 日のスター増減 - #2
1分の音声データでも優れたTTSモデルのトレーニングに使用可能!(Few-shotボイスクローニング)
★ 61,476+138直近 7 日のスター増減 - #3
5秒で音声をクローンし、任意の音声をリアルタイムで生成
★ 60,117-4直近 7 日のスター増減 - #4★ 48,833+84直近 7 日のスター増減
- #5★ 45,985+18直近 7 日のスター増減
- #6★ 39,814+9直近 7 日のスター増減
- #7★ 37,419+61直近 7 日のスター増減
- #8
🚀5秒でボイスをクローンし、任意の音声をリアルタイムで生成。
★ 36,912+0直近 7 日のスター増減 - #9★ 36,595+345直近 7 日のスター増減
- #10
SOTAオープンソースTTS
★ 32,510+52直近 7 日のスター増減 - #11
🚀 AI 完全自動ショートビデオエンジン | AI Fully Automated Short Video Engine
★ 27,702+236直近 7 日のスター増減 - #12★ 27,657+96直近 7 日のスター増減
- #13
Readestは、熱心な読者のために設計されたモダンで多機能な電子書籍リーダーであり、シームレスなクロスプラットフォームアクセス、強力なツール、直感的なインターフェースを提供し、読書体験を向上させます。
★ 24,008+138直近 7 日のスター増減 - #14★ 23,686+109直近 7 日のスター増減
- #15★ 23,426+359直近 7 日のスター増減
- #16
電子書籍からオーディオブックを生成、ボイスクローニング&1158以上の言語に対応!
★ 20,097+34直近 7 日のスター増減 - #17
🌈クロスプラットフォームのテキスト翻訳およびOCRソフトウェア
★ 19,408+28直近 7 日のスター増減 - #18
大規模言語モデル、マルチモーダル、および音声AI(自動音声認識とText-to-Speech)に取り組む研究者や開発者のために構築されたスケーラブルな生成AIフレームワーク
★ 18,379+21直近 7 日のスター増減 - #19
VoiceStudioは、完全にローカルで動作するオープンソースのElevenLabs代替ツールです。646言語で音声クローニング、音声デザイン、ビデオダビング、ディクテーション、文字起こし、オーディオブック作成に対応しています。
★ 14,835+2,880直近 7 日のスター増減 - #20
超高速、オンデバイス、多言語対応のTTS — ONNX経由でネイティブ実行。
★ 13,757+20直近 7 日のスター増減 - #21
クリエイターと開発者のためのGradio WebUI。主要なTTS (Edge-TTS, kokoro) およびゼロショット音声クローニング (E2 & F5-TTS, CosyVoice) を特徴とし、Whisperオーディオ処理、YouTubeダウンロード、Demucsによるボーカル分離、多言語翻訳に対応。
★ 12,730+54直近 7 日のスター増減 - #22
自己教師あり学習モデル、句読点付きSOTA/ストリーミングASR、テキストフロントエンド付きストリーミングTTS、話者認証システム、エンドツーエンド音声翻訳、キーワードスポッティングを含む使いやすい音声ツールキット。NAACL2022最優秀デモ賞を受賞。
★ 12,676+5直近 7 日のスター増減 - #23★ 11,847+29直近 7 日のスター増減
- #24
LLMを搭載したAI動画翻訳・吹き替えツール。人間およびAIエージェント向け。全パイプライン(ダウンロード、文字起こし、翻訳、TTS吹き替え、再フォーマット、カバー生成)に対応。100以上の言語をサポートし、YouTube、TikTok、Bilibili、Douyinなどに最適化。
★ 11,333+46直近 7 日のスター増減 - #25★ 10,997+33直近 7 日のスター増減
- #26★ 10,529+80直近 7 日のスター増減
- #27
multilingual-bertを搭載したvits2バックボーン
★ 8,794-3直近 7 日のスター増減 - #28
EmotiVoice 😊: マルチボイスおよびプロンプト制御型TTSエンジン
★ 8,522-1直近 7 日のスター増減 - #29★ 8,479+9直近 7 日のスター増減
- #30
StreamによるOpen Vision Agents。任意のモデルまたはビデオプロバイダーを使用して、音声およびビジョンエージェントを迅速に構築できます。超低遅延のためにStreamのエッジネットワークを利用しています。
★ 8,113+9直近 7 日のスター増減