text-to-speech
text-to-speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #61★ 1,836+0直近 7 日のスター増減
- #62
アプリのためのセルフコーディングシステム — Android用 Alan AI SDK
★ 1,807+0直近 7 日のスター増減 - #63★ 1,760+0直近 7 日のスター増減
- #64
アプリ向けセルフコーディングシステム — Flutter 用 Alan AI SDK
★ 1,756+0直近 7 日のスター増減 - #65
字幕ファイルに基づいて動画のテキストを自動翻訳し、AI音声サービスを使用して新しい吹き替えおよび翻訳されたオーディオトラックを作成します。音声は字幕のタイミングに同期されます。
★ 1,746+0直近 7 日のスター増減 - #66
ワンクリックでウェブページのコンテンツを読み上げる素晴らしいブラウザ拡張機能
★ 1,737+0直近 7 日のスター増減 - #67
ExecuTorch を活用し、React Native でデバイス上の AI モデルを実行する宣言的な方法。
★ 1,707+0直近 7 日のスター増減 - #68
アプリのためのセルフコーディングシステム — Ionic 向け Alan AI SDK
★ 1,649+0直近 7 日のスター増減 - #69
PyTorch による非公式の Parallel WaveGAN(+ MelGAN、Multi-band MelGAN、HiFi-GAN、StyleMelGAN)
★ 1,646+0直近 7 日のスター増減 - #70
Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。
★ 1,622+0直近 7 日のスター増減 - #71
トピック → コーディングエージェント向けの 4K ナレーション付き動画。v4.0: すべての TTS が ttsCN エンジンコンポーネント経由(MiniMax の音声クローンやネイティブの単語単位字幕同期を含む 11 プラットフォーム)、マニフェストベースのアセットエンジン、Remotion 構成、コスト制御された AI 生成
★ 1,599+0直近 7 日のスター増減 - #72
強力な音声合成、画像生成、動画生成 API との連携を可能にする公式 MiniMax Model Context Protocol (MCP) サーバー
★ 1,573+0直近 7 日のスター増減 - #73
Apple Silicon 向けの高性能な OpenAI および Anthropic 互換 LLM 推論サーバー。ネイティブ MLX、連続バッチ処理、マルチモーダルモデル、MCP ツール呼び出し、Claude Code をサポート。
★ 1,557+0直近 7 日のスター増減 - #74
MicrosoftのVibeVoice音声合成モデル向けの包括的なComfyUI統合。ComfyUIのワークフロー内で直接、高品質なシングルおよびマルチスピーカーの音声合成を実現します。
★ 1,555+0直近 7 日のスター増減 - #75★ 1,548+0直近 7 日のスター増減
- #76★ 1,542+0直近 7 日のスター増減
- #77
Talking Head (3D): 全身 3D アバターを使用したリアルタイムリップシンク用の JavaScript クラス
★ 1,522+0直近 7 日のスター増減 - #78
人間の声を簡単に合成するための Python/PyTorch アプリケーション
★ 1,440+0直近 7 日のスター増減 - #79★ 1,437+0直近 7 日のスター増減
- #80
強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。
★ 1,427+0直近 7 日のスター増減 - #81
🍦 Speech-AI-Forgeは、TTS生成モデルを中心に開発されたプロジェクトで、APIサーバーとGradioベースのWebUIを実装しています。
★ 1,418+0直近 7 日のスター増減 - #82
動画の同期翻訳。動画の吹き替え
★ 1,413+0直近 7 日のスター増減 - #83
💎 ASR、TTS、その他の音声技術向けにアクセス可能な音声コーパスのリスト
★ 1,399+0直近 7 日のスター増減 - #84
Apple Silicon 搭載 Mac で LLM をファインチューニング。MLX 上でネイティブ動作する SFT、DPO、GRPO、Vision、TTS、STT、Embedding、OCR のファインチューニング対応。Unsloth 互換 API。
★ 1,398+0直近 7 日のスター増減 - #85
[ICASSP 2024] 🍵 Matcha-TTS: 条件付きフローマッチングを用いた高速なTTSアーキテクチャ
★ 1,353+0直近 7 日のスター増減 - #86
[ICLR 2025] 音声言語モデリング向け、毎秒40/75トークンを実現するSOTA(最先端)の離散音響コーデックモデル
★ 1,317+0直近 7 日のスター増減 - #87★ 1,314+0直近 7 日のスター増減
- #88
StreamSpeech は、オフラインおよび同時音声認識、音声翻訳、音声合成のための「オールインワン」シームレスモデルです。
★ 1,288+0直近 7 日のスター増減 - #89
様々な音声関連のNeural Network向けWebUI
★ 1,246+0直近 7 日のスター増減 - #90
絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル
★ 1,228+0直近 7 日のスター増減