speech-synthesis
speech-synthesis がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31
音声機能を備えたオープンソースのChatGPTアプリ
★ 2,350-1直近 7 日のスター増減 - #32
7,000以上の言語に対応する、制御可能で高速なテキスト読み上げ(TTS)!
★ 2,207-1直近 7 日のスター増減 - #33★ 1,836+1直近 7 日のスター増減
- #34
PyTorch による非公式の Parallel WaveGAN(+ MelGAN、Multi-band MelGAN、HiFi-GAN、StyleMelGAN)
★ 1,646+1直近 7 日のスター増減 - #35
Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。
★ 1,622+8直近 7 日のスター増減 - #36
ComfyUI の機能を拡張するカスタムノード
★ 1,525+1直近 7 日のスター増減 - #37★ 1,498+0直近 7 日のスター増減
- #38★ 1,449+0直近 7 日のスター増減
- #39
強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。
★ 1,427+1直近 7 日のスター増減 - #40
💎 ASR、TTS、その他の音声技術向けにアクセス可能な音声コーパスのリスト
★ 1,399+0直近 7 日のスター増減 - #41
汎用音声修復
★ 1,375+0直近 7 日のスター増減 - #42★ 1,339+0直近 7 日のスター増減
- #43
StreamSpeech は、オフラインおよび同時音声認識、音声翻訳、音声合成のための「オールインワン」シームレスモデルです。
★ 1,288+0直近 7 日のスター増減 - #44
絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル
★ 1,228+4直近 7 日のスター増減 - #45★ 1,227+1直近 7 日のスター増減
- #46
オフライン動作対応のロシア語音声アシスタント「Ирина」。プラグインによるスキルをサポート。
★ 1,153+0直近 7 日のスター増減 - #47
Youtube/Twitch 配信用の AI VTuber
★ 1,116+2直近 7 日のスター増減 - #48★ 1,100+0直近 7 日のスター増減
- #49★ 1,054+0直近 7 日のスター増減
- #50
Cognitive Services の一部である、複数言語による Microsoft Text-to-Speech API のサンプルコード。
★ 1,014+3直近 7 日のスター増減 - #51
AIを活用したマルチボイスオーディオブックジェネレーター — LLMスクリプトアノテーション、音声クローン、音声デザイン、LoRAトレーニング、行ごとのスタイル制御、MP3・章付きM4B・Audacityマルチトラックへのエクスポート。Qwen3-TTSをベースに構築。
★ 1,000+20直近 7 日のスター増減 - #52★ 972+3直近 7 日のスター増減
- #53
Azure の自然な音声合成(TTS)音声を、SAPI 5 互換のアプリケーションから利用できるようにする
★ 934+13直近 7 日のスター増減 - #54
オープンソースのLLMを活用した基盤TTSシステム
★ 919+1直近 7 日のスター増減 - #55
インターネットを必要とせず、自分のコンピュータ上で動作する音声対話型LLM
★ 891+2直近 7 日のスター増減 - #56★ 884+0直近 7 日のスター増減
- #57
Confucius4-TTS: 多言語・クロスリンガル対応のゼロショットTTSエンジン
★ 794+10直近 7 日のスター増減 - #58
リアルタイム音声アシスタント — WebRTC ストリーミング、faster-whisper ASR、ローカル LLM、Vui Nano (300M) TTS。OpenAI Realtime API 互換。音声クローン、発話割り込み (barge-in)、RTX 4090 で約 9 倍のリアルタイム処理。Apache 2.0 ライセンス。
★ 759+10直近 7 日のスター増減 - #59
Thorsten-Voice: ライセンスの心配なく、あらゆるプロジェクトで使用可能な、無料、オフライン動作、高品質なドイツ語TTS音声
★ 729+1直近 7 日のスター増減 - #60
INTERSPEECH 2023-2024論文コレクション:INTERSPEECH 2023-24カンファレンスの影響力ある重要な研究論文の完全なまとめ。音声および言語処理の最新の進歩を探索できます。コード付き。音声技術の発展を支援するためにリポジトリにスターをお願いします!
★ 684+0直近 7 日のスター増減