メインコンテンツへスキップ
buildradar
Sign in
トピック · speech-synthesis

speech-synthesis

speech-synthesis がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

66 件のリポジトリ
  • chat-with-gpt@cogentapps

    音声機能を備えたオープンソースのChatGPTアプリ

    2,350-1直近 7 日のスター増減
  • IMS-Toucan@DigitalPhonetics

    7,000以上の言語に対応する、制御可能で高速なテキスト読み上げ(TTS)!

    2,207-1直近 7 日のスター増減
  • RHVoice@RHVoice

    ロシア語およびその他の言語に対応したオープンソースの音声合成エンジン

    1,836+1直近 7 日のスター増減
  • ParallelWaveGAN@kan-bayashi

    PyTorch による非公式の Parallel WaveGAN(+ MelGAN、Multi-band MelGAN、HiFi-GAN、StyleMelGAN)

    1,646+1直近 7 日のスター増減
  • dsnote@mkiol

    Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。

    1,622+8直近 7 日のスター増減
  • ComfyUI の機能を拡張するカスタムノード

    1,525+1直近 7 日のスター増減
  • SAM@s-macke

    Software Automatic Mouth - 小型音声合成システム

    1,498+0直近 7 日のスター増減
  • SpeechT5@microsoft

    音声言語処理のための統合モーダル音声・テキスト事前学習

    1,449+0直近 7 日のスター増減
  • 強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。

    1,427+1直近 7 日のスター増減
  • 💎 ASR、TTS、その他の音声技術向けにアクセス可能な音声コーパスのリスト

    1,399+0直近 7 日のスター増減
  • voicefixer@haoheliu

    汎用音声修復

    1,375+0直近 7 日のスター増減
  • World@mmorise

    高品質な音声分析、操作、合成システム

    1,339+0直近 7 日のスター増減
  • StreamSpeech@ictnlp

    StreamSpeech は、オフラインおよび同時音声認識、音声翻訳、音声合成のための「オールインワン」シームレスモデルです。

    1,288+0直近 7 日のスター増減
  • Irodori-TTS@Aratako

    絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル

    1,228+4直近 7 日のスター増減
  • BigVGAN@NVIDIA

    BigVGAN の公式 PyTorch 実装 (ICLR 2023)

    1,227+1直近 7 日のスター増減
  • オフライン動作対応のロシア語音声アシスタント「Ирина」。プラグインによるスキルをサポート。

    1,153+0直近 7 日のスター増減
  • AI-Waifu-Vtuber@ardha27

    Youtube/Twitch 配信用の AI VTuber

    1,116+2直近 7 日のスター増減
  • autovc@auspicious3000

    AutoVC: オートエンコーダ損失のみを用いたゼロショット音声スタイル変換

    1,100+0直近 7 日のスター増減
  • YourTTS@Edresson

    YourTTS:誰でも使えるゼロショット・マルチスピーカーTTSおよびゼロショット音声変換に向けた取り組み

    1,054+0直近 7 日のスター増減
  • Cognitive-Speech-TTS@Azure-Samples

    Cognitive Services の一部である、複数言語による Microsoft Text-to-Speech API のサンプルコード。

    1,014+3直近 7 日のスター増減
  • alexandria-audiobook@Finrandojin

    AIを活用したマルチボイスオーディオブックジェネレーター — LLMスクリプトアノテーション、音声クローン、音声デザイン、LoRAトレーニング、行ごとのスタイル制御、MP3・章付きM4B・Audacityマルチトラックへのエクスポート。Qwen3-TTSをベースに構築。

    1,000+20直近 7 日のスター増減
  • NISQA@gabrielmittag

    NISQA - 非侵入型音声品質およびTTS自然性評価

    972+3直近 7 日のスター増減
  • Azure の自然な音声合成(TTS)音声を、SAPI 5 互換のアプリケーションから利用できるようにする

    934+13直近 7 日のスター増減
  • FireRedTTS@FireRedTeam

    オープンソースのLLMを活用した基盤TTSシステム

    919+1直近 7 日のスター増減
  • インターネットを必要とせず、自分のコンピュータ上で動作する音声対話型LLM

    891+2直近 7 日のスター増減
  • diffwave@lmnt-com

    DiffWave は、高速で高品質なニューラルボコーダーおよび波形シンセサイザーです。

    884+0直近 7 日のスター増減
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: 多言語・クロスリンガル対応のゼロショットTTSエンジン

    794+10直近 7 日のスター増減
  • vui@fluxions-ai

    リアルタイム音声アシスタント — WebRTC ストリーミング、faster-whisper ASR、ローカル LLM、Vui Nano (300M) TTS。OpenAI Realtime API 互換。音声クローン、発話割り込み (barge-in)、RTX 4090 で約 9 倍のリアルタイム処理。Apache 2.0 ライセンス。

    759+10直近 7 日のスター増減
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: ライセンスの心配なく、あらゆるプロジェクトで使用可能な、無料、オフライン動作、高品質なドイツ語TTS音声

    729+1直近 7 日のスター増減
  • INTERSPEECH 2023-2024論文コレクション:INTERSPEECH 2023-24カンファレンスの影響力ある重要な研究論文の完全なまとめ。音声および言語処理の最新の進歩を探索できます。コード付き。音声技術の発展を支援するためにリポジトリにスターをお願いします!

    684+0直近 7 日のスター増減
← トピック一覧に戻る