メインコンテンツへスキップ
buildradar
Sign in
トピック · speech-synthesis

speech-synthesis

speech-synthesis がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
66
総スター数
348,104
平均スター数
5,274
シェア
0.02%

speech-synthesis と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、speech-synthesis がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • TTS@coqui-ai

    🐸💬 - 研究および本番環境で実証済みの Text-to-Speech 用ディープラーニングツールキット

    45,985+18直近 7 日のスター増減
  • VoxCPM@OpenBMB

    VoxCPM2: 多言語音声生成、クリエイティブなボイスデザイン、真実味のあるクローニングのためのトークナイザーフリーTTS

    36,595+345直近 7 日のスター増減
  • Speech@NVIDIA-NeMo

    大規模言語モデル、マルチモーダル、および音声AI(自動音声認識とText-to-Speech)に取り組む研究者や開発者のために構築されたスケーラブルな生成AIフレームワーク

    18,379+21直近 7 日のスター増減
  • leon@leon-ai

    🧠 Leonはあなたのオープンソースのパーソナルアシスタントです。

    17,476+1直近 7 日のスター増減
  • DeepLearningExamples@NVIDIA

    モデル別に整理された最先端のディープラーニングスクリプト - エンタープライズグレードのインフラストラクチャ上で再現性のある精度とパフォーマンスで容易にトレーニングおよびデプロイ可能。

    14,846+4直近 7 日のスター増減
  • supertonic@supertone-inc

    超高速、オンデバイス、多言語対応のTTS — ONNX経由でネイティブ実行。

    13,757+20直近 7 日のスター増減
  • speech-to-speech@huggingface

    オープンソースモデルでボイスエージェントを構築

    13,015+82直近 7 日のスター増減
  • voice-pro@abus-aikorea

    クリエイターと開発者のためのGradio WebUI。主要なTTS (Edge-TTS, kokoro) およびゼロショット音声クローニング (E2 & F5-TTS, CosyVoice) を特徴とし、Whisperオーディオ処理、YouTubeダウンロード、Demucsによるボーカル分離、多言語翻訳に対応。

    12,730+54直近 7 日のスター増減
  • PaddleSpeech@PaddlePaddle

    自己教師あり学習モデル、句読点付きSOTA/ストリーミングASR、テキストフロントエンド付きストリーミングTTS、話者認証システム、エンドツーエンド音声翻訳、キーワードスポッティングを含む使いやすい音声ツールキット。NAACL2022最優秀デモ賞を受賞。

    12,676+5直近 7 日のスター増減
  • edge-tts@rany2

    Microsoft EdgeやWindows、APIキーを必要とせずにPythonからMicrosoft Edgeのオンラインテキスト読み上げサービスを利用

    11,847+29直近 7 日のスター増減
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) は、オーディオ、音楽、音声生成のためのツールキットです。再現性のある研究をサポートし、若手研究者やエンジニアがオーディオ、音楽、音声生成の研究開発分野を始めやすくすることを目的としています。

    10,276+1直近 7 日のスター増減
  • espnet@espnet

    エンドツーエンド音声処理ツールキット

    9,949+3直近 7 日のスター増減
  • so-vits-svc-fork@voicepaw

    リアルタイムサポート、改善されたインターフェース、およびより多くの機能を備えたso-vits-svcのフォーク。

    9,329+3直近 7 日のスター増減
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: マルチボイスおよびプロンプト制御型TTSエンジン

    8,522-1直近 7 日のスター増減
  • mlx-audio@Blaizzy

    AppleのMLXフレームワーク上に構築された、テキスト読み上げ (TTS)、音声認識 (STT)、音声合成 (STS) のライブラリ。Apple Silicon上での効率的な音声分析を提供。

    7,826+23直近 7 日のスター増減
  • espeak-ng@espeak-ng

    eSpeak NGは、100以上の言語とアクセントをサポートするオープンソースの音声合成エンジンです。

    6,802+13直近 7 日のスター増減
  • StyleTTS2@yl4579

    StyleTTS 2: 大規模音声言語モデルを用いたスタイル拡散と敵対的学習による人間レベルのText-to-Speechへのアプローチ

    6,342+3直近 7 日のスター増減
  • silero-models@snakers4

    Silero Models: 驚くほどシンプルな事前学習済みテキスト読み上げモデル

    6,084-1直近 7 日のスター増減
  • abogen@denizsafak

    同期キャプション付きで、EPUB、PDF、およびテキストからオーディオブックを生成します。

    5,831+45直近 7 日のスター増減
  • DiffSinger@MoonInTheRiver

    DiffSinger: シャロー拡散メカニズムによる歌声合成 (SVS & TTS); AAAI 2022; 公式コード

    4,855+3直近 7 日のスター増減
  • WhisperSpeech@WhisperSpeech

    Whisperを反転させて構築されたオープンソースのテキスト読み上げ(TTS)システム。

    4,645+3直近 7 日のスター増減
  • OpenUtau@openutau

    オープンシンギング合成プラットフォーム / オープンソースのUTAU後継

    4,258+18直近 7 日のスター増減
  • metavoice-src@metavoiceio

    人間的で表現力豊かなTTSのための基盤モデル。

    4,203-1直近 7 日のスター増減
  • RealtimeTTS@KoljaB

    テキストをリアルタイムで音声に変換

    4,021+2直近 7 日のスター増減
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: TensorFlow 2向けのリアルタイム最先端音声合成(英語、フランス語、韓国語、中国語、ドイツ語に対応しており、他の言語への適応が容易)

    3,996+0直近 7 日のスター増減
  • lingvo@tensorflow

    Lingvo

    2,864+0直近 7 日のスター増減
  • MARS5-TTS@Camb-ai

    CAMB.AI の MARS5 音声モデル (TTS)

    2,818+1直近 7 日のスター増減
  • marytts@marytts

    純粋な Java で書かれたオープンソースの多言語音声合成システム「MARY TTS」

    2,583+0直近 7 日のスター増減
  • VieNeu-TTS@pnnbao97

    インスタント音声クローンを備えたベトナム語TTS • オンデバイス • リアルタイムCPU推論 • 24kHz音声品質 • ベトナム語音声合成

    2,468+21直近 7 日のスター増減
  • hifi-gan@jik876

    HiFi-GAN:効率的かつ高忠実度な音声合成のための積層型敵対的生成ネットワーク(GAN)

    2,367+0直近 7 日のスター増減
← トピック一覧に戻る