メインコンテンツへスキップ
buildradar
Sign in
トピック · tts

tts

tts がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
189
総スター数
1,061,717
平均スター数
5,618
シェア
0.06%

tts と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、tts がタグ付けされたリポジトリ。

  • audio.cpp@0xShug0

    ggml を活用した、音声モデル向けのオールインワンかつ純粋な C++ 推論エンジン。TTS、STT、VAD、音声変換、音楽生成などを高度に最適化されたパフォーマンスでサポートします。Python 依存関係はありません。

    2,214
  • vox-director@Alisa0808

    1つのトピックからVoxスタイルのペーパーコラージュ解説/広告動画を作成 — Atlas Cloud + ffmpegでエンドツーエンドを自動化。エージェントスキル。

    1,698
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    828
  • ROOT権限不要のオープンソースAndroid画面リアルタイム翻訳ツール。ゲーム、ビジュアルノベル、マンガに最適です。オンデバイスおよびクラウドOCR、オフラインLLM、多様な翻訳サービス、音声読み上げ(TTS)をサポートし、画面上に直接翻訳を表示できます。

    768
  • Orkas-VideoStudio@Orkas-AI

    コーディングエージェントをビデオスタジオに変える:プレーンテキストで動画を説明すると、エージェントがタイムラインを作成し、ファイルを生成します。

    525
  • unsloth@unslothai

    Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、DeepSeek-V4、FLUXなどを含むLLMおよび拡散モデルを実行・学習するためのローカルUI。

    75,515+337直近 7 日のスター増減
  • GPT-SoVITS@RVC-Boss

    1分の音声データでも優れたTTSモデルのトレーニングに使用可能!(Few-shotボイスクローニング)

    61,476+138直近 7 日のスター増減
  • 5秒で音声をクローンし、任意の音声をリアルタイムで生成

    60,117-4直近 7 日のスター増減
  • LocalAI@mudler

    LocalAIはオープンソースのAIエンジン。あらゆるハードウェアで、LLMs、ビジョン、音声、画像、動画など、あらゆるモデルを実行可能。GPUは不要。

    48,833+84直近 7 日のスター増減
  • TTS@coqui-ai

    🐸💬 - 研究および本番環境で実証済みの Text-to-Speech 用ディープラーニングツールキット

    45,985+18直近 7 日のスター増減
  • ChatTTS@2noise

    日常会話のための生成型音声モデル。

    39,814+9直近 7 日のスター増減
  • OpenVoice@myshell-ai

    MITとMyShellによるインスタントボイスクローニング。オーディオ基盤モデル。

    37,419+61直近 7 日のスター増減
  • MockingBird@babysor

    🚀5秒でボイスをクローンし、任意の音声をリアルタイムで生成。

    36,912+0直近 7 日のスター増減
  • VoxCPM@OpenBMB

    VoxCPM2: 多言語音声生成、クリエイティブなボイスデザイン、真実味のあるクローニングのためのトークナイザーフリーTTS

    36,595+345直近 7 日のスター増減
  • fish-speech@fishaudio

    SOTAオープンソースTTS

    32,510+52直近 7 日のスター増減
  • Pixelle-Video@ATH-MaaS

    🚀 AI 完全自動ショートビデオエンジン | AI Fully Automated Short Video Engine

    27,702+236直近 7 日のスター増減
  • mastra@mastra-ai

    MastraはAIを活用したアプリケーションおよびエージェントのためのモダンなTypeScriptフレームワークである。

    27,657+96直近 7 日のスター増減
  • readest@readest

    Readestは、熱心な読者のために設計されたモダンで多機能な電子書籍リーダーであり、シームレスなクロスプラットフォームアクセス、強力なツール、直感的なインターフェースを提供し、読書体験を向上させます。

    24,008+138直近 7 日のスター増減
  • index-tts@index-tts

    産業レベルで制御可能かつ効率的なゼロショットText-To-Speechシステム

    23,686+109直近 7 日のスター増減
  • CosyVoice@QwenAudio

    推論、学習、デプロイのフルスタック機能を備えた多言語大規模音声生成モデル

    23,426+359直近 7 日のスター増減
  • ebook2audiobook@DrewThomasson

    電子書籍からオーディオブックを生成、ボイスクローニング&1158以上の言語に対応!

    20,097+34直近 7 日のスター増減
  • pot-desktop@pot-app

    🌈クロスプラットフォームのテキスト翻訳およびOCRソフトウェア

    19,408+28直近 7 日のスター増減
  • Speech@NVIDIA-NeMo

    大規模言語モデル、マルチモーダル、および音声AI(自動音声認識とText-to-Speech)に取り組む研究者や開発者のために構築されたスケーラブルな生成AIフレームワーク

    18,379+21直近 7 日のスター増減
  • VoiceStudio@debpalash

    VoiceStudioは、完全にローカルで動作するオープンソースのElevenLabs代替ツールです。646言語で音声クローニング、音声デザイン、ビデオダビング、ディクテーション、文字起こし、オーディオブック作成に対応しています。

    14,835+2,880直近 7 日のスター増減
  • supertonic@supertone-inc

    超高速、オンデバイス、多言語対応のTTS — ONNX経由でネイティブ実行。

    13,757+20直近 7 日のスター増減
  • voice-pro@abus-aikorea

    クリエイターと開発者のためのGradio WebUI。主要なTTS (Edge-TTS, kokoro) およびゼロショット音声クローニング (E2 & F5-TTS, CosyVoice) を特徴とし、Whisperオーディオ処理、YouTubeダウンロード、Demucsによるボーカル分離、多言語翻訳に対応。

    12,730+54直近 7 日のスター増減
  • PaddleSpeech@PaddlePaddle

    自己教師あり学習モデル、句読点付きSOTA/ストリーミングASR、テキストフロントエンド付きストリーミングTTS、話者認証システム、エンドツーエンド音声翻訳、キーワードスポッティングを含む使いやすい音声ツールキット。NAACL2022最優秀デモ賞を受賞。

    12,676+5直近 7 日のスター増減
  • edge-tts@rany2

    Microsoft EdgeやWindows、APIキーを必要とせずにPythonからMicrosoft Edgeのオンラインテキスト読み上げサービスを利用

    11,847+29直近 7 日のスター増減
  • KrillinAI@krillinai

    LLMを搭載したAI動画翻訳・吹き替えツール。人間およびAIエージェント向け。全パイプライン(ダウンロード、文字起こし、翻訳、TTS吹き替え、再フォーマット、カバー生成)に対応。100以上の言語をサポートし、YouTube、TikTok、Bilibili、Douyinなどに最適化。

    11,333+46直近 7 日のスター増減
  • moonshine@moonshine-ai

    超低遅延の音声認識、意図認識、テキスト読み上げ機能。ボイスエージェントやインターフェースの構築に最適です。

    10,997+33直近 7 日のスター増減
  • voltagent@VoltAgent

    オープンソースのTypeScript AI Agent Frameworkを基盤としたAIエージェントエンジニアリングプラットフォーム

    10,529+80直近 7 日のスター増減
  • Bert-VITS2@fishaudio

    multilingual-bertを搭載したvits2バックボーン

    8,794-3直近 7 日のスター増減
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: マルチボイスおよびプロンプト制御型TTSエンジン

    8,522-1直近 7 日のスター増減
  • audiblez@santinic

    電子書籍からオーディオブックを生成。

    8,479+9直近 7 日のスター増減
  • Vision-Agents@GetStream

    StreamによるOpen Vision Agents。任意のモデルまたはビデオプロバイダーを使用して、音声およびビジョンエージェントを迅速に構築できます。超低遅延のためにStreamのエッジネットワークを利用しています。

    8,113+9直近 7 日のスター増減
← トピック一覧に戻る