メインコンテンツへスキップ
buildradar
ログイン
トピック · text-to-speech

text-to-speech

text-to-speech がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

150 件のリポジトリ
  • RHVoice@RHVoice

    ロシア語およびその他の言語に対応したオープンソースの音声合成エンジン

    1,836+0直近 7 日のスター増減
  • アプリのためのセルフコーディングシステム — Android用 Alan AI SDK

    1,807+0直近 7 日のスター増減
  • Genie-TTS@High-Logic

    GPT-SoVITS ONNX推論エンジンおよびモデルコンバーター

    1,760+0直近 7 日のスター増減
  • アプリ向けセルフコーディングシステム — Flutter 用 Alan AI SDK

    1,756+0直近 7 日のスター増減
  • 字幕ファイルに基づいて動画のテキストを自動翻訳し、AI音声サービスを使用して新しい吹き替えおよび翻訳されたオーディオトラックを作成します。音声は字幕のタイミングに同期されます。

    1,746+0直近 7 日のスター増減
  • read-aloud@ken107

    ワンクリックでウェブページのコンテンツを読み上げる素晴らしいブラウザ拡張機能

    1,737+0直近 7 日のスター増減
  • react-native-executorch@software-mansion

    ExecuTorch を活用し、React Native でデバイス上の AI モデルを実行する宣言的な方法。

    1,707+0直近 7 日のスター増減
  • alan-sdk-ionic@alan-ai

    アプリのためのセルフコーディングシステム — Ionic 向け Alan AI SDK

    1,649+0直近 7 日のスター増減
  • ParallelWaveGAN@kan-bayashi

    PyTorch による非公式の Parallel WaveGAN(+ MelGAN、Multi-band MelGAN、HiFi-GAN、StyleMelGAN)

    1,646+0直近 7 日のスター増減
  • dsnote@mkiol

    Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。

    1,622+0直近 7 日のスター増減
  • video-podcast-maker@Agents365-ai

    トピック → コーディングエージェント向けの 4K ナレーション付き動画。v4.0: すべての TTS が ttsCN エンジンコンポーネント経由(MiniMax の音声クローンやネイティブの単語単位字幕同期を含む 11 プラットフォーム)、マニフェストベースのアセットエンジン、Remotion 構成、コスト制御された AI 生成

    1,599+0直近 7 日のスター増減
  • MiniMax-MCP@MiniMax-AI

    強力な音声合成、画像生成、動画生成 API との連携を可能にする公式 MiniMax Model Context Protocol (MCP) サーバー

    1,573+0直近 7 日のスター増減
  • vllm-mlx@waybarrios

    Apple Silicon 向けの高性能な OpenAI および Anthropic 互換 LLM 推論サーバー。ネイティブ MLX、連続バッチ処理、マルチモーダルモデル、MCP ツール呼び出し、Claude Code をサポート。

    1,557+0直近 7 日のスター増減
  • VibeVoice-ComfyUI@Enemyx-net

    MicrosoftのVibeVoice音声合成モデル向けの包括的なComfyUI統合。ComfyUIのワークフロー内で直接、高品質なシングルおよびマルチスピーカーの音声合成を実現します。

    1,555+0直近 7 日のスター増減
  • soprano@ekwek1

    Soprano:インスタントで超リアルなテキスト読み上げ(TTS)

    1,548+0直近 7 日のスター増減
  • RCLI@RunanywhereAI

    Mac に話しかけ、ドキュメントを検索。クラウド不要。デバイス上の音声 AI + RAG

    1,542+0直近 7 日のスター増減
  • TalkingHead@met4citizen

    Talking Head (3D): 全身 3D アバターを使用したリアルタイムリップシンク用の JavaScript クラス

    1,522+0直近 7 日のスター増減
  • Voice-Cloning-App@voice-cloning-app

    人間の声を簡単に合成するための Python/PyTorch アプリケーション

    1,440+0直近 7 日のスター増減
  • OuteTTS@edwko

    OuteTTS モデル用インターフェース

    1,437+0直近 7 日のスター増減
  • 強力なChatterbox TTSモデルをセルフホストします。ユーザーフレンドリーなWeb UI、柔軟なAPIエンドポイント(OpenAI互換を含む)、プリセット音声、音声クローン、大規模なオーディオブック規模のテキスト処理を提供します。NVIDIA (CUDA)、AMD (ROCm)、CPUで高速実行可能です。

    1,427+0直近 7 日のスター増減
  • Speech-AI-Forge@lenML

    🍦 Speech-AI-Forgeは、TTS生成モデルを中心に開発されたプロジェクトで、APIサーバーとGradioベースのWebUIを実装しています。

    1,418+0直近 7 日のスター増減
  • SoniTranslate@R3gm

    動画の同期翻訳。動画の吹き替え

    1,413+0直近 7 日のスター増減
  • 💎 ASR、TTS、その他の音声技術向けにアクセス可能な音声コーパスのリスト

    1,399+0直近 7 日のスター増減
  • mlx-tune@ARahim3

    Apple Silicon 搭載 Mac で LLM をファインチューニング。MLX 上でネイティブ動作する SFT、DPO、GRPO、Vision、TTS、STT、Embedding、OCR のファインチューニング対応。Unsloth 互換 API。

    1,398+0直近 7 日のスター増減
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: 条件付きフローマッチングを用いた高速なTTSアーキテクチャ

    1,353+0直近 7 日のスター増減
  • WavTokenizer@jishengpeng

    [ICLR 2025] 音声言語モデリング向け、毎秒40/75トークンを実現するSOTA(最先端)の離散音響コーデックモデル

    1,317+0直近 7 日のスター増減
  • airunner@Capsize-Games

    画像、リアルタイム音声会話、LLM を活用したチャットボット、自動化ワークフローのためのオフライン推論エンジン。

    1,314+0直近 7 日のスター増減
  • StreamSpeech@ictnlp

    StreamSpeech は、オフラインおよび同時音声認識、音声翻訳、音声合成のための「オールインワン」シームレスモデルです。

    1,288+0直近 7 日のスター増減
  • audio-webui@gitmylo

    様々な音声関連のNeural Network向けWebUI

    1,246+0直近 7 日のスター増減
  • Irodori-TTS@Aratako

    絵文字駆動型スタイル制御を備えたFlow Matchingベースの音声合成モデル

    1,228+0直近 7 日のスター増減
← トピック一覧に戻る