メインコンテンツへスキップ
buildradar
Sign in
トピック · tts

tts

tts がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

189 件のリポジトリ
  • alexandria-audiobook@Finrandojin

    AIを活用したマルチボイスオーディオブックジェネレーター — LLMスクリプトアノテーション、音声クローン、音声デザイン、LoRAトレーニング、行ごとのスタイル制御、MP3・章付きM4B・Audacityマルチトラックへのエクスポート。Qwen3-TTSをベースに構築。

    996+17直近 7 日のスター増減
  • lobe-vidol@lobehub

    🧸 Lobe Vidol - 誰もがバーチャルアイドルを身近に

    986+1直近 7 日のスター増減
  • Step-Audio-EditX@stepfun-ai

    感情、話し方、パラ言語の編集に優れ、堅牢なゼロショットTTS機能を備えた、強力な3BパラメータのLLMベース強化学習オーディオ編集モデル

    971+1直近 7 日のスター増減
  • NISQA@gabrielmittag

    NISQA - 非侵入型音声品質およびTTS自然性評価

    970+2直近 7 日のスター増減
  • epub2tts@aedocw

    epubまたはテキストファイルをオーディオブックに変換します

    955-1直近 7 日のスター増減
  • audio-ai-hub@BinWang28

    音声 AI 研究のハブ: 音声 LLM、音声認識、TTS、音楽・音声生成に関する論文、オープンモデル、ベンチマーク、データセット。

    953+3直近 7 日のスター増減
  • Azure の自然な音声合成(TTS)音声を、SAPI 5 互換のアプリケーションから利用できるようにする

    933+12直近 7 日のスター増減
  • FireRedTTS@FireRedTeam

    オープンソースのLLMを活用した基盤TTSシステム

    920+1直近 7 日のスター増減
  • SmartJavaAI@geekwenjie

    🔥🔥🔥 Java の無料オフライン AI アルゴリズムツールボックス。顔認識、生体検知、表情認識、物体検出、インスタンスセグメンテーション、歩行者検出、OCR 文字認識、ナンバープレート認識、表認識、ASR+TTS、機械翻訳などの機能をサポートし、Maven 依存関係に追加するだけで使用できます。PyTorch、Tensorflow をサポートし、Mtcnn、InsightFace、SeetaFace6、YOLOv8~v12、PaddleOCR(PPOCRv5)、Whisper などの主流モデルを統合済みです。

    908+3直近 7 日のスター増減
  • mosec@mosecorg

    動的バッチ処理と CPU/GPU パイプラインを提供し、計算マシンの性能を最大限に引き出す高性能な ML モデルサービングフレームワーク

    902+0直近 7 日のスター増減
  • xtts-webui@daswer123

    XTTS の使用およびファインチューニングのための WebUI

    895+0直近 7 日のスター増減
  • diffwave@lmnt-com

    DiffWave は、高速で高品質なニューラルボコーダーおよび波形シンセサイザーです。

    885+0直近 7 日のスター増減
  • pdf-to-podcast@NVIDIA-AI-Blueprints

    PDFをAIポッドキャストに変換し、移動中でも魅力的な音声コンテンツを楽しめるようにする

    875+1直近 7 日のスター増減
  • Easy-Voice-Toolkit@Spr-Aachen

    音声認識、文字起こし、変換などのための使いやすいツールキット

    873+0直近 7 日のスター増減
  • bark.cpp@PABannier

    高速なテキスト読み上げ生成を実現する、C/C++版の Suno AI Bark モデル

    867+1直近 7 日のスター増減
  • esp-ai@wangzongming

    最もシンプルで低コストなAI統合ソリューション。このプロジェクトが気に入ったら、ぜひスターをお願いします〜

    856+2直近 7 日のスター増減
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    828+15直近 7 日のスター増減
  • Voxtral ASR と TTS をネイティブおよびブラウザ上で実行。Burn ML フレームワークを使用した Mistral の Voxtral mini リアルタイム ASR / TTS の Rust 実装

    819+2直近 7 日のスター増減
  • Kokoros@lucasjinreal

    Rust製のKokoro。https://huggingface.co/hexgrad/Kokoro-82M 圧倒的な高速性と高品質を実現したリアルタイムTTS

    817+1直近 7 日のスター増減
  • gitpodcast@BandarLabs

    任意の git リポジトリを魅力的なポッドキャストに変換する

    814-1直近 7 日のスター増減
  • lue@paulilaaso

    オーディオブック品質の音声読み上げ機能を備えたターミナル向け電子書籍リーダー — EPUB、PDF、DOCX、HTML、RTF、TXT、MD をサポート。

    806+2直近 7 日のスター増減
  • lobe-tts@lobehub

    🎤 Lobe TTS - サーバーおよびブラウザ向けの高品質で信頼性の高いTTS/STTライブラリ

    805+1直近 7 日のスター増減
  • 音声からテキスト、そして音声へ。現在再生中の楽曲。テキストをOSCメッセージとしてVRChatに送信し、アバター上に表示します。(STTTS) (Speech to TTS) (VRC STTシステム) (VTuber TTS)

    803+4直近 7 日のスター増減
  • ZerolanLiveRobot@AkagawaTsurunaki

    LLM、ASR、TTS、OCR、CVなどの技術を搭載し、ライブ配信を行ったりMinecraftを一緒にプレイしたりできるAI VTuber

    803+5直近 7 日のスター増減
  • CloneTTS@sipeter

    システム全体でのシームレスな音声クローンと高忠実度なテキスト読み上げを可能にする、軽量なオフライン Android Text-to-Speech (TTS) エンジン。

    801+2直近 7 日のスター増減
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: 多言語・クロスリンガル対応のゼロショットTTSエンジン

    794+10直近 7 日のスター増減
  • mlx-audio-swift@Blaizzy

    Apple Silicon上のMLXで音声処理を行うためのモジュール式Swift SDK

    772+6直近 7 日のスター増減
  • ROOT権限不要のオープンソースAndroid画面リアルタイム翻訳ツール。ゲーム、ビジュアルノベル、マンガに最適です。オンデバイスおよびクラウドOCR、オフラインLLM、多様な翻訳サービス、音声読み上げ(TTS)をサポートし、画面上に直接翻訳を表示できます。

    768+82直近 7 日のスター増減
  • dla@markovka17

    音声処理のためのディープラーニング

    763+1直近 7 日のスター増減
  • vui@fluxions-ai

    リアルタイム音声アシスタント — WebRTC ストリーミング、faster-whisper ASR、ローカル LLM、Vui Nano (300M) TTS。OpenAI Realtime API 互換。音声クローン、発話割り込み (barge-in)、RTX 4090 で約 9 倍のリアルタイム処理。Apache 2.0 ライセンス。

    757+10直近 7 日のスター増減
← トピック一覧に戻る