メインコンテンツへスキップ
buildradar
ログイン
トピック · audio-processing

audio-processing

audio-processing がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

57 件のリポジトリ
  • LanPaint@scraed

    あらゆるStable Diffusionモデルに対応する、高品質かつトレーニング不要のインペイント。ComfyUIをサポート

    1,372+0直近 7 日のスター増減
  • chromaprint@acoustid

    AcoustID で使用されるオーディオフィンガープリントを生成するための C ライブラリ

    1,362+0直近 7 日のスター増減
  • DawDreamer@DBraun

    Pythonによるデジタルオーディオワークステーション(DAW); VSTインストゥルメント/エフェクト、パラメータ自動化、FAUST、JAX、Warp Markers、JUCEプロセッサ

    1,289+0直近 7 日のスター増減
  • StreamSpeech@ictnlp

    StreamSpeech は、オフラインおよび同時音声認識、音声翻訳、音声合成のための「オールインワン」シームレスモデルです。

    1,288+0直近 7 日のスター増減
  • ffmediaelement@unosquare

    FFME: 高度なWPF MediaElement(FFmpegベース)

    1,274+0直近 7 日のスター増減
  • TTS-Audio-Suite@diodiogod

    ローカルでのマルチエンジン・多言語の音声合成(TTS)および音声変換を行うためのComfyUIカスタムノード統合。RVC、Echo-TTS、Qwen3-TTS、Cozy Voice 3、Step Audio EditX、IndexTTS-2、Chatterbox(クラシックおよび多言語)、F5-TTS、Higgs Audio 2、3、VibeVoiceをサポートし、無制限のテキスト長、SRTタイミング、キャラクターサポート、および多数のオーディオツールを備えています。

    1,187+0直近 7 日のスター増減
  • audino@midas-research

    人間向けのオープンソース音声アノテーションツール

    1,146+0直近 7 日のスター増減
  • nnAudio@KinWaiCheuk

    PyTorchの1D畳み込みネットワークを使用した音声処理

    1,126+0直近 7 日のスター増減
  • SLAM-LLM@X-LANCE

    大規模言語モデルを用いた音声、言語、オーディオ、音楽処理のためのフレームワーク

    1,058+1直近 7 日のスター増減
  • .NET向けのオープンソースの音声フィンガープリンティング。純粋なC#で書かれた、音響フィンガープリンティングのための効率的なアルゴリズム。

    1,036+0直近 7 日のスター増減
  • klio@spotify

    音声用のよりスマートなデータパイプライン

    876+1直近 7 日のスター増減
  • react-native-audio-api@software-mansion

    react-native向け高性能オーディオエンジン

    837+2直近 7 日のスター増減
  • XR3Player@goxr3plus

    🎧 🎼 最も高度なJavaFXメディアプレイヤー

    771+0直近 7 日のスター増減
  • APT@rnchg

    AI生産性向上ツール - 無料かつオープンソースで、ユーザーの生産性を向上させ、プライバシーとデータのセキュリティを保護します。内蔵のローカル専用ChatGPT、DeepSeek、Phi、Qwenなどのモデル、画像・動画・音声などのワンクリック一括インテリジェント処理を含みますが、これらに限定されません。

    768-1直近 7 日のスター増減
  • オーディオAIにおける大規模言語モデル(LLM)の応用に関するリソース集

    738+0直近 7 日のスター増減
  • 高品質なプロ用オーディオのリサンプラー/サンプルレート変換ヘッダーオンリー C++ ライブラリ。音声リサンプリングと時系列補間の両方で非常に高速です。

    736+4直近 7 日のスター増減
  • fast-music-remover@omeryusufyagci

    DeepFilterNetによる音声拡張を使用した、C++ベースの軽量なYouTubeおよびインターネットメディア向け音楽・ノイズリムーバー

    721+1直近 7 日のスター増減
  • jumpcutter@WofWca

    文間の長い無音部分を早送りし、講義動画を約1.5倍速で視聴できるブラウザ拡張機能

    663+0直近 7 日のスター増減
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter:リアルで同期したサウンドでサイレント動画に生命を吹き込む。無声動画に生き生きとした同期音声を追加するAIフォーリーツール 😝

    663+0直近 7 日のスター増減
  • PESQ@ludlows

    Pythonユーザー向けのPESQ(音声品質の知覚評価)ラッパー(狭帯域および広帯域対応)

    631+1直近 7 日のスター増減
  • checkrr@aetaric

    ライブラリ内の破損したメディアファイルをスキャンし、必要に応じてsonarrやradarr経由でファイルを置き換えるCheckrr

    578+2直近 7 日のスター増減
  • nara_wpe@fgnt

    音声の残響除去(デリバーベレーション)のための「重み付き予測誤差(WPE)」のさまざまな実装

    571+1直近 7 日のスター増減
  • Dplug@AuburnSounds

    D 言語を使用して Linux/macOS/Windows 向けの VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP プラグインを作成する

    564+0直近 7 日のスター増減
  • unified-audio@alibaba

    音声処理と生成を統合するオープンソースプロジェクト

    520+4直近 7 日のスター増減
  • SoundFlow@LSXPrime

    .NET 8+ 向けの高性能かつモジュール式のオーディオ&MIDIエンジン。再生、録音、マルチトラック編集、プロ仕様のシンセシス(MPE/SF2)、リアルタイム DSP、ビジュアライゼーションなど、オーディオのライフサイクル全体を網羅する完全なツールキット。AES-256暗号化、音響フィンガープリンティング、ウォーターマーキングのための独自のセキュリティスイートを搭載。SIMD と NativeAOT をサポート。

    511+5直近 7 日のスター増減
  • android-vad@gkonovalov

    Android 音声活動検出 (VAD) ライブラリ。WebRTC VAD GMM、Silero VAD DNN、Yamnet VAD DNN モデルをサポート。

    506+0直近 7 日のスター増減
  • MediaEditor@opencodewin

    素敵な動画作成を支援するノンリニア編集ソフト

    503+0直近 7 日のスター増減
← トピック一覧に戻る