मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें
विषय · audio-processing

audio-processing

audio-processing टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

57 रिपॉजिटरी
  • LanPaint@scraed

    प्रत्येक स्टेबल डिफ़्यूज़न मॉडल के लिए उच्च गुणवत्ता वाली ट्रेनिंग-मुक्त इनपेंट। ComfyUI का समर्थन करता है

    1,372+0पिछले 7 दिनों में स्टार का बदलाव
  • chromaprint@acoustid

    AcoustID द्वारा उपयोग किए जाने वाले ऑडियो फिंगरप्रिंट उत्पन्न करने के लिए C लाइब्रेरी

    1,362+0पिछले 7 दिनों में स्टार का बदलाव
  • DawDreamer@DBraun

    Python के साथ डिजिटल ऑडियो वर्कस्टेशन; VST इंस्ट्रूमेंट्स/इफेक्ट्स, पैरामीटर ऑटोमेशन, FAUST, JAX, वार्प मार्कर, और JUCE प्रोसेसर

    1,289+0पिछले 7 दिनों में स्टार का बदलाव
  • StreamSpeech@ictnlp

    StreamSpeech ऑफ़लाइन और एक साथ स्पीच रिकग्निशन, स्पीच ट्रांसलेशन और स्पीच सिंथेसिस के लिए एक "ऑल इन वन" सीमलेस मॉडल है।

    1,288+0पिछले 7 दिनों में स्टार का बदलाव
  • ffmediaelement@unosquare

    FFME: उन्नत WPF MediaElement (FFmpeg पर आधारित)

    1,274+0पिछले 7 दिनों में स्टार का बदलाव
  • TTS-Audio-Suite@diodiogod

    स्थानीय मल्टी-इंजन मल्टी-लैंग्वेज टेक्स्ट-टू-स्पीच और वॉयस कन्वर्जन के लिए एक ComfyUI कस्टम नोड इंटीग्रेशन। समर्थित: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (क्लासिक और बहुभाषी), F5-TTS, Higgs Audio 2, 3, और असीमित टेक्स्ट लंबाई, SRT टाइमिंग, कैरेक्टर सपोर्ट और कई ऑडियो टूल के साथ VibeVoice

    1,187+0पिछले 7 दिनों में स्टार का बदलाव
  • audino@midas-research

    इंसानों के लिए ओपन सोर्स ऑडियो एनोटेशन टूल

    1,146+0पिछले 7 दिनों में स्टार का बदलाव
  • nnAudio@KinWaiCheuk

    pytorch 1D कनवल्शन नेटवर्क का उपयोग करके ऑडियो प्रोसेसिंग।

    1,126+0पिछले 7 दिनों में स्टार का बदलाव
  • SLAM-LLM@X-LANCE

    लार्ज लैंग्वेज मॉडल के साथ स्पीच, लैंग्वेज, ऑडियो और म्यूजिक प्रोसेसिंग के लिए एक फ्रेमवर्क।

    1,058+1पिछले 7 दिनों में स्टार का बदलाव
  • .NET में ओपन सोर्स ऑडियो फिंगरप्रिंटिंग। पूरी तरह से C# में लिखा गया एक कुशल एकॉस्टिक फिंगरप्रिंटिंग एल्गोरिदम।

    1,036+0पिछले 7 दिनों में स्टार का बदलाव
  • klio@spotify

    ऑडियो के लिए स्मार्ट डेटा पाइपलाइन्स।

    876+1पिछले 7 दिनों में स्टार का बदलाव
  • react-native-audio-api@software-mansion

    react-native के लिए उच्च-प्रदर्शन ऑडियो इंजन

    837+2पिछले 7 दिनों में स्टार का बदलाव
  • XR3Player@goxr3plus

    🎧 🎼 सबसे उन्नत JavaFX मीडिया प्लेयर।

    771+0पिछले 7 दिनों में स्टार का बदलाव
  • APT@rnchg

    AI उत्पादकता टूल - मुफ्त और ओपन सोर्स, उपयोगकर्ता की उत्पादकता में सुधार करता है, और गोपनीयता तथा डेटा सुरक्षा की रक्षा करता है। इसमें शामिल हैं लेकिन सीमित नहीं: इन-बिल्ट लोकल एक्सक्लूसिव ChatGPT, DeepSeek, Phi, Qwen और अन्य मॉडल, चित्रों, वीडियो, ऑडियो आदि की एक-क्लिक बैच इंटेलिजेंट प्रोसेसिंग।

    768-1पिछले 7 दिनों में स्टार का बदलाव
  • ऑडियो AI में लार्ज लैंग्वेज मॉडल्स (LLMs) के अनुप्रयोगों पर संसाधनों का संग्रह

    738+0पिछले 7 दिनों में स्टार का बदलाव
  • उच्च-गुणवत्ता वाला प्रो ऑडियो रीसैंपलर / सैंपल रेट कन्वर्जन हेडर-ओनली C++ लाइब्रेरी। ऑडियो रीसैंपलिंग और टाइम-सीरीज़ इंटरपोलेशन दोनों के लिए बहुत तेज़।

    736+4पिछले 7 दिनों में स्टार का बदलाव
  • fast-music-remover@omeryusufyagci

    YouTube और अन्य इंटरनेट मीडिया के लिए C++ आधारित, हल्का संगीत और शोर हटाने वाला टूल, जो ऑडियो संवर्द्धन के लिए DeepFilterNet का उपयोग करता है।

    721+1पिछले 7 दिनों में स्टार का बदलाव
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: मूक वीडियो में सजीव और सिंक्रोनाइज़्ड साउंड जोड़ें

    663+0पिछले 7 दिनों में स्टार का बदलाव
  • jumpcutter@WofWca

    वाक्यों के बीच लंबे विराम को तेजी से आगे बढ़ाता है — लेक्चर्स को ~1.5 गुना तेजी से देखें (ब्राउज़र एक्सटेंशन)।

    662+0पिछले 7 दिनों में स्टार का बदलाव
  • PESQ@ludlows

    Python उपयोगकर्ताओं के लिए PESQ (Perceptual Evaluation of Speech Quality) रैपर (नैरो बैंड और वाइड बैंड)

    631+1पिछले 7 दिनों में स्टार का बदलाव
  • checkrr@aetaric

    Checkrr आपकी लाइब्रेरी फ़ाइलों को दूषित मीडिया के लिए स्कैन करता है और वैकल्पिक रूप से sonarr और radarr के माध्यम से फ़ाइलों को बदलता है

    578+2पिछले 7 दिनों में स्टार का बदलाव
  • nara_wpe@fgnt

    स्पीच डेरिवरबेरेशन के लिए "Weighted Prediction Error" के विभिन्न कार्यान्वयन (implementations)।

    571+1पिछले 7 दिनों में स्टार का बदलाव
  • Dplug@AuburnSounds

    D का उपयोग करके Linux/macOS/Windows के लिए VST2 / VST3 / AU / AAX / CLAP / LV2 / FLP प्लग-इन्स बनाएँ।

    564+0पिछले 7 दिनों में स्टार का बदलाव
  • unified-audio@alibaba

    ऑडियो प्रोसेसिंग और जनरेशन को एकीकृत करने के लिए एक ओपन-सोर्स प्रोजेक्ट

    520+4पिछले 7 दिनों में स्टार का बदलाव
  • SoundFlow@LSXPrime

    .NET 8+ के लिए एक उच्च-प्रदर्शन, मॉड्यूलर ऑडियो और MIDI इंजन। पूरे ऑडियो लाइफसाइकिल के लिए एक पूर्ण टूलकिट: प्लेबैक, रिकॉर्डिंग, मल्टी-ट्रैक एडिटिंग, प्रो सिंथेसिस (MPE/SF2), रियल-टाइम DSP, और विज़ुअलाइज़ेशन। इसमें AES-256 एन्क्रिप्शन, एकॉस्टिक फिंगरप्रिंटिंग और वॉटरमार्किंग के लिए एक अद्वितीय सुरक्षा सुइट शामिल है। SIMD और NativeAOT सपोर्ट के साथ।

    511+5पिछले 7 दिनों में स्टार का बदलाव
  • android-vad@gkonovalov

    Android Voice Activity Detection (VAD) लाइब्रेरी। WebRTC VAD GMM, Silero VAD DNN, Yamnet VAD DNN मॉडल का समर्थन करता है।

    506+0पिछले 7 दिनों में स्टार का बदलाव
  • MediaEditor@opencodewin

    एक नॉन-लीनियर एडिटिंग सॉफ्टवेयर जो आपको बेहतरीन वीडियो बनाने में मदद करता है

    503+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस