speaker-diarization
speaker-diarization टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर speaker-diarization के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और speaker-diarization टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
ट्रेनिंग, इन्फरेंस, स्ट्रीमिंग ASR, VAD, पंक्चुएशन, स्पीकर डायराइजेशन पाइपलाइन्स और OpenAI-संगत/MCP सर्विंग के लिए ओपन-सोर्स स्पीच रिकग्निशन टूलकिट।
★ 20,136+64पिछले 7 दिनों में स्टार का बदलाव - #2
PyTorch पर आधारित एक स्पीच टूलकिट।
★ 11,802+10पिछले 7 दिनों में स्टार का बदलाव - #3
स्ट्रीमिंग ASR, स्पीकर डायरिज़ेशन, अनुवाद और OpenAI/Deepgram-संगत API के साथ रीयल-टाइम, स्थानीय स्पीच-टू-टेक्स्ट।
★ 10,990+16पिछले 7 दिनों में स्टार का बदलाव - #4
स्पीकर डायराइजेशन के लिए न्यूरल बिल्डिंग ब्लॉक्स: स्पीच एक्टिविटी डिटेक्शन, स्पीकर चेंज डिटेक्शन, ओवरलैप्ड स्पीच डिटेक्शन, स्पीकर एम्बेडिंग।
★ 10,500+16पिछले 7 दिनों में स्टार का बदलाव - #5★ 9,949+3पिछले 7 दिनों में स्टार का बदलाव
- #6
Apple Silicon के लिए ऑन-डिवाइस स्पीच AI
★ 6,353+8पिछले 7 दिनों में स्टार का बदलाव - #7
OpenAI Whisper के आधार पर स्पीकर डायरीज़ेशन के साथ स्वचालित वाक् पहचान
★ 5,634+1पिछले 7 दिनों में स्टार का बदलाव - #8
Whisper और Faster-Whisper के स्टैंडअलोन निष्पादन योग्य (executables) उन लोगों के लिए जो Python के झंझट में नहीं पड़ना चाहते।
★ 3,171+2पिछले 7 दिनों में स्टार का बदलाव - #9
सिंगल और मल्टी-मोडल स्पीकर वेरिफिकेशन, स्पीकर रिकग्निशन और स्पीकर डायराइजेशन के लिए एक रिपॉजिटरी
★ 3,128+3पिछले 7 दिनों में स्टार का बदलाव - #10
शब्द-स्तरीय टाइमस्टैम्प और कॉन्फिडेंस के साथ बहुभाषी स्वचालित वाक् पहचान (Multilingual ASR)
★ 2,842+1पिछले 7 दिनों में स्टार का बदलाव - #11
आपके ऐप्स में फ्रंटियर CoreML ऑडियो मॉडल — टेक्स्ट-टू-स्पीच, स्पीच-टू-टेक्स्ट, वॉयस एक्टिविटी डिटेक्शन, और स्पीकर डायरिज़ेशन। Swift में, SOTA ओपन सोर्स द्वारा संचालित।
★ 2,723+13पिछले 7 दिनों में स्टार का बदलाव - #12★ 2,024+1पिछले 7 दिनों में स्टार का बदलाव
- #13
अद्भुत स्पीकर डायरिज़ेशन पेपर, लाइब्रेरी, डेटासेट और अन्य संसाधनों की एक क्यूरेटेड सूची।
★ 1,894+1पिछले 7 दिनों में स्टार का बदलाव - #14
चीनी, बोलियों, लहजों और बहुभाषी भाषण के लिए ओपन-सोर्स LLM-आधारित ASR मॉडल परिवार, FunASR, vLLM, स्ट्रीमिंग और llama.cpp रनटाइम के साथ।
★ 1,512+10पिछले 7 दिनों में स्टार का बदलाव - #15
Research and Production Oriented Speaker Verification, Recognition and Diarization Toolkit
★ 1,402+8पिछले 7 दिनों में स्टार का बदलाव - #16
Apple Silicon के लिए AI स्पीच टूलकिट — MLX और CoreML द्वारा संचालित ASR, TTS, स्पीच-टू-स्पीच, VAD और डायराइजेशन
★ 1,161+4पिछले 7 दिनों में स्टार का बदलाव - #17
llm सारांश के साथ टर्नकी सेल्फ-होस्टेड ऑफ़लाइन ट्रांसक्रिप्शन और डायरीज़ेशन सेवा
★ 948+2पिछले 7 दिनों में स्टार का बदलाव - #18
वन-स्टॉप स्वचालित उपशीर्षक जनरेटर। डाउनलोडिंग, ट्रांसक्रिप्शन, अनुवाद और हार्डकोडिंग को संभालता है - किसी मानवीय हस्तक्षेप की आवश्यकता नहीं है।
★ 810+3पिछले 7 दिनों में स्टार का बदलाव - #19★ 677+0पिछले 7 दिनों में स्टार का बदलाव
- #20
Google के स्पीकर डायराइजेशन पेपर्स में उपयोग किए गए (constrained) स्पेक्ट्रल क्लस्टरिंग एल्गोरिदम का Python में पुन: कार्यान्वयन।
★ 555+0पिछले 7 दिनों में स्टार का बदलाव