voice-recognition
voice-recognition टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर voice-recognition के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और voice-recognition टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
Python, Java, C# और Node के साथ Android, iOS, Raspberry Pi और सर्वर के लिए ऑफ़लाइन स्पीच रिकग्निशन API
★ 15,101+22पिछले 7 दिनों में स्टार का बदलाव - #2
उपयोग में आसान स्पीच टूलकिट जिसमें सेल्फ-सुपरवाइज्ड लर्निंग मॉडल, विराम चिह्नों के साथ SOTA/स्ट्रीमिंग ASR, टेक्स्ट फ्रंटएंड के साथ स्ट्रीमिंग TTS, स्पीकर वेरिफिकेशन सिस्टम, एंड-टू-एंड स्पीच ट्रांसलेशन और कीवर्ड स्पॉटिंग शामिल है। NAACL2022 बेस्ट डेमो अवार्ड जीता।
★ 12,676+6पिछले 7 दिनों में स्टार का बदलाव - #3
PyTorch पर आधारित एक स्पीच टूलकिट।
★ 11,802+17पिछले 7 दिनों में स्टार का बदलाव - #4
वॉइस एजेंट और इंटरफेस बनाने के लिए बहुत कम विलंबता (low latency) वाला स्पीच-टू-टेक्स्ट, इंटेंट रिकग्निशन और टेक्स्ट-टू-स्पीच
★ 10,997+53पिछले 7 दिनों में स्टार का बदलाव - #5
Silero VAD: पूर्व-प्रशिक्षित एंटरप्राइज़-ग्रेड वॉयस एक्टिविटी डिटेक्टर
★ 10,112+48पिछले 7 दिनों में स्टार का बदलाव - #6
OpenAI के Whisper का लगभग-लाइव कार्यान्वयन।
★ 4,246+5पिछले 7 दिनों में स्टार का बदलाव - #7
पूर्ण विशेषताओं वाला चीनी चरित्र टूल लाइब्रेरी (पinyin, स्ट्रोक, रेडिकल्स, मुहावरे, आवाज, विज़ुअलाइज़ेशन, आदि)
★ 3,087+4पिछले 7 दिनों में स्टार का बदलाव - #8
🐸STT - स्पीच-टू-टेक्स्ट के लिए डीप लर्निंग टूलकिट। STT मॉडल को प्रशिक्षित करना और तैनात करना इतना आसान कभी नहीं रहा।
★ 2,606+0पिछले 7 दिनों में स्टार का बदलाव - #9★ 2,256+8पिछले 7 दिनों में स्टार का बदलाव
- #10
🔊 आवाज़ और ध्वनि कंप्यूटिंग के लिए ओपन-सोर्स डेटासेट की एक व्यापक सूची (95+ डेटासेट)।
★ 2,223+1पिछले 7 दिनों में स्टार का बदलाव - #11
💎 ASR, TTS और अन्य Speech Technologies के लिए एक्सेसिबल स्पीच कॉर्पोरा की एक सूची
★ 1,399+0पिछले 7 दिनों में स्टार का बदलाव - #12
यह प्रोजेक्ट EcapaTdnn, ResNetSE, ERes2Net, CAM++ आदि जैसे विभिन्न उन्नत वॉइसप्रिंट पहचान मॉडल का उपयोग करता है। भविष्य में और अधिक मॉडल समर्थित किए जाने की संभावना है। साथ ही, यह प्रोजेक्ट MelSpectrogram, Spectrogram डेटा प्रीप्रोसेसिंग तरीकों का भी समर्थन करता है।
★ 1,313+1पिछले 7 दिनों में स्टार का बदलाव - #13
Python AI असिस्टेंट 🧠
★ 1,014+0पिछले 7 दिनों में स्टार का बदलाव - #14
Elite Dangerous के लिए कैप्टन लॉग और 3D स्टार मैप।
★ 896+0पिछले 7 दिनों में स्टार का बदलाव - #15★ 710+1पिछले 7 दिनों में स्टार का बदलाव
- #16
Voicetypr - macOS और Windows के लिए व्यस्त फाउंडर्स, कोडर और AI उपयोगकर्ताओं हेतु AI-संचालित ऑफलाइन वॉयस-टू-टेक्स्ट डिक्टेशन टूल। यह wispr flow और superwhisper का विकल्प है।
★ 703+10पिछले 7 दिनों में स्टार का बदलाव - #17
स्पीच-टू-टेक्स्ट बेंचमार्क फ्रेमवर्क
★ 697+0पिछले 7 दिनों में स्टार का बदलाव - #18
React Native Expo प्रोजेक्ट्स के लिए स्पीच रिकग्निशन
★ 675+6पिछले 7 दिनों में स्टार का बदलाव - #19★ 671+0पिछले 7 दिनों में स्टार का बदलाव
- #20★ 638+0पिछले 7 दिनों में स्टार का बदलाव
- #21
faster-whisper का उपयोग करके रियल-टाइम ट्रांसक्रिप्शन
★ 614+0पिछले 7 दिनों में स्टार का बदलाव - #22
रीयल-टाइम ऑडियो अनुवाद, सिस्टम ऑडियो + माइक कैप्चर करता है, ASR (Whisper/SenseVoice) चलाता है, और स्ट्रीमिंग डिस्प्ले के साथ LLM API के माध्यम से अनुवाद करता है। VTubers, लाइवस्ट्रीमर्स और विदेशी सामग्री देखने के लिए उपयुक्त।
★ 606+18पिछले 7 दिनों में स्टार का बदलाव - #23
🗣 एक ओवरले जो आपके उपयोगकर्ता की आवाज़ की अनुमति और इनपुट को एक कस्टमाइज़ेबल UI में टेक्स्ट के रूप में प्राप्त करता है
★ 557+0पिछले 7 दिनों में स्टार का बदलाव