automatic-speech-recognition
automatic-speech-recognition टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर automatic-speech-recognition के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और automatic-speech-recognition टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
स्ट्रीमिंग ASR, स्पीकर डायरिज़ेशन, अनुवाद और OpenAI/Deepgram-संगत API के साथ रीयल-टाइम, स्थानीय स्पीच-टू-टेक्स्ट।
★ 10,990+16पिछले 7 दिनों में स्टार का बदलाव - #2★ 5,229+1पिछले 7 दिनों में स्टार का बदलाव
- #3
OpenAI Whisper ASR वेबसर्विस API
★ 3,328+2पिछले 7 दिनों में स्टार का बदलाव - #4
[AutoArk] GPA (General Purpose Audio) एक छोटे मॉडल के साथ ASR, TTS और वॉयस कन्वर्जन कर सकता है!
★ 3,061+164पिछले 7 दिनों में स्टार का बदलाव - #5
आपके ऐप्स में फ्रंटियर CoreML ऑडियो मॉडल — टेक्स्ट-टू-स्पीच, स्पीच-टू-टेक्स्ट, वॉयस एक्टिविटी डिटेक्शन, और स्पीकर डायरिज़ेशन। Swift में, SOTA ओपन सोर्स द्वारा संचालित।
★ 2,723+13पिछले 7 दिनों में स्टार का बदलाव - #6
🐸STT - स्पीच-टू-टेक्स्ट के लिए डीप लर्निंग टूलकिट। STT मॉडल को प्रशिक्षित करना और तैनात करना इतना आसान कभी नहीं रहा।
★ 2,606+1पिछले 7 दिनों में स्टार का बदलाव - #7★ 2,256+7पिछले 7 दिनों में स्टार का बदलाव
- #8
मंदारिन, चीनी बोलियों और अंग्रेजी का समर्थन करने वाले ओपन-सोर्स इंडस्ट्रियल-ग्रेड ASR मॉडल, सार्वजनिक मंदारिन ASR बेंचमार्क पर एक नया SOTA हासिल करते हैं, साथ ही उत्कृष्ट गायन गीत पहचान क्षमता भी प्रदान करते हैं।
★ 1,975+2पिछले 7 दिनों में स्टार का बदलाव - #9
:zap: TensorFlowASR: Tensorflow 2 में लगभग अत्याधुनिक (State-of-the-art) स्वचालित वाक् पहचान (ASR)। समर्थित भाषाओं में वर्णों या सबवर्ड का उपयोग किया जा सकता है।
★ 1,010+0पिछले 7 दिनों में स्टार का बदलाव - #10
Word Error Rate (WER) जैसे समानता मापदंडों के साथ अपने स्पीच-टू-टेक्स्ट सिस्टम का मूल्यांकन करें।
★ 927+1पिछले 7 दिनों में स्टार का बदलाव - #11
ऑडियो AI में लार्ज लैंग्वेज मॉडल्स (LLMs) के अनुप्रयोगों पर संसाधनों का संग्रह
★ 738+1पिछले 7 दिनों में स्टार का बदलाव - #12
Android के लिए OpenAI Whisper और TensorFlow Lite के साथ ऑफ़लाइन वाक् पहचान (Speech Recognition)
★ 688+0पिछले 7 दिनों में स्टार का बदलाव - #13★ 671+0पिछले 7 दिनों में स्टार का बदलाव
- #14
ASR, VAD, LID और Punc मॉड्यूल के साथ एक अत्याधुनिक औद्योगिक-ग्रेड ऑल-इन-वन ASR सिस्टम। FireRedASR2 चीनी (मंदारिन, 20+ बोलियों/उच्चारणों), अंग्रेजी, कोड-स्विचिंग, और भाषण और गायन दोनों ASR का समर्थन करता है। FireRedVAD 100+ भाषाओं में भाषण/गायन/संगीत का समर्थन करता है। FireRedLID 100+ भाषाओं और 20+ चीनी बोलियों का समर्थन करता है। FireRedPunc चीनी और अंग्रेजी का समर्थन करता है।
★ 669+12पिछले 7 दिनों में स्टार का बदलाव