मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · automatic-speech-recognition

automatic-speech-recognition

automatic-speech-recognition टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
14
कुल स्टार
36,866
औसत स्टार
2,633
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर automatic-speech-recognition के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और automatic-speech-recognition टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • WhisperLiveKit@QuentinFuxa

    स्ट्रीमिंग ASR, स्पीकर डायरिज़ेशन, अनुवाद और OpenAI/Deepgram-संगत API के साथ रीयल-टाइम, स्थानीय स्पीच-टू-टेक्स्ट।

    10,990+16पिछले 7 दिनों में स्टार का बदलाव
  • wenet@wenet-e2e

    प्रोडक्शन फर्स्ट और प्रोडक्शन रेडी एंड-टू-एंड स्पीच रिकग्निशन टूलकिट

    5,229+1पिछले 7 दिनों में स्टार का बदलाव
  • OpenAI Whisper ASR वेबसर्विस API

    3,328+2पिछले 7 दिनों में स्टार का बदलाव
  • GPA@AutoArk

    [AutoArk] GPA (General Purpose Audio) एक छोटे मॉडल के साथ ASR, TTS और वॉयस कन्वर्जन कर सकता है!

    3,061+164पिछले 7 दिनों में स्टार का बदलाव
  • FluidAudio@FluidInference

    आपके ऐप्स में फ्रंटियर CoreML ऑडियो मॉडल — टेक्स्ट-टू-स्पीच, स्पीच-टू-टेक्स्ट, वॉयस एक्टिविटी डिटेक्शन, और स्पीकर डायरिज़ेशन। Swift में, SOTA ओपन सोर्स द्वारा संचालित।

    2,723+13पिछले 7 दिनों में स्टार का बदलाव
  • STT@coqui-ai

    🐸STT - स्पीच-टू-टेक्स्ट के लिए डीप लर्निंग टूलकिट। STT मॉडल को प्रशिक्षित करना और तैनात करना इतना आसान कभी नहीं रहा।

    2,606+1पिछले 7 दिनों में स्टार का बदलाव
  • ten-vad@TEN-framework

    वॉयस एक्टिविटी डिटेक्टर (VAD): कम-विलंबता, उच्च-प्रदर्शन और हल्का

    2,256+7पिछले 7 दिनों में स्टार का बदलाव
  • FireRedASR@FireRedTeam

    मंदारिन, चीनी बोलियों और अंग्रेजी का समर्थन करने वाले ओपन-सोर्स इंडस्ट्रियल-ग्रेड ASR मॉडल, सार्वजनिक मंदारिन ASR बेंचमार्क पर एक नया SOTA हासिल करते हैं, साथ ही उत्कृष्ट गायन गीत पहचान क्षमता भी प्रदान करते हैं।

    1,975+2पिछले 7 दिनों में स्टार का बदलाव
  • TensorFlowASR@TensorSpeech

    :zap: TensorFlowASR: Tensorflow 2 में लगभग अत्याधुनिक (State-of-the-art) स्वचालित वाक् पहचान (ASR)। समर्थित भाषाओं में वर्णों या सबवर्ड का उपयोग किया जा सकता है।

    1,010+0पिछले 7 दिनों में स्टार का बदलाव
  • jiwer@jitsi

    Word Error Rate (WER) जैसे समानता मापदंडों के साथ अपने स्पीच-टू-टेक्स्ट सिस्टम का मूल्यांकन करें।

    927+1पिछले 7 दिनों में स्टार का बदलाव
  • ऑडियो AI में लार्ज लैंग्वेज मॉडल्स (LLMs) के अनुप्रयोगों पर संसाधनों का संग्रह

    738+1पिछले 7 दिनों में स्टार का बदलाव
  • Android के लिए OpenAI Whisper और TensorFlow Lite के साथ ऑफ़लाइन वाक् पहचान (Speech Recognition)

    688+0पिछले 7 दिनों में स्टार का बदलाव
  • cheetah@Picovoice

    डीप लर्निंग द्वारा संचालित ऑन-डिफ़ाइस स्ट्रीमिंग स्पीच-टू-टेक्स्ट इंजन

    671+0पिछले 7 दिनों में स्टार का बदलाव
  • FireRedASR2S@FireRedTeam

    ASR, VAD, LID और Punc मॉड्यूल के साथ एक अत्याधुनिक औद्योगिक-ग्रेड ऑल-इन-वन ASR सिस्टम। FireRedASR2 चीनी (मंदारिन, 20+ बोलियों/उच्चारणों), अंग्रेजी, कोड-स्विचिंग, और भाषण और गायन दोनों ASR का समर्थन करता है। FireRedVAD 100+ भाषाओं में भाषण/गायन/संगीत का समर्थन करता है। FireRedLID 100+ भाषाओं और 20+ चीनी बोलियों का समर्थन करता है। FireRedPunc चीनी और अंग्रेजी का समर्थन करता है।

    669+12पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस