मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · voice-recognition

voice-recognition

voice-recognition टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
23
कुल स्टार
85,588
औसत स्टार
3,721
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर voice-recognition के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और voice-recognition टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • vosk-api@alphacep

    Python, Java, C# और Node के साथ Android, iOS, Raspberry Pi और सर्वर के लिए ऑफ़लाइन स्पीच रिकग्निशन API

    15,101+22पिछले 7 दिनों में स्टार का बदलाव
  • PaddleSpeech@PaddlePaddle

    उपयोग में आसान स्पीच टूलकिट जिसमें सेल्फ-सुपरवाइज्ड लर्निंग मॉडल, विराम चिह्नों के साथ SOTA/स्ट्रीमिंग ASR, टेक्स्ट फ्रंटएंड के साथ स्ट्रीमिंग TTS, स्पीकर वेरिफिकेशन सिस्टम, एंड-टू-एंड स्पीच ट्रांसलेशन और कीवर्ड स्पॉटिंग शामिल है। NAACL2022 बेस्ट डेमो अवार्ड जीता।

    12,676+6पिछले 7 दिनों में स्टार का बदलाव
  • speechbrain@speechbrain

    PyTorch पर आधारित एक स्पीच टूलकिट।

    11,802+17पिछले 7 दिनों में स्टार का बदलाव
  • moonshine@moonshine-ai

    वॉइस एजेंट और इंटरफेस बनाने के लिए बहुत कम विलंबता (low latency) वाला स्पीच-टू-टेक्स्ट, इंटेंट रिकग्निशन और टेक्स्ट-टू-स्पीच

    10,997+53पिछले 7 दिनों में स्टार का बदलाव
  • silero-vad@snakers4

    Silero VAD: पूर्व-प्रशिक्षित एंटरप्राइज़-ग्रेड वॉयस एक्टिविटी डिटेक्टर

    10,112+48पिछले 7 दिनों में स्टार का बदलाव
  • WhisperLive@collabora

    OpenAI के Whisper का लगभग-लाइव कार्यान्वयन।

    4,246+5पिछले 7 दिनों में स्टार का बदलाव
  • cnchar@theajack

    पूर्ण विशेषताओं वाला चीनी चरित्र टूल लाइब्रेरी (पinyin, स्ट्रोक, रेडिकल्स, मुहावरे, आवाज, विज़ुअलाइज़ेशन, आदि)

    3,087+4पिछले 7 दिनों में स्टार का बदलाव
  • STT@coqui-ai

    🐸STT - स्पीच-टू-टेक्स्ट के लिए डीप लर्निंग टूलकिट। STT मॉडल को प्रशिक्षित करना और तैनात करना इतना आसान कभी नहीं रहा।

    2,606+0पिछले 7 दिनों में स्टार का बदलाव
  • ten-vad@TEN-framework

    वॉयस एक्टिविटी डिटेक्टर (VAD): कम-विलंबता, उच्च-प्रदर्शन और हल्का

    2,256+8पिछले 7 दिनों में स्टार का बदलाव
  • voice_datasets@jim-schwoebel

    🔊 आवाज़ और ध्वनि कंप्यूटिंग के लिए ओपन-सोर्स डेटासेट की एक व्यापक सूची (95+ डेटासेट)।

    2,223+1पिछले 7 दिनों में स्टार का बदलाव
  • 💎 ASR, TTS और अन्य Speech Technologies के लिए एक्सेसिबल स्पीच कॉर्पोरा की एक सूची

    1,399+0पिछले 7 दिनों में स्टार का बदलाव
  • यह प्रोजेक्ट EcapaTdnn, ResNetSE, ERes2Net, CAM++ आदि जैसे विभिन्न उन्नत वॉइसप्रिंट पहचान मॉडल का उपयोग करता है। भविष्य में और अधिक मॉडल समर्थित किए जाने की संभावना है। साथ ही, यह प्रोजेक्ट MelSpectrogram, Spectrogram डेटा प्रीप्रोसेसिंग तरीकों का भी समर्थन करता है।

    1,313+1पिछले 7 दिनों में स्टार का बदलाव
  • Python AI असिस्टेंट 🧠

    1,014+0पिछले 7 दिनों में स्टार का बदलाव
  • EDDiscovery@EDDiscovery

    Elite Dangerous के लिए कैप्टन लॉग और 3D स्टार मैप।

    896+0पिछले 7 दिनों में स्टार का बदलाव
  • rhino@Picovoice

    deep learning द्वारा संचालित On-device Speech-to-Intent इंजन

    710+1पिछले 7 दिनों में स्टार का बदलाव
  • voicetypr@moinulmoin

    Voicetypr - macOS और Windows के लिए व्यस्त फाउंडर्स, कोडर और AI उपयोगकर्ताओं हेतु AI-संचालित ऑफलाइन वॉयस-टू-टेक्स्ट डिक्टेशन टूल। यह wispr flow और superwhisper का विकल्प है।

    703+10पिछले 7 दिनों में स्टार का बदलाव
  • स्पीच-टू-टेक्स्ट बेंचमार्क फ्रेमवर्क

    697+0पिछले 7 दिनों में स्टार का बदलाव
  • React Native Expo प्रोजेक्ट्स के लिए स्पीच रिकग्निशन

    675+6पिछले 7 दिनों में स्टार का बदलाव
  • cheetah@Picovoice

    डीप लर्निंग द्वारा संचालित ऑन-डिफ़ाइस स्ट्रीमिंग स्पीच-टू-टेक्स्ट इंजन

    671+0पिछले 7 दिनों में स्टार का बदलाव
  • sonus@evancohen

    Node के लिए STT (स्पीच टू टेक्स्ट), जिसमें ऑफलाइन हॉटवर्ड डिटेक्शन की सुविधा है।

    638+0पिछले 7 दिनों में स्टार का बदलाव
  • speech-to-text@reriiasu

    faster-whisper का उपयोग करके रियल-टाइम ट्रांसक्रिप्शन

    614+0पिछले 7 दिनों में स्टार का बदलाव
  • LiveTranslate@TheDeathDragon

    रीयल-टाइम ऑडियो अनुवाद, सिस्टम ऑडियो + माइक कैप्चर करता है, ASR (Whisper/SenseVoice) चलाता है, और स्ट्रीमिंग डिस्प्ले के साथ LLM API के माध्यम से अनुवाद करता है। VTubers, लाइवस्ट्रीमर्स और विदेशी सामग्री देखने के लिए उपयुक्त।

    606+18पिछले 7 दिनों में स्टार का बदलाव
  • 🗣 एक ओवरले जो आपके उपयोगकर्ता की आवाज़ की अनुमति और इनपुट को एक कस्टमाइज़ेबल UI में टेक्स्ट के रूप में प्राप्त करता है

    557+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस