मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · speech

speech

speech टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

74 रिपॉजिटरी
  • TTS-papers@coqui-ai

    🐸 TTS पेपर का संग्रह

    734+1पिछले 7 दिनों में स्टार का बदलाव
  • MASR@yeyupiaoling

    Pytorch में कार्यान्वित स्ट्रीमिंग और नॉन-स्ट्रीमिंग ऑटोमैटिक स्पीच रिकग्निशन फ्रेमवर्क, जो ऑनलाइन और ऑफलाइन रिकग्निशन के साथ संगत है, वर्तमान में Conformer, Squeezeformer, और DeepSpeech2 मॉडल का समर्थन करता है और विभिन्न डेटा ऑगमेंटेशन विधियों के साथ आता है।

    727+0पिछले 7 दिनों में स्टार का बदलाव
  • FreeVC@OlaWod

    FreeVC: उच्च-गुणवत्ता वाले टेक्स्ट-फ्री वन-शॉट वॉयस कन्वर्जन की दिशा में

    716+0पिछले 7 दिनों में स्टार का बदलाव
  • openspeech@openspeech-team

    PyTorch-Lightning और Hydra का लाभ उठाने वाला एंड-टू-एंड स्पीच रिकग्निशन के लिए ओपन-सोर्स टूलकिट।

    714+0पिछले 7 दिनों में स्टार का बदलाव
  • BabelDuck@Orenoid

    शुरुआती लोगों के लिए AI वार्तालाप अभ्यास एप्लिकेशन

    693+1पिछले 7 दिनों में स्टार का बदलाव
  • chatterbox-tts-api@travisvn

    Chatterbox का उपयोग करने वाला लोकल, OpenAI-compatible टेक्स्ट-टू-स्पीच (TTS) API, जो उपयोगकर्ताओं को कहीं भी वॉयस क्लोन स्पीच जेनरेट करने की अनुमति देता है जहाँ OpenAI API का उपयोग किया जाता है (जैसे Open WebUI, AnythingLLM, आदि)।

    676+5पिछले 7 दिनों में स्टार का बदलाव
  • MOSS-Audio@OpenMOSS

    MOSS-Audio एकीकृत ऑडियो समझ के लिए एक ओपन-सोर्स फाउंडेशन मॉडल है, जो वास्तविक दुनिया के परिदृश्यों में भाषण, ध्वनि, संगीत, कैप्शनिंग, QA और तर्क को सक्षम बनाता है।

    656+5पिछले 7 दिनों में स्टार का बदलाव
  • sonus@evancohen

    Node के लिए STT (स्पीच टू टेक्स्ट), जिसमें ऑफलाइन हॉटवर्ड डिटेक्शन की सुविधा है।

    638+0पिछले 7 दिनों में स्टार का बदलाव
  • स्पीच डोमेन लैब्स/कंपनियां/संसाधन/इंटर्नशिप आदि, सिफारिशों या स्व-प्रस्तुति का स्वागत है।

    610+1पिछले 7 दिनों में स्टार का बदलाव
  • सार्वजनिक रूप से उपलब्ध रूम इम्पल्स रिस्पांस डेटासेट और उन्हें डाउनलोड करने के लिए स्क्रिप्ट की एक सूची।

    608+2पिछले 7 दिनों में स्टार का बदलाव
  • Leaderboard@SpeechColab

    SpeechIO लीडरबोर्ड: ऑटोमैटिक स्पीच रिकग्निशन के लिए एक बड़ा, मजबूत और व्यापक बेंचमार्किंग प्लेटफ़ॉर्म।

    553+3पिछले 7 दिनों में स्टार का बदलाव
  • tacotron@google

    Tacotron से संबंधित प्रकाशनों के साथ ऑडियो नमूने, जो एक एंड-टू-एंड स्पीच सिंथेसिस मॉडल है

    539+0पिछले 7 दिनों में स्टार का बदलाव
  • knn-vc@bshall

    केवल नियरेस्ट नेबर्स (Nearest Neighbors) के साथ वॉयस कन्वर्जन

    524+1पिछले 7 दिनों में स्टार का बदलाव
  • StarGANv2-VC@yl4579

    StarGANv2-VC: प्राकृतिक लगने वाले वॉइस कन्वर्शन के लिए एक विविध, अनसुपरवाइज्ड, नॉन-पैरेलल फ्रेमवर्क

    522+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस