मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · speech-synthesis

speech-synthesis

speech-synthesis टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
66
कुल स्टार
3,48,104
औसत स्टार
5,274
हिस्सा
0.02%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर speech-synthesis के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और speech-synthesis टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • TTS@coqui-ai

    🐸💬 - Text-to-Speech के लिए एक डीप लर्निंग टूलकिट, जो रिसर्च और प्रोडक्शन में परखा हुआ है

    45,985+18पिछले 7 दिनों में स्टार का बदलाव
  • VoxCPM@OpenBMB

    VoxCPM2: बहुभाषी भाषण निर्माण, रचनात्मक आवाज़ डिज़ाइन, और वास्तविक क्लोनिंग के लिए टोकनराइज़र-मुक्त TTS

    36,595+345पिछले 7 दिनों में स्टार का बदलाव
  • Speech@NVIDIA-NeMo

    Linguistic Models, Multimodal और Speech AI पर काम कर रहे शोधकर्ताओं और डेवलपर्स के लिए बनाया गया एक स्केलेबल जनरेटिव AI फ़्रेमवर्क

    18,379+21पिछले 7 दिनों में स्टार का बदलाव
  • leon@leon-ai

    🧠 Leon आपका ओपन-सोर्स पर्सनल असिस्टेंट है।

    17,476+1पिछले 7 दिनों में स्टार का बदलाव
  • DeepLearningExamples@NVIDIA

    मॉडलों द्वारा आयोजित अत्याधुनिक Deep Learning स्क्रिप्ट - एंटरप्राइज़-ग्रेड बुनियादी ढांचे पर पुनरुत्पादित सटीकता और प्रदर्शन के साथ प्रशिक्षित और तैनात करने में आसान।

    14,846+4पिछले 7 दिनों में स्टार का बदलाव
  • supertonic@supertone-inc

    बिजली की गति वाला, ऑन-डिवाइस, बहुभाषी TTS — जो ONNX के माध्यम से नेटिव रूप से चलता है।

    13,757+20पिछले 7 दिनों में स्टार का बदलाव
  • speech-to-speech@huggingface

    ओपन-सोर्स मॉडल के साथ वॉयस एजेंट बनाएं

    13,015+82पिछले 7 दिनों में स्टार का बदलाव
  • voice-pro@abus-aikorea

    क्रिएटर्स और डेवलपर्स के लिए Gradio WebUI, जिसमें प्रमुख TTS (Edge-TTS, kokoro) और ज़ीरो-शॉट Voice Cloning (E2 & F5-TTS, CosyVoice) शामिल हैं, साथ ही Whisper ऑडियो प्रोसेसिंग, YouTube डाउनलोड, Demucs वोकल आइसोलेशन और बहुभाषी अनुवाद शामिल हैं।

    12,730+54पिछले 7 दिनों में स्टार का बदलाव
  • PaddleSpeech@PaddlePaddle

    उपयोग में आसान स्पीच टूलकिट जिसमें सेल्फ-सुपरवाइज्ड लर्निंग मॉडल, विराम चिह्नों के साथ SOTA/स्ट्रीमिंग ASR, टेक्स्ट फ्रंटएंड के साथ स्ट्रीमिंग TTS, स्पीकर वेरिफिकेशन सिस्टम, एंड-टू-एंड स्पीच ट्रांसलेशन और कीवर्ड स्पॉटिंग शामिल है। NAACL2022 बेस्ट डेमो अवार्ड जीता।

    12,676+5पिछले 7 दिनों में स्टार का बदलाव
  • edge-tts@rany2

    Microsoft Edge या Windows या API की की आवश्यकता के बिना Python से Microsoft Edge की ऑनलाइन टेक्स्ट-टू-स्पीच सेवा का उपयोग करें।

    11,847+29पिछले 7 दिनों में स्टार का बदलाव
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) ऑडियो, म्यूजिक और स्पीच जनरेशन के लिए एक टूलकिट है। इसका उद्देश्य पुनरुत्पादनीय अनुसंधान (reproducible research) का समर्थन करना और नए शोधकर्ताओं व इंजीनियरों को ऑडियो, म्यूजिक और स्पीच जनरेशन के क्षेत्र में शुरुआत करने में मदद करना है।

    10,276+1पिछले 7 दिनों में स्टार का बदलाव
  • espnet@espnet

    एंड-टू-एंड स्पीच प्रोसेसिंग टूलकिट

    9,949+3पिछले 7 दिनों में स्टार का बदलाव
  • so-vits-svc-fork@voicepaw

    realtime support, improved interface और अधिक features के साथ so-vits-svc fork।

    9,329+3पिछले 7 दिनों में स्टार का बदलाव
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: एक बहु-आवाज़ और प्रॉम्प्ट-नियंत्रित TTS इंजन

    8,522-1पिछले 7 दिनों में स्टार का बदलाव
  • mlx-audio@Blaizzy

    Apple के MLX फ्रेमवर्क पर बनी एक टेक्स्ट-टू-स्पीच (TTS), स्पीच-टू-टेक्स्ट (STT) और स्पीच-टू-स्पीच (STS) लाइब्रेरी, जो Apple Silicon पर कुशल भाषण विश्लेषण प्रदान करती है।

    7,826+23पिछले 7 दिनों में स्टार का बदलाव
  • espeak-ng@espeak-ng

    eSpeak NG एक ओपन सोर्स स्पीच सिंथेसाइज़र है जो सौ से अधिक भाषाओं और लहजों का समर्थन करता है।

    6,802+13पिछले 7 दिनों में स्टार का बदलाव
  • StyleTTS2@yl4579

    StyleTTS 2: लार्ज स्पीच लैंग्वेज मॉडल के साथ स्टाइल डिफ़्यूज़न और एडवरसरियल ट्रेनिंग के माध्यम से मानव-स्तरीय टेक्स्ट-टू-स्पीच की ओर

    6,342+3पिछले 7 दिनों में स्टार का बदलाव
  • silero-models@snakers4

    Silero मॉडल: प्री-ट्रेनिंग टेक्स्ट-टू-स्पीच मॉडल जिन्हें अत्यंत सरल बनाया गया है

    6,084-1पिछले 7 दिनों में स्टार का बदलाव
  • abogen@denizsafak

    सिंक्रनाइज़ कैप्शन के साथ EPUBs, PDFs और टेक्स्ट से ऑडियोबुक जेनरेट करें।

    5,831+45पिछले 7 दिनों में स्टार का बदलाव
  • DiffSinger@MoonInTheRiver

    DiffSinger: शैलो डिफ्यूजन तंत्र (SVS & TTS) के माध्यम से सिंगिंग वॉयस सिंथेसिस; AAAI 2022; आधिकारिक कोड

    4,855+3पिछले 7 दिनों में स्टार का बदलाव
  • WhisperSpeech@WhisperSpeech

    Whisper को उलट कर बनाया गया एक ओपन सोर्स टेक्स्ट-टू-स्पीच सिस्टम।

    4,645+3पिछले 7 दिनों में स्टार का बदलाव
  • OpenUtau@openutau

    ओपन सिंगिंग सिंथेसिस प्लेटफॉर्म / ओपन सोर्स UTAU उत्तराधिकारी

    4,258+18पिछले 7 दिनों में स्टार का बदलाव
  • metavoice-src@metavoiceio

    मानव-जैसी, अभिव्यक्तfमक TTS के लिए फ़ाउंडेशनल मॉडल

    4,203-1पिछले 7 दिनों में स्टार का बदलाव
  • RealtimeTTS@KoljaB

    रीयलटाइम में टेक्स्ट को स्पीच में बदलता है

    4,021+2पिछले 7 दिनों में स्टार का बदलाव
  • TensorFlowTTS@TensorSpeech

    :stuck_out_tongue_closed_eyes: TensorFlowTTS: Tensorflow 2 के लिए रियल-टाइम अत्याधुनिक स्पीच सिंथेसिस (अंग्रेजी, फ्रेंच, कोरियाई, चीनी, जर्मन सहित समर्थित और अन्य भाषाओं के लिए अनुकूलित करना आसान)

    3,996+0पिछले 7 दिनों में स्टार का बदलाव
  • lingvo@tensorflow

    Lingvo

    2,864+0पिछले 7 दिनों में स्टार का बदलाव
  • MARS5-TTS@Camb-ai

    CAMB.AI से MARS5 स्पीच मॉडल (TTS)

    2,818+1पिछले 7 दिनों में स्टार का बदलाव
  • marytts@marytts

    MARY TTS -- शुद्ध जावा में लिखा गया एक ओपन-सोर्स, बहुभाषी टेक्स्ट-टू-स्पीच सिंथेसिस सिस्टम

    2,583+0पिछले 7 दिनों में स्टार का बदलाव
  • VieNeu-TTS@pnnbao97

    इंस्टेंट वॉइस क्लोनिंग के साथ Vietnamese TTS • ऑन-डिवाइस • रियल-टाइम CPU इन्फरेंस • 24kHz ऑडियो क्वालिटी • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt

    2,468+21पिछले 7 दिनों में स्टार का बदलाव
  • hifi-gan@jik876

    HiFi-GAN: कुशल और उच्च निष्ठा वाक् संश्लेषण के लिए जेनरेटिव एडवरसarial नेटवर्क

    2,367+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस