मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें
विषय · speech-synthesis

speech-synthesis

speech-synthesis टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

66 रिपॉजिटरी
  • chat-with-gpt@cogentapps

    आवाज़ के साथ एक ओपन-सोर्स ChatGPT ऐप

    2,350+0पिछले 7 दिनों में स्टार का बदलाव
  • IMS-Toucan@DigitalPhonetics

    7000 से अधिक भाषाओं के लिए नियंत्रणीय और तेज़ Text-to-Speech!

    2,207+0पिछले 7 दिनों में स्टार का बदलाव
  • RHVoice@RHVoice

    रूसी और अन्य भाषाओं के लिए एक मुफ्त और ओपन सोर्स स्पीच सिंथेसाइज़र

    1,836+0पिछले 7 दिनों में स्टार का बदलाव
  • ParallelWaveGAN@kan-bayashi

    Pytorch के साथ अनौपचारिक Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN)।

    1,646+0पिछले 7 दिनों में स्टार का बदलाव
  • dsnote@mkiol

    Speech Note Linux ऐप। ऑफ़लाइन Speech to Text, Text to Speech और मशीन अनुवाद के साथ नोट्स लेना, पढ़ना और अनुवाद करना।

    1,622+0पिछले 7 दिनों में स्टार का बदलाव
  • कस्टम नोड्स जो Comfyui की क्षमताओं का विस्तार करते हैं।

    1,525+0पिछले 7 दिनों में स्टार का बदलाव
  • SAM@s-macke

    Software Automatic Mouth - छोटा स्पीच सिंथेसाइज़र

    1,498+0पिछले 7 दिनों में स्टार का बदलाव
  • SpeechT5@microsoft

    Spoken Language Processing के लिए Unified-Modal Speech-Text Pre-Training।

    1,449+0पिछले 7 दिनों में स्टार का बदलाव
  • शक्तिशाली Chatterbox TTS मॉडल को सेल्फ-हॉस्ट करें। यह सर्वर एक उपयोगकर्ता के अनुकूल Web UI, लचीले API एंडपॉइंट (OpenAI संगत सहित), पूर्वनिर्धारित आवाज़ें, वॉयस क्लोनिंग, और बड़े ऑडियोबुक-स्केल टेक्स्ट प्रोसेसिंग प्रदान करता है। NVIDIA (CUDA), AMD (ROCm), और CPU पर त्वरित रूप से चलता है।

    1,427+0पिछले 7 दिनों में स्टार का बदलाव
  • 💎 ASR, TTS और अन्य Speech Technologies के लिए एक्सेसिबल स्पीच कॉर्पोरा की एक सूची

    1,399+0पिछले 7 दिनों में स्टार का बदलाव
  • voicefixer@haoheliu

    सामान्य भाषण बहाली

    1,375+0पिछले 7 दिनों में स्टार का बदलाव
  • World@mmorise

    एक उच्च-गुणवत्ता वाली स्पीच एनालिसिस, मैनिपुलेशन और सिंथेसिस सिस्टम

    1,339+0पिछले 7 दिनों में स्टार का बदलाव
  • StreamSpeech@ictnlp

    StreamSpeech ऑफ़लाइन और एक साथ स्पीच रिकग्निशन, स्पीच ट्रांसलेशन और स्पीच सिंथेसिस के लिए एक "ऑल इन वन" सीमलेस मॉडल है।

    1,288+0पिछले 7 दिनों में स्टार का बदलाव
  • Irodori-TTS@Aratako

    इमोजी-संचालित स्टाइल नियंत्रण के साथ एक Flow Matching-आधारित Text-to-Speech मॉडल

    1,228+0पिछले 7 दिनों में स्टार का बदलाव
  • BigVGAN@NVIDIA

    BigVGAN (ICLR 2023) का आधिकारिक PyTorch कार्यान्वयन

    1,227+0पिछले 7 दिनों में स्टार का बदलाव
  • इरीना - ऑफ़लाइन काम करने के लिए रूसी वॉयस असिस्टेंट। प्लगइन्स के माध्यम से कौशल का समर्थन करता है।

    1,153+0पिछले 7 दिनों में स्टार का बदलाव
  • AI-Waifu-Vtuber@ardha27

    Youtube/Twitch पर स्ट्रीमिंग के लिए AI Vtuber

    1,116+3पिछले 7 दिनों में स्टार का बदलाव
  • autovc@auspicious3000

    AutoVC: केवल ऑटोएनकोडर लॉस के साथ ज़ीरो-शॉट वॉयस स्टाइल ट्रांसफर

    1,100+0पिछले 7 दिनों में स्टार का बदलाव
  • YourTTS@Edresson

    YourTTS: सभी के लिए ज़ीरो-शॉट मल्टी-स्पीकर TTS और ज़ीरो-शॉट वॉयस कन्वर्ज़न की दिशा में।

    1,054+1पिछले 7 दिनों में स्टार का बदलाव
  • Cognitive-Speech-TTS@Azure-Samples

    Cognitive Services का हिस्सा, कई भाषाओं में Microsoft Text-to-Speech API सैंपल कोड।

    1,014+1पिछले 7 दिनों में स्टार का बदलाव
  • alexandria-audiobook@Finrandojin

    AI-संचालित मल्टी-वॉयस ऑडियोबुक जनरेटर — LLM स्क्रिप्ट एनोटेशन, वॉयस क्लोनिंग, वॉयस डिज़ाइन, LoRA ट्रेनिंग, प्रति-लाइन स्टाइल नियंत्रण, और MP3, चैप्टर वाले M4B या Audacity मल्टी-ट्रैक में निर्यात। Qwen3-TTS पर निर्मित

    1,000+10पिछले 7 दिनों में स्टार का बदलाव
  • NISQA@gabrielmittag

    NISQA - गैर-हस्तक्षेपी भाषण गुणवत्ता और TTS प्राकृतिकता मूल्यांकन

    972+4पिछले 7 दिनों में स्टार का बदलाव
  • Azure नेचुरल TTS वॉयस को किसी भी SAPI 5-संगत एप्लिकेशन के लिए सुलभ बनाएं।

    934+7पिछले 7 दिनों में स्टार का बदलाव
  • FireRedTTS@FireRedTeam

    एक ओपन-सोर्स LLM-सक्षम फाउंडेशन TTS सिस्टम

    919-1पिछले 7 दिनों में स्टार का बदलाव
  • एक टॉकिंग LLM जो बिना इंटरनेट के आपके कंप्यूटर पर चलता है।

    891+1पिछले 7 दिनों में स्टार का बदलाव
  • diffwave@lmnt-com

    DiffWave एक तेज़, उच्च-गुणवत्ता वाला न्यूरल वोकोडर और वेवफॉर्म सिंथेसाइज़र है।

    884-1पिछले 7 दिनों में स्टार का बदलाव
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: एक बहुभाषी और क्रॉस-लिंगुअल ज़ीरो-शॉट TTS इंजन

    794+6पिछले 7 दिनों में स्टार का बदलाव
  • vui@fluxions-ai

    रीयल-टाइम वॉयस असिस्टेंट — WebRTC स्ट्रीमिंग, faster-whisper ASR, लोकल LLM, Vui Nano (300M) TTS। OpenAI रीयल-टाइम API संगत। वॉयस क्लोनिंग, बार्ज-इन, 4090 पर ~9× रीयल-टाइम। Apache 2.0।

    759+7पिछले 7 दिनों में स्टार का बदलाव
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: एक मुफ्त, ऑफलाइन काम करने वाली, उच्च गुणवत्ता वाली जर्मन TTS आवाज़, जो बिना किसी लाइसेंस समस्या के हर प्रोजेक्ट के लिए उपलब्ध होनी चाहिए।

    729+0पिछले 7 दिनों में स्टार का बदलाव
  • INTERSPEECH 2023-2024 पेपर्स: INTERSPEECH 2023-24 सम्मेलन से प्रभावशाली और रोमांचक शोध पत्रों का एक संपूर्ण संग्रह। स्पीच और लैंग्वेज प्रोसेसिंग में नवीनतम प्रगति का अन्वेषण करें। कोड शामिल है।

    684+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस