speech-synthesis
speech-synthesis टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर speech-synthesis के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और speech-synthesis टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
🐸💬 - Text-to-Speech के लिए एक डीप लर्निंग टूलकिट, जो रिसर्च और प्रोडक्शन में परखा हुआ है
★ 45,985+18पिछले 7 दिनों में स्टार का बदलाव - #2
VoxCPM2: बहुभाषी भाषण निर्माण, रचनात्मक आवाज़ डिज़ाइन, और वास्तविक क्लोनिंग के लिए टोकनराइज़र-मुक्त TTS
★ 36,595+345पिछले 7 दिनों में स्टार का बदलाव - #3
Linguistic Models, Multimodal और Speech AI पर काम कर रहे शोधकर्ताओं और डेवलपर्स के लिए बनाया गया एक स्केलेबल जनरेटिव AI फ़्रेमवर्क
★ 18,379+21पिछले 7 दिनों में स्टार का बदलाव - #4★ 17,476+1पिछले 7 दिनों में स्टार का बदलाव
- #5
मॉडलों द्वारा आयोजित अत्याधुनिक Deep Learning स्क्रिप्ट - एंटरप्राइज़-ग्रेड बुनियादी ढांचे पर पुनरुत्पादित सटीकता और प्रदर्शन के साथ प्रशिक्षित और तैनात करने में आसान।
★ 14,846+4पिछले 7 दिनों में स्टार का बदलाव - #6
बिजली की गति वाला, ऑन-डिवाइस, बहुभाषी TTS — जो ONNX के माध्यम से नेटिव रूप से चलता है।
★ 13,757+20पिछले 7 दिनों में स्टार का बदलाव - #7
ओपन-सोर्स मॉडल के साथ वॉयस एजेंट बनाएं
★ 13,015+82पिछले 7 दिनों में स्टार का बदलाव - #8
क्रिएटर्स और डेवलपर्स के लिए Gradio WebUI, जिसमें प्रमुख TTS (Edge-TTS, kokoro) और ज़ीरो-शॉट Voice Cloning (E2 & F5-TTS, CosyVoice) शामिल हैं, साथ ही Whisper ऑडियो प्रोसेसिंग, YouTube डाउनलोड, Demucs वोकल आइसोलेशन और बहुभाषी अनुवाद शामिल हैं।
★ 12,730+54पिछले 7 दिनों में स्टार का बदलाव - #9
उपयोग में आसान स्पीच टूलकिट जिसमें सेल्फ-सुपरवाइज्ड लर्निंग मॉडल, विराम चिह्नों के साथ SOTA/स्ट्रीमिंग ASR, टेक्स्ट फ्रंटएंड के साथ स्ट्रीमिंग TTS, स्पीकर वेरिफिकेशन सिस्टम, एंड-टू-एंड स्पीच ट्रांसलेशन और कीवर्ड स्पॉटिंग शामिल है। NAACL2022 बेस्ट डेमो अवार्ड जीता।
★ 12,676+5पिछले 7 दिनों में स्टार का बदलाव - #10
Microsoft Edge या Windows या API की की आवश्यकता के बिना Python से Microsoft Edge की ऑनलाइन टेक्स्ट-टू-स्पीच सेवा का उपयोग करें।
★ 11,847+29पिछले 7 दिनों में स्टार का बदलाव - #11
Amphion (/æmˈfaɪən/) ऑडियो, म्यूजिक और स्पीच जनरेशन के लिए एक टूलकिट है। इसका उद्देश्य पुनरुत्पादनीय अनुसंधान (reproducible research) का समर्थन करना और नए शोधकर्ताओं व इंजीनियरों को ऑडियो, म्यूजिक और स्पीच जनरेशन के क्षेत्र में शुरुआत करने में मदद करना है।
★ 10,276+1पिछले 7 दिनों में स्टार का बदलाव - #12★ 9,949+3पिछले 7 दिनों में स्टार का बदलाव
- #13
realtime support, improved interface और अधिक features के साथ so-vits-svc fork।
★ 9,329+3पिछले 7 दिनों में स्टार का बदलाव - #14
EmotiVoice 😊: एक बहु-आवाज़ और प्रॉम्प्ट-नियंत्रित TTS इंजन
★ 8,522-1पिछले 7 दिनों में स्टार का बदलाव - #15
Apple के MLX फ्रेमवर्क पर बनी एक टेक्स्ट-टू-स्पीच (TTS), स्पीच-टू-टेक्स्ट (STT) और स्पीच-टू-स्पीच (STS) लाइब्रेरी, जो Apple Silicon पर कुशल भाषण विश्लेषण प्रदान करती है।
★ 7,826+23पिछले 7 दिनों में स्टार का बदलाव - #16
eSpeak NG एक ओपन सोर्स स्पीच सिंथेसाइज़र है जो सौ से अधिक भाषाओं और लहजों का समर्थन करता है।
★ 6,802+13पिछले 7 दिनों में स्टार का बदलाव - #17
StyleTTS 2: लार्ज स्पीच लैंग्वेज मॉडल के साथ स्टाइल डिफ़्यूज़न और एडवरसरियल ट्रेनिंग के माध्यम से मानव-स्तरीय टेक्स्ट-टू-स्पीच की ओर
★ 6,342+3पिछले 7 दिनों में स्टार का बदलाव - #18
Silero मॉडल: प्री-ट्रेनिंग टेक्स्ट-टू-स्पीच मॉडल जिन्हें अत्यंत सरल बनाया गया है
★ 6,084-1पिछले 7 दिनों में स्टार का बदलाव - #19★ 5,831+45पिछले 7 दिनों में स्टार का बदलाव
- #20
DiffSinger: शैलो डिफ्यूजन तंत्र (SVS & TTS) के माध्यम से सिंगिंग वॉयस सिंथेसिस; AAAI 2022; आधिकारिक कोड
★ 4,855+3पिछले 7 दिनों में स्टार का बदलाव - #21
Whisper को उलट कर बनाया गया एक ओपन सोर्स टेक्स्ट-टू-स्पीच सिस्टम।
★ 4,645+3पिछले 7 दिनों में स्टार का बदलाव - #22★ 4,258+18पिछले 7 दिनों में स्टार का बदलाव
- #23
मानव-जैसी, अभिव्यक्तfमक TTS के लिए फ़ाउंडेशनल मॉडल
★ 4,203-1पिछले 7 दिनों में स्टार का बदलाव - #24
रीयलटाइम में टेक्स्ट को स्पीच में बदलता है
★ 4,021+2पिछले 7 दिनों में स्टार का बदलाव - #25
:stuck_out_tongue_closed_eyes: TensorFlowTTS: Tensorflow 2 के लिए रियल-टाइम अत्याधुनिक स्पीच सिंथेसिस (अंग्रेजी, फ्रेंच, कोरियाई, चीनी, जर्मन सहित समर्थित और अन्य भाषाओं के लिए अनुकूलित करना आसान)
★ 3,996+0पिछले 7 दिनों में स्टार का बदलाव - #26★ 2,864+0पिछले 7 दिनों में स्टार का बदलाव
- #27★ 2,818+1पिछले 7 दिनों में स्टार का बदलाव
- #28
MARY TTS -- शुद्ध जावा में लिखा गया एक ओपन-सोर्स, बहुभाषी टेक्स्ट-टू-स्पीच सिंथेसिस सिस्टम
★ 2,583+0पिछले 7 दिनों में स्टार का बदलाव - #29
इंस्टेंट वॉइस क्लोनिंग के साथ Vietnamese TTS • ऑन-डिवाइस • रियल-टाइम CPU इन्फरेंस • 24kHz ऑडियो क्वालिटी • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2,468+21पिछले 7 दिनों में स्टार का बदलाव - #30★ 2,367+0पिछले 7 दिनों में स्टार का बदलाव