tts
tts टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर tts के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और tts टैग वाली रिपॉजिटरी।
- #1
ऑडियो मॉडल के लिए एक ऑल-इन-वन, शुद्ध C++ इन्फेरेंस इंजन, जो ggml द्वारा संचालित है। अत्यधिक अनुकूलित प्रदर्शन के साथ TTS, STT, VAD, वॉयस कन्वर्शन, म्यूजिक जनरेशन और बहुत कुछ समर्थन करता है। कोई Python निर्भरता नहीं।
★ 2,214 - #2
एक विषय को तैयार Vox-शैली के पेपर-कोलाज एक्सप्लेनर/विज्ञापन वीडियो में बदलें - Atlas Cloud + ffmpeg पर स्वचालित एंड-टू-एंड। एक एजेंट स्किल।
★ 1,698 - #3
SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.
★ 828 - #4
बिना ROOT के Android के लिए ओपन-सोर्स रीयल-टाइम स्क्रीन ट्रांसलेटर, जो गेम, विज़ुअल नॉवेल और मंगा के लिए उपयुक्त है। यह ऑन-डिवाइस और क्लाउड OCR, ऑफ़लाइन LLM, विभिन्न अनुवाद सेवाओं और TTS का समर्थन करता है।
★ 768 - #5★ 530
- #1
Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX और अन्य सहित LLM और डिफ़्यूज़न मॉडल को चलाने और प्रशिक्षित करने के लिए स्थानीय UI।
★ 75,515+337पिछले 7 दिनों में स्टार का बदलाव - #2
1 मिनट के वॉयस डेटा का उपयोग करके भी एक अच्छा TTS मॉडल प्रशिक्षित किया जा सकता है! (फ्यू शॉट वॉयस क्लोनिंग)
★ 61,476+138पिछले 7 दिनों में स्टार का बदलाव - #3
रीयल-टाइम में मनचाहा भाषण जनरेट करने के लिए 5 सेकंड में आवाज़ क्लोन करें
★ 60,117-4पिछले 7 दिनों में स्टार का बदलाव - #4
LocalAI एक ओपन-सोर्स AI इंजन है। किसी भी हार्डवेयर पर कोई भी मॉडल - LLM, विज़न, वॉइस, इमेज, वीडियो - चलाएं। GPU की आवश्यकता नहीं है।
★ 48,833+84पिछले 7 दिनों में स्टार का बदलाव - #5
🐸💬 - Text-to-Speech के लिए एक डीप लर्निंग टूलकिट, जो रिसर्च और प्रोडक्शन में परखा हुआ है
★ 45,985+18पिछले 7 दिनों में स्टार का बदलाव - #6★ 39,814+9पिछले 7 दिनों में स्टार का बदलाव
- #7★ 37,419+61पिछले 7 दिनों में स्टार का बदलाव
- #8
🚀रियल-टाइम में मनमाना भाषण उत्पन्न करने के लिए 5 सेकंड में आवाज़ क्लोन करें
★ 36,912+0पिछले 7 दिनों में स्टार का बदलाव - #9
VoxCPM2: बहुभाषी भाषण निर्माण, रचनात्मक आवाज़ डिज़ाइन, और वास्तविक क्लोनिंग के लिए टोकनराइज़र-मुक्त TTS
★ 36,595+345पिछले 7 दिनों में स्टार का बदलाव - #10
SOTA ओपन सोर्स TTS
★ 32,510+52पिछले 7 दिनों में स्टार का बदलाव - #11
🚀 AI पूरी तरह से स्वचालित शॉर्ट वीडियो इंजन
★ 27,702+236पिछले 7 दिनों में स्टार का बदलाव - #12★ 27,657+96पिछले 7 दिनों में स्टार का बदलाव
- #13
Readest एक आधुनिक, सुविधाओं से भरपूर ई-बुक रीडर है जो उत्साही पाठकों के लिए डिज़ाइन किया गया है, जो आपके पढ़ने के अनुभव को बेहतरीन बनाने के लिए निर्बाध क्रॉस-प्लेटफ़ॉर्म एक्सेस, शक्तिशाली टूल और एक सहज इंटरफ़ेस प्रदान करता है।
★ 24,008+138पिछले 7 दिनों में स्टार का बदलाव - #14★ 23,686+109पिछले 7 दिनों में स्टार का बदलाव
- #15
बहु-भाषी बड़ा वॉइस जनरेशन मॉडल, जो इन्फेरेंस, ट्रेनिंग और डिप्लॉयमेंट की फुल-स्टैक क्षमता प्रदान करता है।
★ 23,426+359पिछले 7 दिनों में स्टार का बदलाव - #16
ई-बुक्स से ऑडियोबुक जेनरेट करें, वॉयस क्लोनिंग और 1158+ भाषाएँ!
★ 20,097+34पिछले 7 दिनों में स्टार का बदलाव - #17
एक क्रॉस-प्लेटफ़ॉर्म टेक्स्ट अनुवाद और OCR सॉफ़्टवेयर।
★ 19,408+28पिछले 7 दिनों में स्टार का बदलाव - #18
Linguistic Models, Multimodal और Speech AI पर काम कर रहे शोधकर्ताओं और डेवलपर्स के लिए बनाया गया एक स्केलेबल जनरेटिव AI फ़्रेमवर्क
★ 18,379+21पिछले 7 दिनों में स्टार का बदलाव - #19
VoiceStudio एक ओपन-सोर्स, पूरी तरह से लोकल ElevenLabs विकल्प है - जो 646 भाषाओं में वॉयस क्लोनिंग, वॉयस डिज़ाइन, वीडियो डबिंग, डिक्टेशन, ट्रांसक्रिप्शन और ऑडियोबुक निर्माण की सुविधा देता है।
★ 14,835+2,880पिछले 7 दिनों में स्टार का बदलाव - #20
बिजली की गति वाला, ऑन-डिवाइस, बहुभाषी TTS — जो ONNX के माध्यम से नेटिव रूप से चलता है।
★ 13,757+20पिछले 7 दिनों में स्टार का बदलाव - #21
क्रिएटर्स और डेवलपर्स के लिए Gradio WebUI, जिसमें प्रमुख TTS (Edge-TTS, kokoro) और ज़ीरो-शॉट Voice Cloning (E2 & F5-TTS, CosyVoice) शामिल हैं, साथ ही Whisper ऑडियो प्रोसेसिंग, YouTube डाउनलोड, Demucs वोकल आइसोलेशन और बहुभाषी अनुवाद शामिल हैं।
★ 12,730+54पिछले 7 दिनों में स्टार का बदलाव - #22
उपयोग में आसान स्पीच टूलकिट जिसमें सेल्फ-सुपरवाइज्ड लर्निंग मॉडल, विराम चिह्नों के साथ SOTA/स्ट्रीमिंग ASR, टेक्स्ट फ्रंटएंड के साथ स्ट्रीमिंग TTS, स्पीकर वेरिफिकेशन सिस्टम, एंड-टू-एंड स्पीच ट्रांसलेशन और कीवर्ड स्पॉटिंग शामिल है। NAACL2022 बेस्ट डेमो अवार्ड जीता।
★ 12,676+5पिछले 7 दिनों में स्टार का बदलाव - #23
Microsoft Edge या Windows या API की की आवश्यकता के बिना Python से Microsoft Edge की ऑनलाइन टेक्स्ट-टू-स्पीच सेवा का उपयोग करें।
★ 11,847+29पिछले 7 दिनों में स्टार का बदलाव - #24
मानव और AI एजेंटों के लिए AI वीडियो अनुवाद और डबिंग टूल, LLMs द्वारा संचालित। पूर्ण पाइपलाइन: डाउनलोड, ट्रांसक्राइब, अनुवाद, TTS डब, रीफ़ॉर्मेट, कवर जनरेशन। 100+ भाषाएँ, YouTube, TikTok, Bilibili, Douyin और अन्य के लिए अनुकूलित।
★ 11,333+46पिछले 7 दिनों में स्टार का बदलाव - #25
वॉइस एजेंट और इंटरफेस बनाने के लिए बहुत कम विलंबता (low latency) वाला स्पीच-टू-टेक्स्ट, इंटेंट रिकग्निशन और टेक्स्ट-टू-स्पीच
★ 10,997+33पिछले 7 दिनों में स्टार का बदलाव - #26
ओपन सोर्स TypeScript AI एजेंट फ्रेमवर्क पर निर्मित AI एजेंट इंजीनियरिंग प्लेटफॉर्म
★ 10,529+80पिछले 7 दिनों में स्टार का बदलाव - #27
multilingual-bert के साथ vits2 बैकबोन
★ 8,794-3पिछले 7 दिनों में स्टार का बदलाव - #28
EmotiVoice 😊: एक बहु-आवाज़ और प्रॉम्प्ट-नियंत्रित TTS इंजन
★ 8,522-1पिछले 7 दिनों में स्टार का बदलाव - #29★ 8,479+9पिछले 7 दिनों में स्टार का बदलाव
- #30
Stream द्वारा ओपन विजन एजेंट्स। किसी भी मॉडल या वीडियो प्रदाता के साथ तुरंत वॉयस और विजन एजेंट बनाएं।
★ 8,113+9पिछले 7 दिनों में स्टार का बदलाव