tts
tts टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61
सिमेंटिक सर्च, RAG चैट, लोकल वेक्टर स्टोर, नोट्स, TTS और WebDAV सिंक के साथ AI-संचालित क्रॉस-प्लेटफ़ॉर्म ई-बुक रीडर।
★ 2,305+24पिछले 7 दिनों में स्टार का बदलाव - #62
ओपन-सोर्स टेक्स्ट-टू-स्पीच टूल, जो लंबे टेक्स्ट और मल्टी-रोल वॉयसओवर का समर्थन करता है
★ 2,296+7पिछले 7 दिनों में स्टार का बदलाव - #63
VALL-E (ज़ीरो-शॉट टेक्स्ट-टू-स्पीच) का PyTorch कार्यान्वयन, पुनरुत्पादित डेमो https://lifeiteng.github.io/valle/index.html
★ 2,215+0पिछले 7 दिनों में स्टार का बदलाव - #64
ऑडियो मॉडल के लिए एक ऑल-इन-वन, शुद्ध C++ इन्फेरेंस इंजन, जो ggml द्वारा संचालित है। अत्यधिक अनुकूलित प्रदर्शन के साथ TTS, STT, VAD, वॉयस कन्वर्शन, म्यूजिक जनरेशन और बहुत कुछ समर्थन करता है। कोई Python निर्भरता नहीं।
★ 2,214+115पिछले 7 दिनों में स्टार का बदलाव - #65
7000 से अधिक भाषाओं के लिए नियंत्रणीय और तेज़ Text-to-Speech!
★ 2,207-1पिछले 7 दिनों में स्टार का बदलाव - #66
OpenAI, Azure, या ElevenLabs को बदलने के लिए मुफ़्त, उच्च-गुणवत्ता वाला text-to-speech API एंडपॉइंट
★ 2,075+5पिछले 7 दिनों में स्टार का बदलाव - #67
EPUB से ऑडियोबुक कन्वर्टर, Audiobookshelf के लिए अनुकूलित, WebUI शामिल
★ 2,064+1पिछले 7 दिनों में स्टार का बदलाव - #68
AI साथियों और उपकरणों के लिए सुरक्षित वेबसोकेट और एज फ़ंक्शंस के साथ Arduino ESP32 पर 100+ मॉडल के साथ रियलटाइम वॉयस AI टॉयज
★ 1,938+5पिछले 7 दिनों में स्टार का बदलाव - #69
Home Assistant से Yandex.Station और Alice वाले अन्य स्मार्ट होम उपकरणों को नियंत्रित करें
★ 1,917-1पिछले 7 दिनों में स्टार का बदलाव - #70★ 1,912+1पिछले 7 दिनों में स्टार का बदलाव
- #71
वर्कफ़्लो-टू-ऐप, स्क्रीनशेयर और फ़्लोटिंग वीडियो, GPT और 3D, स्पीच रिकग्निशन और TTS
★ 1,861-2पिछले 7 दिनों में स्टार का बदलाव - #72★ 1,836+1पिछले 7 दिनों में स्टार का बदलाव
- #73
Kokoro मॉडल का उपयोग करने वाला एक CLI टेक्स्ट-टू-स्पीच टूल, जो कई भाषाओं, आवाज़ों (मिश्रण के साथ), और EPUB पुस्तकों और PDF दस्तावेजों सहित विभिन्न इनपुट प्रारूपों का समर्थन करता है।
★ 1,835+14पिछले 7 दिनों में स्टार का बदलाव - #74★ 1,760+3पिछले 7 दिनों में स्टार का बदलाव
- #75
Bailing GPT-4o जैसा एक语音对话机器人 है, जो ASR+LLM+TTS के माध्यम से महसूस किया जाता है, DeepSeek R1 जैसे उत्कृष्ट बड़े मॉडल को एकीकृत करता है, openClaw तक पहुंचता है, एक सच्चा व्यक्तिगत语音 सहायक है, विलंबता 800ms जितनी कम है, Mac जैसे कम-कॉन्फ़िगरेशन वाले डिवाइस भी चल सकते हैं, और रुकावट का समर्थन करता है।
★ 1,759+2पिछले 7 दिनों में स्टार का बदलाव - #76
🚀 AI पूरी तरह से स्वचालित वीडियो निर्माण कर्मचारी | आपका पहला AIGC सहकर्मी। एक विचार चैट करें। एक फिल्म प्राप्त करें। 🦞
★ 1,749+14पिछले 7 दिनों में स्टार का बदलाव - #77
सबटाइटल फ़ाइल के आधार पर वीडियो के पाठ का स्वचालित रूप से अनुवाद करता है, और फिर उपशीर्षक के समय का उपयोग करके भाषण को सिंक्रनाइज़ किए जाने वाले एक नया डब और अनुवादित ऑडियो ट्रैक बनाने के लिए AI आवाज सेवाओं का उपयोग करता है।
★ 1,746-1पिछले 7 दिनों में स्टार का बदलाव - #78
एक विषय को तैयार Vox-शैली के पेपर-कोलाज एक्सप्लेनर/विज्ञापन वीडियो में बदलें - Atlas Cloud + ffmpeg पर स्वचालित एंड-टू-एंड। एक एजेंट स्किल।
★ 1,698+67पिछले 7 दिनों में स्टार का बदलाव - #79★ 1,687+4पिछले 7 दिनों में स्टार का बदलाव
- #80
Ava से मिलें, WhatsApp एजेंट
★ 1,675+2पिछले 7 दिनों में स्टार का बदलाव - #81
Pytorch के साथ अनौपचारिक Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN)।
★ 1,646+1पिछले 7 दिनों में स्टार का बदलाव - #82
Speech Note Linux ऐप। ऑफ़लाइन Speech to Text, Text to Speech और मशीन अनुवाद के साथ नोट्स लेना, पढ़ना और अनुवाद करना।
★ 1,622+8पिछले 7 दिनों में स्टार का बदलाव - #83
Amica वॉयस सिंथेसिस और स्पीच रिकग्निशन के साथ 3D कैरेक्टर के साथ इंटरैक्टिव संचार के लिए एक ओपन सोर्स इंटरफ़ेस है।
★ 1,591-2पिछले 7 दिनों में स्टार का बदलाव - #84
Microsoft के VibeVoice टेक्स्ट-टू-स्पीच मॉडल के लिए एक व्यापक ComfyUI इंटीग्रेशन, जो सीधे आपके ComfyUI वर्कफ़्लो के भीतर उच्च-गुणवत्ता वाले सिंगल और मल्टी-स्पीकर वॉयस सिंथेसिस को सक्षम बनाता है।
★ 1,555+4पिछले 7 दिनों में स्टार का बदलाव - #85★ 1,548+60पिछले 7 दिनों में स्टार का बदलाव
- #86
Android के लिए Dicio असिस्टेंट ऐप
★ 1,463+3पिछले 7 दिनों में स्टार का बदलाव - #87★ 1,449+1पिछले 7 दिनों में स्टार का बदलाव
- #88
मानव आवाज़ों को आसानी से सिंथेटिक रूप से उत्पन्न करने के लिए एक Python/Pytorch ऐप
★ 1,440+0पिछले 7 दिनों में स्टार का बदलाव - #89★ 1,437+0पिछले 7 दिनों में स्टार का बदलाव
- #90
शक्तिशाली Chatterbox TTS मॉडल को सेल्फ-हॉस्ट करें। यह सर्वर एक उपयोगकर्ता के अनुकूल Web UI, लचीले API एंडपॉइंट (OpenAI संगत सहित), पूर्वनिर्धारित आवाज़ें, वॉयस क्लोनिंग, और बड़े ऑडियोबुक-स्केल टेक्स्ट प्रोसेसिंग प्रदान करता है। NVIDIA (CUDA), AMD (ROCm), और CPU पर त्वरित रूप से चलता है।
★ 1,427+1पिछले 7 दिनों में स्टार का बदलाव