tts
tts टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #151
ब्राउज़र के लिए टेक्स्ट-टू-स्पीच के साथ ऑगमेंटेटिव और अल्टरनेटिव कम्युनिकेशन (AAC) सिस्टम
★ 755+9पिछले 7 दिनों में स्टार का बदलाव - #152
Flutter टेक्स्ट-टू-स्पीच पैकेज
★ 753+1पिछले 7 दिनों में स्टार का बदलाव - #153
MLX Omni Server Apple के MLX फ्रेमवर्क द्वारा संचालित एक लोकल इन्फरेंस सर्वर है, जिसे विशेष रूप से Apple Silicon (M-series) चिप्स के लिए डिज़ाइन किया गया है। यह OpenAI-संगत API एंडपॉइंट्स को लागू करता है, जो लोकल ML इन्फरेंस की शक्ति का लाभ उठाते हुए मौजूदा OpenAI SDK क्लाइंट्स के साथ सहज एकीकरण को सक्षम बनाता है।
★ 741+1पिछले 7 दिनों में स्टार का बदलाव - #154
🐸 TTS पेपर का संग्रह
★ 734+1पिछले 7 दिनों में स्टार का बदलाव - #155
🔊 Kokoro Web: मुफ्त AI टेक्स्ट-टू-स्पीच, ऑनलाइन या सेल्फ-होस्टेड, OpenAI के साथ संगत!
★ 733+6पिछले 7 दिनों में स्टार का बदलाव - #156
MimikaStudio - macOS (Apple Silicon) के लिए एक लोकल-फर्स्ट एप्लिकेशन + Agentic MCP सपोर्ट
★ 731+0पिछले 7 दिनों में स्टार का बदलाव - #157
Thorsten-Voice: एक मुफ्त, ऑफलाइन काम करने वाली, उच्च गुणवत्ता वाली जर्मन TTS आवाज़, जो बिना किसी लाइसेंस समस्या के हर प्रोजेक्ट के लिए उपलब्ध होनी चाहिए।
★ 729+1पिछले 7 दिनों में स्टार का बदलाव - #158
किसी भी आवाज़ में आसानी से Piper टेक्स्ट-टू-स्पीच मॉडल बनाएं। अपनी आवाज़ की रिकॉर्डिंग के साथ एक टेक्स्ट-टू-स्पीच मॉडल बनाएं, या हज़ारों RVC आवाज़ों का उपयोग करें। Raspberry Pi पर ऑफलाइन काम करता है। किसी भी metadata.csv फ़ाइल के लिए कस्टम डेटासेट तेज़ी से रिकॉर्ड करें और प्रशिक्षण के दौरान अपने मॉडल को सुनें।
★ 713+6पिछले 7 दिनों में स्टार का बदलाव - #159
Android के लिए OpenAI Whisper और TensorFlow Lite के साथ ऑफ़लाइन वाक् पहचान (Speech Recognition)
★ 688+0पिछले 7 दिनों में स्टार का बदलाव - #160
Chatterbox का उपयोग करने वाला लोकल, OpenAI-compatible टेक्स्ट-टू-स्पीच (TTS) API, जो उपयोगकर्ताओं को कहीं भी वॉयस क्लोन स्पीच जेनरेट करने की अनुमति देता है जहाँ OpenAI API का उपयोग किया जाता है (जैसे Open WebUI, AnythingLLM, आदि)।
★ 677+5पिछले 7 दिनों में स्टार का बदलाव - #161
MLX में F5-TTS का कार्यान्वयन।
★ 644+0पिछले 7 दिनों में स्टार का बदलाव - #162
LLM/GenAI मॉडल और MCP UE5 सर्वर के लिए Unreal Engine प्लगइन। OpenAI GPT-5, Deepseek R1, Claude Opus/Sonnet, Gemini 3, Grok 4, Alibaba Qwen, Kimi, ElevenLabs TTS, Inworld, OpenRouter, Groq, GLM, Ollama, Local, Meshy, Tripo, Hunyuan3D, Rodin, fal, Dashscope, Seedream का समर्थन। NPC AI, एजेंटिक, चैट, 3D जनरेशन, TTS, मल्टीमॉडल और इमेज जनरेशन।
★ 643+5पिछले 7 दिनों में स्टार का बदलाव - #163★ 639+1पिछले 7 दिनों में स्टार का बदलाव
- #164★ 625+0पिछले 7 दिनों में स्टार का बदलाव
- #165
🤗 Optimum Intel: Intel अनुकूलन टूल के साथ इन्फेरेंस को गति दें
★ 617+1पिछले 7 दिनों में स्टार का बदलाव - #166
TikTok TTS API के साथ इंटरैक्ट करने के लिए सरल Python स्क्रिप्ट
★ 611+1पिछले 7 दिनों में स्टार का बदलाव - #167
VibeVoice TTS के लिए ComfyUI कस्टम नोड। अभिव्यंजक, लंबे-फॉर्म, मल्टी-स्पीकर संवादात्मक ऑडियो
★ 597+0पिछले 7 दिनों में स्टार का बदलाव - #168
XTTSv2 चलाने के लिए एक सरल FastAPI सर्वर
★ 597+0पिछले 7 दिनों में स्टार का बदलाव - #169
ओपन सोर्स वॉयस एजेंट प्लेटफॉर्म।
★ 592+2पिछले 7 दिनों में स्टार का बदलाव - #170
LaiJian एक हल्का वीडियो एडिटर। वेब और डेस्कटॉप संस्करण मुफ्त में उपलब्ध हैं, जिसके फीचर्स CapCut जैसे एडिटर्स से प्रेरित हैं।
★ 588+4पिछले 7 दिनों में स्टार का बदलाव - #171
आपके ऐप के लिए सेल्फ-कोडिंग सिस्टम — React Native के लिए Alan AI SDK।
★ 575+0पिछले 7 दिनों में स्टार का बदलाव - #172
Chatterbox का संशोधित संस्करण जो इनपुट के रूप में टेक्स्ट फ़ाइलों को स्वीकार करता है और इसमें कोई वर्ण प्रतिबंध नहीं है। मैं इसका उपयोग ऑडियोबुक बनाने के लिए करता हूँ, विशेष रूप से अपने बच्चों के लिए।
★ 575-1पिछले 7 दिनों में स्टार का बदलाव - #173
Mac (M1/M2/M3/M4) पर स्थानीय रूप से Qwen3-TTS टेक्स्ट-टू-स्पीच चलाएं। वॉयस क्लोनिंग, वॉयस डिज़ाइन, कस्टम वॉयस। MLX का उपयोग करके 100% ऑफ़लाइन।
★ 561+4पिछले 7 दिनों में स्टार का बदलाव - #174
व्यक्तिगत ब्लॉग और क्रिएटर वेबसाइटों के लिए AI-संचालित CMS कोर, जिसमें AI सारांश, अनुवाद, मॉडरेशन और लेखन वर्कफ़्लो शामिल हैं।
★ 557+3पिछले 7 दिनों में स्टार का बदलाव - #175
साथी, मनोरंजन, शिक्षा, स्वास्थ्य सेवा, IoT एप्लिकेशन और DIY रोबोटिक्स के लिए एक संवादात्मक AI डिवाइस और सॉफ़्टवेयर फ्रेमवर्क। Python, NextJS, Arduino, ESP32, LLMs (GPT-4o), Deepgram STT और Azure TTS के साथ निर्मित 🤖
★ 550+1पिछले 7 दिनों में स्टार का बदलाव - #176
pytorch में vits2-TTS का अनौपचारिक कार्यान्वयन
★ 549+0पिछले 7 दिनों में स्टार का बदलाव - #177
LM Studio के साथ Orpheus 3B को स्थानीय रूप से चलाएं
★ 549+0पिछले 7 दिनों में स्टार का बदलाव - #178
SummerTTS C++ पर आधारित एक स्टैंडअलोन चीनी और अंग्रेजी स्पीच सिंथेसिस प्रोजेक्ट है, जो बिना इंटरनेट के स्थानीय रूप से चल सकता है, और इसमें कोई अतिरिक्त निर्भरता नहीं है, एक-क्लिक संकलन पूरा होने के बाद इसे चीनी और अंग्रेजी स्पीच सिंथेसिस के लिए उपयोग किया जा सकता है।
★ 543-1पिछले 7 दिनों में स्टार का बदलाव - #179
ComfyUI के लिए OmniVoice TTS नोड्स - वॉयस क्लोनिंग, वॉयस डिज़ाइन और मल्टी-स्पीकर डायलॉग के साथ ज़ीरो-शॉट बहुभाषी टेक्स्ट-टू-स्पीच।
★ 543+5पिछले 7 दिनों में स्टार का बदलाव - #180
Tacotron से संबंधित प्रकाशनों के साथ ऑडियो नमूने, जो एक एंड-टू-एंड स्पीच सिंथेसिस मॉडल है
★ 539+0पिछले 7 दिनों में स्टार का बदलाव