मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें
विषय · text-to-speech

text-to-speech

text-to-speech टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

150 रिपॉजिटरी
  • audio-webui@gitmylo

    विभिन्न ऑडियो-संबंधित Neural Networks के लिए एक webui

    1,245+0पिछले 7 दिनों में स्टार का बदलाव
  • TTS-Audio-Suite@diodiogod

    स्थानीय मल्टी-इंजन मल्टी-लैंग्वेज टेक्स्ट-टू-स्पीच और वॉयस कन्वर्जन के लिए एक ComfyUI कस्टम नोड इंटीग्रेशन। समर्थित: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (क्लासिक और बहुभाषी), F5-TTS, Higgs Audio 2, 3, और असीमित टेक्स्ट लंबाई, SRT टाइमिंग, कैरेक्टर सपोर्ट और कई ऑडियो टूल के साथ VibeVoice

    1,199+0पिछले 7 दिनों में स्टार का बदलाव
  • Apple के Foundation Models फ्रेमवर्क के साथ ऐप्स बनाने, परीक्षण करने और मूल्यांकन करने के लिए एक व्यावहारिक लैब।

    1,179+0पिछले 7 दिनों में स्टार का बदलाव
  • dia2@nari-labs

    वास्तविक समय में संवादात्मक ऑडियो स्ट्रीम करने में सक्षम TTS मॉडल

    1,176+0पिछले 7 दिनों में स्टार का बदलाव
  • speech-swift@soniqo

    Apple Silicon के लिए AI स्पीच टूलकिट — MLX और CoreML द्वारा संचालित ASR, TTS, स्पीच-टू-स्पीच, VAD और डायराइजेशन

    1,172+0पिछले 7 दिनों में स्टार का बदलाव
  • sglang-omni@sgl-project

    SGLang-Omni, TTS, ASR, स्पीच और ओम्नी मॉडल के लिए उच्च-प्रदर्शन सर्विंग को सक्षम बनाता है।

    1,159+56पिछले 7 दिनों में स्टार का बदलाव
  • आपके ऐप के लिए सेल्फ-कोडिंग सिस्टम — Cordova के लिए Alan AI SDK

    1,132+0पिछले 7 दिनों में स्टार का बदलाव
  • Patter@PatterAI

    ओपन-सोर्स वॉयस-AI SDK। उन बिल्डर्स के लिए Vapi/Retell विकल्प जो स्टैक के मालिक बनना चाहते हैं। अपने AI एजेंट को 4 लाइनों में फोन नंबर दें — Python और TypeScript, MIT लाइसेंस प्राप्त, Twilio, Telnyx और Plivo।

    1,052+7पिछले 7 दिनों में स्टार का बदलाव
  • Cognitive-Speech-TTS@Azure-Samples

    Cognitive Services का हिस्सा, कई भाषाओं में Microsoft Text-to-Speech API सैंपल कोड।

    1,014+1पिछले 7 दिनों में स्टार का बदलाव
  • alexandria-audiobook@Finrandojin

    AI-संचालित मल्टी-वॉयस ऑडियोबुक जनरेटर — LLM स्क्रिप्ट एनोटेशन, वॉयस क्लोनिंग, वॉयस डिज़ाइन, LoRA ट्रेनिंग, प्रति-लाइन स्टाइल नियंत्रण, और MP3, चैप्टर वाले M4B या Audacity मल्टी-ट्रैक में निर्यात। Qwen3-TTS पर निर्मित

    1,003+10पिछले 7 दिनों में स्टार का बदलाव
  • NISQA@gabrielmittag

    NISQA - गैर-हस्तक्षेपी भाषण गुणवत्ता और TTS प्राकृतिकता मूल्यांकन

    974+4पिछले 7 दिनों में स्टार का बदलाव
  • Step-Audio-EditX@stepfun-ai

    एक शक्तिशाली 3B-पैरामीटर, LLM-आधारित रीइन्फोर्समेंट लर्निंग ऑडियो एडिट मॉडल, जो भावना, बोलने की शैली और पैरालिंग्विस्टिक्स को एडिट करने में उत्कृष्ट है, और इसमें मजबूत ज़ीरो-शॉट टेक्स्ट-टू-स्पीच की सुविधा है।

    974+1पिछले 7 दिनों में स्टार का बदलाव
  • botium-speech-processing@codeforequity-at

    Botium Speech Processing

    943+0पिछले 7 दिनों में स्टार का बदलाव
  • Azure नेचुरल TTS वॉयस को किसी भी SAPI 5-संगत एप्लिकेशन के लिए सुलभ बनाएं।

    936+7पिछले 7 दिनों में स्टार का बदलाव
  • PHP के लिए Vonage REST API क्लाइंट। SMS, Voice, Text-to-Speech, Numbers, Verify (2FA) और अन्य के लिए API समर्थन।

    931-1पिछले 7 दिनों में स्टार का बदलाव
  • FireRedTTS@FireRedTeam

    एक ओपन-सोर्स LLM-सक्षम फाउंडेशन TTS सिस्टम

    919-1पिछले 7 दिनों में स्टार का बदलाव
  • EDDiscovery@EDDiscovery

    Elite Dangerous के लिए कैप्टन लॉग और 3D स्टार मैप।

    900+4पिछले 7 दिनों में स्टार का बदलाव
  • diffwave@lmnt-com

    DiffWave एक तेज़, उच्च-गुणवत्ता वाला न्यूरल वोकोडर और वेवफॉर्म सिंथेसाइज़र है।

    884-1पिछले 7 दिनों में स्टार का बदलाव
  • bark.cpp@PABannier

    तेज़ टेक्स्ट-टू-स्पीच जनरेशन के लिए C/C++ में Suno AI का Bark मॉडल।

    868+2पिछले 7 दिनों में स्टार का बदलाव
  • बिना ROOT के Android के लिए ओपन-सोर्स रीयल-टाइम स्क्रीन ट्रांसलेटर, जो गेम, विज़ुअल नॉवेल और मंगा के लिए उपयुक्त है। यह ऑन-डिवाइस और क्लाउड OCR, ऑफ़लाइन LLM, विभिन्न अनुवाद सेवाओं और TTS का समर्थन करता है।

    809+73पिछले 7 दिनों में स्टार का बदलाव
  • CloneTTS@sipeter

    एक हल्का, ऑफ़लाइन Android टेक्स्ट-टू-स्पीच (TTS) इंजन जो निर्बाध सिस्टम-व्यापी वॉयस क्लोनिंग और उच्च-निष्ठा टेक्स्ट रीडिंग को सक्षम बनाता है।

    807+5पिछले 7 दिनों में स्टार का बदलाव
  • lue@paulilaaso

    ऑडियोबुक-गुणवत्ता वाले टेक्स्ट-टू-स्पीच के साथ टर्मिनल ईबुक रीडर - EPUB, PDF, DOCX, HTML, RTF, TXT और MD को सपोर्ट करता है।

    806+1पिछले 7 दिनों में स्टार का बदलाव
  • Speech to Text to Speech। गाना अभी चल रहा है। अवतार पर प्रदर्शित करने के लिए टेक्स्ट को OSC संदेशों के रूप में VRChat पर भेजता है। (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    805+5पिछले 7 दिनों में स्टार का बदलाव
  • lobe-tts@lobehub

    🎤 Lobe TTS - सर्वर और ब्राउज़र के लिए एक उच्च-गुणवत्ता और विश्वसनीय TTS/STT लाइब्रेरी

    805-1पिछले 7 दिनों में स्टार का बदलाव
  • ai-video-editor@MartinDelophy

    ओपन-सोर्स, लोकल-फर्स्ट वीडियो एडिटर जहाँ क्रिएटर और AI एजेंट एक ही वास्तविक टाइमलाइन को एडिट करते हैं।

    803+82पिछले 7 दिनों में स्टार का बदलाव
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: एक बहुभाषी और क्रॉस-लिंगुअल ज़ीरो-शॉट TTS इंजन

    793+6पिछले 7 दिनों में स्टार का बदलाव
  • june@mezbaul-h

    Ollama, Hugging Face Transformers और Coqui TTS टूलकिट द्वारा संचालित आकर्षक बातचीत के लिए लोकल वॉयस चैटबॉट।

    788+1पिछले 7 दिनों में स्टार का बदलाव
  • mlx-audio-swift@Blaizzy

    Apple Silicon पर MLX के साथ ऑडियो प्रोसेसिंग के लिए एक मॉड्यूलर Swift SDK

    774+5पिछले 7 दिनों में स्टार का बदलाव
  • vui@fluxions-ai

    रीयल-टाइम वॉयस असिस्टेंट — WebRTC स्ट्रीमिंग, faster-whisper ASR, लोकल LLM, Vui Nano (300M) TTS। OpenAI रीयल-टाइम API संगत। वॉयस क्लोनिंग, बार्ज-इन, 4090 पर ~9× रीयल-टाइम। Apache 2.0।

    760+7पिछले 7 दिनों में स्टार का बदलाव
  • cboard@cboard-org

    ब्राउज़र के लिए टेक्स्ट-टू-स्पीच के साथ ऑगमेंटेटिव और अल्टरनेटिव कम्युनिकेशन (AAC) सिस्टम

    756+9पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस