मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · tts

tts

tts टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

190 रिपॉजिटरी
  • ReadAny@codedogQBY

    सिमेंटिक सर्च, RAG चैट, लोकल वेक्टर स्टोर, नोट्स, TTS और WebDAV सिंक के साथ AI-संचालित क्रॉस-प्लेटफ़ॉर्म ई-बुक रीडर।

    2,305+24पिछले 7 दिनों में स्टार का बदलाव
  • easyVoice@cosin2077

    ओपन-सोर्स टेक्स्ट-टू-स्पीच टूल, जो लंबे टेक्स्ट और मल्टी-रोल वॉयसओवर का समर्थन करता है

    2,296+7पिछले 7 दिनों में स्टार का बदलाव
  • vall-e@lifeiteng

    VALL-E (ज़ीरो-शॉट टेक्स्ट-टू-स्पीच) का PyTorch कार्यान्वयन, पुनरुत्पादित डेमो https://lifeiteng.github.io/valle/index.html

    2,215+0पिछले 7 दिनों में स्टार का बदलाव
  • audio.cpp@0xShug0

    ऑडियो मॉडल के लिए एक ऑल-इन-वन, शुद्ध C++ इन्फेरेंस इंजन, जो ggml द्वारा संचालित है। अत्यधिक अनुकूलित प्रदर्शन के साथ TTS, STT, VAD, वॉयस कन्वर्शन, म्यूजिक जनरेशन और बहुत कुछ समर्थन करता है। कोई Python निर्भरता नहीं।

    2,214+115पिछले 7 दिनों में स्टार का बदलाव
  • IMS-Toucan@DigitalPhonetics

    7000 से अधिक भाषाओं के लिए नियंत्रणीय और तेज़ Text-to-Speech!

    2,207-1पिछले 7 दिनों में स्टार का बदलाव
  • openai-edge-tts@travisvn

    OpenAI, Azure, या ElevenLabs को बदलने के लिए मुफ़्त, उच्च-गुणवत्ता वाला text-to-speech API एंडपॉइंट

    2,075+5पिछले 7 दिनों में स्टार का बदलाव
  • EPUB से ऑडियोबुक कन्वर्टर, Audiobookshelf के लिए अनुकूलित, WebUI शामिल

    2,064+1पिछले 7 दिनों में स्टार का बदलाव
  • ElatoAI@akdeb

    AI साथियों और उपकरणों के लिए सुरक्षित वेबसोकेट और एज फ़ंक्शंस के साथ Arduino ESP32 पर 100+ मॉडल के साथ रियलटाइम वॉयस AI टॉयज

    1,938+5पिछले 7 दिनों में स्टार का बदलाव
  • YandexStation@AlexxIT

    Home Assistant से Yandex.Station और Alice वाले अन्य स्मार्ट होम उपकरणों को नियंत्रित करें

    1,917-1पिछले 7 दिनों में स्टार का बदलाव
  • Dot@alexpinel

    टेक्स्ट-टू-स्पीच, RAG, और LLMs। सब कुछ स्थानीय!

    1,912+1पिछले 7 दिनों में स्टार का बदलाव
  • comfyui-mixlab-nodes@MixLabPro

    वर्कफ़्लो-टू-ऐप, स्क्रीनशेयर और फ़्लोटिंग वीडियो, GPT और 3D, स्पीच रिकग्निशन और TTS

    1,861-2पिछले 7 दिनों में स्टार का बदलाव
  • RHVoice@RHVoice

    रूसी और अन्य भाषाओं के लिए एक मुफ्त और ओपन सोर्स स्पीच सिंथेसाइज़र

    1,836+1पिछले 7 दिनों में स्टार का बदलाव
  • kokoro-tts@nazdridoy

    Kokoro मॉडल का उपयोग करने वाला एक CLI टेक्स्ट-टू-स्पीच टूल, जो कई भाषाओं, आवाज़ों (मिश्रण के साथ), और EPUB पुस्तकों और PDF दस्तावेजों सहित विभिन्न इनपुट प्रारूपों का समर्थन करता है।

    1,835+14पिछले 7 दिनों में स्टार का बदलाव
  • Genie-TTS@High-Logic

    GPT-SoVITS ONNX इन्फेरेंस इंजन और मॉडल कन्वर्टर

    1,760+3पिछले 7 दिनों में स्टार का बदलाव
  • bailing@wwbin2017

    Bailing GPT-4o जैसा एक语音对话机器人 है, जो ASR+LLM+TTS के माध्यम से महसूस किया जाता है, DeepSeek R1 जैसे उत्कृष्ट बड़े मॉडल को एकीकृत करता है, openClaw तक पहुंचता है, एक सच्चा व्यक्तिगत语音 सहायक है, विलंबता 800ms जितनी कम है, Mac जैसे कम-कॉन्फ़िगरेशन वाले डिवाइस भी चल सकते हैं, और रुकावट का समर्थन करता है।

    1,759+2पिछले 7 दिनों में स्टार का बदलाव
  • VideoClaw@HITsz-TMG

    🚀 AI पूरी तरह से स्वचालित वीडियो निर्माण कर्मचारी | आपका पहला AIGC सहकर्मी। एक विचार चैट करें। एक फिल्म प्राप्त करें। 🦞

    1,749+14पिछले 7 दिनों में स्टार का बदलाव
  • सबटाइटल फ़ाइल के आधार पर वीडियो के पाठ का स्वचालित रूप से अनुवाद करता है, और फिर उपशीर्षक के समय का उपयोग करके भाषण को सिंक्रनाइज़ किए जाने वाले एक नया डब और अनुवादित ऑडियो ट्रैक बनाने के लिए AI आवाज सेवाओं का उपयोग करता है।

    1,746-1पिछले 7 दिनों में स्टार का बदलाव
  • vox-director@Alisa0808

    एक विषय को तैयार Vox-शैली के पेपर-कोलाज एक्सप्लेनर/विज्ञापन वीडियो में बदलें - Atlas Cloud + ffmpeg पर स्वचालित एंड-टू-एंड। एक एजेंट स्किल।

    1,698+67पिछले 7 दिनों में स्टार का बदलाव
  • uzu@trymirai

    AI मॉडल के लिए एक उच्च-प्रदर्शन इन्फ्रेंस इंजन

    1,687+4पिछले 7 दिनों में स्टार का बदलाव
  • Ava से मिलें, WhatsApp एजेंट

    1,675+2पिछले 7 दिनों में स्टार का बदलाव
  • ParallelWaveGAN@kan-bayashi

    Pytorch के साथ अनौपचारिक Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN)।

    1,646+1पिछले 7 दिनों में स्टार का बदलाव
  • dsnote@mkiol

    Speech Note Linux ऐप। ऑफ़लाइन Speech to Text, Text to Speech और मशीन अनुवाद के साथ नोट्स लेना, पढ़ना और अनुवाद करना।

    1,622+8पिछले 7 दिनों में स्टार का बदलाव
  • amica@semperai

    Amica वॉयस सिंथेसिस और स्पीच रिकग्निशन के साथ 3D कैरेक्टर के साथ इंटरैक्टिव संचार के लिए एक ओपन सोर्स इंटरफ़ेस है।

    1,591-2पिछले 7 दिनों में स्टार का बदलाव
  • VibeVoice-ComfyUI@Enemyx-net

    Microsoft के VibeVoice टेक्स्ट-टू-स्पीच मॉडल के लिए एक व्यापक ComfyUI इंटीग्रेशन, जो सीधे आपके ComfyUI वर्कफ़्लो के भीतर उच्च-गुणवत्ता वाले सिंगल और मल्टी-स्पीकर वॉयस सिंथेसिस को सक्षम बनाता है।

    1,555+4पिछले 7 दिनों में स्टार का बदलाव
  • soprano@ekwek1

    Soprano: त्वरित, अति-यथार्थवादी टेक्स्ट-टू-स्पीच

    1,548+60पिछले 7 दिनों में स्टार का बदलाव
  • dicio-android@DicioTeam

    Android के लिए Dicio असिस्टेंट ऐप

    1,463+3पिछले 7 दिनों में स्टार का बदलाव
  • BrowserAI@sauravpanda

    अपने ब्राउज़र के अंदर llama, deepseek-distill, kokoro जैसे लोकल LLMs चलाएं।

    1,449+1पिछले 7 दिनों में स्टार का बदलाव
  • Voice-Cloning-App@voice-cloning-app

    मानव आवाज़ों को आसानी से सिंथेटिक रूप से उत्पन्न करने के लिए एक Python/Pytorch ऐप

    1,440+0पिछले 7 दिनों में स्टार का बदलाव
  • OuteTTS@edwko

    OuteTTS मॉडल के लिए इंटरफ़ेस।

    1,437+0पिछले 7 दिनों में स्टार का बदलाव
  • शक्तिशाली Chatterbox TTS मॉडल को सेल्फ-हॉस्ट करें। यह सर्वर एक उपयोगकर्ता के अनुकूल Web UI, लचीले API एंडपॉइंट (OpenAI संगत सहित), पूर्वनिर्धारित आवाज़ें, वॉयस क्लोनिंग, और बड़े ऑडियोबुक-स्केल टेक्स्ट प्रोसेसिंग प्रदान करता है। NVIDIA (CUDA), AMD (ROCm), और CPU पर त्वरित रूप से चलता है।

    1,427+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस