tts
tts टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #31
ChatTTS का उपयोग करके टेक्स्ट को स्पीच में बदलने के लिए एक सरल स्थानीय वेब इंटरफेस, जो बाहरी API इंटरफेस का समर्थन भी करता है।
★ 7,648+4पिछले 7 दिनों में स्टार का बदलाव - #32
MyShell.ai द्वारा उच्च-गुणवत्ता वाली बहुभाषी टेक्स्ट-टू-स्पीच लाइब्रेरी। अंग्रेजी, स्पेनिश, फ्रेंच, चीनी, जापानी और कोरियाई का समर्थन करती है।
★ 7,616+7पिछले 7 दिनों में स्टार का बदलाव - #33
🤖 wukong-robot एक सरल, लचीला और सुरुचिपूर्ण चीनी वॉयस डायलॉग रोबोट/स्मार्ट स्पीकर प्रोजेक्ट है, जो ChatGPT मल्टी-राउंड डायलॉग क्षमता का समर्थन करता है, और संभवतः ब्रेन-कंप्यूटर इंटरैक्शन का समर्थन करने वाला पहला ओपन-सोर्स स्मार्ट स्पीकर प्रोजेक्ट है।
★ 7,126+2पिछले 7 दिनों में स्टार का बदलाव - #34
StyleTTS 2: लार्ज स्पीच लैंग्वेज मॉडल के साथ स्टाइल डिफ़्यूज़न और एडवरसरियल ट्रेनिंग के माध्यम से मानव-स्तरीय टेक्स्ट-टू-स्पीच की ओर
★ 6,342+3पिछले 7 दिनों में स्टार का बदलाव - #35
मानव जैसी आवाज की ओर
★ 6,324+5पिछले 7 दिनों में स्टार का बदलाव - #36
🎤 माइक्रोसॉफ्ट वॉयस सिंथेसिस टूल, जिसे Electron + Vue + ElementPlus + Vite का उपयोग करके बनाया गया है।
★ 6,103+1पिछले 7 दिनों में स्टार का बदलाव - #37
Silero मॉडल: प्री-ट्रेनिंग टेक्स्ट-टू-स्पीच मॉडल जिन्हें अत्यंत सरल बनाया गया है
★ 6,084-1पिछले 7 दिनों में स्टार का बदलाव - #38★ 5,831+45पिछले 7 दिनों में स्टार का बदलाव
- #39
Kokoro-82M टेक्स्ट-टू-स्पीच के लिए डॉक्युराइज्ड OpenAI-संगत रैपर, मल्टीप्लैटफॉर्म CPU, AMD, NVIDIA GPU PyTorch; मल्टी-स्पीकर, वॉयस-मिक्सिंग, ऑटो-स्टिचिंग, कैप्शन टाइमस्टैम्प, SSML, रीडअलांग वेब UI के साथ
★ 5,399+19पिछले 7 दिनों में स्टार का बदलाव - #40
एक सामान्य-उद्देश्य AIGC वीडियो इंजन: एक ही पाइपलाइन में स्क्रिप्ट से तैयार फ़िल्म — नाटक, विज्ञापन, उत्पाद वीडियो, ओटोमे गेम, और बहुत कुछ।
★ 4,900+384पिछले 7 दिनों में स्टार का बदलाव - #41
DiffSinger: शैलो डिफ्यूजन तंत्र (SVS & TTS) के माध्यम से सिंगिंग वॉयस सिंथेसिस; AAAI 2022; आधिकारिक कोड
★ 4,855+3पिछले 7 दिनों में स्टार का बदलाव - #42
Whisper को उलट कर बनाया गया एक ओपन सोर्स टेक्स्ट-टू-स्पीच सिस्टम।
★ 4,645+3पिछले 7 दिनों में स्टार का बदलाव - #43
यह एक एंड्रॉइड सिस्टम TTS एप्लिकेशन है जिसमें माइक्रोसॉफ्ट डेमो इंटरफ़ेस अंतर्निहित है, कस्टम HTTP अनुरोध, अन्य स्थानीय TTS इंजन आयात करने की क्षमता, चीनी दोहरे उद्धरण चिह्नों के आधार पर सरल वर्णन/संभाषण पहचान वाचन, और ऑटो-रीट्राय, बैकअप कॉन्फ़िगरेशन, टेक्स्ट प्रतिस्थापन जैसी अधिक सुविधाएँ हैं।
★ 4,488+5पिछले 7 दिनों में स्टार का बदलाव - #44
MOSS-TTS-Nano MOSI.AI और OpenMOSS टीम का एक ओपन-सोर्स बहुभाषी छोटा स्पीच जनरेशन मॉडल है। केवल 0.1B पैरामीटर के साथ, इसे रीयल-टाइम स्पीच जनरेशन के लिए डिज़ाइन किया गया है, यह बिना GPU के सीधे CPU पर चल सकता है, और स्थानीय डेमो, वेब सर्विंग और हल्के उत्पाद एकीकरण के लिए डिप्लॉयमेंट स्टैक को सरल रखता है।
★ 4,282+11पिछले 7 दिनों में स्टार का बदलाव - #45
मानव-जैसी, अभिव्यक्तfमक TTS के लिए फ़ाउंडेशनल मॉडल
★ 4,203-1पिछले 7 दिनों में स्टार का बदलाव - #46
:stuck_out_tongue_closed_eyes: TensorFlowTTS: Tensorflow 2 के लिए रियल-टाइम अत्याधुनिक स्पीच सिंथेसिस (अंग्रेजी, फ्रेंच, कोरियाई, चीनी, जर्मन सहित समर्थित और अन्य भाषाओं के लिए अनुकूलित करना आसान)
★ 3,996+0पिछले 7 दिनों में स्टार का बदलाव - #47
Streamer-Sales - सेल्स-चैंपियन लाइव-स्ट्रीमर LLM बड़ा मॉडल🛒🎁, जो दी गई उत्पाद विशेषताओं के आधार पर उपयोगकर्ताओं की खरीदारी की इच्छा को जगाने के लिए उत्पाद का विवरण देता है।🚀⭐ विस्तृत डेटा जनरेशन प्रक्रिया शामिल है❗ 📦 इसके अलावा इसमें त्वरित अनुमान के लिए LMDeploy 🚀, RAG खोज-संवर्धित जनरेशन 📚, TTS टेक्स्ट-टू-स्पीच 🔊, डिजिटल मानव जनरेशन 🦸, वास्तविक समय की जानकारी खोजने के लिए Agent 🌐, ASR स्पीच-टू-टेक्स्ट 🎙️, फ्रंटएंड के लिए Vue इकोसिस्टम 🍍, बैकएंड के लिए FastAPI 🗝️, और पैकेजिंग एवं परिनियोजन के लिए Docker-compose 🐋 एकीकृत हैं।
★ 3,764+1पिछले 7 दिनों में स्टार का बदलाव - #48
उपयोग में आसानी और प्रदर्शन पर केंद्रित एक सरल, उच्च-गुणवत्ता वाला वॉयस कन्वर्जन टूल।
★ 3,674+14पिछले 7 दिनों में स्टार का बदलाव - #49
ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T, और Bark के लिए एक्सटेंशन के साथ एक एकल Gradio + React WebUI!
★ 3,250+5पिछले 7 दिनों में स्टार का बदलाव - #50
[AutoArk] GPA (General Purpose Audio) एक छोटे मॉडल के साथ ASR, TTS और वॉयस कन्वर्जन कर सकता है!
★ 3,061+164पिछले 7 दिनों में स्टार का बदलाव - #51
openctp提供CTP股票期权、中泰证券XTP、华鑫证券奇点TORA、东方证券OST、东方财富证券EMT、盈透证券TWS、易盛TAP、量投QDP等各通道的CTPAPI兼容接口,CTP程序可以无缝对接各股票柜台。openctp也提供了一套基于TTS交易系统的模拟环境,同样提供了CTPAPI兼容接口,不仅支持国内期货与期权全品种,也支持A股股票、基金、债券以及股票期权模拟交易,可以替代Simnow,为CTP量化交易开发者提供7x24可用的模拟环境。
★ 2,920+7पिछले 7 दिनों में स्टार का बदलाव - #52★ 2,864+0पिछले 7 दिनों में स्टार का बदलाव
- #53
aeneas एक Python/C लाइब्रेरी और टूल्स का एक सेट है जो ऑडियो और टेक्स्ट को स्वचालित रूप से सिंक करता है (जिसे फोर्स्ड अलाइनमेंट भी कहते हैं)
★ 2,862+0पिछले 7 दिनों में स्टार का बदलाव - #54
FLUX, Stable Diffusion, SDXL, SD3, LoRA, Fine Tuning, DreamBooth, Training, Automatic1111, Forge WebUI, SwarmUI, DeepFake, TTS, Animation, Text To Video, Tutorials, Guides, Lectures, Courses, ComfyUI, Google Colab, RunPod, Kaggle, NoteBooks, ControlNet, TTS, Voice Cloning, AI, AI News, ML, ML News, News, Tech, Tech News, Kohya, Midjourney, RunPod
★ 2,762-1पिछले 7 दिनों में स्टार का बदलाव - #55
kokoro और onnx runtime के साथ TTS
★ 2,694+8पिछले 7 दिनों में स्टार का बदलाव - #56
Google Translate की टेक्स्ट-टू-स्पीच API के साथ इंटरफेस करने के लिए Python लाइब्रेरी और CLI टूल।
★ 2,628+0पिछले 7 दिनों में स्टार का बदलाव - #57★ 2,586+1पिछले 7 दिनों में स्टार का बदलाव
- #58
MARY TTS -- शुद्ध जावा में लिखा गया एक ओपन-सोर्स, बहुभाषी टेक्स्ट-टू-स्पीच सिंथेसिस सिस्टम
★ 2,583+0पिछले 7 दिनों में स्टार का बदलाव - #59
इंस्टेंट वॉइस क्लोनिंग के साथ Vietnamese TTS • ऑन-डिवाइस • रियल-टाइम CPU इन्फरेंस • 24kHz ऑडियो क्वालिटी • Chuyển văn bản thành giọng nói tiếng Việt • Text to speech tiếng Việt • TTS tiếng Việt
★ 2,468+21पिछले 7 दिनों में स्टार का बदलाव - #60★ 2,367+0पिछले 7 दिनों में स्टार का बदलाव