मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · audio-generation

audio-generation

audio-generation टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
22
कुल स्टार
1,18,649
औसत स्टार
5,393
हिस्सा
0.01%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर audio-generation के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और audio-generation टैग वाली रिपॉजिटरी।

  • flatkey-cli@flatkey-ai

    इमेज, वीडियो, ऑडियो, टेक्स्ट, क्रेडिट और मॉडल डिस्कवरी के लिए फ्लैटकी मीडिया जनरेशन CLI।

    634
  • LocalAI@mudler

    LocalAI एक ओपन-सोर्स AI इंजन है। किसी भी हार्डवेयर पर कोई भी मॉडल - LLM, विज़न, वॉइस, इमेज, वीडियो - चलाएं। GPU की आवश्यकता नहीं है।

    48,749+135पिछले 7 दिनों में स्टार का बदलाव
  • CosyVoice@QwenAudio

    बहु-भाषी बड़ा वॉइस जनरेशन मॉडल, जो इन्फेरेंस, ट्रेनिंग और डिप्लॉयमेंट की फुल-स्टैक क्षमता प्रदान करता है।

    23,067+215पिछले 7 दिनों में स्टार का बदलाव
  • Amphion@open-mmlab

    Amphion (/æmˈfaɪən/) ऑडियो, म्यूजिक और स्पीच जनरेशन के लिए एक टूलकिट है। इसका उद्देश्य पुनरुत्पादनीय अनुसंधान (reproducible research) का समर्थन करना और नए शोधकर्ताओं व इंजीनियरों को ऑडियो, म्यूजिक और स्पीच जनरेशन के क्षेत्र में शुरुआत करने में मदद करना है।

    10,275+17पिछले 7 दिनों में स्टार का बदलाव
  • vllm-omni@vllm-project

    omni-modality मॉडलों के साथ कुशल मॉडल इनफरेंस के लिए एक फ्रेमवर्क।

    6,457+229पिछले 7 दिनों में स्टार का बदलाव
  • YuE@multimodal-art-projection

    YuE: ओपन फुल-सॉन्ग म्यूज़िक जनरेशन फाउंडेशन मॉडल, Suno.ai जैसा कुछ लेकिन ओपन

    6,408+14पिछले 7 दिनों में स्टार का बदलाव
  • TTS-WebUI@rsxdalv

    ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Audio, MMS, StyleTTS2, MAGNet, AudioGen, MusicGen, Tortoise, RVC, Vocos, Demucs, SeamlessM4T, और Bark के लिए एक्सटेंशन के साथ एक एकल Gradio + React WebUI!

    3,245+5पिछले 7 दिनों में स्टार का बदलाव
  • AudioLDM@haoheliu

    AudioLDM: टेक्स्ट के साथ स्पीच, साउंड इफेक्ट्स, म्यूजिक और बहुत कुछ जनरेट करें।

    2,908+2पिछले 7 दिनों में स्टार का बदलाव
  • AudioLDM2@haoheliu

    टेक्स्ट-से-ऑडियो/संगीत जनरेशन

    2,639+1पिछले 7 दिनों में स्टार का बदलाव
  • 2023 से शुरू होने वाले ऑडियो जनरेशन के लिए नवीनतम AI मॉडल की एक टाइमलाइन!เช

    1,904+0पिछले 7 दिनों में स्टार का बदलाव
  • soundstorm-pytorch@lucidrains

    Google Deepmind द्वारा SoundStorm का कार्यान्वयन, Pytorch में कुशल समानांतर ऑडियो जनरेशन

    1,547+1पिछले 7 दिनों में स्टार का बदलाव
  • शक्तिशाली Chatterbox TTS मॉडल को सेल्फ-हॉस्ट करें। यह सर्वर एक उपयोगकर्ता के अनुकूल Web UI, लचीले API एंडपॉइंट (OpenAI संगत सहित), पूर्वनिर्धारित आवाज़ें, वॉयस क्लोनिंग, और बड़े ऑडियोबुक-स्केल टेक्स्ट प्रोसेसिंग प्रदान करता है। NVIDIA (CUDA), AMD (ROCm), और CPU पर त्वरित रूप से चलता है।

    1,426+12पिछले 7 दिनों में स्टार का बदलाव
  • tango@declare-lab

    टेक्स्ट-टू-ऑडियो जनरेशन के लिए डिफ्यूजन मॉडल का एक परिवार।

    1,238+0पिछले 7 दिनों में स्टार का बदलाव
  • BigVGAN@NVIDIA

    BigVGAN (ICLR 2023) का आधिकारिक PyTorch कार्यान्वयन

    1,226+0पिछले 7 दिनों में स्टार का बदलाव
  • TTS-Audio-Suite@diodiogod

    स्थानीय मल्टी-इंजन मल्टी-लैंग्वेज टेक्स्ट-टू-स्पीच और वॉयस कन्वर्जन के लिए एक ComfyUI कस्टम नोड इंटीग्रेशन। समर्थित: RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox (क्लासिक और बहुभाषी), F5-TTS, Higgs Audio 2, 3, और असीमित टेक्स्ट लंबाई, SRT टाइमिंग, कैरेक्टर सपोर्ट और कई ऑडियो टूल के साथ VibeVoice

    1,184+9पिछले 7 दिनों में स्टार का बदलाव
  • muapi-cli@SamurAIGPT

    muapi.ai के लिए आधिकारिक CLI — टर्मिनल से इमेज, वीडियो और ऑडियो जनरेट करें। MCP सर्वर, 14 AI मॉडल, npm और pip के माध्यम से इंस्टॉल करने योग्य।

    1,043+1पिछले 7 दिनों में स्टार का बदलाव
  • sglang-omni@sgl-project

    SGLang-Omni, TTS, ASR, स्पीच और ओम्नी मॉडल के लिए उच्च-प्रदर्शन सर्विंग को सक्षम बनाता है।

    978+70पिछले 7 दिनों में स्टार का बदलाव
  • AI Audio Datasets (AI-ADS) 🎵, जिसमें स्पीच, म्यूजिक और साउंड इफेक्ट्स शामिल हैं, जो जेनरेटिव AI, AIGC, AI मॉडल ट्रेनिंग, इंटेलिजेंट ऑडियो टूल डेवलपमेंट और ऑडियो एप्लिकेशन के लिए ट्रेनिंग डेटा प्रदान करते हैं।

    961+0पिछले 7 दिनों में स्टार का बदलाव
  • audio-ai-hub@BinWang28

    ऑडियो AI अनुसंधान के लिए हब: ऑडियो LLMs, स्पीच रिकग्निशन, TTS, संगीत और ऑडियो जनरेशन पर शोध पत्र, ओपन मॉडल, बेंचमार्क और डेटासेट।

    950+0पिछले 7 दिनों में स्टार का बदलाव
  • vui@fluxions-ai

    रीयल-टाइम वॉयस असिस्टेंट — WebRTC स्ट्रीमिंग, faster-whisper ASR, लोकल LLM, Vui Nano (300M) TTS। OpenAI रीयल-टाइम API संगत। वॉयस क्लोनिंग, बार्ज-इन, 4090 पर ~9× रीयल-टाइम। Apache 2.0।

    748+0पिछले 7 दिनों में स्टार का बदलाव
  • flatkey-cli@flatkey-ai

    इमेज, वीडियो, ऑडियो, टेक्स्ट, क्रेडिट और मॉडल डिस्कवरी के लिए फ्लैटकी मीडिया जनरेशन CLI।

    634+89पिछले 7 दिनों में स्टार का बदलाव
  • genblaze@backblaze-labs

    Genblaze एक ओपन सोर्स Python SDK है जो वीडियो, ऑडियो और इमेज प्रदाताओं के बीच जेनरेटिव AI मीडिया पाइपलाइनों को व्यवस्थित करता है, जिसमें प्रत्येक आउटपुट के लिए इन-बिल्ट प्रोवेनेंस शामिल है।

    559-1पिछले 7 दिनों में स्टार का बदलाव
  • unified-audio@alibaba

    ऑडियो प्रोसेसिंग और जनरेशन को एकीकृत करने के लिए एक ओपन-सोर्स प्रोजेक्ट

    510+3पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस