मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · audio-language-model

audio-language-model

audio-language-model टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
4
कुल स्टार
3,852
औसत स्टार
963
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर audio-language-model के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और audio-language-model टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • Fun-ASR@QwenAudio

    चीनी, बोलियों, लहजों और बहुभाषी भाषण के लिए ओपन-सोर्स LLM-आधारित ASR मॉडल परिवार, FunASR, vLLM, स्ट्रीमिंग और llama.cpp रनटाइम के साथ।

    1,512+10पिछले 7 दिनों में स्टार का बदलाव
  • SoundMind@xid32

    हम Audio Logical Reasoning (ALR) डेटासेट पेश करते हैं, जिसमें जटिल तर्क कार्यों के लिए विशेष रूप से डिज़ाइन किए गए 6,446 टेक्स्ट-ऑडियो एनोटेटेड नमूने शामिल हैं। इस संसाधन के आधार पर, हम SoundMind का प्रस्ताव करते हैं, जो ऑडियो लैंग्वेज मॉडल (ALMs) को गहरी द्विमोडल तर्क क्षमताओं से लैस करने के लिए तैयार किया गया एक नियम-आधारित सुदृढीकरण शिक्षण (RL) एल्गोरिदम है।

    1,113+0पिछले 7 दिनों में स्टार का बदलाव
  • OmniVinci@NVlabs

    OmniVinci दृष्टि, ऑडियो और भाषा की संयुक्त समझ के लिए एक सर्व-मोडल LLM है।

    677+0पिछले 7 दिनों में स्टार का बदलाव
  • FlashLabs-Chroma@FlashLabs-AI-Corp

    पर्सनलाइज्ड वॉयस क्लोनिंग के साथ दुनिया का पहला ओपन-सोर्स रियल-टाइम एंड-टू-एंड स्पोकन डायलॉग मॉडल।

    549-1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस