dataset
dataset टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61
2020 से सार्वजनिक BTC ट्रेडिंग संदर्भ।
★ 1,216+1पिछले 7 दिनों में स्टार का बदलाव - #62
M2DGR: ग्राउंड रोबोट्स के लिए एक मल्टी-मॉडल और मल्टी-परिदृश्य डेटासेट (RA-L2021 & ICRA2022)
★ 1,201+5पिछले 7 दिनों में स्टार का बदलाव - #63
मैन्युअल रूप से फाइन-ट्यून किया गया चीनी संवाद डेटासेट और ChatGLM के लिए फाइन-ट्यूनिंग कोड का एक टुकड़ा
★ 1,191+0पिछले 7 दिनों में स्टार का बदलाव - #64
TorchXRayVision: छाती के एक्स-रे डेटासेट और मॉडल की एक लाइब्रेरी। क्लासिफायर, सेगमेंटेशन और ऑटोएन्कोडर।
★ 1,188+3पिछले 7 दिनों में स्टार का बदलाव - #65★ 1,165+1पिछले 7 दिनों में स्टार का बदलाव
- #66★ 1,157+1पिछले 7 दिनों में स्टार का बदलाव
- #67
Twitter डेटासेट और संबंधित संसाधनों की एक सूची।
★ 1,125+1पिछले 7 दिनों में स्टार का बदलाव - #68
गेम डेटासेट और गेम में आर्टिफिशियल इंटेलिजेंस के लिए टूल्स की एक क्यूरेटेड सूची।
★ 1,118+9पिछले 7 दिनों में स्टार का बदलाव - #69
हम Audio Logical Reasoning (ALR) डेटासेट पेश करते हैं, जिसमें जटिल तर्क कार्यों के लिए विशेष रूप से डिज़ाइन किए गए 6,446 टेक्स्ट-ऑडियो एनोटेटेड नमूने शामिल हैं। इस संसाधन के आधार पर, हम SoundMind का प्रस्ताव करते हैं, जो ऑडियो लैंग्वेज मॉडल (ALMs) को गहरी द्विमोडल तर्क क्षमताओं से लैस करने के लिए तैयार किया गया एक नियम-आधारित सुदृढीकरण शिक्षण (RL) एल्गोरिदम है।
★ 1,113+0पिछले 7 दिनों में स्टार का बदलाव - #70
बीमा उद्योग के लिए कॉर्पस और चैटबॉट।
★ 1,064-1पिछले 7 दिनों में स्टार का बदलाव - #71★ 1,059+8पिछले 7 दिनों में स्टार का बदलाव
- #72
अनुसंधान के लिए परिवहन नेटवर्क
★ 1,051+2पिछले 7 दिनों में स्टार का बदलाव - #73★ 1,046+4पिछले 7 दिनों में स्टार का बदलाव
- #74
नामों के लिए Python लाइब्रेरी।
★ 1,019-1पिछले 7 दिनों में स्टार का बदलाव - #75
लार्ज लैंग्वेज मॉडल्स में चेन-ऑफ-थॉट रीजनिंग से संबंधित डेटा और टूल्स के लिए एक केंद्रीय, ओपन रिसोर्स। Samwald रिसर्च ग्रुप द्वारा विकसित: https://samwald.info/
★ 1,015+0पिछले 7 दिनों में स्टार का बदलाव - #76
बायोमैकेनिक्स और मानव गति विश्लेषण के लिए संसाधनों की एक क्यूरेटेड सार्वजनिक सूची: डेटासेट, प्रोसेसिंग टूल्स, सिमुलेशन सॉफ़्टवेयर, शैक्षिक वीडियो, व्याख्यान आदि।
★ 1,010+1पिछले 7 दिनों में स्टार का बदलाव - #77★ 1,004-1पिछले 7 दिनों में स्टार का बदलाव
- #78★ 948+0पिछले 7 दिनों में स्टार का बदलाव
- #79
KDD 2019: स्टोकेस्टिक रीकरेंट न्यूरल नेटवर्क के माध्यम से मल्टीवेरिएट टाइम सीरीज़ के लिए मजबूत एनोमली डिटेक्शन
★ 948+5पिछले 7 दिनों में स्टार का बदलाव - #80
PyTorch में SOTA सिमेंटिक सेगमेंटेशन मॉडल्स
★ 942-1पिछले 7 दिनों में स्टार का बदलाव - #81★ 902+0पिछले 7 दिनों में स्टार का बदलाव
- #82
डेटासेट विज़ुअलाइज़ेशन, डेटा प्रोसेसिंग और परिणामों के मूल्यांकन के लिए SemanticKITTI API
★ 899+3पिछले 7 दिनों में स्टार का बदलाव - #83
एक ही पाइपलाइन में उच्च-गुणवत्ता वाले सिंथेटिक्स उत्पन्न करें, प्रशिक्षित करें, मापें और मूल्यांकन करें
★ 885+3पिछले 7 दिनों में स्टार का बदलाव - #84
[ICLR 2025] संरेखित LLMs को कुछ भी न देकर प्रॉम्प्टिंग के माध्यम से शून्य से संरेखण डेटा संश्लेषण। आपका कुशल और उच्च गुणवत्ता वाला सिंथेटिक डेटा जनरेशन पाइपलाइन!
★ 882+2पिछले 7 दिनों में स्टार का बदलाव - #85★ 834+4पिछले 7 दिनों में स्टार का बदलाव
- #86★ 833+0पिछले 7 दिनों में स्टार का बदलाव
- #87★ 823+6पिछले 7 दिनों में स्टार का बदलाव
- #88★ 820+6पिछले 7 दिनों में स्टार का बदलाव
- #89
COCO डेटासेट बनाने के लिए हेल्पर फ़ंक्शंस
★ 783-1पिछले 7 दिनों में स्टार का बदलाव - #90
Total Text Dataset। इसमें 1555 चित्र शामिल हैं जिनमें 3 से अधिक विभिन्न टेक्स्ट ओरिएंटेशन हैं: हॉरिजॉन्टल, मल्टी-ओरिएंटेड और कर्व्ड, जो अपनी तरह का अनूठा है।
★ 771-1पिछले 7 दिनों में स्टार का बदलाव