datasets
datasets टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #61★ 939+1पिछले 7 दिनों में स्टार का बदलाव
- #62
मेडिकल इमेजिंग पर ध्यान केंद्रित करते हुए मेडिकल डेटासेट को ट्रैक करना
★ 926+1पिछले 7 दिनों में स्टार का बदलाव - #63
एक बैकएंड जो सार्वजनिक API के माध्यम से Hugging Face डेटासेट पेजों पर डेटासेट व्यूअर को पावर देता है।
★ 900-1पिछले 7 दिनों में स्टार का बदलाव - #64
Croissant मशीन लर्निंग डेटासेट के लिए एक हाई-लेवल फॉर्मेट है जो चार समृद्ध परतों को एक साथ लाता है।
★ 895+3पिछले 7 दिनों में स्टार का बदलाव - #65
🚀🚀🚀 लार्ज लैंग्वेज मॉडल (LLM), विज़न लैंग्वेज मॉडल (VLM), विज़न लैंग्वेज एक्शन (VLA), AI जेनरेटेड कंटेंट (AIGC), और संबंधित डेटासेट व एप्लिकेशन के बारे में कुछ बेहतरीन सार्वजनिक प्रोजेक्ट्स का संग्रह।
★ 815+0पिछले 7 दिनों में स्टार का बदलाव - #66
AI, कंप्यूटर विज़न और रोबोटिक्स से संबंधित विभिन्न सामग्री के उपयोगी लिंक।
★ 783+1पिछले 7 दिनों में स्टार का बदलाव - #67★ 754+1पिछले 7 दिनों में स्टार का बदलाव
- #68
ChatLLM जैसे मॉडल को प्रशिक्षित करने के लिए बेहतरीन प्रॉम्प्ट और इंस्ट्रक्शन डेटासेट का संग्रह।
★ 744+1पिछले 7 दिनों में स्टार का बदलाव - #69
सॉफ्टवेयर इंजीनियरिंग के लिए मशीन लर्निंग के अनुप्रयोग से संबंधित शोध पत्रों, थीसिस, डेटासेट और टूल्स की एक क्यूरेटेड सूची।
★ 733+0पिछले 7 दिनों में स्टार का बदलाव - #70
बड़े कॉलम वाले डेटासेट के भंडारण के लिए नया और विस्तार योग्य फ़ाइल फॉर्मेट।
★ 732+1पिछले 7 दिनों में स्टार का बदलाव - #71
Open Bandit Pipeline: bandit algorithms और off-policy evaluation के लिए एक python लाइब्रेरी
★ 708+0पिछले 7 दिनों में स्टार का बदलाव - #72
डेटासेट मैनेजमेंट फ्रेमवर्क, कंप्यूटर विज़न डेटासेट बनाने, विश्लेषण करने और प्रबंधित करने के लिए एक Python लाइब्रेरी और CLI टूल।
★ 687+0पिछले 7 दिनों में स्टार का बदलाव - #73
साझा Ultralytics लोगो, मीडिया, नमूना चित्र, प्रीट्रेन्ड मॉडल वेट, डेटासेट आर्टिफैक्ट्स और रिलीज़ एसेट्स।
★ 665+2पिछले 7 दिनों में स्टार का बदलाव - #74
Indonesian भाषा के लिए अब तक का सबसे बड़ा नेचुरल लैंग्वेज प्रोसेसिंग बेंचमार्क। हम कई डाउनस्ट्रीम टास्क, प्री-ट्रेंड IndoBERT मॉडल और स्टार्टर कोड प्रदान करते हैं! (AACL-IJCNLP 2020)
★ 655+1पिछले 7 दिनों में स्टार का बदलाव - #75
सेगमेंटेशन / सेलियंसी डिटेक्शन के लिए डेटासेट का संग्रह। PR का स्वागत है।
★ 640+1पिछले 7 दिनों में स्टार का बदलाव - #76
ExerciseDB API एक फिटनेस एक्सरसाइज डेटाबेस API है जो उपयोगकर्ताओं को 11000+ अभ्यासों के उच्च-गुणवत्ता वाले डेटा तक पहुँच प्रदान करता है। यह API प्रत्येक अभ्यास पर विस्तृत जानकारी प्रदान करता है, जिसमें लक्षित शरीर के अंग, आवश्यक उपकरण, वीडियो, GIF, दृश्य मार्गदर्शन के लिए चित्र और चरण-दर-चरण निर्देश शामिल हैं।
★ 621+12पिछले 7 दिनों में स्टार का बदलाव - #77
यह रिपॉजिटरी जहाज का पता लगाने, वर्गीकरण, सिमेंटिक सेगमेंटेशन और इंस्टेंस सेगमेंटेशन कार्यों के लिए क्यूरेट किए गए रडार और ऑप्टिकल सैटेलाइट डेटासेट की एक व्यापक सूची प्रदान करती है। ये डेटासेट कंप्यूटर विज़न, मशीन लर्निंग, रिमोट सेंसिंग और समुद्री विश्लेषण में अनुप्रयोगों के लिए आदर्श हैं।
★ 606+0पिछले 7 दिनों में स्टार का बदलाव - #78
हिस्टोपैथोलॉजी डेटासेट के संसाधन
★ 571+0पिछले 7 दिनों में स्टार का बदलाव - #79
Cleora AI विषम संबंधपरक डेटा के लिए स्थिर और इंडक्टिव एंटिटी एम्बेडिंग के कुशल और स्केलेबल लर्निंग के लिए एक सामान्य प्रयोजन का ओपन-सोर्स मॉडल है। इसे Synerise.com टीम द्वारा बनाया गया है।
★ 541+1पिछले 7 दिनों में स्टार का बदलाव - #80
डोमेन जनरलाइज़ेशन के बारे में बेहतरीन चीजें, जिसमें पेपर, कोड आदि शामिल हैं।
★ 539+1पिछले 7 दिनों में स्टार का बदलाव - #81
इंस्ट्रक्शन ट्यूनिंग और फॉलोइंग पर शोध पत्र और डेटासेट।
★ 511-1पिछले 7 दिनों में स्टार का बदलाव