मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · datasets

datasets

datasets टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

81 रिपॉजिटरी
  • commons@datasets

    DataHub कॉमन्स। दिलचस्प और महत्वपूर्ण डेटासेट

    939+1पिछले 7 दिनों में स्टार का बदलाव
  • मेडिकल इमेजिंग पर ध्यान केंद्रित करते हुए मेडिकल डेटासेट को ट्रैक करना

    926+1पिछले 7 दिनों में स्टार का बदलाव
  • dataset-viewer@huggingface

    एक बैकएंड जो सार्वजनिक API के माध्यम से Hugging Face डेटासेट पेजों पर डेटासेट व्यूअर को पावर देता है।

    900-1पिछले 7 दिनों में स्टार का बदलाव
  • croissant@mlcommons

    Croissant मशीन लर्निंग डेटासेट के लिए एक हाई-लेवल फॉर्मेट है जो चार समृद्ध परतों को एक साथ लाता है।

    895+3पिछले 7 दिनों में स्टार का बदलाव
  • 🚀🚀🚀 लार्ज लैंग्वेज मॉडल (LLM), विज़न लैंग्वेज मॉडल (VLM), विज़न लैंग्वेज एक्शन (VLA), AI जेनरेटेड कंटेंट (AIGC), और संबंधित डेटासेट व एप्लिकेशन के बारे में कुछ बेहतरीन सार्वजनिक प्रोजेक्ट्स का संग्रह।

    815+0पिछले 7 दिनों में स्टार का बदलाव
  • AI, कंप्यूटर विज़न और रोबोटिक्स से संबंधित विभिन्न सामग्री के उपयोगी लिंक।

    783+1पिछले 7 दिनों में स्टार का बदलाव
  • OpenML@openml

    ओपन मशीन लर्निंग

    754+1पिछले 7 दिनों में स्टार का बदलाव
  • ChatLLM जैसे मॉडल को प्रशिक्षित करने के लिए बेहतरीन प्रॉम्प्ट और इंस्ट्रक्शन डेटासेट का संग्रह।

    744+1पिछले 7 दिनों में स्टार का बदलाव
  • ml4se@saltudelft

    सॉफ्टवेयर इंजीनियरिंग के लिए मशीन लर्निंग के अनुप्रयोग से संबंधित शोध पत्रों, थीसिस, डेटासेट और टूल्स की एक क्यूरेटेड सूची।

    733+0पिछले 7 दिनों में स्टार का बदलाव
  • nimble@facebookincubator

    बड़े कॉलम वाले डेटासेट के भंडारण के लिए नया और विस्तार योग्य फ़ाइल फॉर्मेट।

    732+1पिछले 7 दिनों में स्टार का बदलाव
  • zr-obp@st-tech

    Open Bandit Pipeline: bandit algorithms और off-policy evaluation के लिए एक python लाइब्रेरी

    708+0पिछले 7 दिनों में स्टार का बदलाव
  • datumaro@open-edge-platform

    डेटासेट मैनेजमेंट फ्रेमवर्क, कंप्यूटर विज़न डेटासेट बनाने, विश्लेषण करने और प्रबंधित करने के लिए एक Python लाइब्रेरी और CLI टूल।

    687+0पिछले 7 दिनों में स्टार का बदलाव
  • assets@ultralytics

    साझा Ultralytics लोगो, मीडिया, नमूना चित्र, प्रीट्रेन्ड मॉडल वेट, डेटासेट आर्टिफैक्ट्स और रिलीज़ एसेट्स।

    665+2पिछले 7 दिनों में स्टार का बदलाव
  • indonlu@IndoNLP

    Indonesian भाषा के लिए अब तक का सबसे बड़ा नेचुरल लैंग्वेज प्रोसेसिंग बेंचमार्क। हम कई डाउनस्ट्रीम टास्क, प्री-ट्रेंड IndoBERT मॉडल और स्टार्टर कोड प्रदान करते हैं! (AACL-IJCNLP 2020)

    655+1पिछले 7 दिनों में स्टार का बदलाव
  • सेगमेंटेशन / सेलियंसी डिटेक्शन के लिए डेटासेट का संग्रह। PR का स्वागत है।

    640+1पिछले 7 दिनों में स्टार का बदलाव
  • ExerciseDB API एक फिटनेस एक्सरसाइज डेटाबेस API है जो उपयोगकर्ताओं को 11000+ अभ्यासों के उच्च-गुणवत्ता वाले डेटा तक पहुँच प्रदान करता है। यह API प्रत्येक अभ्यास पर विस्तृत जानकारी प्रदान करता है, जिसमें लक्षित शरीर के अंग, आवश्यक उपकरण, वीडियो, GIF, दृश्य मार्गदर्शन के लिए चित्र और चरण-दर-चरण निर्देश शामिल हैं।

    621+12पिछले 7 दिनों में स्टार का बदलाव
  • यह रिपॉजिटरी जहाज का पता लगाने, वर्गीकरण, सिमेंटिक सेगमेंटेशन और इंस्टेंस सेगमेंटेशन कार्यों के लिए क्यूरेट किए गए रडार और ऑप्टिकल सैटेलाइट डेटासेट की एक व्यापक सूची प्रदान करती है। ये डेटासेट कंप्यूटर विज़न, मशीन लर्निंग, रिमोट सेंसिंग और समुद्री विश्लेषण में अनुप्रयोगों के लिए आदर्श हैं।

    606+0पिछले 7 दिनों में स्टार का बदलाव
  • हिस्टोपैथोलॉजी डेटासेट के संसाधन

    571+0पिछले 7 दिनों में स्टार का बदलाव
  • cleora@BaseModelAI

    Cleora AI विषम संबंधपरक डेटा के लिए स्थिर और इंडक्टिव एंटिटी एम्बेडिंग के कुशल और स्केलेबल लर्निंग के लिए एक सामान्य प्रयोजन का ओपन-सोर्स मॉडल है। इसे Synerise.com टीम द्वारा बनाया गया है।

    541+1पिछले 7 दिनों में स्टार का बदलाव
  • डोमेन जनरलाइज़ेशन के बारे में बेहतरीन चीजें, जिसमें पेपर, कोड आदि शामिल हैं।

    539+1पिछले 7 दिनों में स्टार का बदलाव
  • इंस्ट्रक्शन ट्यूनिंग और फॉलोइंग पर शोध पत्र और डेटासेट।

    511-1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस