मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · datasets

datasets

datasets टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

81 रिपॉजिटरी
  • ogb@snap-stanford

    ग्राफ मशीन लर्निंग के लिए बेंचमार्क डेटासेट, डेटा लोडर और मूल्यांकनकर्ता

    2,095+1पिछले 7 दिनों में स्टार का बदलाव
  • अद्भुत रूप से बेहतरीन साइबर सुरक्षा डेटासेट की एक क्यूरेटेड सूची

    2,077+4पिछले 7 दिनों में स्टार का बदलाव
  • DB-GPT-Hub@eosphoros-ai

    एक रिपॉजिटरी जिसमें Text-to-SQL में मॉडल के प्रदर्शन को बढ़ाने के उद्देश्य से DB-GPT के लिए मॉडल, डेटासेट और फाइन-ट्यूनिंग तकनीकें शामिल हैं

    2,008+0पिछले 7 दिनों में स्टार का बदलाव
  • diffgram@diffgram

    Schemas, BLOBs और Predictions के लिए AI Datastore। अपने AI डेटा से अधिकतम मूल्य प्राप्त करने के लिए अपने ऐप्स के साथ उपयोग करें या अंतर्निहित Human Supervision, Data Workflow और UI Catalog को एकीकृत करें।

    1,909+0पिछले 7 दिनों में स्टार का बदलाव
  • awesome-data-analysis@PavelGrigoryevDS

    🚀 डेटा एनालिसिस और डेटा साइंस के लिए 500+ क्यूरेटेड संसाधन: Python, SQL, सांख्यिकी, ML, AI, विज़ुअलाइज़ेशन, चीटशीट, रोडमैप, इंटरव्यू की तैयारी। शुरुआती और विशेषज्ञों दोनों के लिए।

    1,890+16पिछले 7 दिनों में स्टार का बदलाव
  • DataFrames.jl@JuliaData

    Julia में इन-मेमोरी सारणीबद्ध डेटा

    1,831+0पिछले 7 दिनों में स्टार का बदलाव
  • awesome-transit@MobilityData

    ट्रांजिट API, ऐप्स, डेटासेट, अनुसंधान और सॉफ्टवेयर की सामुदायिक सूची :bus::star2::train::star2::steam_locomotive:

    1,826+5पिछले 7 दिनों में स्टार का बदलाव
  • 🚀🚀🚀 कुछ बेहतरीन public YOLO object detection series प्रोजेक्ट्स और संबंधित object detection datasets का संग्रह।

    1,783+0पिछले 7 दिनों में स्टार का बदलाव
  • हु चेनफेंग की सभी सामग्री एकत्र करें

    1,650+4पिछले 7 दिनों में स्टार का बदलाव
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Safe Reinforcement Learning from Human Feedback के माध्यम से प्रतिबंधित वैल्यू एलाइनमेंट

    1,613+2पिछले 7 दिनों में स्टार का बदलाव
  • नेम्ड एंटिटी रिकग्निशन (NER) और एंटिटी रिकग्निशन कार्यों के लिए कॉर्पोरा का एक संग्रह। ये एनोटेट किए गए डेटासेट विभिन्न भाषाओं, डोमेन और एंटिटी प्रकारों को कवर करते हैं।

    1,574+0पिछले 7 दिनों में स्टार का बदलाव
  • रोबोट के लिए उपयोगी बेहतरीन लिंक और सॉफ़्टवेयर लाइब्रेरी की एक क्यूरेटेड सूची।

    1,483+4पिछले 7 दिनों में स्टार का बदलाव
  • projects@explosion

    🪐 प्रोटोटाइप से प्रोडक्शन तक एंड-टू-एंड NLP वर्कफ़्लो

    1,436+0पिछले 7 दिनों में स्टार का बदलाव
  • kitops@kitops-ml

    AI/ML मॉडल, डेटासेट, कोड और कॉन्फ़िगरेशन को OCI आर्टिफैक्ट में पैक और वर्शन करने के लिए CNCF का एक ओपन सोर्स DevOps टूल।

    1,409+1पिछले 7 दिनों में स्टार का बदलाव
  • IMAGDressing@muzishen

    [AAAI 2025]👔IMAGDressing👔: वर्चुअल ड्रेसिंग के लिए इंटरएक्टिव मॉड्यूलर अपैरल जनरेशन।

    1,343+0पिछले 7 दिनों में स्टार का बदलाव
  • Minari@Farama-Foundation

    लोकप्रिय संदर्भ डेटासेट और संबंधित यूटिलिटीज के साथ ऑफ़लाइन सुदृढीकरण शिक्षण डेटासेट के लिए एक मानक प्रारूप

    1,294+3पिछले 7 दिनों में स्टार का बदलाव
  • TDC@mims-harvard

    Therapeutics Commons (TDC): चिकित्सीय विज्ञान के लिए मल्टीमॉडल फाउंडेशन

    1,279+3पिछले 7 दिनों में स्टार का बदलाव
  • langtrace@Scale3-Labs

    Langtrace 🔍 LLM अनुप्रयोगों के लिए एक ओपन-सोर्स, ओपन टेलीमेट्री आधारित एंड-टू-एंड ऑब्जर्वेबिलिटी टूल है, जो लोकप्रिय LLMs, LLM फ्रेमवर्क, vectorDBs और अन्य के लिए वास्तविक समय ट्रेसिंग, मूल्यांकन और मेट्रिक्स प्रदान करता है। Typescript, Python का उपयोग करके एकीकृत करें। 🚀💻📊

    1,228-1पिछले 7 दिनों में स्टार का बदलाव
  • datasets@satellite-image-deep-learning

    उपग्रह और हवाई imagery के साथ डीप लर्निंग के लिए डेटासेट

    1,195+3पिछले 7 दिनों में स्टार का बदलाव
  • निर्देश-पालन करने वाले LLMs (ChatGPT, LLaMA, Alpaca) को प्रशिक्षित करने के लिए ओपन-सोर्स डेटासेट का एक संग्रह

    1,153-1पिछले 7 दिनों में स्टार का बदलाव
  • audino@midas-research

    इंसानों के लिए ओपन सोर्स ऑडियो एनोटेशन टूल

    1,146+0पिछले 7 दिनों में स्टार का बदलाव
  • Twitter डेटासेट और संबंधित संसाधनों की एक सूची।

    1,125+1पिछले 7 दिनों में स्टार का बदलाव
  • csghub-server@OpenCSGs

    csghub-server CSGHub के लिए बैकएंड सर्वर है जो उपयोगकर्ताओं को डेटासेट, मॉडल प्रबंधित करने और मॉडल इन्फरेंस, फाइनट्यून और एप्लिकेशन स्पेस चलाने में मदद करता है

    1,048+2पिछले 7 दिनों में स्टार का बदलाव
  • CLUECorpus2020@CLUEbenchmark

    चीनी भाषा के लिए बड़े पैमाने पर प्री-ट्रेनिंग कॉर्पस (100G)।

    1,019+0पिछले 7 दिनों में स्टार का बदलाव
  • [ACL 2023] लैंग्वेज मॉडल प्रॉम्प्टिंग के साथ रीजनिंग: एक सर्वेक्षण

    1,007+1पिछले 7 दिनों में स्टार का बदलाव
  • mola@MOLAorg

    लोकलाइज़ेशन और मैपिंग (MOLA) के लिए एक मॉड्यूलर ऑप्टिमाइज़ेशन फ्रेमवर्क

    1,006+4पिछले 7 दिनों में स्टार का बदलाव
  • ICCV-2023-25-Papers@DmitryRyumin

    ICCV 2023-2025 पेपर्स: प्रमुख कंप्यूटर विज़न कॉन्फ्रेंस ICCV 2023-25 से अत्याधुनिक शोध खोजें। कंप्यूटर विज़न और डीप लर्निंग में नवीनतम अपडेट रहें, कोड के साथ। ⭐ विज़ुअल इंटेलिजेंस विकास का समर्थन करें!

    969-1पिछले 7 दिनों में स्टार का बदलाव
  • AI Audio Datasets (AI-ADS) 🎵, जिसमें स्पीच, म्यूजिक और साउंड इफेक्ट्स शामिल हैं, जो जेनरेटिव AI, AIGC, AI मॉडल ट्रेनिंग, इंटेलिजेंट ऑडियो टूल डेवलपमेंट और ऑडियो एप्लिकेशन के लिए ट्रेनिंग डेटा प्रदान करते हैं।

    963+0पिछले 7 दिनों में स्टार का बदलाव
  • semhash@MinishLab

    तेज़ मल्टीमॉडल सिमेंटिक डुप्लीकेशन हटाना और फ़िल्टरिंग

    963+2पिछले 7 दिनों में स्टार का बदलाव
  • geobr@ipea

    R और Python में ब्राजील के आधिकारिक स्थानिक डेटा सेट तक आसान पहुँच

    945+2पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस