datasets
Erfasste Open-Source-Repos mit dem Tag datasets, sortiert nach Sternen.
- #61★ 939+0Sterne-Änderung der letzten 7 Tage
- #62
Verfolgung medizinischer Datensätze mit Schwerpunkt auf medizinischer Bildgebung
★ 926+2Sterne-Änderung der letzten 7 Tage - #63
Backend, das den Dataset-Viewer auf Hugging Face Dataset-Seiten über eine öffentliche API betreibt.
★ 900+1Sterne-Änderung der letzten 7 Tage - #64
Croissant ist ein High-Level-Format für Machine-Learning-Datensätze, das vier reichhaltige Ebenen zusammenführt.
★ 895+5Sterne-Änderung der letzten 7 Tage - #65
🚀🚀🚀 Eine Sammlung großartiger öffentlicher Projekte zu Large Language Models (LLM), Vision Language Models (VLM), Vision Language Action (VLA), AI Generated Content (AIGC) sowie den zugehörigen Datensätzen und Anwendungen.
★ 815+1Sterne-Änderung der letzten 7 Tage - #66
Nützliche Links zu verschiedenen Inhalten rund um KI, Computer Vision und Robotik.
★ 783+0Sterne-Änderung der letzten 7 Tage - #67★ 754+1Sterne-Änderung der letzten 7 Tage
- #68
Eine Sammlung von awesome-prompt-datasets und awesome-instruction-datasets zum Training von ChatLLMs wie ChatGPT.
★ 744+1Sterne-Änderung der letzten 7 Tage - #69
Eine kuratierte Liste von Arbeiten, Abschlussarbeiten, Datensätzen und Tools im Bereich der Anwendung von Machine Learning im Software Engineering
★ 733+0Sterne-Änderung der letzten 7 Tage - #70
Neues und erweiterbares Dateiformat zur Speicherung großer spaltenorientierter Datensätze.
★ 732+2Sterne-Änderung der letzten 7 Tage - #71
Open Bandit Pipeline: Eine Python-Bibliothek für Bandit-Algorithmen und Off-Policy-Evaluierung
★ 708+1Sterne-Änderung der letzten 7 Tage - #72
Dataset Management Framework, eine Python-Bibliothek und ein CLI-Tool zum Erstellen, Analysieren und Verwalten von Computer-Vision-Datensätzen.
★ 689+0Sterne-Änderung der letzten 7 Tage - #73
Geteilte Ultralytics-Logos, Medien, Beispielbilder, vortrainierte Modellgewichte, Datensatz-Artefakte und Release-Assets.
★ 665+5Sterne-Änderung der letzten 7 Tage - #74
Der allererste umfangreiche Benchmark für die indonesische Sprache im Bereich der natürlichen Sprachverarbeitung. Wir bieten mehrere Downstream-Aufgaben, vortrainierte IndoBERT-Modelle und Startcode! (AACL-IJCNLP 2020)
★ 655+1Sterne-Änderung der letzten 7 Tage - #75
Eine Sammlung von Datensätzen für Segmentierung und Saliency Detection. PRs sind willkommen.
★ 640+0Sterne-Änderung der letzten 7 Tage - #76
Die ExerciseDB API ist eine Fitness-Datenbank-API, die Zugriff auf über 11.000 hochwertige Übungen bietet. Sie umfasst detaillierte Informationen wie Zielmuskelgruppen, benötigte Ausrüstung, Videos, GIFs, Bilder zur visuellen Anleitung sowie Schritt-für-Schritt-Anleitungen.
★ 622+19Sterne-Änderung der letzten 7 Tage - #77
Dieses Repository bietet eine umfassende Liste von Radar- und optischen Satellitendatensätzen, die für Aufgaben der Schiffserkennung, Klassifizierung, semantischen Segmentierung und Instanzsegmentierung zusammengestellt wurden. Diese Datensätze sind ideal für Anwendungen in Computer Vision, Machine Learning, Fernerkundung und maritimer Analyse.
★ 606+0Sterne-Änderung der letzten 7 Tage - #78
Ressourcen für histopathologische Datensätze
★ 571+1Sterne-Änderung der letzten 7 Tage - #79
Cleora AI ist ein quelloffenes Allzweckmodell für effizientes, skalierbares Lernen stabiler und induktiver Entity-Embeddings für heterogene relationale Daten. Entwickelt vom Team von Synerise.com.
★ 541+1Sterne-Änderung der letzten 7 Tage - #80
Eine kuratierte Liste zu Domain Generalization, inklusive Papers, Code und mehr.
★ 539+1Sterne-Änderung der letzten 7 Tage - #81
Paper und Datensätze zu Instruction Tuning und Instruction Following.
★ 511-1Sterne-Änderung der letzten 7 Tage