Aller au contenu principal
buildradar
Sign in
Sujet · dataset

dataset

Dépôts open source suivis étiquetés dataset, triés par étoiles.

148 dépôts
  • Contexte public de trading BTC depuis 2020.

    1 216+1Évolution des étoiles sur les 7 derniers jours
  • M2DGR@SJTU-ViSYS

    M2DGR : un jeu de données multimodal et multiscénario pour robots terrestres (RA-L2021 & ICRA2022).

    1 201+5Évolution des étoiles sur les 7 derniers jours
  • chat-dataset-baseline@hikariming

    Jeu de données de conversation en chinois finement ajusté manuellement et code de fine-tuning pour ChatGLM

    1 191+0Évolution des étoiles sur les 7 derniers jours
  • torchxrayvision@mlmed

    TorchXRayVision : une bibliothèque de jeux de données et de modèles de radiographies thoraciques, incluant des classifieurs, de la segmentation et des auto-encodeurs.

    1 188+3Évolution des étoiles sur les 7 derniers jours
  • covid-19@datasets

    Données chronologiques sur les cas de coronavirus 2019

    1 165+1Évolution des étoiles sur les 7 derniers jours
  • domains@tb0hdan

    Le plus grand ensemble de données de domaines Internet au monde

    1 157+1Évolution des étoiles sur les 7 derniers jours
  • Une liste de jeux de données Twitter et de ressources associées.

    1 125+1Évolution des étoiles sur les 7 derniers jours
  • game-datasets@leomaurodesenv

    :video_game: Une liste organisée de jeux de données de jeux vidéo et d'outils pour l'intelligence artificielle dans les jeux

    1 116+3Évolution des étoiles sur les 7 derniers jours
  • SoundMind@xid32

    Nous présentons le jeu de données Audio Logical Reasoning (ALR), composé de 6 446 échantillons texte-audio annotés, spécifiquement conçus pour des tâches de raisonnement complexe. En nous appuyant sur cette ressource, nous proposons SoundMind, un algorithme d'apprentissage par renforcement (RL) basé sur des règles, conçu pour doter les modèles de langage audio (ALM) de capacités de raisonnement bimodal approfondies.

    1 113+0Évolution des étoiles sur les 7 derniers jours
  • insuranceqa-corpus-zh@chatopera

    Corpus pour le secteur de l'assurance et chatbot.

    1 064-1Évolution des étoiles sur les 7 derniers jours
  • hagrid@hukenovs

    Jeu de données d'images pour la reconnaissance de gestes de la main

    1 059+6Évolution des étoiles sur les 7 derniers jours
  • TransportationNetworks@bstabler

    Réseaux de transport pour la recherche.

    1 050+1Évolution des étoiles sur les 7 derniers jours
  • MMSA@thuiar

    MMSA est un framework unifié pour l'analyse de sentiment multimodale.

    1 045+3Évolution des étoiles sur les 7 derniers jours
  • name-dataset@philipperemy

    La bibliothèque Python pour les noms.

    1 018+0Évolution des étoiles sur les 7 derniers jours
  • ThoughtSource@OpenBioLink

    Ressource centrale et ouverte pour les données et outils liés au raisonnement par chaîne de pensée (chain-of-thought) dans les grands modèles de langage. Développé par le groupe de recherche Samwald.

    1 015+0Évolution des étoiles sur les 7 derniers jours
  • Liste publique et organisée de ressources pour la biomécanique et l'analyse du mouvement humain : jeux de données, outils de traitement, logiciels de simulation, vidéos éducatives, conférences, etc.

    1 011+1Évolution des étoiles sur les 7 derniers jours
  • githut@madnight

    Statistiques de langages GitHub

    1 004-1Évolution des étoiles sur les 7 derniers jours
  • Mobius@microsoft

    Liaisons et extensions des langages C# et F# pour Apache Spark

    948+0Évolution des étoiles sur les 7 derniers jours
  • OmniAnomaly@NetManAIOps

    KDD 2019 : Détection robuste d'anomalies pour les séries temporelles multivariées via un réseau de neurones récurrent stochastique.

    948+5Évolution des étoiles sur les 7 derniers jours
  • semantic-segmentation@sithu31296

    Modèles de segmentation sémantique SOTA en PyTorch

    942-1Évolution des étoiles sur les 7 derniers jours
  • tfrecord@vahidk

    Lecteur/enregistreur TFRecord autonome compatible avec les chargeurs de données PyTorch

    902+0Évolution des étoiles sur les 7 derniers jours
  • API SemanticKITTI pour la visualisation de jeux de données, le traitement de données et l'évaluation des résultats.

    898+3Évolution des étoiles sur les 7 derniers jours
  • deepfabric@nolabs-ai

    Générer des données synthétiques de haute qualité, entraîner, mesurer et évaluer dans un pipeline unique

    885+3Évolution des étoiles sur les 7 derniers jours
  • magpie@magpie-align

    [ICLR 2025] Synthèse de données d'alignement à partir de zéro en sollicitant des LLM alignés sans données préalables. Votre pipeline efficace de génération de données synthétiques de haute qualité.

    881+1Évolution des étoiles sur les 7 derniers jours
  • OpenCUA@xlang-ai

    [NeurIPS 2025 Spotlight] OpenCUA : Fondations ouvertes pour les agents d'utilisation informatique

    833+4Évolution des étoiles sur les 7 derniers jours
  • MINT-1T@mlfoundations

    🍃 MINT-1T : Un jeu de données multimodal entrelacé d'un billion de jetons.

    832+0Évolution des étoiles sur les 7 derniers jours
  • PrimeKG@mims-harvard

    Graphe de connaissances en médecine de précision (PrimeKG).

    822+3Évolution des étoiles sur les 7 derniers jours
  • opendata@NationalGalleryOfArt

    Programme de données ouvertes de la National Gallery of Art

    818+5Évolution des étoiles sur les 7 derniers jours
  • pycococreator@waspinator

    Fonctions d'assistance pour la création de jeux de données COCO

    783+0Évolution des étoiles sur les 7 derniers jours
  • Total-Text-Dataset@cs-chan

    Jeu de données Total Text. Il comprend 1555 images avec plus de 3 orientations de texte différentes : horizontal, multi-orienté et incurvé.

    771+0Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets