Lompat ke konten utama
buildradar
Sign in
Topik · dataset

dataset

Repositori open source terpantau bertanda dataset, diurutkan berdasarkan bintang.

148 repositori
  • Konteks perdagangan BTC publik sejak 2020.

    1.216+1Perubahan bintang dalam 7 hari terakhir
  • M2DGR@SJTU-ViSYS

    M2DGR: Kumpulan data multimodal dan multiskenario untuk robot darat (RA-L2021 & ICRA2022)

    1.201+5Perubahan bintang dalam 7 hari terakhir
  • chat-dataset-baseline@hikariming

    Dataset percakapan bahasa Mandarin yang disesuaikan secara manual dan kode fine-tuning untuk ChatGLM

    1.191+0Perubahan bintang dalam 7 hari terakhir
  • torchxrayvision@mlmed

    TorchXRayVision: Pustaka dataset dan model rontgen dada. Pengklasifikasi, segmentasi, dan autoencoder.

    1.188+3Perubahan bintang dalam 7 hari terakhir
  • covid-19@datasets

    Data deret waktu kasus Novel Coronavirus 2019

    1.165+1Perubahan bintang dalam 7 hari terakhir
  • domains@tb0hdan

    Dataset domain Internet tunggal terbesar di dunia

    1.157+1Perubahan bintang dalam 7 hari terakhir
  • Daftar dataset Twitter dan sumber daya terkait.

    1.125+1Perubahan bintang dalam 7 hari terakhir
  • game-datasets@leomaurodesenv

    :video_game: Daftar kurasi dataset game pilihan dan alat untuk kecerdasan buatan dalam game

    1.116+3Perubahan bintang dalam 7 hari terakhir
  • SoundMind@xid32

    Kami memperkenalkan dataset Audio Logical Reasoning (ALR), yang terdiri dari 6.446 sampel anotasi teks-audio yang dirancang khusus untuk tugas penalaran kompleks. Berdasarkan sumber daya ini, kami mengusulkan SoundMind, sebuah algoritma reinforcement learning (RL) berbasis aturan yang dirancang untuk membekali model bahasa audio (ALM) dengan kemampuan penalaran bimodal yang mendalam.

    1.113+0Perubahan bintang dalam 7 hari terakhir
  • insuranceqa-corpus-zh@chatopera

    Korpus industri asuransi, chatbot

    1.064-1Perubahan bintang dalam 7 hari terakhir
  • hagrid@hukenovs

    Dataset Citra Pengenalan Gestur Tangan

    1.059+6Perubahan bintang dalam 7 hari terakhir
  • TransportationNetworks@bstabler

    Jaringan Transportasi untuk Penelitian

    1.050+1Perubahan bintang dalam 7 hari terakhir
  • MMSA@thuiar

    MMSA adalah kerangka kerja terpadu untuk Analisis Sentimen Multimodal.

    1.045+3Perubahan bintang dalam 7 hari terakhir
  • name-dataset@philipperemy

    Pustaka Python untuk nama.

    1.018+0Perubahan bintang dalam 7 hari terakhir
  • ThoughtSource@OpenBioLink

    Sumber daya terbuka terpusat untuk data dan alat yang berkaitan dengan penalaran chain-of-thought dalam model bahasa besar. Dikembangkan oleh grup riset Samwald: https://samwald.info/

    1.015+0Perubahan bintang dalam 7 hari terakhir
  • Daftar sumber daya publik yang dikurasi untuk biomekanika dan analisis gerak manusia: dataset, alat pemrosesan, perangkat lunak simulasi, video edukasi, kuliah, dll.

    1.011+1Perubahan bintang dalam 7 hari terakhir
  • githut@madnight

    Statistik Bahasa GitHub

    1.004-1Perubahan bintang dalam 7 hari terakhir
  • Mobius@microsoft

    Pengikatan bahasa dan ekstensi C# serta F# untuk Apache Spark

    948+0Perubahan bintang dalam 7 hari terakhir
  • OmniAnomaly@NetManAIOps

    KDD 2019: Deteksi Anomali Kuat untuk Rangkaian Waktu Multivariat melalui Stochastic Recurrent Neural Network

    948+5Perubahan bintang dalam 7 hari terakhir
  • semantic-segmentation@sithu31296

    Model Semantic Segmentation SOTA di PyTorch

    942-1Perubahan bintang dalam 7 hari terakhir
  • tfrecord@vahidk

    Pembaca/penulis TFRecord mandiri dengan pemuat data PyTorch

    902+0Perubahan bintang dalam 7 hari terakhir
  • API SemanticKITTI untuk visualisasi dataset, pemrosesan data, dan evaluasi hasil.

    898+3Perubahan bintang dalam 7 hari terakhir
  • deepfabric@nolabs-ai

    Hasilkan Data Sintetis Berkualitas Tinggi, Latih, Ukur, dan Evaluasi dalam Satu Pipeline

    885+3Perubahan bintang dalam 7 hari terakhir
  • magpie@magpie-align

    [ICLR 2025] Sintesis Data Penyelarasan dari Awal dengan Meminta LLM yang Terlaras tanpa Input. Pipeline pembuatan data sintetis Anda yang efisien dan berkualitas tinggi!

    881+1Perubahan bintang dalam 7 hari terakhir
  • OpenCUA@xlang-ai

    [NeurIPS 2025 Spotlight] OpenCUA: Pondasi Terbuka untuk Agen Penggunaan Komputer

    833+4Perubahan bintang dalam 7 hari terakhir
  • MINT-1T@mlfoundations

    🍃 MINT-1T: Kumpulan data multimodal terselip satu triliun token.

    832+0Perubahan bintang dalam 7 hari terakhir
  • PrimeKG@mims-harvard

    Graf Pengetahuan Kedokteran Presisi (PrimeKG)

    822+3Perubahan bintang dalam 7 hari terakhir
  • opendata@NationalGalleryOfArt

    Program Data Terbuka National Gallery of Art

    818+5Perubahan bintang dalam 7 hari terakhir
  • pycococreator@waspinator

    Fungsi pembantu untuk membuat dataset COCO

    783+0Perubahan bintang dalam 7 hari terakhir
  • Total-Text-Dataset@cs-chan

    Dataset Total Text. Terdiri dari 1555 gambar dengan lebih dari 3 orientasi teks berbeda: Horizontal, Multi-Orientasi, dan Melengkung, satu-satunya di jenisnya.

    771+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik