본문으로 건너뛰기
buildradar
Sign in
토픽 · dataset

dataset

dataset 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 148개
  • 2020년부터의 공개 BTC 트레이딩 컨텍스트.

    1,216+1최근 7일 스타 변화
  • M2DGR@SJTU-ViSYS

    M2DGR: 지상 로봇을 위한 멀티모달 및 다나리오 데이터셋 (RA-L2021 & ICRA2022)

    1,201+5최근 7일 스타 변화
  • chat-dataset-baseline@hikariming

    수동 조율된 중국어 대화 데이터셋 및 ChatGLM 미세 조정 코드

    1,191+0최근 7일 스타 변화
  • torchxrayvision@mlmed

    TorchXRayVision: 흉부 X선 데이터셋 및 모델 라이브러리. 분류, 분할, 오토인코더를 제공합니다.

    1,188+3최근 7일 스타 변화
  • covid-19@datasets

    신종 코로나바이러스 2019 확진자 시계열 데이터

    1,165+1최근 7일 스타 변화
  • domains@tb0hdan

    세계에서 가장 큰 단일 인터넷 도메인 데이터셋

    1,157+1최근 7일 스타 변화
  • Twitter 데이터셋 및 관련 리소스 목록

    1,125+1최근 7일 스타 변화
  • SoundMind@xid32

    복잡한 추론 작업을 위해 특별히 설계된 6,446개의 텍스트-오디오 주석 샘플로 구성된 Audio Logical Reasoning (ALR) 데이터셋을 소개합니다. 이 리소스를 바탕으로, 오디오 언어 모델(ALM)에 깊이 있는 이중 모달 추론 능력을 부여하기 위해 맞춤형으로 제작된 규칙 기반 강화학습(RL) 알고리즘 SoundMind를 제안합니다.

    1,113+0최근 7일 스타 변화
  • game-datasets@leomaurodesenv

    게임 AI를 위한 엄선된 게임 데이터셋 및 도구 목록

    1,112+3최근 7일 스타 변화
  • insuranceqa-corpus-zh@chatopera

    보험 업계 말뭉치, 챗봇

    1,064-1최근 7일 스타 변화
  • hagrid@hukenovs

    손 gesture 인식 이미지 데이터셋

    1,057+6최근 7일 스타 변화
  • TransportationNetworks@bstabler

    연구용 교통 네트워크

    1,050+1최근 7일 스타 변화
  • MMSA@thuiar

    MMSA는 멀티모달 감성 분석을 위한 통합 프레임워크입니다.

    1,045+3최근 7일 스타 변화
  • name-dataset@philipperemy

    이름 생성을 위한 Python 라이브러리

    1,019+0최근 7일 스타 변화
  • ThoughtSource@OpenBioLink

    대형 언어 모델의 사고 łańcuch(chain-of-thought) 추론 관련 데이터 및 도구를 위한 중앙 집중형 오픈 리소스. Samwald 연구그룹 개발: https://samwald.info/

    1,015+0최근 7일 스타 변화
  • 생체역학 및 인체 동작 분석을 위한 엄선된 공개 리소스 목록: 데이터셋, 처리 도구, 시뮬레이션 소프트웨어, 교육용 비디오, 강의 등

    1,010+1최근 7일 스타 변화
  • githut@madnight

    Github 언어 통계

    1,004-1최근 7일 스타 변화
  • OmniAnomaly@NetManAIOps

    KDD 2019: 확률적 순환 신경망을 통한 다변량 시계열의 강력한 이상 탐지

    948+5최근 7일 스타 변화
  • Mobius@microsoft

    Apache Spark를 위한 C# 및 F# 언어 바인딩 및 확장

    948+0최근 7일 스타 변화
  • semantic-segmentation@sithu31296

    PyTorch로 구현한 SOTA Semantic Segmentation 모델

    942-1최근 7일 스타 변화
  • tfrecord@vahidk

    PyTorch 데이터 로더를 포함한 독립형 TFRecord 리더/라이터

    902+0최근 7일 스타 변화
  • 데이터셋 시각화, 데이터 처리, 결과 평가를 위한 SemanticKITTI API

    898+3최근 7일 스타 변화
  • deepfabric@nolabs-ai

    단일 파이프라인에서 고품질 합성 데이터 생성, 학습, 측정 및 평가

    885+3최근 7일 스타 변화
  • magpie@magpie-align

    [ICLR 2025] 정렬된 LLM에 아무것도 입력하지 않고 프롬프트를 통해 처음부터 정렬 데이터 합성. 효율적이고 고품질의 합성 데이터 생성 파이프라인!

    880+1최근 7일 스타 변화
  • OpenCUA@xlang-ai

    [NeurIPS 2025 Spotlight] OpenCUA: 컴퓨터 사용 에이전트를 위한 오픈 파운데이션입니다.

    833+4최근 7일 스타 변화
  • MINT-1T@mlfoundations

    🍃 MINT-1T: 1조 개의 토큰으로 구성된 멀티모달 인터리브 데이터셋

    832+0최근 7일 스타 변화
  • PrimeKG@mims-harvard

    정밀 의학 지식 그래프 (PrimeKG)

    820+3최근 7일 스타 변화
  • opendata@NationalGalleryOfArt

    미국 국립미술관(National Gallery of Art) 오픈 데이터 프로그램

    818+5최근 7일 스타 변화
  • pycococreator@waspinator

    COCO 데이터셋 생성을 위한 헬퍼 함수

    784+0최근 7일 스타 변화
  • Total-Text-Dataset@cs-chan

    Total Text 데이터셋. 수평, 다중 방향, 곡선 등 3가지 이상의 텍스트 방향을 포함하는 1,555개의 이미지로 구성된 독보적인 데이터셋입니다.

    772+0최근 7일 스타 변화
← 토픽 목록으로