본문으로 건너뛰기
buildradar
Sign in
토픽 · dataset

dataset

dataset 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 148개
  • LLM의 잠재력 활용: 나만의 ChatGPT를 학습시키기 위한 데이터셋 탐색

    768+0최근 7일 스타 변화
  • tech.ml.dataset@techascent

    Clojure 기반 고성능 데이터 처리 시스템

    760+0최근 7일 스타 변화
  • TACO@pedropro

    TACO(Trash Annotations in Context) 데이터셋 툴킷.

    756+1최근 7일 스타 변화
  • couplet-dataset@wb14123

    대구(Couplet) 데이터셋. 70만 개의 대구 데이터베이스.

    747+1최근 7일 스타 변화
  • person_search@ShuangLI59

    보행자 검색을 위한 공동 검출 및 식별 특징 학습

    746+0최근 7일 스타 변화
  • dataset-serialize@viniciussanchez

    Delphi 및 Lazarus(FPC)용 JSON-DataSet 변환기

    744+1최근 7일 스타 변화
  • io@tensorflow

    TensorFlow SIG-IO에서 유지 관리하는 데이터셋, 스트리밍 및 파일 시스템 확장

    739+0최근 7일 스타 변화
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: 라이선스 문제없이 모든 프로젝트에서 사용할 수 있는 무료, 오프라인 지원, 고품질 독일어 TTS 음성

    729+1최근 7일 스타 변화
  • OpenAI-CLIP@moein-shariatnia

    PyTorch로 구현한 간단한 OpenAI CLIP 모델.

    726+0최근 7일 스타 변화
  • MovieChat@wenhaochai

    [CVPR 2024] MovieChat: 롱 비디오 이해를 위한 촘촘한 토큰에서 희소 메모리로의 전환

    706+0최근 7일 스타 변화
  • PointTinyBenchmark@ucas-vg

    UCAS-VG의 포인트 기반 소형 객체 탐지 및 위치 추적 코드 세트입니다.

    694+1최근 7일 스타 변화
  • long-form-factuality@google-deepmind

    대형 언어 모델의 장문 사실성(long-form factuality)을 벤치마킹합니다. 논문 "Long-form factuality in large language models"의 원본 코드입니다.

    693+2최근 7일 스타 변화
  • datumaro@open-edge-platform

    Computer Vision 데이터셋을 구축, 분석 및 관리하기 위한 Python 라이브러리이자 CLI 도구인 Dataset Management Framework.

    687+0최근 7일 스타 변화
  • Structured3D@bertjiazheng

    [ECCV'20] Structured3D: 구조화된 3D 모델링을 위한 대규모 사실적 데이터셋

    682+2최근 7일 스타 변화
  • FX-1-Minute-Data@philipperemy

    HISTDATA - 모든 FX 거래 쌍, 원유, 주가 지수로 구성된 데이터셋. 1분 데이터(및 틱 데이터)와 최신 역사적 FX 가격을 검색하는 간단한 API

    681+0최근 7일 스타 변화
  • 음성 숫자로 구성된 무료 오디오 데이터셋. MNIST의 오디오 버전.

    678+0최근 7일 스타 변화
  • ACM Multimedia2020 University-1652: 드론 기반 지오로컬라이제이션(Geo-localization)을 위한 멀티뷰 멀티소스 벤치마크 :helicopter: 전 세계 72개 대학의 1652개 건물에 주석을 추가했습니다.

    677+5최근 7일 스타 변화
  • video2dataset@iejMac

    비디오 URL로부터 대규모 비디오 데이터셋을 쉽게 생성

    664+1최근 7일 스타 변화
  • datalad@datalad

    git과 git-annex를 사용하여 코드, 데이터, 컨테이너를 관리

    658+1최근 7일 스타 변화
  • ClawBench@TIGER-AI-Lab

    일상적인 작업에서 브라우저 AI 에이전트를 테스트하기 위한 오픈소스 벤치마크.

    657+54최근 7일 스타 변화
  • Awesome-LLM-Eval: 주로 LLM 평가를 위한 도구, 데이터셋/벤치마크, 데모, 리더보드, 논문, 문서 및 모델의 선별 목록

    656-2최근 7일 스타 변화
  • datasets@benedekrozemberczki

    네트워크 과학 및 머신러닝 연구를 위해 수집한 멋진 데이터셋 저장소입니다.

    655+0최근 7일 스타 변화
  • 데이터 과학 프로젝트의 전체 수명 주기 관리입니다.

    653+0최근 7일 스타 변화
  • comma2k19@commaai

    융합 포즈 추정기 및 매핑 알고리즘 개발과 검증을 위한 주행 데이터셋

    652+2최근 7일 스타 변화
  • ConvoKit@CornellNLP

    ConvoKit은 대화 기능을 추출하고 대화 속 사회적 현상을 분석하기 위한 툴킷입니다. 툴킷 사용법을 보여주는 스크립트와 함께 여러 개의 대규모 대화 데이터셋을 포함하고 있습니다.

    648+1최근 7일 스타 변화
  • NAS-Bench-201@D-X-Y

    NAS-Bench-201 API 및 지침

    645+0최근 7일 스타 변화
  • Ego4d@facebookresearch

    Ego4d 데이터셋 저장소. 데이터셋 다운로드, 시각화, 특징 추출 및 예제 사용법 제공

    642+3최근 7일 스타 변화
  • Exclusively Dark (ExDARK) 데이터셋. 우리가 아는 한, 이미지 클래스 및 객체 수준 주석과 함께 초저조도 환경부터 황혼까지(즉, 10가지 다른 조건) 촬영된 저조도 이미지 컬렉션 중 현재까지 가장 큰 규모입니다.

    640-1최근 7일 스타 변화
  • 세그멘테이션 및 saliency detection을 위한 데이터셋 모음. PR 환영

    640+0최근 7일 스타 변화
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: 거대 언어 모델의 신뢰성 연구

    632+2최근 7일 스타 변화
← 토픽 목록으로