Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · dataset

dataset

Các kho mã nguồn mở đang theo dõi được gắn thẻ dataset, sắp xếp theo số sao.

148 kho mã
  • Khai phá sức mạnh của LLM: Khám phá các tập dữ liệu này để huấn luyện ChatGPT của riêng bạn!

    768+0Thay đổi số sao trong 7 ngày qua
  • tech.ml.dataset@techascent

    Một hệ thống xử lý dữ liệu hiệu năng cao bằng Clojure

    760+0Thay đổi số sao trong 7 ngày qua
  • TACO@pedropro

    Bộ công cụ cho tập dữ liệu Trash Annotations in Context

    756+1Thay đổi số sao trong 7 ngày qua
  • couplet-dataset@wb14123

    Tập dữ liệu câu đối. Cơ sở dữ liệu gồm 700.000 câu đối.

    747+1Thay đổi số sao trong 7 ngày qua
  • person_search@ShuangLI59

    Học đặc trưng kết hợp phát hiện và nhận dạng cho tìm kiếm người.

    746+0Thay đổi số sao trong 7 ngày qua
  • dataset-serialize@viniciussanchez

    Bộ chuyển đổi JSON sang DataSet và DataSet sang JSON cho Delphi và Lazarus (FPC)

    744+1Thay đổi số sao trong 7 ngày qua
  • io@tensorflow

    Các phần mở rộng về tập dữ liệu, truyền phát và hệ thống tệp được duy trì bởi TensorFlow SIG-IO.

    739+0Thay đổi số sao trong 7 ngày qua
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: Giọng nói TTS tiếng Đức chất lượng cao, hoạt động ngoại tuyến và miễn phí, dành cho mọi dự án mà không gặp rắc rối về giấy phép.

    729+1Thay đổi số sao trong 7 ngày qua
  • OpenAI-CLIP@moein-shariatnia

    Triển khai đơn giản mô hình OpenAI CLIP trong PyTorch.

    726+0Thay đổi số sao trong 7 ngày qua
  • MovieChat@wenhaochai

    [CVPR 2024] MovieChat: Từ Dense Token đến Sparse Memory để hiểu video dài

    706+0Thay đổi số sao trong 7 ngày qua
  • PointTinyBenchmark@ucas-vg

    Bộ mã phát hiện và định vị đối tượng dựa trên điểm của UCAS-VG.

    694+1Thay đổi số sao trong 7 ngày qua
  • long-form-factuality@google-deepmind

    Đánh giá tính xác thực dạng dài trong các mô hình ngôn ngữ lớn. Mã nguồn gốc cho bài báo "Long-form factuality in large language models" của chúng tôi.

    693+2Thay đổi số sao trong 7 ngày qua
  • datumaro@open-edge-platform

    Khung quản lý tập dữ liệu, một thư viện Python và công cụ CLI để xây dựng, phân tích và quản lý các tập dữ liệu thị giác máy tính.

    689+2Thay đổi số sao trong 7 ngày qua
  • Structured3D@bertjiazheng

    [ECCV'20] Structured3D: Một tập dữ liệu ảnh thực tế quy mô lớn cho mô hình hóa 3D có cấu trúc

    682+2Thay đổi số sao trong 7 ngày qua
  • FX-1-Minute-Data@philipperemy

    HISTDATA - Tập dữ liệu bao gồm tất cả các cặp giao dịch ngoại hối / Dầu thô / Chỉ số chứng khoán. API đơn giản để truy xuất dữ liệu 1 phút (và dữ liệu tick) Giá ngoại hối lịch sử (được cập nhật).

    681+0Thay đổi số sao trong 7 ngày qua
  • Một bộ dữ liệu âm thanh miễn phí về các chữ số được đọc. Phiên bản âm thanh của MNIST.

    678+0Thay đổi số sao trong 7 ngày qua
  • ACM Multimedia 2020 University-1652: Bộ chuẩn đa góc nhìn và đa nguồn cho định vị địa lý bằng drone, chú thích 1652 tòa nhà tại 72 trường đại học trên toàn thế giới.

    677+5Thay đổi số sao trong 7 ngày qua
  • ClawBench@TIGER-AI-Lab

    Bộ tiêu chuẩn đánh giá mã nguồn mở cho các tác nhân AI trên trình duyệt thực hiện các tác vụ hàng ngày.

    675+61Thay đổi số sao trong 7 ngày qua
  • video2dataset@iejMac

    Dễ dàng tạo tập dữ liệu video lớn từ các URL video

    664+1Thay đổi số sao trong 7 ngày qua
  • datalad@datalad

    Kiểm soát mã nguồn, dữ liệu và container với git và git-annex.

    660+3Thay đổi số sao trong 7 ngày qua
  • Awesome-LLM-Eval: danh sách tuyển chọn các công cụ, tập dữ liệu/benchmark, bản demo, bảng xếp hạng, tài liệu và mô hình, chủ yếu dành cho việc đánh giá LLM.

    656-2Thay đổi số sao trong 7 ngày qua
  • datasets@benedekrozemberczki

    Kho lưu trữ các tập dữ liệu hữu ích được thu thập cho nghiên cứu khoa học mạng và học máy.

    655+0Thay đổi số sao trong 7 ngày qua
  • Vòng đời hoàn chỉnh của một dự án khoa học dữ liệu

    653+0Thay đổi số sao trong 7 ngày qua
  • comma2k19@commaai

    Tập dữ liệu lái xe phục vụ việc phát triển và xác thực các thuật toán ước tính tư thế và lập bản đồ kết hợp

    653+3Thay đổi số sao trong 7 ngày qua
  • ConvoKit@CornellNLP

    ConvoKit là bộ công cụ dùng để trích xuất các đặc trưng hội thoại và phân tích các hiện tượng xã hội trong các cuộc trò chuyện. Nó bao gồm một số tập dữ liệu hội thoại lớn cùng với các tập lệnh minh họa cách sử dụng bộ công cụ trên các tập dữ liệu này.

    648+1Thay đổi số sao trong 7 ngày qua
  • NAS-Bench-201@D-X-Y

    API và hướng dẫn cho NAS-Bench-201

    646+0Thay đổi số sao trong 7 ngày qua
  • Ego4d@facebookresearch

    Kho lưu trữ tập dữ liệu Ego4d. Tải xuống tập dữ liệu, trực quan hóa, trích xuất đặc trưng và ví dụ sử dụng tập dữ liệu.

    644+3Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các tập dữ liệu cho phân đoạn / phát hiện độ nổi bật. Chào đón các PR.

    640+0Thay đổi số sao trong 7 ngày qua
  • Tập dữ liệu Exclusively Dark (ExDARK), bộ sưu tập hình ảnh thiếu sáng lớn nhất hiện nay với 10 điều kiện ánh sáng khác nhau, bao gồm chú thích cấp độ lớp và đối tượng

    640-1Thay đổi số sao trong 7 ngày qua
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: Độ tin cậy trong các mô hình ngôn ngữ lớn

    632+2Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề