Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · datasets

datasets

Các kho mã nguồn mở đang theo dõi được gắn thẻ datasets, sắp xếp theo số sao.

81 kho mã
  • ogb@snap-stanford

    Các tập dữ liệu thử nghiệm, bộ tải dữ liệu và công cụ đánh giá cho học máy đồ thị

    2.095+1Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các tập dữ liệu An ninh mạng tuyệt vời

    2.077+1Thay đổi số sao trong 7 ngày qua
  • DB-GPT-Hub@eosphoros-ai

    Kho lưu trữ chứa các mô hình, tập dữ liệu và kỹ thuật tinh chỉnh cho DB-GPT, nhằm mục đích nâng cao hiệu suất mô hình trong tác vụ Text-to-SQL

    2.008-1Thay đổi số sao trong 7 ngày qua
  • diffgram@diffgram

    AI Datastore cho Schema, BLOB và Dự đoán. Sử dụng cùng ứng dụng của bạn hoặc tích hợp tính năng Giám sát con người, Quy trình dữ liệu và Danh mục UI có sẵn để khai thác tối đa giá trị từ Dữ liệu AI của bạn.

    1.909+0Thay đổi số sao trong 7 ngày qua
  • awesome-data-analysis@PavelGrigoryevDS

    🚀 Hơn 500 tài nguyên được tuyển chọn cho Phân tích Dữ liệu & Khoa học Dữ liệu: Python, SQL, Thống kê, ML, AI, Trực quan hóa, Bảng gian lận, Lộ trình, Chuẩn bị phỏng vấn. Dành cho người mới bắt đầu và chuyên gia.

    1.890+8Thay đổi số sao trong 7 ngày qua
  • DataFrames.jl@JuliaData

    Dữ liệu bảng trong bộ nhớ tại Julia

    1.831+0Thay đổi số sao trong 7 ngày qua
  • awesome-transit@MobilityData

    Danh sách do cộng đồng đóng góp về các API, ứng dụng, tập dữ liệu, nghiên cứu và phần mềm giao thông công cộng :bus::star2::train::star2::steam_locomotive:

    1.826+3Thay đổi số sao trong 7 ngày qua
  • 🚀🚀🚀 Tổng hợp các dự án chuỗi phát hiện đối tượng YOLO công khai tuyệt vời và các tập dữ liệu phát hiện đối tượng liên quan.

    1.783-2Thay đổi số sao trong 7 ngày qua
  • Thu thập tất cả nội dung của Hộ Thần Phong

    1.650+2Thay đổi số sao trong 7 ngày qua
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Căn chỉnh giá trị có ràng buộc thông qua Học tăng cường an toàn từ phản hồi của con người

    1.613+1Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập các tập dữ liệu cho các tác vụ nhận diện thực thể có tên (NER) và nhận diện thực thể. Các tập dữ liệu được gán nhãn này bao gồm nhiều ngôn ngữ, lĩnh vực và loại thực thể khác nhau.

    1.574+0Thay đổi số sao trong 7 ngày qua
  • Danh sách chọn lọc các liên kết tuyệt vời và thư viện phần mềm hữu ích cho robot.

    1.483+3Thay đổi số sao trong 7 ngày qua
  • projects@explosion

    🪐 Quy trình công việc NLP từ đầu đến cuối từ nguyên mẫu đến sản xuất

    1.436+0Thay đổi số sao trong 7 ngày qua
  • kitops@kitops-ml

    Một công cụ DevOps mã nguồn mở từ CNCF dùng để đóng gói và quản lý phiên bản cho các mô hình AI/ML, tập dữ liệu, mã nguồn và cấu hình thành một OCI Artifact.

    1.409+0Thay đổi số sao trong 7 ngày qua
  • IMAGDressing@muzishen

    [AAAI 2025]👔IMAGDressing👔: Tạo trang phục mô-đun tương tác để mặc đồ ảo. Cho phép tạo hình ảnh con người có thể tùy chỉnh với khả năng điều khiển trang phục, tư thế và bối cảnh linh hoạt, đảm bảo độ trung thực cao và tính nhất quán của trang phục cho việc thử đồ ảo.

    1.343+0Thay đổi số sao trong 7 ngày qua
  • Minari@Farama-Foundation

    Định dạng chuẩn cho các tập dữ liệu học tăng cường ngoại tuyến (offline reinforcement learning), đi kèm các tập dữ liệu tham chiếu phổ biến và các tiện ích liên quan

    1.294+3Thay đổi số sao trong 7 ngày qua
  • TDC@mims-harvard

    Therapeutics Commons (TDC): Nền tảng đa phương thức cho khoa học trị liệu

    1.279+2Thay đổi số sao trong 7 ngày qua
  • langtrace@Scale3-Labs

    Langtrace 🔍 là công cụ quan sát toàn diện mã nguồn mở dựa trên OpenTelemetry dành cho các ứng dụng LLM, cung cấp khả năng theo dõi thời gian thực, đánh giá và số liệu cho các LLM, framework LLM, vectorDB phổ biến và nhiều hơn nữa. Tích hợp bằng TypeScript, Python. 🚀💻📊

    1.228-1Thay đổi số sao trong 7 ngày qua
  • datasets@satellite-image-deep-learning

    Bộ dữ liệu cho học sâu với hình ảnh vệ tinh và trên không

    1.195+2Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập tập dữ liệu mã nguồn mở để huấn luyện các LLM tuân theo hướng dẫn (ChatGPT, LLaMA, Alpaca)

    1.153-1Thay đổi số sao trong 7 ngày qua
  • audino@midas-research

    Công cụ chú thích âm thanh mã nguồn mở dành cho con người

    1.146+0Thay đổi số sao trong 7 ngày qua
  • Danh sách các tập dữ liệu Twitter và các tài nguyên liên quan.

    1.125+1Thay đổi số sao trong 7 ngày qua
  • csghub-server@OpenCSGs

    csghub-server là máy chủ backend cho CSGHub giúp người dùng quản lý dataset, mô hình, cũng như chạy Model Inference, Finetune và Application Spaces.

    1.048+2Thay đổi số sao trong 7 ngày qua
  • CLUECorpus2020@CLUEbenchmark

    Kho ngữ liệu huấn luyện trước quy mô lớn cho tiếng Trung 100G

    1.020+1Thay đổi số sao trong 7 ngày qua
  • [ACL 2023] Suy luận với kỹ thuật Prompting cho mô hình ngôn ngữ: Một bài khảo sát

    1.007+1Thay đổi số sao trong 7 ngày qua
  • mola@MOLAorg

    Một framework tối ưu hóa dạng mô-đun cho Định vị và Lập bản đồ (MOLA).

    1.005+6Thay đổi số sao trong 7 ngày qua
  • ICCV-2023-25-Papers@DmitryRyumin

    Các bài báo ICCV 2023-2025: Khám phá nghiên cứu tiên tiến từ ICCV 2023-25, hội nghị hàng đầu về thị giác máy tính. Cập nhật những tin tức mới nhất về thị giác máy tính và deep learning, kèm theo mã nguồn. ⭐ Hỗ trợ phát triển trí tuệ thị giác!

    969+1Thay đổi số sao trong 7 ngày qua
  • Tập dữ liệu âm thanh AI (AI-ADS) 🎵, bao gồm Giọng nói, Âm nhạc và Hiệu ứng âm thanh, có thể cung cấp dữ liệu huấn luyện cho Generative AI, AIGC, huấn luyện mô hình AI, phát triển công cụ âm thanh thông minh và các ứng dụng âm thanh.

    964+1Thay đổi số sao trong 7 ngày qua
  • semhash@MinishLab

    Khử trùng lặp và lọc ngữ nghĩa đa phương thức nhanh chóng

    963+2Thay đổi số sao trong 7 ngày qua
  • geobr@ipea

    Truy cập dễ dàng vào các tập dữ liệu không gian chính thức của Brazil bằng R và Python.

    945+2Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề