跳到主要內容
buildradar
Sign in
主題 · datasets

datasets

標記 datasets 主題、收錄中的開源專案,依星數排序。

共 81 個專案
  • commons@datasets

    DataHub 共用元件。有趣且重要的資料集

    940+0近 7 天星數變化
  • 追蹤醫療資料集,專注於醫學影像

    926+2近 7 天星數變化
  • dataset-viewer@huggingface

    透過公開 API 驅動 Hugging Face 資料集頁面上資料集檢視器的後端。

    900+1近 7 天星數變化
  • croissant@mlcommons

    Croissant 是一個用於機器學習資料集的高階格式,集成了四個豐富的層。

    897+7近 7 天星數變化
  • 🚀🚀🚀 收集一些關於大型語言模型(LLM)、視覺語言模型(VLM)、視覺語言動作(VLA)、AI 生成內容(AIGC)以及相關資料集與應用的優秀公開專案。

    815+1近 7 天星數變化
  • 關於 AI、電腦視覺與機器人的各類實用連結。

    784+0近 7 天星數變化
  • OpenML@openml

    開放式機器學習

    754+1近 7 天星數變化
  • 收錄各種指令集資料集與提示詞資料集,用於訓練 ChatLLM 等模型。

    744+1近 7 天星數變化
  • nimble@facebookincubator

    用於儲存大型列式資料集的新型可擴充檔案格式。

    733+3近 7 天星數變化
  • ml4se@saltudelft

    與機器學習應用於軟體工程相關的論文、學位論文、資料集與工具精選清單

    733+0近 7 天星數變化
  • zr-obp@st-tech

    Open Bandit Pipeline:用於 bandit 演算法與 off-policy 評估的 python 函式庫

    708+1近 7 天星數變化
  • datumaro@open-edge-platform

    資料集管理框架,是用來建構、分析與管理 Computer Vision 資料集的 Python 程式庫與 CLI 工具。

    689+2近 7 天星數變化
  • assets@ultralytics

    共用的 Ultralytics 標誌、媒體、範例圖片、預訓練模型權重、資料集產物與發布資產。

    665+5近 7 天星數變化
  • indonlu@IndoNLP

    針對印尼語的第一個大型自然語言處理基準測試。我們提供多個下游任務、預訓練的 IndoBERT 模型以及入門程式碼!(AACL-IJCNLP 2020)

    655+1近 7 天星數變化
  • 一些分割與顯著性檢測的資料集集合。歡迎 PR...:smile:

    640+0近 7 天星數變化
  • ExerciseDB API 是一個健身運動資料庫 API,讓使用者能存取包含超過 11,000 種高品質運動資料。此 API 提供每個運動的詳細資訊,包含目標肌肉群、所需器材、影片、動態圖、視覺化指導圖片以及逐步操作說明。

    628+20近 7 天星數變化
  • 這個儲存庫提供了一份全面的雷達與光學衛星資料集清單,專為船舶偵測、分類、語意分割與實例分割任務而策劃。這些資料集非常適合應用於電腦視覺、機器學習、遙測與海事分析領域。

    606+0近 7 天星數變化
  • 組織病理學資料集資源

    571+1近 7 天星數變化
  • cleora@BaseModelAI

    Cleora AI 是一個通用開源模型,用於高效、可擴展地學習異質關聯資料的穩定與歸納式實體嵌入。由 Synerise.com 團隊開發。

    541+1近 7 天星數變化
  • 關於領域泛化(Domain Generalization)的精選資源,包含論文、程式碼等

    539+1近 7 天星數變化
  • 關於指令微調 (Instruction Tuning) 與指令遵循 (Instruction Following) 的論文與資料集

    511-1近 7 天星數變化
← 返回主題列表