メインコンテンツへスキップ
buildradar
Sign in
トピック · dataset

dataset

dataset がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

148 件のリポジトリ
  • LLM のパワーを解放:これらのデータセットを探索して独自の ChatGPT をトレーニングしよう!

    768+0直近 7 日のスター増減
  • tech.ml.dataset@techascent

    Clojure 製の高性能データ処理システム

    760+0直近 7 日のスター増減
  • TACO@pedropro

    🌮 Trash Annotations in Context データセットツールキット

    756+1直近 7 日のスター増減
  • couplet-dataset@wb14123

    対聯のデータセット。70万件の対聯データベース

    747+1直近 7 日のスター増減
  • person_search@ShuangLI59

    人物検索のための関節検出と識別特徴量学習

    746+0直近 7 日のスター増減
  • dataset-serialize@viniciussanchez

    DelphiおよびLazarus (FPC) 向けのJSON・DataSet相互変換コンバーター

    744+1直近 7 日のスター増減
  • io@tensorflow

    TensorFlow SIG-IO が保守するデータセット、ストリーミング、ファイルシステム拡張機能。

    739+0直近 7 日のスター増減
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: ライセンスの心配なく、あらゆるプロジェクトで使用可能な、無料、オフライン動作、高品質なドイツ語TTS音声

    729+1直近 7 日のスター増減
  • OpenAI-CLIP@moein-shariatnia

    PyTorchによるOpenAI CLIPモデルのシンプルな実装

    726+0直近 7 日のスター増減
  • MovieChat@wenhaochai

    [CVPR 2024] MovieChat: 長い動画理解のための高密度トークンからスパースメモリへの変換

    706+0直近 7 日のスター増減
  • PointTinyBenchmark@ucas-vg

    UCAS-VGのポイントベースおよび極小オブジェクト検出・ローカライゼーションコードセット

    694+1直近 7 日のスター増減
  • long-form-factuality@google-deepmind

    大規模言語モデルにおける長文の事実性のベンチマーク。論文「Long-form factuality in large language models」のオリジナルコード。

    693+2直近 7 日のスター増減
  • datumaro@open-edge-platform

    コンピュータビジョンのデータセットを構築、分析、管理するためのPythonライブラリおよびCLIツールであるデータセット管理フレームワーク。

    689+2直近 7 日のスター増減
  • Structured3D@bertjiazheng

    [ECCV'20] Structured3D: 構造化3Dモデリングのための大規模なフォトリアルなデータセット

    682+2直近 7 日のスター増減
  • FX-1-Minute-Data@philipperemy

    HISTDATA - すべての FX 通貨ペア / 原油 / 株価指数で構成されるデータセット。1 分足データ(およびティックデータ)の過去の FX 価格を取得するシンプルな API(最新対応)。

    681+0直近 7 日のスター増減
  • 音声数字の無料オーディオデータセット。MNIST のオーディオ版。

    678+0直近 7 日のスター増減
  • ACM Multimedia2020 University-1652: ドローンによるジオローカライゼーションのためのマルチビュー・マルチソースベンチマーク :helicopter: 世界中の72の大学にある1,652の建物にアノテーションを付与します。

    677+5直近 7 日のスター増減
  • ClawBench@TIGER-AI-Lab

    日常タスクにおけるブラウザ AI エージェントのオープンソースベンチマーク。

    675+72直近 7 日のスター増減
  • video2dataset@iejMac

    動画 URL から大規模な動画データセットを簡単に作成する

    664+1直近 7 日のスター増減
  • datalad@datalad

    git と git-annex を使用してコード、データ、コンテナを管理する

    660+3直近 7 日のスター増減
  • Awesome-LLM-Eval: LLMの評価に特化したツール、データセット/ベンチマーク、デモ、リーダーボード、論文、ドキュメント、モデルの厳選リスト。

    656-2直近 7 日のスター増減
  • datasets@benedekrozemberczki

    ネットワーク科学および機械学習の研究のために収集した、なかなか興味深いデータセットのレポジトリ

    655+0直近 7 日のスター増減
  • データサイエンスプロジェクトの完全なライフサイクル

    653+0直近 7 日のスター増減
  • comma2k19@commaai

    融合ポーズ推定器およびマッピングアルゴリズムの開発と検証のためのドライビングデータセット

    653+3直近 7 日のスター増減
  • ConvoKit@CornellNLP

    ConvoKitは、会話特徴の抽出や会話内の社会現象の分析を行うためのツールキットです。いくつかの大規模な会話データセットと、それらのデータセットでのツールキットの使用例を示すスクリプトが含まれています。

    648+1直近 7 日のスター増減
  • NAS-Bench-201@D-X-Y

    NAS-Bench-201 API とその手順

    646+1直近 7 日のスター増減
  • Ego4d@facebookresearch

    Ego4d データセットのリポジトリ。データセットのダウンロード、視覚化、特徴量の抽出、および使用例。

    644+5直近 7 日のスター増減
  • Exclusively Dark (ExDARK) データセット。我々の知る限り、極低照度環境からトワイライトまで(10種類の異なる条件)、画像クラスとオブジェクトレベルのアノテーションが付与された、現在最大規模の低照度画像コレクションです。

    640-1直近 7 日のスター増減
  • セグメンテーションおよびサリエンシー検出用データセットのコレクション。PR大歓迎です:smile:

    640+0直近 7 日のスター増減
  • TrustLLM@HowieHwong

    [ICML 2024] TrustLLM: 大規模言語モデルにおける信頼性

    632+2直近 7 日のスター増減
← トピック一覧に戻る