メインコンテンツへスキップ
buildradar
Sign in
トピック · dataset

dataset

dataset がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

148 件のリポジトリ
  • 2020年からの公開BTC取引コンテキスト。

    1,216+1直近 7 日のスター増減
  • M2DGR@SJTU-ViSYS

    M2DGR:地上ロボット向けマルチモーダルおよびマルチシナリオデータセット(RA-L2021 & ICRA2022)

    1,201+5直近 7 日のスター増減
  • chat-dataset-baseline@hikariming

    手動で微調整された中国語対話データセットと、chatglmのファインチューニング用コード

    1,191+0直近 7 日のスター増減
  • torchxrayvision@mlmed

    TorchXRayVision: 胸部X線データセットとモデルのライブラリ。分類、セグメンテーション、オートエンコーダーを提供。

    1,188+3直近 7 日のスター増減
  • covid-19@datasets

    新型コロナウイルス感染症(2019-nCoV)の感染者数時系列データ

    1,165+1直近 7 日のスター増減
  • domains@tb0hdan

    世界単一最大規模のインターネットドメインデータセット

    1,157+1直近 7 日のスター増減
  • Twitterのデータセットおよび関連リソースのリスト。

    1,125+1直近 7 日のスター増減
  • game-datasets@leomaurodesenv

    ゲーム用データセットや、ゲームにおける人工知能のためのツールに関する厳選されたリスト

    1,118+9直近 7 日のスター増減
  • SoundMind@xid32

    複雑な推論タスク向けに特別に設計された 6,446 件のテキスト・音声アノテーション済みサンプルからなる Audio Logical Reasoning (ALR) データセットを提案します。このリソースを基に、音声言語モデル (ALMs) に高度なバイモーダル推論能力を付与するために調整された、ルールベースの強化学習 (RL) アルゴリズムである SoundMind を提案します。

    1,113+0直近 7 日のスター増減
  • insuranceqa-corpus-zh@chatopera

    保険業界向けコーパス、チャットボット

    1,064-1直近 7 日のスター増減
  • hagrid@hukenovs

    ハンドジェスチャー認識画像データセット

    1,059+8直近 7 日のスター増減
  • TransportationNetworks@bstabler

    研究用交通ネットワーク

    1,051+2直近 7 日のスター増減
  • MMSA@thuiar

    MMSAはマルチモーダル感情分析のための統合フレームワークです

    1,046+4直近 7 日のスター増減
  • name-dataset@philipperemy

    名前を扱うための Python ライブラリ

    1,018-1直近 7 日のスター増減
  • ThoughtSource@OpenBioLink

    大規模言語モデルにおける思考連鎖(chain-of-thought)推論に関するデータとツールの中心的なオープンリソース。開発元:Samwald research group (https://samwald.info/)

    1,015+0直近 7 日のスター増減
  • 生体力学および人体動作解析に関する公開リソースのキュレーションリスト:データセット、処理ツール、シミュレーション用ソフトウェア、教育用ビデオ、講義など。

    1,010+1直近 7 日のスター増減
  • githut@madnight

    GitHub の言語統計

    1,004-1直近 7 日のスター増減
  • Mobius@microsoft

    Apache Spark向けのC#およびF#言語バインディングと拡張機能

    948+0直近 7 日のスター増減
  • OmniAnomaly@NetManAIOps

    KDD 2019: 確率的再帰型ニューラルネットワークを用いた多変量時系列のロバストな異常検知

    948+5直近 7 日のスター増減
  • semantic-segmentation@sithu31296

    PyTorch による SOTA セマンティックセグメンテーションモデル

    942-1直近 7 日のスター増減
  • tfrecord@vahidk

    PyTorch データローダーを備えたスタンドアロンの TFRecord リーダー/ライター

    902+0直近 7 日のスター増減
  • データセットの視覚化、データ処理、結果の評価を行うための SemanticKITTI API

    898+3直近 7 日のスター増減
  • deepfabric@nolabs-ai

    単一のパイプラインで高品質な合成データの生成、トレーニング、測定、評価を行う

    885+3直近 7 日のスター増減
  • magpie@magpie-align

    [ICLR 2025] アライメント済み LLM に何も与えずにプロンプティングすることによる、ゼロからのアライメントデータ合成。効率的で高品質な合成データ生成パイプライン!

    881+2直近 7 日のスター増減
  • OpenCUA@xlang-ai

    [NeurIPS 2025 Spotlight] OpenCUA: コンピュータ利用エージェントのためのオープンな基盤

    833+4直近 7 日のスター増減
  • MINT-1T@mlfoundations

    🍃 MINT-1T: 1兆トークンのマルチモーダルインターリーブデータセット。

    832+0直近 7 日のスター増減
  • PrimeKG@mims-harvard

    精密医療ナレッジグラフ (PrimeKG)

    823+6直近 7 日のスター増減
  • opendata@NationalGalleryOfArt

    ナショナル・ギャラリー・オブ・アート(米国立美術館)オープンデータプログラム

    819+6直近 7 日のスター増減
  • pycococreator@waspinator

    COCO データセットを作成するためのヘルパー関数

    783-1直近 7 日のスター増減
  • Total-Text-Dataset@cs-chan

    Total Text Dataset。水平、多方向、曲線という3つ以上の異なるテキスト方向を持つ1555枚の画像で構成される、類を見ないデータセット

    771-1直近 7 日のスター増減
← トピック一覧に戻る