メインコンテンツへスキップ
buildradar
Sign in
トピック · datasets

datasets

datasets がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

81 件のリポジトリ
  • ogb@snap-stanford

    グラフ機械学習用のベンチマークデータセット、データローダー、評価ツール

    2,095+1直近 7 日のスター増減
  • 厳選された素晴らしいサイバーセキュリティデータセットのリスト

    2,077+1直近 7 日のスター増減
  • DB-GPT-Hub@eosphoros-ai

    Text-to-SQL におけるモデルの性能向上を目的として、DB-GPT のモデル、データセット、ファインチューニング手法を格納するリポジトリ。

    2,008-1直近 7 日のスター増減
  • diffgram@diffgram

    スキーマ、BLOB、予測のための AI データストア。アプリで使用したり、組み込みの人による監督、データワークフロー、UI カタログを統合して、AI データの価値を最大限に引き出します。

    1,909+0直近 7 日のスター増減
  • awesome-data-analysis@PavelGrigoryevDS

    データ分析とデータサイエンスに関する厳選された500以上のリソース:Python、SQL、統計、ML、AI、可視化、チートシート、ロードマップ、面接対策。初心者から上級者まで。

    1,890+8直近 7 日のスター増減
  • DataFrames.jl@JuliaData

    Julia におけるインメモリの表形式データ

    1,831+0直近 7 日のスター増減
  • awesome-transit@MobilityData

    公共交通機関のAPI、アプリ、データセット、研究、ソフトウェアのコミュニティリスト :bus::star2::train::star2::steam_locomotive:

    1,826+3直近 7 日のスター増減
  • 🚀🚀🚀 優れた公開YOLO物体検出シリーズプロジェクトと関連する物体検出データセットのコレクション

    1,783-2直近 7 日のスター増減
  • 户晨风のすべてのコンテンツを収集する

    1,650+2直近 7 日のスター増減
  • safe-rlhf@PKU-Alignment

    Safe RLHF: 人間からのフィードバックによる安全な強化学習を通じた制約付き価値アライメント

    1,613+1直近 7 日のスター増減
  • 固有表現抽出(NER)およびエンティティ認識タスク向けのコーパス集。これらのアノテーション済みデータセットは、多様な言語、ドメイン、エンティティタイプをカバーしています。

    1,574+0直近 7 日のスター増減
  • ロボット開発に役立つ素晴らしいリンクやソフトウェアライブラリの厳選リスト

    1,483+3直近 7 日のスター増減
  • projects@explosion

    🪐 プロトタイプから本番環境までのエンドツーエンドのNLPワークフロー

    1,436+0直近 7 日のスター増減
  • kitops@kitops-ml

    AI/ML モデル、データセット、コード、設定を OCI Artifact にパッケージングおよびバージョン管理するための CNCF 製オープンソース DevOps ツール

    1,409+0直近 7 日のスター増減
  • IMAGDressing@muzishen

    [AAAI 2025] 👔IMAGDressing👔:バーチャル試着のためのインタラクティブなモジュール型アパレル生成。柔軟な衣服、ポーズ、シーン制御によりカスタマイズ可能な人物画像生成を可能にし、バーチャル試着における高い忠実度と衣服の一貫性を保証します。

    1,343+0直近 7 日のスター増減
  • Minari@Farama-Foundation

    オフライン強化学習データセットのための標準フォーマット。主要な参照データセットと関連ユーティリティを含む

    1,294+3直近 7 日のスター増減
  • TDC@mims-harvard

    Therapeutics Commons (TDC): 治療科学のためのマルチモーダル基盤

    1,279+2直近 7 日のスター増減
  • langtrace@Scale3-Labs

    Langtrace 🔍は、LLMアプリケーション向けのオープンソースかつOpenTelemetryベースのエンドツーエンド観測性(オブザーバビリティ)ツールであり、主要なLLM、LLMフレームワーク、vectorDBなどのリアルタイムトレーシング、評価、メトリクスを提供します。TypeScriptやPythonを使用して統合可能。🚀💻📊

    1,228-1直近 7 日のスター増減
  • datasets@satellite-image-deep-learning

    衛星画像および航空写真を用いたディープラーニング用データセット

    1,195+2直近 7 日のスター増減
  • 指示追従型 LLM(ChatGPT、LLaMA、Alpaca)の訓練用オープンソースデータセット集

    1,153-1直近 7 日のスター増減
  • audino@midas-research

    人間向けのオープンソース音声アノテーションツール

    1,146+0直近 7 日のスター増減
  • Twitterのデータセットおよび関連リソースのリスト。

    1,125+1直近 7 日のスター増減
  • csghub-server@OpenCSGs

    csghub-serverは、ユーザーがデータセットやモデルの管理を行い、モデルの推論、ファインチューニング、アプリケーションスペースを実行できるようにするCSGHubのバックエンドサーバーです。

    1,048+2直近 7 日のスター増減
  • CLUECorpus2020@CLUEbenchmark

    中国語100Gの大規模事前学習コーパス

    1,020+2直近 7 日のスター増減
  • [ACL 2023] 言語モデルプロンプトによる推論:サーベイ論文

    1,007+1直近 7 日のスター増減
  • mola@MOLAorg

    自己位置推定と地図作成(SLAM)のためのモジュール式最適化フレームワーク(MOLA)

    1,006+5直近 7 日のスター増減
  • ICCV-2023-25-Papers@DmitryRyumin

    ICCV 2023-2025 Papers: コンピュータービジョン分野の主要な学会である ICCV 2023-25 の最先端の研究を発見。コード付きでコンピュータビジョンとディープラーニングの最新情報を常に把握できます。⭐ ビジュアルインテリジェンスの開発をサポート!

    969+1直近 7 日のスター増減
  • 音声、音楽、効果音を含むAI音声データセット (AI-ADS) 🎵。生成AI、AIGC、AIモデルのトレーニング、インテリジェントな音声ツールの開発、音声アプリケーションにトレーニングデータを提供します。

    964+2直近 7 日のスター増減
  • semhash@MinishLab

    高速なマルチモーダルセマンティック重複排除&フィルタリング。

    963+2直近 7 日のスター増減
  • geobr@ipea

    R および Python でブラジルの公式空間データセットに簡単にアクセス

    945+2直近 7 日のスター増減
← トピック一覧に戻る