メインコンテンツへスキップ
buildradar
Sign in
トピック · dataset

dataset

dataset がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
147
総スター数
828,882
平均スター数
5,639
シェア
0.04%

dataset と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、dataset がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • public-apis@public-apis

    無料APIの集合リスト

    472,776+4,663直近 7 日のスター増減
  • label-studio@HumanSignal

    Label Studioは、標準化された出力形式を持つマルチタイプのデータラベリングおよびアノテーションツール

    28,162+56直近 7 日のスター増減
  • exercises-dataset@hasaneyldrm

    1,324種のエクササイズフィットネスデータセット — アニメーションGIF、180×180のサムネイル、筋肉群・器具データ、6か国語でのステップバイステップの指示。LogPressアプリの裏側にあるエクササイズデータレイヤー。

    21,087+523直近 7 日のスター増減
  • faker@joke2k

    Fakerは、ダミーデータを生成するためのPythonパッケージです。

    19,383+9直近 7 日のスター増減
  • cvat@cvat-ai

    Computer Vision Annotation Tool (CVAT) は、ビジョンAI向け高品質なビジュアルデータセット構築の主要プラットフォームです。AI支援によるラベリング、品質保証、チームコラボレーション、分析、開発者APIを備えた、画像、動画、3Dアノテーション用のオープンソース、クラウド、エンタープライズ製品およびラベリングサービスを提供します。

    16,618+51直近 7 日のスター増減
  • LaTeX-OCR@lukas-blecher

    pix2tex: ViTを使用して、数式の画像をLaTeXコードに変換

    16,549+5直近 7 日のスター増減
  • easy-dataset@ConardLi

    LLMのファインチューニング、RAG、Eval用のデータセットを作成するための強力なツール。

    14,854+43直近 7 日のスター増減
  • doccano@doccano

    機械学習の実務家向けのオープンソースアノテーションツール

    10,760+7直近 7 日のスター増減
  • techniques@satellite-image-deep-learning

    衛星および航空画像を用いた深層学習の技術

    10,240+6直近 7 日のスター増減
  • 大規模中国語自然言語処理コーパス (Large Scale Chinese Corpus for NLP)

    9,910+1直近 7 日のスター増減
  • MDNに表示されているWeb技術のブラウザ互換性データ

    5,730+7直近 7 日のスター増減
  • 優れた事前学習済み中国語NLPモデル。高品質な中文事前学習モデル、大規模モデル、マルチモーダルモデル、大規模言語モデルの集合。

    5,582+0直近 7 日のスター増減
  • ポストトレーニング用のデータセットとツールの厳選リスト

    4,759+12直近 7 日のスター増減
  • esProc@SPLWare

    esProc SPLは、構造化データ計算のために設計されたJVMベースのプログラミング言語であり、データ分析ツールとしても組み込みコンピューティングエンジンとしても機能する。

    4,684-2直近 7 日のスター増減
  • transformer@hyunwoongko

    Transformer: 「Attention Is All You Need」のPyTorch実装。

    4,648+10直近 7 日のスター増減
  • datasets@tensorflow

    TFDSは、TensorFlow、Jaxなどとすぐに使えるデータセットのコレクションです。

    4,581+1直近 7 日のスター増減
  • img2dataset@rom1504

    大量の画像URLを簡単に画像データセットに変換可能。1台のマシンで1億件のURLを20時間でダウンロード、リサイズ、パッケージ化できる。

    4,443+1直近 7 日のスター増減
  • 中国人名コーパス。人名ジェネレーター。中国語の氏名、姓、名、敬称、日本人名、翻訳された人名、英語名。中国語の分かち書き、人名固有表現認識に使用可能。

    4,327+1直近 7 日のスター増減
  • sql-translator@whoiskatrin

    SQL Translatorは、AIを用いて自然言語のクエリをSQLコードに変換するツール。本プロジェクトは100%無料かつオープンソースです。

    4,321-2直近 7 日のスター増減
  • CLUE@CLUEbenchmark

    中文言語理解評価ベンチマーク (Chinese Language Understanding Evaluation Benchmark): データセット、ベースライン、事前学習モデル、コーパス、リーダーボード

    4,279+0直近 7 日のスター増減
  • 📈 現在最大級の産業欠陥検出データベースおよび論文集。表面欠陥研究分野における重要度の高いオープンソースデータセットと論文を継続的に要約。

    4,103+4直近 7 日のスター増減
  • csghub@OpenCSGs

    CSGHubは、OpenCSGチームによって開発された全く新しいLLM管理のためのオープンソースプラットフォームです。Hugging Faceに匹敵する機能を備えたオープンソースおよびオンプレミス/SaaSソリューションを提供します。Hugging FaceとのPython SDK互換性により、LLM、データセット、エージェントのライフサイクルを完全に制御できます。ぜひご参加ください! ⭐️

    4,101+3直近 7 日のスター増減
  • 産業用画像異常/欠陥検出の論文リストとデータセット(更新中)。工業異常/瑕疵検出の論文およびデータセット検索ライブラリ(継続更新)。

    3,749+5直近 7 日のスター増減
  • テキスト認識用の合成データ生成ツール

    3,691+0直近 7 日のスター増減
  • dataset@linhandev

    医学画像データセット一覧 『An Index for Medical Imaging Datasets』

    3,605+0直近 7 日のスター増減
  • StringZilla@ashvardanian

    NEON、AVX2、AVX-512、SVE、GPGPU、SWAR を活用して検索、ハッシュ化、ソート、編集距離、スケッチ、メモリ操作を高速化し、C、C++、CUDA、Python、Rust、Swift、JS、Go 向けに最大 100 倍高速な文字列を実現 🦖

    3,543+7直近 7 日のスター増減
  • waymo-open-dataset@waymo-research

    Waymoオープンデータセット

    3,400+8直近 7 日のスター増減
  • 幅広いインターネットソースからデータを抽出し、pandas DataFrame に変換します。

    3,238+2直近 7 日のスター増減
  • color-names@meodai

    厳選されたカラー名の大きなリスト 🌈

    2,984+6直近 7 日のスター増減
  • whylogs@whylabs

    機械学習モデルとデータパイプライン向けのオープンソースデータロギングライブラリ。📚 時間経過に伴うデータ品質とモデルパフォーマンスの可視化を提供。🛡️ プライバシーを保護するデータ収集をサポートし、安全性と堅牢性を確保。📈

    2,831-1直近 7 日のスター増減
← トピック一覧に戻る