dataset
dataset がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
dataset と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、dataset がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
無料APIの集合リスト
★ 472,776+4,663直近 7 日のスター増減 - #2
Label Studioは、標準化された出力形式を持つマルチタイプのデータラベリングおよびアノテーションツール
★ 28,162+56直近 7 日のスター増減 - #3
1,324種のエクササイズフィットネスデータセット — アニメーションGIF、180×180のサムネイル、筋肉群・器具データ、6か国語でのステップバイステップの指示。LogPressアプリの裏側にあるエクササイズデータレイヤー。
★ 21,087+523直近 7 日のスター増減 - #4★ 19,383+9直近 7 日のスター増減
- #5
Computer Vision Annotation Tool (CVAT) は、ビジョンAI向け高品質なビジュアルデータセット構築の主要プラットフォームです。AI支援によるラベリング、品質保証、チームコラボレーション、分析、開発者APIを備えた、画像、動画、3Dアノテーション用のオープンソース、クラウド、エンタープライズ製品およびラベリングサービスを提供します。
★ 16,618+51直近 7 日のスター増減 - #6★ 16,549+5直近 7 日のスター増減
- #7
LLMのファインチューニング、RAG、Eval用のデータセットを作成するための強力なツール。
★ 14,854+43直近 7 日のスター増減 - #8★ 10,760+7直近 7 日のスター増減
- #9
衛星および航空画像を用いた深層学習の技術
★ 10,240+6直近 7 日のスター増減 - #10
大規模中国語自然言語処理コーパス (Large Scale Chinese Corpus for NLP)
★ 9,910+1直近 7 日のスター増減 - #11
MDNに表示されているWeb技術のブラウザ互換性データ
★ 5,730+7直近 7 日のスター増減 - #12
優れた事前学習済み中国語NLPモデル。高品質な中文事前学習モデル、大規模モデル、マルチモーダルモデル、大規模言語モデルの集合。
★ 5,582+0直近 7 日のスター増減 - #13
ポストトレーニング用のデータセットとツールの厳選リスト
★ 4,759+12直近 7 日のスター増減 - #14
esProc SPLは、構造化データ計算のために設計されたJVMベースのプログラミング言語であり、データ分析ツールとしても組み込みコンピューティングエンジンとしても機能する。
★ 4,684-2直近 7 日のスター増減 - #15
Transformer: 「Attention Is All You Need」のPyTorch実装。
★ 4,648+10直近 7 日のスター増減 - #16★ 4,581+1直近 7 日のスター増減
- #17
大量の画像URLを簡単に画像データセットに変換可能。1台のマシンで1億件のURLを20時間でダウンロード、リサイズ、パッケージ化できる。
★ 4,443+1直近 7 日のスター増減 - #18
中国人名コーパス。人名ジェネレーター。中国語の氏名、姓、名、敬称、日本人名、翻訳された人名、英語名。中国語の分かち書き、人名固有表現認識に使用可能。
★ 4,327+1直近 7 日のスター増減 - #19
SQL Translatorは、AIを用いて自然言語のクエリをSQLコードに変換するツール。本プロジェクトは100%無料かつオープンソースです。
★ 4,321-2直近 7 日のスター増減 - #20
中文言語理解評価ベンチマーク (Chinese Language Understanding Evaluation Benchmark): データセット、ベースライン、事前学習モデル、コーパス、リーダーボード
★ 4,279+0直近 7 日のスター増減 - #21
📈 現在最大級の産業欠陥検出データベースおよび論文集。表面欠陥研究分野における重要度の高いオープンソースデータセットと論文を継続的に要約。
★ 4,103+4直近 7 日のスター増減 - #22
CSGHubは、OpenCSGチームによって開発された全く新しいLLM管理のためのオープンソースプラットフォームです。Hugging Faceに匹敵する機能を備えたオープンソースおよびオンプレミス/SaaSソリューションを提供します。Hugging FaceとのPython SDK互換性により、LLM、データセット、エージェントのライフサイクルを完全に制御できます。ぜひご参加ください! ⭐️
★ 4,101+3直近 7 日のスター増減 - #23
産業用画像異常/欠陥検出の論文リストとデータセット(更新中)。工業異常/瑕疵検出の論文およびデータセット検索ライブラリ(継続更新)。
★ 3,749+5直近 7 日のスター増減 - #24
テキスト認識用の合成データ生成ツール
★ 3,691+0直近 7 日のスター増減 - #25★ 3,605+0直近 7 日のスター増減
- #26
NEON、AVX2、AVX-512、SVE、GPGPU、SWAR を活用して検索、ハッシュ化、ソート、編集距離、スケッチ、メモリ操作を高速化し、C、C++、CUDA、Python、Rust、Swift、JS、Go 向けに最大 100 倍高速な文字列を実現 🦖
★ 3,543+7直近 7 日のスター増減 - #27
Waymoオープンデータセット
★ 3,400+8直近 7 日のスター増減 - #28
幅広いインターネットソースからデータを抽出し、pandas DataFrame に変換します。
★ 3,238+2直近 7 日のスター増減 - #29
厳選されたカラー名の大きなリスト 🌈
★ 2,984+6直近 7 日のスター増減 - #30
機械学習モデルとデータパイプライン向けのオープンソースデータロギングライブラリ。📚 時間経過に伴うデータ品質とモデルパフォーマンスの可視化を提供。🛡️ プライバシーを保護するデータ収集をサポートし、安全性と堅牢性を確保。📈
★ 2,831-1直近 7 日のスター増減