dataset
dataset がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #91
LLM のパワーを解放:これらのデータセットを探索して独自の ChatGPT をトレーニングしよう!
★ 768+0直近 7 日のスター増減 - #92
Clojure 製の高性能データ処理システム
★ 760+0直近 7 日のスター増減 - #93★ 756+1直近 7 日のスター増減
- #94
対聯のデータセット。70万件の対聯データベース
★ 747+1直近 7 日のスター増減 - #95
人物検索のための関節検出と識別特徴量学習
★ 746+0直近 7 日のスター増減 - #96
DelphiおよびLazarus (FPC) 向けのJSON・DataSet相互変換コンバーター
★ 744+1直近 7 日のスター増減 - #97★ 739+0直近 7 日のスター増減
- #98
Thorsten-Voice: ライセンスの心配なく、あらゆるプロジェクトで使用可能な、無料、オフライン動作、高品質なドイツ語TTS音声
★ 729+1直近 7 日のスター増減 - #99
PyTorchによるOpenAI CLIPモデルのシンプルな実装
★ 726+0直近 7 日のスター増減 - #100★ 706+0直近 7 日のスター増減
- #101
UCAS-VGのポイントベースおよび極小オブジェクト検出・ローカライゼーションコードセット
★ 694+1直近 7 日のスター増減 - #102
大規模言語モデルにおける長文の事実性のベンチマーク。論文「Long-form factuality in large language models」のオリジナルコード。
★ 693+2直近 7 日のスター増減 - #103★ 689+2直近 7 日のスター増減
- #104
[ECCV'20] Structured3D: 構造化3Dモデリングのための大規模なフォトリアルなデータセット
★ 682+2直近 7 日のスター増減 - #105
HISTDATA - すべての FX 通貨ペア / 原油 / 株価指数で構成されるデータセット。1 分足データ(およびティックデータ)の過去の FX 価格を取得するシンプルな API(最新対応)。
★ 681+0直近 7 日のスター増減 - #106
音声数字の無料オーディオデータセット。MNIST のオーディオ版。
★ 678+0直近 7 日のスター増減 - #107
ACM Multimedia2020 University-1652: ドローンによるジオローカライゼーションのためのマルチビュー・マルチソースベンチマーク :helicopter: 世界中の72の大学にある1,652の建物にアノテーションを付与します。
★ 677+5直近 7 日のスター増減 - #108★ 675+72直近 7 日のスター増減
- #109
動画 URL から大規模な動画データセットを簡単に作成する
★ 664+1直近 7 日のスター増減 - #110★ 660+3直近 7 日のスター増減
- #111
Awesome-LLM-Eval: LLMの評価に特化したツール、データセット/ベンチマーク、デモ、リーダーボード、論文、ドキュメント、モデルの厳選リスト。
★ 656-2直近 7 日のスター増減 - #112★ 655+0直近 7 日のスター増減
- #113
データサイエンスプロジェクトの完全なライフサイクル
★ 653+0直近 7 日のスター増減 - #114★ 653+3直近 7 日のスター増減
- #115
ConvoKitは、会話特徴の抽出や会話内の社会現象の分析を行うためのツールキットです。いくつかの大規模な会話データセットと、それらのデータセットでのツールキットの使用例を示すスクリプトが含まれています。
★ 648+1直近 7 日のスター増減 - #116
NAS-Bench-201 API とその手順
★ 646+1直近 7 日のスター増減 - #117★ 644+5直近 7 日のスター増減
- #118
Exclusively Dark (ExDARK) データセット。我々の知る限り、極低照度環境からトワイライトまで(10種類の異なる条件)、画像クラスとオブジェクトレベルのアノテーションが付与された、現在最大規模の低照度画像コレクションです。
★ 640-1直近 7 日のスター増減 - #119
セグメンテーションおよびサリエンシー検出用データセットのコレクション。PR大歓迎です:smile:
★ 640+0直近 7 日のスター増減 - #120★ 632+2直近 7 日のスター増減