deep-reinforcement-learning
deep-reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
deep-reinforcement-learning と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、deep-reinforcement-learning がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
Unity Machine Learning Agents Toolkit (ML-Agents) は、深層強化学習と模倣学習を用いてインテリジェントエージェントを訓練するための環境としてゲームやシミュレーションを利用可能にするオープンソースプロジェクトです。
★ 19,655+2直近 7 日のスター増減 - #2★ 18,434+8直近 7 日のスター増減
- #3★ 16,200+52直近 7 日のスター増減
- #4★ 14,600+8直近 7 日のスター増減
- #5★ 14,352+17直近 7 日のスター増減
- #6
これらの刺激的な講義を通じて、Deep Learning、Reinforcement Learning、Machine Learning、Computer Vision、NLPにどっぷり浸りましょう!!
★ 12,939+3直近 7 日のスター増減 - #7
MITのDeep Learning関連コース向けのチュートリアル、課題、コンペティション。
★ 10,453-1直近 7 日のスター増減 - #8★ 10,358+19直近 7 日のスター増減
- #9
(⌐■_■) - WiFi pwningのためのbettercapへの深層強化学習の組み込み。
★ 9,193+1直近 7 日のスター増減 - #10
MIT 6.S191: Introduction to Deep Learning の実験資料
★ 8,770+8直近 7 日のスター増減 - #11
Deep Reinforcement Learning(Deep Q-learning)を使用したFlappy Birdハック。
★ 6,819+0直近 7 日のスター増減 - #12
実環境における強化学習のコース
★ 6,566+0直近 7 日のスター増減 - #13
Deep Reinforcement Learning NanoDegreeプログラムのリポジトリ
★ 5,176+0直近 7 日のスター増減 - #14
このリポジトリには、Hugging Faceの深層強化学習コースが含まれています。
★ 5,006+10直近 7 日のスター増減 - #15
『大语言模型』著者:赵鑫、李军毅、周昆、唐天一、文继荣
★ 4,557+3直近 7 日のスター増減 - #16
人間フィードバックによる強化学習(Reinforcement Learning with Human Feedback)のリソースを厳選したリスト(継続的に更新中)。
★ 4,424+2直近 7 日のスター増減 - #17
最小限でクリーンな強化学習のサンプル
★ 3,660+0直近 7 日のスター増減 - #18
FinRL-X: クオンツ取引向けの AI ネイティブなモジュール式インフラストラクチャ。
★ 3,657+50直近 7 日のスター増減 - #19★ 3,541+0直近 7 日のスター増減
- #20★ 3,452+3直近 7 日のスター増減
- #21
主要な深層強化学習(DRL)アルゴリズムのクリーン、堅牢、かつ統一された PyTorch 実装(Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3,440+3直近 7 日のスター増減 - #22
Tensorforce: 応用強化学習のためのTensorFlowライブラリ
★ 3,305+0直近 7 日のスター増減 - #23★ 3,197+1直近 7 日のスター増減
- #24
多様なタスクや環境でembodied AIエージェントを訓練するためのモジュール式高水準ライブラリ。
★ 3,117+6直近 7 日のスター増減 - #25
Stable Baselines3 強化学習エージェントのためのトレーニングフレームワーク。ハイパーパラメータ最適化と事前トレーニング済みエージェントが含まれています。
★ 2,873+1直近 7 日のスター増減 - #26
MuZero
★ 2,865+2直近 7 日のスター増減 - #27
PPO x Family DRLチュートリアルコース(意思決定AI入門公開講座:全8回でアルゴリズム理論の整理、コードロジックの理解、意思決定AIアプリの実践を習得)
★ 2,616+2直近 7 日のスター増減 - #28
PyTorch によるクリップ目的関数 Proximal Policy Optimization (PPO) の最小限の実装
★ 2,381+6直近 7 日のスター増減 - #29★ 2,293+0直近 7 日のスター増減
- #30
FinRL-Meta: FinRL 用の動的データセットとマーケット環境
★ 1,934+4直近 7 日のスター増減