トピック · reinforcement-learning
reinforcement-learning
reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
305 件のリポジトリ
- #61
ChatGPTの資料まとめ学習、継続的な更新...
★ 4,190+1直近 7 日のスター増減 - #62★ 4,054+2直近 7 日のスター増減
- #63★ 4,052+1直近 7 日のスター増減
- #64
これはAndrew NGによるCourseraの手書きノートです。
★ 3,808+6直近 7 日のスター増減 - #65★ 3,727+0直近 7 日のスター増減
- #66★ 3,726+12直近 7 日のスター増減
- #67
最小限でクリーンな強化学習のサンプル
★ 3,660+0直近 7 日のスター増減 - #68
ディープラーニングの入門・上級・特色コース、学術・産業実践事例、知識百科、面接問題集
★ 3,651+2直近 7 日のスター増減 - #69★ 3,642+1直近 7 日のスター増減
- #70
五目並べのためのAlphaZeroアルゴリズムの実装
★ 3,627+2直近 7 日のスター増減 - #71
推薦システムに関する古典的な論文とリソース
★ 3,568+1直近 7 日のスター増減 - #72★ 3,545+4直近 7 日のスター増減
- #73★ 3,545+5直近 7 日のスター増減
- #74★ 3,541+0直近 7 日のスター増減
- #75
マルチエージェント強化学習環境のための標準API。一般的なリファレンス環境および関連ユーティリティを含む。
★ 3,503+4直近 7 日のスター増減 - #76★ 3,496-1直近 7 日のスター増減
- #77
Pythonの機械学習およびデータサイエンス向けデバッグ、モニタリング、可視化ツール
★ 3,472+1直近 7 日のスター増減 - #78★ 3,454+1直近 7 日のスター増減
- #79
主要な深層強化学習(DRL)アルゴリズムのクリーン、堅牢、かつ統一された PyTorch 実装(Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3,440+3直近 7 日のスター増減 - #80★ 3,382+0直近 7 日のスター増減
- #81
Tensorforce: 応用強化学習のためのTensorFlowライブラリ
★ 3,305+0直近 7 日のスター増減 - #82
自動運転および戦術的意思決定タスク向けの環境コレクション
★ 3,302+3直近 7 日のスター増減 - #83★ 3,283+13直近 7 日のスター増減
- #84★ 3,227+1直近 7 日のスター増減
- #85
データサイエンスに関する厳選されたリソースリンク集
★ 3,222+1直近 7 日のスター増減 - #86
Skywork-R1V は Skywork AI が開発した高度なマルチモーダル AI モデルシリーズで、視覚と言語の推論を専門としています。
★ 3,168+0直近 7 日のスター増減 - #87★ 3,118+6直近 7 日のスター増減
- #88
多様なタスクや環境でembodied AIエージェントを訓練するためのモジュール式高水準ライブラリ。
★ 3,117+6直近 7 日のスター増減 - #89
ビデオ講義付きの無料の機械学習・AIコース集
★ 3,112+0直近 7 日のスター増減 - #90
TradeMaster は、強化学習を活用した量的取引のためのオープンソースプラットフォームです :fire: :zap: :rainbow:
★ 3,056+2直近 7 日のスター増減