オーナー · opendilab
opendilab
opendilab の追跡中のオープンソースリポジトリを、スター数順に表示します。
16 件のリポジトリ
- #1
人間フィードバックによる強化学習(Reinforcement Learning with Human Feedback)のリソースを厳選したリスト(継続的に更新中)。
★ 4,424+2直近 7 日のスター増減 - #2★ 3,642+1直近 7 日のスター増減
- #3
PPO x Family DRLチュートリアルコース(意思決定AI入門公開講座:全8回でアルゴリズム理論の整理、コードロジックの理解、意思決定AIアプリの実践を習得)
★ 2,616+2直近 7 日のスター増減 - #4
[NeurIPS 2023 Spotlight] LightZero: 一般的な逐次決定シナリオにおけるモンテカルロ木探索の統合ベンチマーク(優れた MCTS)
★ 1,642+4直近 7 日のスター増減 - #5
強化学習(RL)における拡散モデルのリソースに関するキュレーションリスト(随時更新)
★ 1,635+2直近 7 日のスター増減 - #6
モデルベース強化学習(Model-based RL)に関する優れたリソースの厳選リスト(随時更新)
★ 1,393+0直近 7 日のスター増減 - #7★ 1,393+0直近 7 日のスター増減
- #8★ 929+0直近 7 日のスター増減
- #9
Decision Transformer リソースのキュレーションリスト(随時更新)
★ 916+0直近 7 日のスター増減 - #10
探索的強化学習(RL)に関する厳選リソースリスト(随時更新)
★ 723+0直近 7 日のスター増減 - #11
[CoRL 2022] InterFuser: 解釈可能なセンサーフュージョン Transformer を用いた安全性向上のための自動運転
★ 652-1直近 7 日のスター増減 - #12★ 639+1直近 7 日のスター増減
- #13
マルチモーダル強化学習リソースのキュレーションリスト(随時更新)
★ 620+1直近 7 日のスター増減 - #14
LLM Riddlesゲームのオープンソースの再現/デモ
★ 587+0直近 7 日のスター増減 - #15★ 540+0直近 7 日のスター増減
- #16★ 519+0直近 7 日のスター増減