reinforcement-learning
reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #151★ 1,432+1直近 7 日のスター増減
- #152
Julia で書かれた簡潔で美しいアルゴリズム
★ 1,426+0直近 7 日のスター増減 - #153
モデルベース強化学習(Model-based RL)に関する優れたリソースの厳選リスト(随時更新)
★ 1,393+0直近 7 日のスター増減 - #154★ 1,385+2直近 7 日のスター増減
- #155
STEM 教育および AI 強化サービス向けの、プログラム可能で機動性の高いロボット猫。
★ 1,372+1直近 7 日のスター増減 - #156★ 1,367+1直近 7 日のスター増減
- #157
ROS Gazebo シミュレータにおける移動ロボットのナビゲーションのための深層強化学習。Twin Delayed Deep Deterministic Policy Gradient (TD3) ニューラルネットワークを使用し、ロボットが障害物を回避しながらシミュレーション環境内のランダムな目標地点へ移動する方法を学習する。
★ 1,362+2直近 7 日のスター増減 - #158★ 1,362+0直近 7 日のスター増減
- #159
Soft Actor-Critic (SAC)、Twin Delayed DDPG (TD3)、Actor-Critic (AC/A2C)、Proximal Policy Optimization (PPO)、QT-Opt、PointNet などの PyTorch 実装
★ 1,359+1直近 7 日のスター増減 - #160
AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。
★ 1,334+0直近 7 日のスター増減 - #161
Keras による最小限のディープQ学習(DQN & DDQN)の実装
★ 1,329+1直近 7 日のスター増減 - #162★ 1,294+3直近 7 日のスター増減
- #163
ディープラーニングと機械学習に関する論文読解ノート
★ 1,270+0直近 7 日のスター増減 - #164
シンプルでスタイリッシュな PPO の実装。Medium の連載シリーズに基づいています: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8
★ 1,269+1直近 7 日のスター増減 - #165
AndroidデバイスでのRL研究。
★ 1,240+0直近 7 日のスター増減 - #166★ 1,213+8直近 7 日のスター増減
- #167
強化学習を用いた人型ロボットの歩行訓練。
★ 1,210+3直近 7 日のスター増減 - #168
パーダーボルン大学が主催する強化学習コースの講義ノート、解答付きチュートリアル課題、オンラインビデオ。
★ 1,192+1直近 7 日のスター増減 - #169★ 1,188+0直近 7 日のスター増減
- #170★ 1,177+0直近 7 日のスター増減
- #171★ 1,155+7直近 7 日のスター増減
- #172
一般的なセットアップ(Google Robot、WidowX+Bridgeなど)のシミュレーション環境における、現実世界のロボット操作ポリシー(RT-1、RT-1-X、Octoなど)の評価と再現(CoRL 2024)
★ 1,153+3直近 7 日のスター増減 - #173★ 1,150+1直近 7 日のスター増減
- #174★ 1,144+1直近 7 日のスター増減
- #175★ 1,134+0直近 7 日のスター増減
- #176
:computer: 機械に学習させる方法を学び、プログラミングの苦労から解放されましょう。究極のリスト
★ 1,128+0直近 7 日のスター増減 - #177★ 1,125+6直近 7 日のスター増減
- #178★ 1,119+1直近 7 日のスター増減
- #179★ 1,114+3直近 7 日のスター増減
- #180
複雑な推論タスク向けに特別に設計された 6,446 件のテキスト・音声アノテーション済みサンプルからなる Audio Logical Reasoning (ALR) データセットを提案します。このリソースを基に、音声言語モデル (ALMs) に高度なバイモーダル推論能力を付与するために調整された、ルールベースの強化学習 (RL) アルゴリズムである SoundMind を提案します。
★ 1,113+0直近 7 日のスター増減