トピック · reinforcement-learning-from-human-feedback
reinforcement-learning-from-human-feedback
reinforcement-learning-from-human-feedback がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
リポジトリ
3
総スター数
12,426
平均スター数
4,142
シェア
0.00%
関連トピック
reinforcement-learning-from-human-feedback と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、reinforcement-learning-from-human-feedback がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1
Rayベースの使いやすいスケーラブルで高性能なエージェンティックRLフレームワーク (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
★ 9,969+9直近 7 日のスター増減 - #2★ 1,613+1直近 7 日のスター増減
- #3
RLHFおよび代替手法のためのシミュレーションフレームワーク。人間のデータを収集せずにRLHF手法を開発可能
★ 844-1直近 7 日のスター増減