メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning-from-human-feedback

reinforcement-learning-from-human-feedback

reinforcement-learning-from-human-feedback がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
3
総スター数
12,426
平均スター数
4,142
シェア
0.00%

reinforcement-learning-from-human-feedback と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、reinforcement-learning-from-human-feedback がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • OpenRLHF@OpenRLHF

    Rayベースの使いやすいスケーラブルで高性能なエージェンティックRLフレームワーク (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9,969+9直近 7 日のスター増減
  • safe-rlhf@PKU-Alignment

    Safe RLHF: 人間からのフィードバックによる安全な強化学習を通じた制約付き価値アライメント

    1,613+1直近 7 日のスター増減
  • alpaca_farm@tatsu-lab

    RLHFおよび代替手法のためのシミュレーションフレームワーク。人間のデータを収集せずにRLHF手法を開発可能

    844-1直近 7 日のスター増減
← トピック一覧に戻る