Lompat ke konten utama
buildradar
Sign in
Topik · reinforcement-learning-from-human-feedback

reinforcement-learning-from-human-feedback

Repositori open source terpantau bertanda reinforcement-learning-from-human-feedback, diurutkan berdasarkan bintang.

Repositori
3
Total bintang
12.426
Rata-rata bintang
4.142
Porsi
0,00%

Topik yang sering muncul berdampingan dengan reinforcement-learning-from-human-feedback di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda reinforcement-learning-from-human-feedback.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • OpenRLHF@OpenRLHF

    Kerangka kerja Agentic RL yang mudah digunakan, skalabel, dan berkinerja tinggi berbasis Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9.969+9Perubahan bintang dalam 7 hari terakhir
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Penyelarasan Nilai Terbatas melalui Safe Reinforcement Learning from Human Feedback

    1.613+1Perubahan bintang dalam 7 hari terakhir
  • alpaca_farm@tatsu-lab

    Kerangka kerja simulasi untuk RLHF dan alternatifnya. Kembangkan metode RLHF Anda tanpa mengumpulkan data manusia.

    844-1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik