reinforcement-learning-from-human-feedback
Repositori open source terpantau bertanda reinforcement-learning-from-human-feedback, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan reinforcement-learning-from-human-feedback di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda reinforcement-learning-from-human-feedback.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Kerangka kerja Agentic RL yang mudah digunakan, skalabel, dan berkinerja tinggi berbasis Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
★ 9.969+9Perubahan bintang dalam 7 hari terakhir - #2
Safe RLHF: Penyelarasan Nilai Terbatas melalui Safe Reinforcement Learning from Human Feedback
★ 1.613+1Perubahan bintang dalam 7 hari terakhir - #3
Kerangka kerja simulasi untuk RLHF dan alternatifnya. Kembangkan metode RLHF Anda tanpa mengumpulkan data manusia.
★ 844-1Perubahan bintang dalam 7 hari terakhir