Chuyển tới nội dung chính
buildradar
Đăng nhập

opendilab/awesome-RLHF

@opendilab

Danh sách tài nguyên học tăng cường có phản hồi từ con người được tuyển chọn (cập nhật liên tục)

Sao
4.424
Fork
260
Ngôn ngữ
Giấy phép
Apache-2.0
Push gần nhất
4 tháng trước
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.