Chuyển tới nội dung chính
buildradar
Đăng nhập

natolambert/rlhf-book

@natolambert

Sách giáo khoa về học tăng cường từ phản hồi của con người (RLHF)

Sao
2.357
Fork
258
Ngôn ngữ
Python
Giấy phép
NOASSERTION
Push gần nhất
1 tuần trước
Pythonaialignmentrlhf

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.