Chuyển tới nội dung chính
buildradar
Đăng nhập

lucidrains/PaLM-rlhf-pytorch

@lucidrains

Triển khai RLHF (Học tăng cường từ phản hồi của con người) trên kiến trúc PaLM. Về cơ bản là ChatGPT nhưng sử dụng PaLM

Sao
7.866
Fork
673
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
2 tháng trước
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.