Chuyển tới nội dung chính
buildradar
Đăng nhập

tatsu-lab/alpaca_farm

@tatsu-lab

Một khung mô phỏng cho RLHF và các phương pháp thay thế. Phát triển phương pháp RLHF của bạn mà không cần thu thập dữ liệu con người.

Sao
844
Fork
66
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
2 năm trước
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.