मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

lucidrains/PaLM-rlhf-pytorch

@lucidrains

PaLM आर्किटेक्चर के ऊपर RLHF (Reinforcement Learning with Human Feedback) का कार्यान्वयन। मूल रूप से PaLM के साथ ChatGPT जैसा।

स्टार
7,866
फ़ोर्क
673
भाषा
Python
लाइसेंस
MIT
आख़िरी push
1 माह पहले
Pythondeep-learningartificial-intelligenceattention-mechanismsreinforcement-learningtransformershuman-feedback

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।