lucidrains/PaLM-rlhf-pytorch
@lucidrainsPaLM आर्किटेक्चर के ऊपर RLHF (Reinforcement Learning with Human Feedback) का कार्यान्वयन। मूल रूप से PaLM के साथ ChatGPT जैसा।
स्टार
7,866
फ़ोर्क
673
भाषा
Python
लाइसेंस
MIT
आख़िरी push
1 माह पहले
संबंधित intel (0)
अभी कोई संबंधित intel नहीं
यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।