pretraining
pretraining टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर pretraining के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और pretraining टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
PyTorch를 사용하여 처음부터 단계별로 ChatGPT와 유사한 LLM 구현하기
★ 1,04,229+219पिछले 7 दिनों में स्टार का बदलाव - #2
Llama चीनी समुदाय, नवीनतम Llama अध्ययन सामग्री का वास्तविक समय में संकलन, सर्वश्रेष्ठ चीनी Llama बड़े मॉडल ओपन-सोर्स इकोसिस्टम का निर्माण, पूरी तरह से ओपन-सोर्स और व्यावसायिक उपयोग के लिए उपलब्ध
★ 14,743+3पिछले 7 दिनों में स्टार का बदलाव - #3★ 4,465-1पिछले 7 दिनों में स्टार का बदलाव
- #4
OFA (ICML 2022) की आधिकारिक रिपॉजिटरी। पेपर: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework
★ 2,557+0पिछले 7 दिनों में स्टार का बदलाव - #5★ 2,539+0पिछले 7 दिनों में स्टार का बदलाव
- #6
HRM-Text, HRM आर्किटेक्चर पर आधारित 1B टेक्स्ट जनरेशन मॉडल है, जिसे टास्क कंप्लीशन और लेटेंट स्पेस रीज़निंग द्वारा मजबूत किया गया है।
★ 1,938+24पिछले 7 दिनों में स्टार का बदलाव - #7
Graph Neural Networks (GNN) पर प्रीट्रेनिंग और सेल्फ-सुपरवाइज्ड लर्निंग के बारे में शोध पत्र।
★ 1,728+0पिछले 7 दिनों में स्टार का बदलाव - #8
[ICLR'23 Spotlight🔥] किसी भी कन्वोल्यूशनल नेटवर्क पर पहला सफल BERT/MAE-शैली का प्री-ट्रेनिंग; "Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling" का Pytorch कार्यान्वयन।
★ 1,376+0पिछले 7 दिनों में स्टार का बदलाव - #9
GraphGen: ज्ञान-संचालित सिंथेटिक डेटा जनरेशन के साथ LLM के लिए सुपरवाइज्ड फाइन-ट्यूनिंग को बढ़ाना
★ 1,216+2पिछले 7 दिनों में स्टार का बदलाव - #10★ 1,159+3पिछले 7 दिनों में स्टार का बदलाव
- #11
बड़े पैमाने पर डेप्थ-रिकरेंट भाषा मॉडल के लिए प्रीट्रेनिंग और इन्फरेंस कोड।
★ 942+22पिछले 7 दिनों में स्टार का बदलाव - #12
【ICLR 2024🔥】 भाषा-आधारित सिमेंटिक एलाइनमेंट द्वारा वीडियो-लैंग्वेज प्रीट्रेनिंग को N-modality तक विस्तारित करना।
★ 885+0पिछले 7 दिनों में स्टार का बदलाव - #13
लार्ज मॉडल्स (LLMs/VLMs) के युग में रोबोटिक्स डोमेन से संबंधित 3D विजन पेपर्स की एक क्यूरेटेड सूची, जिसमें पेपर्स, कोड और संबंधित वेबसाइटें शामिल हैं।
★ 821+1पिछले 7 दिनों में स्टार का बदलाव - #14
MARS का आधिकारिक कार्यान्वयन: लार्ज मॉडल्स को ट्रेन करने के लिए वेरिएंस रिडक्शन की शक्ति का उपयोग।
★ 722+0पिछले 7 दिनों में स्टार का बदलाव - #15
पर्सनल प्रोजेक्ट: MPP-Qwen14B और MPP-Qwen-Next (Qwen-LM पर आधारित मल्टीमॉडल पाइपलाइन पैरेलल)। [वीडियो/इमेज/मल्टी-इमेज] {sft/conversations} का समर्थन करता है। अपनी कल्पना को सीमित न होने दें! RTX3090/4090 24GB पर अपना खुद का 8B/14B LLaVA-ट्रेनिंग जैसा MLLM ट्रेन करें।
★ 686+0पिछले 7 दिनों में स्टार का बदलाव - #16★ 664+1पिछले 7 दिनों में स्टार का बदलाव
- #17★ 629+2पिछले 7 दिनों में स्टार का बदलाव
- #18
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15पिछले 7 दिनों में स्टार का बदलाव - #19★ 502+0पिछले 7 दिनों में स्टार का बदलाव