मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · post-training

post-training

post-training टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
12
कुल स्टार
14,796
औसत स्टार
1,233
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर post-training के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और post-training टैग वाली रिपॉजिटरी।

  • agent-apprenticeship@ray-r-ren

    एक जीवंत पारिस्थितिकी तंत्र जहाँ AI एजेंट वर्कफ़्लो लूप के माध्यम से कार्य पूरे करते हैं, पुनरावृत्ति निष्पादन के माध्यम से सुधार करते हैं, मेंटर एजेंटों या लूप में मनुष्यों द्वारा मूल्यांकित किए जाते हैं, और भविष्य के एजेंटों को बेहतर बनाने के लिए पूर्ण किए गए कार्य को पुन: प्रयोज्य कार्य अनुभव और डेटा में बदलते हैं।

    1,334
  • FastVideo@hao-ai-lab

    त्वरित वीडियो जेनरेशन के लिए एक एकीकृत अनुमान और पोस्ट-ट्रेनिंग फ्रेमवर्क

    4,300+150पिछले 7 दिनों में स्टार का बदलाव
  • शानदार रीज़निंग LLM ट्यूटोरियल/सर्वेक्षण/गाइड

    2,533+6पिछले 7 दिनों में स्टार का बदलाव
  • EmoLLM@SmartFlowAI

    मानसिक स्वास्थ्य लार्ज लैंग्वेज मॉडल (LLM x Mental Health), प्री- & पोस्ट-ट्रेनिंग & डेटासेट & मूल्यांकन & डिप्लॉय & RAG, InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM सीरीज़ मॉडल के साथ

    1,781+1पिछले 7 दिनों में स्टार का बदलाव
  • agent-apprenticeship@ray-r-ren

    एक जीवंत पारिस्थितिकी तंत्र जहाँ AI एजेंट वर्कफ़्लो लूप के माध्यम से कार्य पूरे करते हैं, पुनरावृत्ति निष्पादन के माध्यम से सुधार करते हैं, मेंटर एजेंटों या लूप में मनुष्यों द्वारा मूल्यांकित किए जाते हैं, और भविष्य के एजेंटों को बेहतर बनाने के लिए पूर्ण किए गए कार्य को पुन: प्रयोज्य कार्य अनुभव और डेटा में बदलते हैं।

    1,334+0पिछले 7 दिनों में स्टार का बदलाव
  • लार्ज लैंग्वेज मॉडल्स के ऑन-पॉलिसी डिस्टिलेशन (OPD) के लिए पेपर्स, तकनीकी रिपोर्ट्स, फ्रेमवर्क्स और टूल्स का एक क्यूरेटेड संग्रह

    786+26पिछले 7 दिनों में स्टार का बदलाव
  • RandOpt@sunrainyg

    "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 स्पॉटलाइट) के लिए आधिकारिक कोडबेस।

    642+2पिछले 7 दिनों में स्टार का बदलाव
  • VisualThinker-R1-Zero@turningpoint-ai

    2B Model पर मल्टीमॉडल “आहा मोमेंट” का पता लगाएं

    623+0पिछले 7 दिनों में स्टार का बदलाव
  • LightReasoner@HKUDS

    [ACL 2026 Oral] "LightReasoner: क्या छोटे भाषा मॉडल बड़े भाषा मॉडलों को तर्क करना सिखा सकते हैं?"

    610+2पिछले 7 दिनों में स्टार का बदलाव
  • Relax@redai-studio

    बड़े पैमाने पर ऑम्नी-मोडल पोस्ट-ट्रेनिंग के लिए एक एसिंक्रोनस रिइंफोर्समेंट लर्निंग इंजन।

    591+10पिछले 7 दिनों में स्टार का बदलाव
  • PostTrainBench@aisa-group

    यह मापना कि Claude Code या Codex CLI जैसे CLI एजेंट 10 घंटों में एक H100 GPU पर बेस LLMs को कितनी अच्छी तरह पोस्ट-ट्रेन कर सकते हैं

    548+9पिछले 7 दिनों में स्टार का बदलाव
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 स्पॉटलाइट] LLM पोस्ट-ट्रेनिंग सूट — जिसमें ReasonFlux, ReasonFlux-PRM, और ReasonFlux-Coder शामिल हैं।

    542+0पिछले 7 दिनों में स्टार का बदलाव
  • Human3R@fanegg

    [ICLR 2026] 4D मानव-दृश्य पुनर्निर्माण के लिए एक एकीकृत मॉडल।

    533+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस