reasoning
reasoning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
- #31★ 1,245+2पिछले 7 दिनों में स्टार का बदलाव
- #32★ 1,137+3पिछले 7 दिनों में स्टार का बदलाव
- #33★ 1,122+2पिछले 7 दिनों में स्टार का बदलाव
- #34★ 1,090+13पिछले 7 दिनों में स्टार का बदलाव
- #35
मल्टीमोडल चेन-ऑफ-थॉट रीजनिंग: एक व्यापक सर्वेक्षण
★ 1,025+2पिछले 7 दिनों में स्टार का बदलाव - #36
लार्ज लैंग्वेज मॉडल्स में चेन-ऑफ-थॉट रीजनिंग से संबंधित डेटा और टूल्स के लिए एक केंद्रीय, ओपन रिसोर्स। Samwald रिसर्च ग्रुप द्वारा विकसित: https://samwald.info/
★ 1,015+0पिछले 7 दिनों में स्टार का बदलाव - #37
[ACL 2023] लैंग्वेज मॉडल प्रॉम्प्टिंग के साथ रीजनिंग: एक सर्वेक्षण
★ 1,007+1पिछले 7 दिनों में स्टार का बदलाव - #38
बड़े पैमाने पर डेप्थ-रिकरेंट भाषा मॉडल के लिए प्रीट्रेनिंग और इन्फरेंस कोड।
★ 942+31पिछले 7 दिनों में स्टार का बदलाव - #39★ 928+4पिछले 7 दिनों में स्टार का बदलाव
- #40
[ACL 2026 KnowFM] एजेंटिक डीप रिसर्च संसाधनों का संग्रह
★ 861+6पिछले 7 दिनों में स्टार का बदलाव - #41
LLMs अपने काम पर फीडबैक उत्पन्न कर सकते हैं, आउटपुट को बेहतर बनाने के लिए इसका उपयोग कर सकते हैं, और इस प्रक्रिया को बार-बार दोहरा सकते हैं।
★ 820+0पिछले 7 दिनों में स्टार का बदलाव - #42★ 769+1पिछले 7 दिनों में स्टार का बदलाव
- #43★ 741+7पिछले 7 दिनों में स्टार का बदलाव
- #44★ 671+9पिछले 7 दिनों में स्टार का बदलाव
- #45
🌾 OAT: LLM ऑनलाइन अलाइनमेंट के लिए एक शोध-अनुकूल फ़्रेमवर्क, जिसमें रीइन्फोर्समेंट लर्निंग, प्रेफरेंस लर्निंग आदि शामिल हैं।
★ 669-1पिछले 7 दिनों में स्टार का बदलाव - #46
फाउंडेशन मॉडल्स के साथ रीजनिंग में नवीनतम पेपर्स और बेंचमार्क।
★ 657+1पिछले 7 दिनों में स्टार का बदलाव - #47
Energy-Based Transformers पेपर के लिए PyTorch कोड -- सामान्यीकृत तर्क और स्केलेबल लर्निंग
★ 657+7पिछले 7 दिनों में स्टार का बदलाव - #48
Long Chain-of-Thought रीजनिंग पर नवीनतम प्रगति।
★ 647-1पिछले 7 दिनों में स्टार का बदलाव - #49
"Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 स्पॉटलाइट) के लिए आधिकारिक कोडबेस।
★ 642+2पिछले 7 दिनों में स्टार का बदलाव - #50
2B Model पर मल्टीमॉडल “आहा मोमेंट” का पता लगाएं
★ 623+0पिछले 7 दिनों में स्टार का बदलाव - #51
EMNLP पेपर "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning" के लिए कोड और दस्तावेज़।
★ 562+0पिछले 7 दिनों में स्टार का बदलाव - #52★ 552-1पिछले 7 दिनों में स्टार का बदलाव
- #53
ICLR 2024 पेपर का आधिकारिक कार्यान्वयन: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"
★ 532-1पिछले 7 दिनों में स्टार का बदलाव - #54★ 518+2पिछले 7 दिनों में स्टार का बदलाव
- #55
🔥🔥🔥[AAAI 2026 Oral] Robust-R1 का आधिकारिक कार्यान्वयन: मजबूत विज़ुअल समझ के लिए डिग्रेडेशन-अवेयर रीजनिंग
★ 511+0पिछले 7 दिनों में स्टार का बदलाव - #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—पिछले 7 दिनों में स्टार का बदलाव