मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · reasoning

reasoning

reasoning टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

56 रिपॉजिटरी
  • Search-o1@RUC-NLPIR

    🔍 Search-o1: एजेंटिक सर्च-संवर्धित बड़े तर्क मॉडल [EMNLP 2025]

    1,245+2पिछले 7 दिनों में स्टार का बदलाव
  • DeepAgent@RUC-NLPIR

    [WWW‘26 Oral🔥] DeepAgent: स्केलेबल टूलसेट्स के साथ एक जनरल रीजनिंग एजेंट।

    1,137+3पिछले 7 दिनों में स्टार का बदलाव
  • TTRL@PRIME-RL

    [NeurIPS 2025] TTRL: टेस्ट-टाइम रीइन्फोर्समेंट लर्निंग।

    1,122+2पिछले 7 दिनों में स्टार का बदलाव
  • SDPO@lasgroup

    सेल्फ-डिस्टिलेशन (SDPO) के माध्यम से रीइन्फोर्समेंट लर्निंग

    1,090+13पिछले 7 दिनों में स्टार का बदलाव
  • Awesome-MCoT@yaotingwangofficial

    मल्टीमोडल चेन-ऑफ-थॉट रीजनिंग: एक व्यापक सर्वेक्षण

    1,025+2पिछले 7 दिनों में स्टार का बदलाव
  • ThoughtSource@OpenBioLink

    लार्ज लैंग्वेज मॉडल्स में चेन-ऑफ-थॉट रीजनिंग से संबंधित डेटा और टूल्स के लिए एक केंद्रीय, ओपन रिसोर्स। Samwald रिसर्च ग्रुप द्वारा विकसित: https://samwald.info/

    1,015+0पिछले 7 दिनों में स्टार का बदलाव
  • [ACL 2023] लैंग्वेज मॉडल प्रॉम्प्टिंग के साथ रीजनिंग: एक सर्वेक्षण

    1,007+1पिछले 7 दिनों में स्टार का बदलाव
  • बड़े पैमाने पर डेप्थ-रिकरेंट भाषा मॉडल के लिए प्रीट्रेनिंग और इन्फरेंस कोड।

    942+31पिछले 7 दिनों में स्टार का बदलाव
  • tutor-gpt@plastic-labs

    Theory-of-Mind रीजनिंग द्वारा संचालित AI ट्यूटर

    928+4पिछले 7 दिनों में स्टार का बदलाव
  • [ACL 2026 KnowFM] एजेंटिक डीप रिसर्च संसाधनों का संग्रह

    861+6पिछले 7 दिनों में स्टार का बदलाव
  • self-refine@madaan

    LLMs अपने काम पर फीडबैक उत्पन्न कर सकते हैं, आउटपुट को बेहतर बनाने के लिए इसका उपयोग कर सकते हैं, और इस प्रक्रिया को बार-बार दोहरा सकते हैं।

    820+0पिछले 7 दिनों में स्टार का बदलाव
  • Nucleoid@NucleoidAI

    LLMs के लिए लॉजिक लैंग्वेज 🌱🐋 वर्ल्ड मॉडल बनाएं 🌍

    769+1पिछले 7 दिनों में स्टार का बदलाव
  • mathcode@math-ai-org

    MathCode: एक फ़्रंटियर मैथमेटिकल कोडिंग एजेंट

    741+7पिछले 7 दिनों में स्टार का बदलाव
  • golitex@litexlang

    Litex: वह भाषा जहाँ गणित स्वयं को सत्यापित करता है।

    671+9पिछले 7 दिनों में स्टार का बदलाव
  • oat@sail-sg

    🌾 OAT: LLM ऑनलाइन अलाइनमेंट के लिए एक शोध-अनुकूल फ़्रेमवर्क, जिसमें रीइन्फोर्समेंट लर्निंग, प्रेफरेंस लर्निंग आदि शामिल हैं।

    669-1पिछले 7 दिनों में स्टार का बदलाव
  • फाउंडेशन मॉडल्स के साथ रीजनिंग में नवीनतम पेपर्स और बेंचमार्क।

    657+1पिछले 7 दिनों में स्टार का बदलाव
  • EBT@alexiglad

    Energy-Based Transformers पेपर के लिए PyTorch कोड -- सामान्यीकृत तर्क और स्केलेबल लर्निंग

    657+7पिछले 7 दिनों में स्टार का बदलाव
  • Long Chain-of-Thought रीजनिंग पर नवीनतम प्रगति।

    647-1पिछले 7 दिनों में स्टार का बदलाव
  • RandOpt@sunrainyg

    "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 स्पॉटलाइट) के लिए आधिकारिक कोडबेस।

    642+2पिछले 7 दिनों में स्टार का बदलाव
  • VisualThinker-R1-Zero@turningpoint-ai

    2B Model पर मल्टीमॉडल “आहा मोमेंट” का पता लगाएं

    623+0पिछले 7 दिनों में स्टार का बदलाव
  • DeepPath@xwhan

    EMNLP पेपर "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning" के लिए कोड और दस्तावेज़।

    562+0पिछले 7 दिनों में स्टार का बदलाव
  • TCS-NQT@ArkS0001
    552-1पिछले 7 दिनों में स्टार का बदलाव
  • ICLR 2024 पेपर का आधिकारिक कार्यान्वयन: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"

    532-1पिछले 7 दिनों में स्टार का बदलाव
  • QeRL@NVlabs

    [ICLR 2026] QeRL एक सिंगल H100 GPU पर 32B LLM के लिए RL सक्षम करता है।

    518+2पिछले 7 दिनों में स्टार का बदलाव
  • Robust-R1@jqtangust

    🔥🔥🔥[AAAI 2026 Oral] Robust-R1 का आधिकारिक कार्यान्वयन: मजबूत विज़ुअल समझ के लिए डिग्रेडेशन-अवेयर रीजनिंग

    511+0पिछले 7 दिनों में स्टार का बदलाव
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस