reasoning
Erfasste Open-Source-Repos mit dem Tag reasoning, sortiert nach Sternen.
- #31
🔍 Search-o1: Agentenbasierte, durch Suche erweiterte große Reasoning-Modelle [EMNLP 2025]
★ 1.245+2Sterne-Änderung der letzten 7 Tage - #32
[WWW‘26 Oral🔥] DeepAgent: Ein allgemeiner Reasoning-Agent mit skalierbaren Werkzeugsätzen
★ 1.137+3Sterne-Änderung der letzten 7 Tage - #33★ 1.121+1Sterne-Änderung der letzten 7 Tage
- #34★ 1.088+11Sterne-Änderung der letzten 7 Tage
- #35
Multimodal Chain-of-Thought Reasoning: Eine umfassende Übersicht
★ 1.025+2Sterne-Änderung der letzten 7 Tage - #36
Eine zentrale, offene Ressource für Daten und Tools rund um Chain-of-Thought-Reasoning in großen Sprachmodellen. Entwickelt von der Samwald Research Group: https://samwald.info/
★ 1.015+0Sterne-Änderung der letzten 7 Tage - #37
[ACL 2023] Reasoning with Language Model Prompting: A Survey
★ 1.007+1Sterne-Änderung der letzten 7 Tage - #38
Pretraining- und Inferenz-Code für ein großflächiges, tiefenrekurrentes Sprachmodell
★ 933+22Sterne-Änderung der letzten 7 Tage - #39★ 928+4Sterne-Änderung der letzten 7 Tage
- #40
[ACL 2026 KnowFM] Großartige Ressourcen für agentische Deep Research
★ 861+6Sterne-Änderung der letzten 7 Tage - #41
LLMs können Feedback zu ihrer Arbeit generieren, dieses zur Verbesserung der Ausgabe nutzen und diesen Prozess iterativ wiederholen.
★ 820+0Sterne-Änderung der letzten 7 Tage - #42★ 769+1Sterne-Änderung der letzten 7 Tage
- #43★ 740+6Sterne-Änderung der letzten 7 Tage
- #44★ 672+10Sterne-Änderung der letzten 7 Tage
- #45
OAT: Ein forschungsfreundliches Framework für das Online-Alignment von LLMs, einschließlich Reinforcement Learning, Präferenzlernen usw.
★ 669-1Sterne-Änderung der letzten 7 Tage - #46
✨✨ Neueste Papers und Benchmarks zum Reasoning mit Foundation Models
★ 656+0Sterne-Änderung der letzten 7 Tage - #47
PyTorch-Code für das Paper zu Energy-Based Transformers -- verallgemeinerbare Logik und skalierbares Lernen
★ 655+5Sterne-Änderung der letzten 7 Tage - #48
Neueste Fortschritte beim Long Chain-of-Thought Reasoning
★ 647-1Sterne-Änderung der letzten 7 Tage - #49
Offizielle Codebasis für „Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights“ (ICML 2026 Spotlight)
★ 642+2Sterne-Änderung der letzten 7 Tage - #50
Erkunden Sie den multimodalen „Aha-Moment“ am 2B-Modell.
★ 623+0Sterne-Änderung der letzten 7 Tage - #51
Code und Dokumentation für das EMNLP-Paper DeepPath: Eine Reinforcement-Learning-Methode für Knowledge-Graph-Reasoning
★ 562+0Sterne-Änderung der letzten 7 Tage - #52★ 552-1Sterne-Änderung der letzten 7 Tage
- #53
Offizielle Implementierung des ICLR 2024-Papers: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning"
★ 532-1Sterne-Änderung der letzten 7 Tage - #54★ 518+2Sterne-Änderung der letzten 7 Tage
- #55
Offizielle Implementierung von Robust-R1: Degradationsbewusstes Schlussfolgern für robustes visuelles Verständnis [AAAI 2026 Oral]
★ 511+0Sterne-Änderung der letzten 7 Tage - #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—Sterne-Änderung der letzten 7 Tage