主题 · reasoning
reasoning
标记 reasoning 主题、收录中的开源项目,按星标数排序。
共 56 个项目
- #31★ 1,245+2近 7 天星标变化
- #32★ 1,137+3近 7 天星标变化
- #33★ 1,123+2近 7 天星标变化
- #34★ 1,093+15近 7 天星标变化
- #35
多模态思维链推理:综合调查
★ 1,025+2近 7 天星标变化 - #36
大型语言模型中思维链推理相关数据与工具的中央开源资源。由 Samwald 研究群开发:https://samwald.info/
★ 1,015+0近 7 天星标变化 - #37
[ACL 2023] 语言模型提示词推理综述
★ 1,007+1近 7 天星标变化 - #38
大规模深度递归语言模型的预训练与推理代码
★ 949+34近 7 天星标变化 - #39★ 929+4近 7 天星标变化
- #40
[ACL 2026 KnowFM] 实用的 Agentic Deep Research 资源整理
★ 861+6近 7 天星标变化 - #41
LLM 可以针对自己的工作生成反馈,利用反馈改进输出,并以迭代方式重复此过程。
★ 820+0近 7 天星标变化 - #42★ 769+1近 7 天星标变化
- #43★ 742+8近 7 天星标变化
- #44★ 672+10近 7 天星标变化
- #45★ 669-1近 7 天星标变化
- #46★ 659+8近 7 天星标变化
- #47
✨✨基础模型推理最新论文与基准测试
★ 657+1近 7 天星标变化 - #48
长思维链推理的最新进展
★ 647-1近 7 天星标变化 - #49
“Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights”(ICML 2026 Spotlight)官方代码库。
★ 644+3近 7 天星标变化 - #50
探索 2B 模型上的多模态“Aha 时刻”
★ 623+0近 7 天星标变化 - #51
EMNLP 论文“DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning”的代码与文档
★ 562+0近 7 天星标变化 - #52★ 553-2近 7 天星标变化
- #53
ICLR 2024 论文“Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning”官方实现。
★ 532-1近 7 天星标变化 - #54★ 518+2近 7 天星标变化
- #55★ 511+0近 7 天星标变化
- #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 502—近 7 天星标变化