主題 · reasoning
reasoning
標記 reasoning 主題、收錄中的開源專案,依星數排序。
共 56 個專案
- #31★ 1,245+4近 7 天星數變化
- #32★ 1,137+4近 7 天星數變化
- #33★ 1,121+1近 7 天星數變化
- #34★ 1,088+7近 7 天星數變化
- #35
多模態思維鏈推理:綜合調查
★ 1,025+1近 7 天星數變化 - #36
大型語言模型中思維鏈推理相關資料與工具的中央開源資源。由 Samwald 研究群開發:https://samwald.info/
★ 1,015+0近 7 天星數變化 - #37
[ACL 2023] 語言模型提示詞推理綜述
★ 1,007+1近 7 天星數變化 - #38
大規模深度遞歸語言模型的預訓練與推論程式碼
★ 933+5近 7 天星數變化 - #39★ 928+3近 7 天星數變化
- #40
[ACL 2026 KnowFM] 實用的 Agentic Deep Research 資源整理
★ 861+3近 7 天星數變化 - #41
LLM 可以針對自己的工作產生回饋,利用回饋改進輸出,並以迭代方式重複此過程。
★ 820+2近 7 天星數變化 - #42★ 769+1近 7 天星數變化
- #43★ 740+3近 7 天星數變化
- #44★ 672+7近 7 天星數變化
- #45★ 669-1近 7 天星數變化
- #46
✨✨基礎模型推理最新論文與基準測試
★ 656+1近 7 天星數變化 - #47★ 655+5近 7 天星數變化
- #48
長思考鏈推理的最新進展
★ 647+0近 7 天星數變化 - #49
「Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights」(ICML 2026 Spotlight)官方程式碼庫。
★ 642+0近 7 天星數變化 - #50
探索 2B 模型上的多模態「Aha 時刻」
★ 623+0近 7 天星數變化 - #51
EMNLP 論文「DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning」的程式碼與文件
★ 562+0近 7 天星數變化 - #52★ 552+0近 7 天星數變化
- #53
ICLR 2024 論文「Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning」官方實作。
★ 532-1近 7 天星數變化 - #54★ 518+2近 7 天星數變化
- #55★ 511+0近 7 天星數變化
- #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—近 7 天星數變化