reasoning
reasoning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
- #31★ 1,245+2直近 7 日のスター増減
- #32★ 1,137+3直近 7 日のスター増減
- #33★ 1,122+2直近 7 日のスター増減
- #34★ 1,092+15直近 7 日のスター増減
- #35
マルチモーダル思考連鎖推論:包括的なサーベイ
★ 1,025+2直近 7 日のスター増減 - #36
大規模言語モデルにおける思考連鎖(chain-of-thought)推論に関するデータとツールの中心的なオープンリソース。開発元:Samwald research group (https://samwald.info/)
★ 1,015+0直近 7 日のスター増減 - #37
[ACL 2023] 言語モデルプロンプトによる推論:サーベイ論文
★ 1,007+1直近 7 日のスター増減 - #38
大規模な深度リカレント言語モデルのための事前学習および推論コード
★ 945+34直近 7 日のスター増減 - #39★ 928+4直近 7 日のスター増減
- #40
[ACL 2026 KnowFM] エージェント型ディープリサーチに関する厳選リソース集
★ 861+6直近 7 日のスター増減 - #41
LLMが自身の生成物に対するフィードバックを作成し、それを利用して出力を改善し、このプロセスを反復的に実行する仕組み
★ 820+0直近 7 日のスター増減 - #42★ 769+1直近 7 日のスター増減
- #43★ 742+8直近 7 日のスター増減
- #44★ 672+10直近 7 日のスター増減
- #45★ 669-1直近 7 日のスター増減
- #46★ 658+8直近 7 日のスター増減
- #47
✨✨基盤モデルの推論に関する最新の論文とベンチマーク
★ 657+1直近 7 日のスター増減 - #48
Long Chain-of-Thought 推論における最新の進展
★ 647-1直近 7 日のスター増減 - #49
「Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights」(ICML 2026 Spotlight)の公式コードベース
★ 643+3直近 7 日のスター増減 - #50
2B Modelにおけるマルチモーダルな「アハ体験」を探求
★ 623+0直近 7 日のスター増減 - #51
EMNLP論文「DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning」のコードとドキュメント
★ 562+0直近 7 日のスター増減 - #52★ 551-2直近 7 日のスター増減
- #53
ICLR 2024 採択論文「Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning」の公式実装
★ 532-1直近 7 日のスター増減 - #54★ 518+2直近 7 日のスター増減
- #55★ 511+0直近 7 日のスター増減
- #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—直近 7 日のスター増減