reasoning
reasoning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31★ 1,245+2최근 7일 스타 변화
- #32★ 1,137+3최근 7일 스타 변화
- #33★ 1,122+2최근 7일 스타 변화
- #34★ 1,090+13최근 7일 스타 변화
- #35
멀티모달 사고의 연쇄(Multimodal Chain-of-Thought) 추론: 종합 조사
★ 1,025+2최근 7일 스타 변화 - #36
대형 언어 모델의 사고 łańcuch(chain-of-thought) 추론 관련 데이터 및 도구를 위한 중앙 집중형 오픈 리소스. Samwald 연구그룹 개발: https://samwald.info/
★ 1,015+0최근 7일 스타 변화 - #37
[ACL 2023] 언어 모델 프롬프팅을 활용한 추론에 관한 설문 조사
★ 1,007+1최근 7일 스타 변화 - #38
대규모 깊이 순환 언어 모델을 위한 사전 학습 및 추론 코드
★ 942+31최근 7일 스타 변화 - #39★ 928+4최근 7일 스타 변화
- #40
[ACL 2026 KnowFM] 에이전트 기반 딥 리서치 관련 유용한 리소스 모음
★ 861+6최근 7일 스타 변화 - #41
LLM이 자신의 작업에 대한 피드백을 생성하고 이를 사용하여 출력을 개선하며 이 과정을 반복적으로 수행
★ 820+0최근 7일 스타 변화 - #42★ 769+1최근 7일 스타 변화
- #43★ 741+7최근 7일 스타 변화
- #44★ 671+9최근 7일 스타 변화
- #45★ 669-1최근 7일 스타 변화
- #46★ 657+7최근 7일 스타 변화
- #47
파운데이션 모델의 추론 관련 최신 논문 및 벤치마크
★ 657+1최근 7일 스타 변화 - #48
Long Chain-of-Thought 추론의 최신 연구 동향
★ 647-1최근 7일 스타 변화 - #49
"Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight) 공식 코드베이스
★ 642+2최근 7일 스타 변화 - #50
2B 모델에서 멀티모달 '아하 모멘트(Aha Moment)' 탐색
★ 623+0최근 7일 스타 변화 - #51
EMNLP 논문 'DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning'의 코드 및 문서
★ 562+0최근 7일 스타 변화 - #52★ 551-1최근 7일 스타 변화
- #53
ICLR 2024 논문 'Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning' 공식 구현
★ 532-1최근 7일 스타 변화 - #54★ 518+2최근 7일 스타 변화
- #55★ 511+0최근 7일 스타 변화
- #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—최근 7일 스타 변화