reasoning
Các kho mã nguồn mở đang theo dõi được gắn thẻ reasoning, sắp xếp theo số sao.
- #31
🔍 Search-o1: Mô hình suy luận lớn được tăng cường tìm kiếm bằng Agent [EMNLP 2025]
★ 1.245+2Thay đổi số sao trong 7 ngày qua - #32
[WWW‘26 Oral🔥] DeepAgent: Một Agent suy luận tổng quát với tập công cụ có khả năng mở rộng
★ 1.137+3Thay đổi số sao trong 7 ngày qua - #33★ 1.122+1Thay đổi số sao trong 7 ngày qua
- #34★ 1.090+11Thay đổi số sao trong 7 ngày qua
- #35
Lập luận chuỗi suy nghĩ đa phương thức: Một khảo sát toàn diện
★ 1.025+2Thay đổi số sao trong 7 ngày qua - #36
Một tài nguyên mở tập trung cho dữ liệu và công cụ liên quan đến lập luận chuỗi suy nghĩ trong các mô hình ngôn ngữ lớn. Phát triển bởi nhóm nghiên cứu Samwald: https://samwald.info/
★ 1.015+0Thay đổi số sao trong 7 ngày qua - #37
[ACL 2023] Suy luận với kỹ thuật Prompting cho mô hình ngôn ngữ: Một bài khảo sát
★ 1.007+1Thay đổi số sao trong 7 ngày qua - #38
Mã huấn luyện trước và suy luận cho mô hình ngôn ngữ hồi tiếp chiều sâu quy mô lớn
★ 942+22Thay đổi số sao trong 7 ngày qua - #39★ 928+4Thay đổi số sao trong 7 ngày qua
- #40
[ACL 2026 KnowFM] Tài nguyên tuyệt vời về nghiên cứu sâu có tác nhân (Agentic Deep Research)
★ 861+6Thay đổi số sao trong 7 ngày qua - #41
Các LLM có thể tạo phản hồi về công việc của chính chúng, sử dụng phản hồi đó để cải thiện kết quả đầu ra và lặp lại quy trình này một cách tuần hoàn.
★ 820+0Thay đổi số sao trong 7 ngày qua - #42★ 769+1Thay đổi số sao trong 7 ngày qua
- #43★ 741+6Thay đổi số sao trong 7 ngày qua
- #44★ 671+10Thay đổi số sao trong 7 ngày qua
- #45
🌾 OAT: Khung nghiên cứu thân thiện cho việc căn chỉnh trực tuyến LLM, bao gồm học tăng cường, học ưu tiên, v.v.
★ 669-1Thay đổi số sao trong 7 ngày qua - #46
Mã nguồn PyTorch cho bài báo Energy-Based Transformers -- suy luận có khả năng khái quát hóa và học tập có thể mở rộng.
★ 657+5Thay đổi số sao trong 7 ngày qua - #47
Các bài báo và điểm chuẩn mới nhất về lập luận với các mô hình nền tảng.
★ 657+0Thay đổi số sao trong 7 ngày qua - #48
Những tiến bộ mới nhất về suy luận chuỗi tư duy dài (Long Chain-of-Thought).
★ 647-1Thay đổi số sao trong 7 ngày qua - #49
Mã nguồn chính thức cho Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights (ICML 2026 Spotlight)
★ 642+2Thay đổi số sao trong 7 ngày qua - #50
Khám phá "Khoảnh khắc Aha" đa phương thức trên mô hình 2B
★ 623+0Thay đổi số sao trong 7 ngày qua - #51
Mã nguồn và tài liệu cho bài báo EMNLP "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning"
★ 562+0Thay đổi số sao trong 7 ngày qua - #52★ 552-1Thay đổi số sao trong 7 ngày qua
- #53
Triển khai chính thức cho bài báo ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning".
★ 532-1Thay đổi số sao trong 7 ngày qua - #54★ 518+2Thay đổi số sao trong 7 ngày qua
- #55
🔥🔥🔥 [AAAI 2026 Oral] Triển khai chính thức của Robust-R1: Suy luận nhận thức suy giảm để hiểu hình ảnh mạnh mẽ
★ 511+0Thay đổi số sao trong 7 ngày qua - #56
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—Thay đổi số sao trong 7 ngày qua