Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · reasoning

reasoning

Các kho mã nguồn mở đang theo dõi được gắn thẻ reasoning, sắp xếp theo số sao.

56 kho mã
  • Search-o1@RUC-NLPIR

    🔍 Search-o1: Mô hình suy luận lớn được tăng cường tìm kiếm bằng Agent [EMNLP 2025]

    1.245+2Thay đổi số sao trong 7 ngày qua
  • DeepAgent@RUC-NLPIR

    [WWW‘26 Oral🔥] DeepAgent: Một Agent suy luận tổng quát với tập công cụ có khả năng mở rộng

    1.137+3Thay đổi số sao trong 7 ngày qua
  • TTRL@PRIME-RL

    [NeurIPS 2025] TTRL: Học tăng cường trong thời gian thử nghiệm

    1.122+1Thay đổi số sao trong 7 ngày qua
  • SDPO@lasgroup

    Học tăng cường thông qua tự chưng cất (SDPO)

    1.090+11Thay đổi số sao trong 7 ngày qua
  • Awesome-MCoT@yaotingwangofficial

    Lập luận chuỗi suy nghĩ đa phương thức: Một khảo sát toàn diện

    1.025+2Thay đổi số sao trong 7 ngày qua
  • ThoughtSource@OpenBioLink

    Một tài nguyên mở tập trung cho dữ liệu và công cụ liên quan đến lập luận chuỗi suy nghĩ trong các mô hình ngôn ngữ lớn. Phát triển bởi nhóm nghiên cứu Samwald: https://samwald.info/

    1.015+0Thay đổi số sao trong 7 ngày qua
  • [ACL 2023] Suy luận với kỹ thuật Prompting cho mô hình ngôn ngữ: Một bài khảo sát

    1.007+1Thay đổi số sao trong 7 ngày qua
  • Mã huấn luyện trước và suy luận cho mô hình ngôn ngữ hồi tiếp chiều sâu quy mô lớn

    942+22Thay đổi số sao trong 7 ngày qua
  • tutor-gpt@plastic-labs

    Gia sư AI được hỗ trợ bởi lập luận Lý thuyết tâm trí (Theory-of-Mind)

    928+4Thay đổi số sao trong 7 ngày qua
  • [ACL 2026 KnowFM] Tài nguyên tuyệt vời về nghiên cứu sâu có tác nhân (Agentic Deep Research)

    861+6Thay đổi số sao trong 7 ngày qua
  • self-refine@madaan

    Các LLM có thể tạo phản hồi về công việc của chính chúng, sử dụng phản hồi đó để cải thiện kết quả đầu ra và lặp lại quy trình này một cách tuần hoàn.

    820+0Thay đổi số sao trong 7 ngày qua
  • Nucleoid@NucleoidAI

    Ngôn ngữ logic cho LLM 🌱🐋 Xây dựng mô hình thế giới 🌍

    769+1Thay đổi số sao trong 7 ngày qua
  • mathcode@math-ai-org

    MathCode: Một tác nhân lập trình toán học tiên phong

    741+6Thay đổi số sao trong 7 ngày qua
  • golitex@litexlang

    Litex: Ngôn ngữ nơi toán học tự xác minh chính nó.

    671+10Thay đổi số sao trong 7 ngày qua
  • oat@sail-sg

    🌾 OAT: Khung nghiên cứu thân thiện cho việc căn chỉnh trực tuyến LLM, bao gồm học tăng cường, học ưu tiên, v.v.

    669-1Thay đổi số sao trong 7 ngày qua
  • EBT@alexiglad

    Mã nguồn PyTorch cho bài báo Energy-Based Transformers -- suy luận có khả năng khái quát hóa và học tập có thể mở rộng.

    657+5Thay đổi số sao trong 7 ngày qua
  • Các bài báo và điểm chuẩn mới nhất về lập luận với các mô hình nền tảng.

    657+0Thay đổi số sao trong 7 ngày qua
  • Những tiến bộ mới nhất về suy luận chuỗi tư duy dài (Long Chain-of-Thought).

    647-1Thay đổi số sao trong 7 ngày qua
  • RandOpt@sunrainyg

    Mã nguồn chính thức cho Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights (ICML 2026 Spotlight)

    642+2Thay đổi số sao trong 7 ngày qua
  • VisualThinker-R1-Zero@turningpoint-ai

    Khám phá "Khoảnh khắc Aha" đa phương thức trên mô hình 2B

    623+0Thay đổi số sao trong 7 ngày qua
  • DeepPath@xwhan

    Mã nguồn và tài liệu cho bài báo EMNLP "DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning"

    562+0Thay đổi số sao trong 7 ngày qua
  • TCS-NQT@ArkS0001
    552-1Thay đổi số sao trong 7 ngày qua
  • Triển khai chính thức cho bài báo ICLR 2024: "Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning".

    532-1Thay đổi số sao trong 7 ngày qua
  • QeRL@NVlabs

    [ICLR 2026] QeRL cho phép RL đối với các LLM 32B trên một GPU H100 duy nhất.

    518+2Thay đổi số sao trong 7 ngày qua
  • Robust-R1@jqtangust

    🔥🔥🔥 [AAAI 2026 Oral] Triển khai chính thức của Robust-R1: Suy luận nhận thức suy giảm để hiểu hình ảnh mạnh mẽ

    511+0Thay đổi số sao trong 7 ngày qua
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề