メインコンテンツへスキップ
buildradar
Sign in
トピック · reasoning

reasoning

reasoning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

56 件のリポジトリ
  • Search-o1@RUC-NLPIR

    🔍 Search-o1: エージェント型検索拡張大規模推論モデル [EMNLP 2025]

    1,245+2直近 7 日のスター増減
  • DeepAgent@RUC-NLPIR

    [WWW‘26 Oral🔥] DeepAgent: スケーラブルなツールセットを備えた汎用推論エージェント

    1,137+3直近 7 日のスター増減
  • TTRL@PRIME-RL

    [NeurIPS 2025] TTRL: テスト時強化学習

    1,122+2直近 7 日のスター増減
  • SDPO@lasgroup

    自己蒸留による強化学習 (SDPO)

    1,092+15直近 7 日のスター増減
  • Awesome-MCoT@yaotingwangofficial

    マルチモーダル思考連鎖推論:包括的なサーベイ

    1,025+2直近 7 日のスター増減
  • ThoughtSource@OpenBioLink

    大規模言語モデルにおける思考連鎖(chain-of-thought)推論に関するデータとツールの中心的なオープンリソース。開発元:Samwald research group (https://samwald.info/)

    1,015+0直近 7 日のスター増減
  • [ACL 2023] 言語モデルプロンプトによる推論:サーベイ論文

    1,007+1直近 7 日のスター増減
  • 大規模な深度リカレント言語モデルのための事前学習および推論コード

    945+34直近 7 日のスター増減
  • tutor-gpt@plastic-labs

    心の理論(Theory-of-Mind)推論を活用したAI家庭教師

    928+4直近 7 日のスター増減
  • [ACL 2026 KnowFM] エージェント型ディープリサーチに関する厳選リソース集

    861+6直近 7 日のスター増減
  • self-refine@madaan

    LLMが自身の生成物に対するフィードバックを作成し、それを利用して出力を改善し、このプロセスを反復的に実行する仕組み

    820+0直近 7 日のスター増減
  • Nucleoid@NucleoidAI

    LLMのための論理言語 🌱🐋 ワールドモデルを構築 🌍

    769+1直近 7 日のスター増減
  • mathcode@math-ai-org

    MathCode:最先端の数理コーディングエージェント

    742+8直近 7 日のスター増減
  • golitex@litexlang

    Litex: 数学が自らを検証する言語。

    672+10直近 7 日のスター増減
  • oat@sail-sg

    🌾 OAT:強化学習や好みの学習などを含む、LLMオンラインアライメント向けの研究しやすいフレームワーク。

    669-1直近 7 日のスター増減
  • EBT@alexiglad

    Energy-Based Transformers 論文の PyTorch コード — 汎用的な推論とスケーラブルな学習

    658+8直近 7 日のスター増減
  • ✨✨基盤モデルの推論に関する最新の論文とベンチマーク

    657+1直近 7 日のスター増減
  • Long Chain-of-Thought 推論における最新の進展

    647-1直近 7 日のスター増減
  • RandOpt@sunrainyg

    「Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights」(ICML 2026 Spotlight)の公式コードベース

    643+3直近 7 日のスター増減
  • VisualThinker-R1-Zero@turningpoint-ai

    2B Modelにおけるマルチモーダルな「アハ体験」を探求

    623+0直近 7 日のスター増減
  • DeepPath@xwhan

    EMNLP論文「DeepPath: A Reinforcement Learning Method for Knowledge Graph Reasoning」のコードとドキュメント

    562+0直近 7 日のスター増減
  • TCS-NQT@ArkS0001
    551-2直近 7 日のスター増減
  • ICLR 2024 採択論文「Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning」の公式実装

    532-1直近 7 日のスター増減
  • QeRL@NVlabs

    [ICLR 2026] QeRLは単一のH100 GPUでの32B LLM向けRLを可能にします

    518+2直近 7 日のスター増減
  • Robust-R1@jqtangust

    [AAAI 2026 Oral] Robust-R1 の公式実装:ロバストな視覚理解のための劣化認識型推論

    511+0直近 7 日のスター増減
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501直近 7 日のスター増減
← トピック一覧に戻る