メインコンテンツへスキップ
buildradar
Sign in
トピック · post-training

post-training

post-training がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
12
総スター数
14,614
平均スター数
1,218
シェア
0.00%

post-training と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、post-training がタグ付けされたリポジトリ。

  • agent-apprenticeship@ray-r-ren

    AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。

    1,333
  • FastVideo@hao-ai-lab

    高速化されたビデオ生成のための統一された推論およびポストトレーニングフレームワーク。

    4,150+128直近 7 日のスター増減
  • 推論特化型 LLM に関する優れたチュートリアル、サーベイ、ガイドのまとめ

    2,527+4直近 7 日のスター増減
  • EmoLLM@SmartFlowAI

    メンタルヘルス向け大規模言語モデル (LLM x Mental Health)。事前学習・事後学習、データセット、評価、デプロイ、RAGに対応し、InternLM、Qwen、Baichuan、DeepSeek、Mixtral、Llama、GLMシリーズのモデルをサポート

    1,781+3直近 7 日のスター増減
  • agent-apprenticeship@ray-r-ren

    AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。

    1,333-3直近 7 日のスター増減
  • 大規模言語モデルのオンポリシー蒸留(OPD)に関する論文、テクニカルレポート、フレームワーク、ツールの厳選コレクション。

    766+29直近 7 日のスター増減
  • RandOpt@sunrainyg

    「Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights」(ICML 2026 Spotlight)の公式コードベース

    640+0直近 7 日のスター増減
  • VisualThinker-R1-Zero@turningpoint-ai

    2B Modelにおけるマルチモーダルな「アハ体験」を探求

    623+0直近 7 日のスター増減
  • LightReasoner@HKUDS

    [ACL 2026 Oral] 「LightReasoner: 小型言語モデルは大規模言語モデルに推論能力を教えることができるか?」

    608+1直近 7 日のスター増減
  • Relax@redai-studio

    大規模オムニモーダル事後学習のための非同期強化学習エンジン

    582+2直近 7 日のスター増減
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] LLM 事後学習スイート。ReasonFlux、ReasonFlux-PRM、ReasonFlux-Coder を搭載。

    542-1直近 7 日のスター増減
  • PostTrainBench@aisa-group

    Claude Code や Codex CLI などの CLI エージェントが、1台の H100 GPU で 10 時間以内にベース LLM の事後学習をどの程度うまく行えるかを測定します

    541+14直近 7 日のスター増減
  • Human3R@fanegg

    [ICLR 2026] 4D人間・シーン再構築のための統合モデル

    533+2直近 7 日のスター増減
← トピック一覧に戻る