post-training
post-training がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
post-training と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、post-training がタグ付けされたリポジトリ。
- #1
AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。
★ 1,333
- #1★ 4,150+128直近 7 日のスター増減
- #2
推論特化型 LLM に関する優れたチュートリアル、サーベイ、ガイドのまとめ
★ 2,527+4直近 7 日のスター増減 - #3
メンタルヘルス向け大規模言語モデル (LLM x Mental Health)。事前学習・事後学習、データセット、評価、デプロイ、RAGに対応し、InternLM、Qwen、Baichuan、DeepSeek、Mixtral、Llama、GLMシリーズのモデルをサポート
★ 1,781+3直近 7 日のスター増減 - #4
AI エージェントがワークフローのループを通じてタスクを完了し、反復実行によって自己改善を行い、メンターエージェントや人間のフィードバックによって評価され、完了した作業を再利用可能な作業経験やデータに変換して将来のエージェントの改善に活かすための活きたエコシステム。
★ 1,333-3直近 7 日のスター増減 - #5
大規模言語モデルのオンポリシー蒸留(OPD)に関する論文、テクニカルレポート、フレームワーク、ツールの厳選コレクション。
★ 766+29直近 7 日のスター増減 - #6
「Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights」(ICML 2026 Spotlight)の公式コードベース
★ 640+0直近 7 日のスター増減 - #7
2B Modelにおけるマルチモーダルな「アハ体験」を探求
★ 623+0直近 7 日のスター増減 - #8
[ACL 2026 Oral] 「LightReasoner: 小型言語モデルは大規模言語モデルに推論能力を教えることができるか?」
★ 608+1直近 7 日のスター増減 - #9★ 582+2直近 7 日のスター増減
- #10
[NeurIPS 2025 Spotlight] LLM 事後学習スイート。ReasonFlux、ReasonFlux-PRM、ReasonFlux-Coder を搭載。
★ 542-1直近 7 日のスター増減 - #11
Claude Code や Codex CLI などの CLI エージェントが、1台の H100 GPU で 10 時間以内にベース LLM の事後学習をどの程度うまく行えるかを測定します
★ 541+14直近 7 日のスター増減 - #12★ 533+2直近 7 日のスター増減