メインコンテンツへスキップ
buildradar
ログイン

mbzuai-oryx/Awesome-LLM-Post-training

@mbzuai-oryx

推論特化型 LLM に関する優れたチュートリアル、サーベイ、ガイドのまとめ

スター
2,533
フォーク
169
言語
Python
ライセンス
最終プッシュ
2 か月前
Pythonlarge-language-modelsreinforcement-learningpost-trainingreasoningscalingfine

関連 Intel はまだありません

このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。