トピック · dpo
dpo
dpo がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
リポジトリ
11
総スター数
33,060
平均スター数
3,005
シェア
0.00%
関連トピック
dpo と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、dpo がタグ付けされたリポジトリ。
直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。
- #1★ 9,383+3直近 7 日のスター増減
- #2
MedicalGPT: ChatGPTトレーニングパイプラインを使用した独自のMedical GPTモデルのトレーニング。医療大規模モデルのトレーニングを行い、インクリメンタル事前学習(PT)、教師ありファインチューニング(SFT)、RLHF、DPO、ORPO、GRPOを実装しています。
★ 5,771+12直近 7 日のスター増減 - #3★ 4,929+1,365直近 7 日のスター増減
- #4
Align Anything: フィードバックを用いた全モダリティモデルのトレーニング。
★ 4,671+3直近 7 日のスター増減 - #5
🚀 基本的なRLの概念からLLMアライメント、RLVR、高度なエージェンティックシステムへのギャップを埋めるオープンソースの実践的カリキュラム
★ 4,199+54直近 7 日のスター増減 - #6★ 909-1直近 7 日のスター増減
- #7★ 736+1直近 7 日のスター増減
- #8★ 669-1直近 7 日のスター増減
- #9
LLM の簡単かつ効率的なファインチューニング。(Llama、Llama2、Llama3、Qwen、Baichuan、GLM、Falcon をサポート)大模型高效量化训练+部署。
★ 621+0直近 7 日のスター増減 - #10
動画生成における強化学習に関する論文のキュレーションリスト
★ 591+1直近 7 日のスター増減 - #11
TensorFlowを使用してテキスト前処理から、トピックモデル、BERT、GPT、LLMなどの最新モデルのダウンストリームタスクまでをまとめたDeep Learning NLPリポジトリ
★ 581+0直近 7 日のスター増減