ChenxinAn-fdu/POLARIS
@ChenxinAn-fdu高度な推論モデルにおける強化学習(RL)のスケーリング
スター
696
フォーク
43
言語
Python
ライセンス
Apache-2.0
最終プッシュ
11 か月前
関連 Intel(0)
関連 Intel はまだありません
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。
高度な推論モデルにおける強化学習(RL)のスケーリング
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。