Agent-RL/ReCall
@Agent-RLReSearch: 強化学習を用いたLLMの検索推論学習 & ReCall: 強化学習を用いたLLMのツール呼び出し推論学習
スター
1,432
フォーク
89
言語
Python
ライセンス
MIT
最終プッシュ
1 年前
関連 Intel(0)
関連 Intel はまだありません
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。
ReSearch: 強化学習を用いたLLMの検索推論学習 & ReCall: 強化学習を用いたLLMのツール呼び出し推論学習
このリポジトリは radar が追跡するソースにまだ登場していません。コレクターはスケジュールで動いています——このリポジトリがカバーされたらまた見てください。