Agent-RL/ReCall
@Agent-RLReSearch: Erlernen des Schlussfolgerns mit Suche für LLMs durch Reinforcement Learning & ReCall: Erlernen des Schlussfolgerns mit Tool-Aufrufen für LLMs durch Reinforcement Learning
Sterne
1.432
Forks
89
Sprache
Python
Lizenz
MIT
Letzter Push
vor 1 Jahr
Verwandte Intel (0)
Noch keine verwandte Intel
Dieses Repo ist noch in keiner der vom Radar verfolgten Quellen aufgetaucht. Der Collector läuft nach Zeitplan — schau wieder vorbei, sobald er dieses Repo abdeckt.