PeterGriffinJin 收錄中的開源專案,依星數排序。
Search-R1:一個高效、可擴展的 RL 訓練框架,用於基於 veRL 的推理與搜索引擎調用交錯 LLM
根據「圖上的大型語言模型:綜合調查」(TKDE)精選的論文與資源清單