PeterGriffinJin 收录中的开源项目,按星标数排序。
Search-R1:一个高效、可扩展的 RL 训练框架,用于基于 veRL 的推理与搜索引擎调用交错 LLM
根据“图上的大型语言模型:综合调查”(TKDE)精选的论文与资源列表