Các kho mã nguồn mở đang theo dõi của AgentR1, sắp xếp theo số sao.
Agent-R1: Đào tạo các Agent LLM mạnh mẽ bằng Học tăng cường đầu cuối (End-to-End Reinforcement Learning)