Chuyển tới nội dung chính
buildradar
Sign in

AgentR1/Agent-R1

@AgentR1

Agent-R1: Đào tạo các Agent LLM mạnh mẽ bằng Học tăng cường đầu cuối (End-to-End Reinforcement Learning)

Sao
1.648
Fork
114
Ngôn ngữ
Python
Giấy phép
MIT
Push gần nhất
3 ngày trước
Pythonagentllmagentic-rl

Chưa có intel liên quan

Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.