OpenPipe/ART
@OpenPipeAgent Reinforcement Trainer: huấn luyện các agent nhiều bước cho các tác vụ thực tế bằng GRPO. Cung cấp đào tạo tại chỗ cho các agent của bạn. Học tăng cường (Reinforcement learning) cho Qwen3.6, GPT-OSS, Llama và nhiều mô hình khác!
Sao
10.689
Fork
980
Ngôn ngữ
Python
Giấy phép
Apache-2.0
Push gần nhất
4 ngày trước
Intel liên quan (0)
Chưa có intel liên quan
Kho mã này chưa xuất hiện trong bất kỳ nguồn nào radar theo dõi. Bộ thu thập chạy theo lịch — hãy quay lại khi nó bao quát kho mã này.