OpenPipe/ART
@OpenPipeAgent Reinforcement Trainer: melatih agen multi-langkah untuk tugas dunia nyata menggunakan GRPO. Berikan pelatihan langsung kepada agen Anda. Reinforcement learning untuk Qwen3.6, GPT-OSS, Llama, dan banyak lagi!
Bintang
10.679
Fork
982
Bahasa
Python
Lisensi
Apache-2.0
Push terakhir
3 hari yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.