post-training
Repositori open source terpantau bertanda post-training, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan post-training di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda post-training.
- #1
Ekosistem aktif tempat agen AI menyelesaikan tugas melalui perulangan alur kerja, meningkatkan diri melalui eksekusi iteratif, dievaluasi oleh agen mentor atau manusia, dan mengubah pekerjaan selesai menjadi pengalaman kerja serta data yang dapat digunakan kembali untuk meningkatkan agen masa depan.
★ 1.333
- #1
Kerangka kerja inferensi dan pasca-pelatihan terpadu untuk akselerasi pembuatan video.
★ 4.150+128Perubahan bintang dalam 7 hari terakhir - #2
Tutorial/Survei/Panduan Awesome Reasoning LLM
★ 2.527+4Perubahan bintang dalam 7 hari terakhir - #3
Model Bahasa Besar (LLM) Kesehatan Mental, Pelatihan Pra & Pasca & Dataset & Evaluasi & Penerapan & RAG, dengan model seri InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM
★ 1.781+3Perubahan bintang dalam 7 hari terakhir - #4
Ekosistem aktif tempat agen AI menyelesaikan tugas melalui perulangan alur kerja, meningkatkan diri melalui eksekusi iteratif, dievaluasi oleh agen mentor atau manusia, dan mengubah pekerjaan selesai menjadi pengalaman kerja serta data yang dapat digunakan kembali untuk meningkatkan agen masa depan.
★ 1.333-3Perubahan bintang dalam 7 hari terakhir - #5
Koleksi makalah, laporan teknis, framework, and alat pilihan untuk on-policy distillation (OPD) pada model bahasa besar
★ 766+29Perubahan bintang dalam 7 hari terakhir - #6
Basis Kode Resmi untuk "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)
★ 640+0Perubahan bintang dalam 7 hari terakhir - #7
Jelajahi “Aha Moment” Multimodal pada Model 2B
★ 623+0Perubahan bintang dalam 7 hari terakhir - #8
[ACL 2026 Oral] "LightReasoner: Bisakah Model Bahasa Kecil Mengajari Model Bahasa Besar Melakukan Penalaran?"
★ 608+1Perubahan bintang dalam 7 hari terakhir - #9
Mesin Reinforcement Learning Asinkron untuk Post-Training Omni-Modal berskala besar.
★ 582+2Perubahan bintang dalam 7 hari terakhir - #10
[NeurIPS 2025 Spotlight] Suite pasca-pelatihan LLM — menampilkan ReasonFlux, ReasonFlux-PRM, dan ReasonFlux-Coder.
★ 542-1Perubahan bintang dalam 7 hari terakhir - #11
Mengukur seberapa baik agen CLI seperti Claude Code atau Codex CLI dapat melatih ulang base LLM pada satu GPU H100 dalam 10 jam
★ 541+14Perubahan bintang dalam 7 hari terakhir - #12★ 533+2Perubahan bintang dalam 7 hari terakhir