Lompat ke konten utama
buildradar
Sign in
Topik · post-training

post-training

Repositori open source terpantau bertanda post-training, diurutkan berdasarkan bintang.

Repositori
12
Total bintang
14.614
Rata-rata bintang
1.218
Porsi
0,00%

Topik yang sering muncul berdampingan dengan post-training di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda post-training.

  • agent-apprenticeship@ray-r-ren

    Ekosistem aktif tempat agen AI menyelesaikan tugas melalui perulangan alur kerja, meningkatkan diri melalui eksekusi iteratif, dievaluasi oleh agen mentor atau manusia, dan mengubah pekerjaan selesai menjadi pengalaman kerja serta data yang dapat digunakan kembali untuk meningkatkan agen masa depan.

    1.333
  • FastVideo@hao-ai-lab

    Kerangka kerja inferensi dan pasca-pelatihan terpadu untuk akselerasi pembuatan video.

    4.150+128Perubahan bintang dalam 7 hari terakhir
  • Tutorial/Survei/Panduan Awesome Reasoning LLM

    2.527+4Perubahan bintang dalam 7 hari terakhir
  • EmoLLM@SmartFlowAI

    Model Bahasa Besar (LLM) Kesehatan Mental, Pelatihan Pra & Pasca & Dataset & Evaluasi & Penerapan & RAG, dengan model seri InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM

    1.781+3Perubahan bintang dalam 7 hari terakhir
  • agent-apprenticeship@ray-r-ren

    Ekosistem aktif tempat agen AI menyelesaikan tugas melalui perulangan alur kerja, meningkatkan diri melalui eksekusi iteratif, dievaluasi oleh agen mentor atau manusia, dan mengubah pekerjaan selesai menjadi pengalaman kerja serta data yang dapat digunakan kembali untuk meningkatkan agen masa depan.

    1.333-3Perubahan bintang dalam 7 hari terakhir
  • Koleksi makalah, laporan teknis, framework, and alat pilihan untuk on-policy distillation (OPD) pada model bahasa besar

    766+29Perubahan bintang dalam 7 hari terakhir
  • RandOpt@sunrainyg

    Basis Kode Resmi untuk "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight)

    640+0Perubahan bintang dalam 7 hari terakhir
  • VisualThinker-R1-Zero@turningpoint-ai

    Jelajahi “Aha Moment” Multimodal pada Model 2B

    623+0Perubahan bintang dalam 7 hari terakhir
  • LightReasoner@HKUDS

    [ACL 2026 Oral] "LightReasoner: Bisakah Model Bahasa Kecil Mengajari Model Bahasa Besar Melakukan Penalaran?"

    608+1Perubahan bintang dalam 7 hari terakhir
  • Relax@redai-studio

    Mesin Reinforcement Learning Asinkron untuk Post-Training Omni-Modal berskala besar.

    582+2Perubahan bintang dalam 7 hari terakhir
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] Suite pasca-pelatihan LLM — menampilkan ReasonFlux, ReasonFlux-PRM, dan ReasonFlux-Coder.

    542-1Perubahan bintang dalam 7 hari terakhir
  • PostTrainBench@aisa-group

    Mengukur seberapa baik agen CLI seperti Claude Code atau Codex CLI dapat melatih ulang base LLM pada satu GPU H100 dalam 10 jam

    541+14Perubahan bintang dalam 7 hari terakhir
  • Human3R@fanegg

    [ICLR 2026] Model terpadu untuk rekonstruksi manusia-adegan 4D

    533+2Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik