post-training
post-training 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 post-training 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 post-training 태그가 달린 리포지토리예요.
- #1
AI 에이전트가 워크플로 루프를 통해 작업을 완료하고, 반복 실행을 통해 개선되며, 멘토 에이전트나 인간의 평가를 받고, 완료된 작업을 재사용 가능한 작업 경험 및 데이터로 전환하여 미래의 에이전트를 개선하는 생태계.
★ 1,333
- #1★ 4,262+128최근 7일 스타 변화
- #2
추론 LLM 관련 Awesome 튜토리얼/서베이/가이드 모음
★ 2,532+4최근 7일 스타 변화 - #3
정신 건강 대규모 언어 모델(LLM x Mental Health), 사전 학습 및 사후 학습, 데이터셋, 평가, 배포, RAG, InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM 시리즈 모델 지원
★ 1,781+3최근 7일 스타 변화 - #4
AI 에이전트가 워크플로 루프를 통해 작업을 완료하고, 반복 실행을 통해 개선되며, 멘토 에이전트나 인간의 평가를 받고, 완료된 작업을 재사용 가능한 작업 경험 및 데이터로 전환하여 미래의 에이전트를 개선하는 생태계.
★ 1,333-3최근 7일 스타 변화 - #5
대형 언어 모델의 온폴리시 증류(OPD)를 위한 논문, 기술 보고서, 프레임워크 및 도구 모음
★ 771+29최근 7일 스타 변화 - #6
"Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight) 공식 코드베이스
★ 640+0최근 7일 스타 변화 - #7
2B 모델에서 멀티모달 '아하 모멘트(Aha Moment)' 탐색
★ 623+0최근 7일 스타 변화 - #8
[ACL 2026 Oral] LightReasoner: 소형 언어 모델이 대형 언어 모델에게 추론을 가르칠 수 있을까?
★ 609+1최근 7일 스타 변화 - #9★ 582+2최근 7일 스타 변화
- #10
Claude Code나 Codex CLI 같은 CLI 에이전트가 단일 H100 GPU에서 10시간 만에 베이스 LLM을 얼마나 잘 사후 학습(post-train)할 수 있는지 측정
★ 543+14최근 7일 스타 변화 - #11
[NeurIPS 2025 Spotlight] LLM 후학습(post-training) 스위트 — ReasonFlux, ReasonFlux-PRM, ReasonFlux-Coder 포함.
★ 542-1최근 7일 스타 변화 - #12★ 533+2최근 7일 스타 변화