본문으로 건너뛰기
buildradar
Sign in
토픽 · post-training

post-training

post-training 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
12
총 스타
14,614
평균 스타
1,218
비중
0.00%

같은 리포지토리에 post-training 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 post-training 태그가 달린 리포지토리예요.

  • agent-apprenticeship@ray-r-ren

    AI 에이전트가 워크플로 루프를 통해 작업을 완료하고, 반복 실행을 통해 개선되며, 멘토 에이전트나 인간의 평가를 받고, 완료된 작업을 재사용 가능한 작업 경험 및 데이터로 전환하여 미래의 에이전트를 개선하는 생태계.

    1,333
  • FastVideo@hao-ai-lab

    가속화된 비디오 생성을 위한 통합 추론 및 학습 후 프레임워크

    4,262+128최근 7일 스타 변화
  • 추론 LLM 관련 Awesome 튜토리얼/서베이/가이드 모음

    2,532+4최근 7일 스타 변화
  • EmoLLM@SmartFlowAI

    정신 건강 대규모 언어 모델(LLM x Mental Health), 사전 학습 및 사후 학습, 데이터셋, 평가, 배포, RAG, InternLM / Qwen / Baichuan / DeepSeek / Mixtral / LLama / GLM 시리즈 모델 지원

    1,781+3최근 7일 스타 변화
  • agent-apprenticeship@ray-r-ren

    AI 에이전트가 워크플로 루프를 통해 작업을 완료하고, 반복 실행을 통해 개선되며, 멘토 에이전트나 인간의 평가를 받고, 완료된 작업을 재사용 가능한 작업 경험 및 데이터로 전환하여 미래의 에이전트를 개선하는 생태계.

    1,333-3최근 7일 스타 변화
  • 대형 언어 모델의 온폴리시 증류(OPD)를 위한 논문, 기술 보고서, 프레임워크 및 도구 모음

    771+29최근 7일 스타 변화
  • RandOpt@sunrainyg

    "Neural Thickets: Diverse Task Experts Are Dense Around Pretrained Weights" (ICML 2026 Spotlight) 공식 코드베이스

    640+0최근 7일 스타 변화
  • VisualThinker-R1-Zero@turningpoint-ai

    2B 모델에서 멀티모달 '아하 모멘트(Aha Moment)' 탐색

    623+0최근 7일 스타 변화
  • LightReasoner@HKUDS

    [ACL 2026 Oral] LightReasoner: 소형 언어 모델이 대형 언어 모델에게 추론을 가르칠 수 있을까?

    609+1최근 7일 스타 변화
  • Relax@redai-studio

    대규모 전모달 사후 학습을 위한 비동기 강화 학습 엔진

    582+2최근 7일 스타 변화
  • PostTrainBench@aisa-group

    Claude Code나 Codex CLI 같은 CLI 에이전트가 단일 H100 GPU에서 10시간 만에 베이스 LLM을 얼마나 잘 사후 학습(post-train)할 수 있는지 측정

    543+14최근 7일 스타 변화
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] LLM 후학습(post-training) 스위트 — ReasonFlux, ReasonFlux-PRM, ReasonFlux-Coder 포함.

    542-1최근 7일 스타 변화
  • Human3R@fanegg

    [ICLR 2026] 4D 인간-장면 재구성을 위한 통합 모델

    533+2최근 7일 스타 변화
← 토픽 목록으로