synthetic-data
synthetic-data 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 synthetic-data 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 synthetic-data 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1
머신러닝 트레이딩 3판 코드 — 데이터 소싱부터 라이브 실행까지.
★ 20,762+43최근 7일 스타 변화 - #2
파운데이션 모델을 위한, 그리고 모델과 함께하는 데이터 처리! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6,975+26최근 7일 스타 변화 - #3★ 5,042+5최근 7일 스타 변화
- #4★ 4,839+0최근 7일 스타 변화
- #5
사실적인 학습 이미지 생성을 위한 절차적 Blender 파이프라인
★ 3,693+5최근 7일 스타 변화 - #6★ 3,551+0최근 7일 스타 변화
- #7
Distilabel은 검증된 연구 논문을 바탕으로 빠르고 안정적이며 확장 가능한 파이프라인이 필요한 엔지니어를 위한 합성 데이터 및 AI 피드백 프레임워크입니다.
★ 3,384+3최근 7일 스타 변화 - #8★ 3,323+2최근 7일 스타 변화
- #9★ 3,322+5최근 7일 스타 변화
- #10
고품질 구조화된 표 형태 데이터를 생성하도록 설계된 특화된 framework
★ 2,436+1최근 7일 스타 변화 - #11★ 2,209+0최근 7일 스타 변화
- #12
🎨 NeMo Data Designer: 처음부터 또는 시드 데이터를 사용하여 고품질 합성 데이터 생성.
★ 2,197+7최근 7일 스타 변화 - #13★ 1,757+4최근 7일 스타 변화
- #14★ 1,722+2최근 7일 스타 변화
- #15
표 형태 및 시계열 데이터용 합성 데이터 생성기
★ 1,654+0최근 7일 스타 변화 - #16★ 1,641-1최근 7일 스타 변화
- #17★ 1,565+3최근 7일 스타 변화
- #18★ 1,484+0최근 7일 스타 변화
- #19
시뮬레이션된 현실적인 합성 상호작용을 사용하여 에이전트를 종합적으로 진단하고 최적화하기 위한 프레임워크
★ 1,257+0최근 7일 스타 변화 - #20
DataDreamer: 프롬프트 입력, 합성 데이터 생성, 모델 학습 및 정렬을 수행합니다.
★ 1,117+0최근 7일 스타 변화 - #21
Synthadoc: 원시 문서를 구조화된 로컬 우선 위키로 변환하는 오픈소스 LLM 지식 컴파일 엔진. 도구 없이도 자체 관리 및 자체 개선이 가능한, 기존 RAG에 대한 투명하고 사람이 읽을 수 있는 대안입니다.
★ 1,116+2최근 7일 스타 변화 - #22
단일 파이프라인에서 고품질 합성 데이터 생성, 학습, 측정 및 평가
★ 885+3최근 7일 스타 변화 - #23
[ICLR 2025] 정렬된 LLM에 아무것도 입력하지 않고 프롬프트를 통해 처음부터 정렬 데이터 합성. 효율적이고 고품질의 합성 데이터 생성 파이프라인!
★ 880+1최근 7일 스타 변화 - #24★ 829+0최근 7일 스타 변화
- #25
응답 확률을 요청하여 LLM의 모드 붕괴를 완화하는 학습 무료 프롬프팅 전략인 Verbalized Sampling. 품질을 유지하면서 2~3배의 다양성 향상을 달성합니다. 창의적 글쓰기, 합성 데이터 생성, 대화 Simulation을 위한 CLI/API를 갖춘 모델 중립적 프레임워크.
★ 803+1최근 7일 스타 변화 - #26★ 798+5최근 7일 스타 변화
- #27
MAMMA: 마커리스 정확한 다인원 모션 획득(Markerless Accurate Multi-person Motion Acquisition) 공식 코드입니다.
★ 793+6최근 7일 스타 변화 - #28★ 715+1최근 7일 스타 변화
- #29★ 680+3최근 7일 스타 변화
- #30★ 652+0최근 7일 스타 변화