diffusion-models
diffusion-models 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #61
확장 가능하고 메모리가 최적화된 디퓨전 모델 학습
★ 1,359+1최근 7일 스타 변화 - #62
[ICASSP 2024] 🍵 Matcha-TTS: 조건부 플로우 매칭을 사용하는 빠른 TTS 아키텍처
★ 1,353+4최근 7일 스타 변화 - #63★ 1,351+2최근 7일 스타 변화
- #64
FireRed-Image-Edit는 정밀한 지시 따르기, 고화질 생성, 우수한 정체성 일관성 및 매끄러운 다중 요소 융합을 통해 오픈 소스 최고 수준(SOTA)의 성능을 달성하는 강력한 이미지 편집 기반 모델입니다.
★ 1,350+6최근 7일 스타 변화 - #65
[AAAI 2025]👔IMAGDressing👔: 가상 피팅을 위한 인터랙티브 모듈러 의류 생성. 유연한 의상, 포즈, 장면 제어를 통해 맞춤형 인물 이미지 생성이 가능하며, 가상 피팅을 위한 높은 충실도와 의상 일관성을 보장합니다.
★ 1,343+0최근 7일 스타 변화 - #66★ 1,337-1최근 7일 스타 변화
- #67
Windows에서 Hunyuan3D 2.0/2.1을 실행하기 위한 휴대용 패키지
★ 1,326+5최근 7일 스타 변화 - #68★ 1,274+2최근 7일 스타 변화
- #69★ 1,267+0최근 7일 스타 변화
- #70
[CVPR2024, Highlight] DragDiffusion 공식 코드
★ 1,259+0최근 7일 스타 변화 - #71★ 1,238-1최근 7일 스타 변화
- #72
이모지 기반 스타일 제어를 지원하는 Flow Matching 방식의 텍스트 음성 변환(TTS) 모델
★ 1,228+8최근 7일 스타 변화 - #73
HunyuanCustom: 맞춤형 비디오 생성을 위한 멀티모달 구동 아키텍처
★ 1,228+1최근 7일 스타 변화 - #74★ 1,196+0최근 7일 스타 변화
- #75
Wunjo CE: 얼굴 교체, 립싱크, 객체 및 텍스트/배경 제거, 스타일 변경, 오디오 분리, 음성 복제, 비디오 생성 기능을 제공합니다. 오픈 소스이며 로컬에서 무료로 사용할 수 있습니다.
★ 1,170+1최근 7일 스타 변화 - #76
[ICLR24] MagicDrive: Street View Generation with Diverse 3D Geometry Control 논문의 공식 구현
★ 1,167+1최근 7일 스타 변화 - #77
텍스트-이미지 디퓨전 모델의 제어 가능한 생성에 관한 리소스 모음.
★ 1,110+0최근 7일 스타 변화 - #78★ 1,108+4최근 7일 스타 변화
- #79
PyTorch로 처음부터 구현한 Stable Diffusion입니다.
★ 1,078-1최근 7일 스타 변화 - #80
[ICLR'24 스포트라이트] 중영 양국어 멀티모달 대형 모델 시리즈(채팅 및 페인트) | CPM 기반 모델 기반 중영 양국어 멀티모달 대형 모델 시리즈
★ 1,061+0최근 7일 스타 변화 - #81
[ECCV 2024 Oral] MotionDirector: 텍스트-비디오 확산 모델의 모션 커스터마이징
★ 1,053+3최근 7일 스타 변화 - #82
[ICLR 2025 Oral] "유연한 가이던스를 이용한 자율주행용 확산 기반 플래닝" 공식 구현
★ 1,050+5최근 7일 스타 변화 - #83
[CVPR 2025 Highlight] 3DTopia-XL: 프리미티브 디퓨전을 통한 고품질 3D PBR 에셋 생성
★ 1,046+1최근 7일 스타 변화 - #84
[ICLR 2024 Spotlight] SyncDreamer: 단일 뷰 이미지로부터 다중 뷰 일관성을 가진 이미지 생성
★ 1,044+0최근 7일 스타 변화 - #85★ 1,013-1최근 7일 스타 변화
- #86★ 986+24최근 7일 스타 변화
- #87
[CVPR 2024] PIA, 개인화된 이미지 애니메이터. 텍스트 프롬프트로 이미지를 애니메이션화하고 Dreambooth와 결합하여 멋진 비디오를 생성합니다.
★ 975+0최근 7일 스타 변화 - #88★ 970+0최근 7일 스타 변화
- #89★ 969+0최근 7일 스타 변화
- #90
[ICLR 2026] 긴 이야기 시각화를 위한 학습 불필요 반복 프레임워크
★ 959+1최근 7일 스타 변화