본문으로 건너뛰기
buildradar
Sign in
토픽 · diffusion-models

diffusion-models

diffusion-models 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 163개
  • finetrainers@huggingface

    확장 가능하고 메모리가 최적화된 디퓨전 모델 학습

    1,359+1최근 7일 스타 변화
  • Matcha-TTS@shivammehta25

    [ICASSP 2024] 🍵 Matcha-TTS: 조건부 플로우 매칭을 사용하는 빠른 TTS 아키텍처

    1,353+4최근 7일 스타 변화
  • DDNM@wyhuai

    [ICLR 2023 Oral] 디노이징 디퓨전 널스페이스 모델을 사용한 제로샷 이미지 복원

    1,351+2최근 7일 스타 변화
  • FireRed-Image-Edit@FireRedTeam

    FireRed-Image-Edit는 정밀한 지시 따르기, 고화질 생성, 우수한 정체성 일관성 및 매끄러운 다중 요소 융합을 통해 오픈 소스 최고 수준(SOTA)의 성능을 달성하는 강력한 이미지 편집 기반 모델입니다.

    1,350+6최근 7일 스타 변화
  • IMAGDressing@muzishen

    [AAAI 2025]👔IMAGDressing👔: 가상 피팅을 위한 인터랙티브 모듈러 의류 생성. 유연한 의상, 포즈, 장면 제어를 통해 맞춤형 인물 이미지 생성이 가능하며, 가상 피팅을 위한 높은 충실도와 의상 일관성을 보장합니다.

    1,343+0최근 7일 스타 변화
  • MagicTime@PKU-YuanGroup

    [TPAMI 2025🔥] MagicTime: 변형 시뮬레이터로서의 타임랩스 비디오 생성 모델

    1,337-1최근 7일 스타 변화
  • Hunyuan3D-2-WinPortable@YanWenKun

    Windows에서 Hunyuan3D 2.0/2.1을 실행하기 위한 휴대용 패키지

    1,326+5최근 7일 스타 변화
  • pruna@PrunaAI

    Pruna는 개발자를 위해 제작된 모델 최적화 프레임워크로, 최소한의 오버헤드로 더 빠르고 효율적인 모델을 제공할 수 있게 해줍니다.

    1,274+2최근 7일 스타 변화
  • Difix3D@nv-tlabs

    [CVPR 2025 Oral & Best Paper Finalist] Difix3D+: 단일 단계 Diffusion 모델을 통한 3D 복원 개선

    1,267+0최근 7일 스타 변화
  • DragDiffusion@Yujun-Shi

    [CVPR2024, Highlight] DragDiffusion 공식 코드

    1,259+0최근 7일 스타 변화
  • tango@declare-lab

    텍스트-오디오 생성을 위한 디퓨전 모델 패밀리.

    1,238-1최근 7일 스타 변화
  • Irodori-TTS@Aratako

    이모지 기반 스타일 제어를 지원하는 Flow Matching 방식의 텍스트 음성 변환(TTS) 모델

    1,228+8최근 7일 스타 변화
  • HunyuanCustom@Tencent-Hunyuan

    HunyuanCustom: 맞춤형 비디오 생성을 위한 멀티모달 구동 아키텍처

    1,228+1최근 7일 스타 변화
  • MeanFlow@haidog-yaqub

    MeanFlow 및 iMF(원스텝 생성 모델링)의 PyTorch 구현

    1,196+0최근 7일 스타 변화
  • wunjo.wladradchenko.ru@wladradchenko

    Wunjo CE: 얼굴 교체, 립싱크, 객체 및 텍스트/배경 제거, 스타일 변경, 오디오 분리, 음성 복제, 비디오 생성 기능을 제공합니다. 오픈 소스이며 로컬에서 무료로 사용할 수 있습니다.

    1,170+1최근 7일 스타 변화
  • MagicDrive@cure-lab

    [ICLR24] MagicDrive: Street View Generation with Diverse 3D Geometry Control 논문의 공식 구현

    1,167+1최근 7일 스타 변화
  • 텍스트-이미지 디퓨전 모델의 제어 가능한 생성에 관한 리소스 모음.

    1,110+0최근 7일 스타 변화
  • MOVA@OpenMOSS

    MOVA: 확장 가능하고 동기화된 비디오-오디오 생성을 향하여

    1,108+4최근 7일 스타 변화
  • pytorch-stable-diffusion@hkproj

    PyTorch로 처음부터 구현한 Stable Diffusion입니다.

    1,078-1최근 7일 스타 변화
  • VisCPM@OpenBMB

    [ICLR'24 스포트라이트] 중영 양국어 멀티모달 대형 모델 시리즈(채팅 및 페인트) | CPM 기반 모델 기반 중영 양국어 멀티모달 대형 모델 시리즈

    1,061+0최근 7일 스타 변화
  • MotionDirector@showlab

    [ECCV 2024 Oral] MotionDirector: 텍스트-비디오 확산 모델의 모션 커스터마이징

    1,053+3최근 7일 스타 변화
  • Diffusion-Planner@ZhengYinan-AIR

    [ICLR 2025 Oral] "유연한 가이던스를 이용한 자율주행용 확산 기반 플래닝" 공식 구현

    1,050+5최근 7일 스타 변화
  • 3DTopia-XL@3DTopia

    [CVPR 2025 Highlight] 3DTopia-XL: 프리미티브 디퓨전을 통한 고품질 3D PBR 에셋 생성

    1,046+1최근 7일 스타 변화
  • SyncDreamer@liuyuan-pal

    [ICLR 2024 Spotlight] SyncDreamer: 단일 뷰 이미지로부터 다중 뷰 일관성을 가진 이미지 생성

    1,044+0최근 7일 스타 변화
  • FlowEdit@fallenshock

    논문 공식 구현: "FlowEdit: 사전 학습된 Flow 모델을 사용한 인버전 프리 텍스트 기반 편집"

    1,013-1최근 7일 스타 변화
  • FastGen@NVlabs

    NVIDIA FastGen: Diffusion Models 기반 고속 생성

    986+24최근 7일 스타 변화
  • PIA@open-mmlab

    [CVPR 2024] PIA, 개인화된 이미지 애니메이터. 텍스트 프롬프트로 이미지를 애니메이션화하고 Dreambooth와 결합하여 멋진 비디오를 생성합니다.

    975+0최근 7일 스타 변화
  • DeepCache@horseee

    [CVPR 2024] DeepCache: 추가 비용 없이 Diffusion Models 가속화

    970+0최근 7일 스타 변화
  • diffae@konpatp

    Diffusion Autoencoders 공식 구현체

    969+0최근 7일 스타 변화
  • story-iter@UCSC-VLAA

    [ICLR 2026] 긴 이야기 시각화를 위한 학습 불필요 반복 프레임워크

    959+1최근 7일 스타 변화
← 토픽 목록으로