Saltar al contenido principal
buildradar
Sign in
Tema · diffusion-models

diffusion-models

Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.

163 repositorios
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video: Animación de imágenes controlable mediante adaptaciones de campos de movimiento generativos en modelos de difusión de imagen a video congelados.

    766+0Variación de estrellas de los últimos 7 días
  • Una colección de estudios asombrosos sobre la generación de texto a imagen.

    765+0Variación de estrellas de los últimos 7 días
  • PMRF@ohayonguy

    [ICLR 2025] Implementación oficial de Posterior-Mean Rectified Flow: Hacia una restauración de imágenes fotorrealistas con MSE mínimo

    754+0Variación de estrellas de los últimos 7 días
  • nano-world-model@simchowitzlabpublic

    Un repositorio minimalista y completo para avanzar en la ciencia de los modelos mundiales

    729+10Variación de estrellas de los últimos 7 días
  • MagicDrive-V2@flymin

    [ICCV 2025] Implementación oficial del artículo “MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control”

    729+1Variación de estrellas de los últimos 7 días
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion: Inferencia paralela distribuida para modelos de difusión de alta resolución.

    728+0Variación de estrellas de los últimos 7 días
  • DL4Proteins-notebooks@Graylab

    Notebooks de Colab que cubren herramientas de aprendizaje profundo para la predicción y el diseño de estructuras biomoleculares

    724+1Variación de estrellas de los últimos 7 días
  • Restauración de imágenes con ecuaciones diferenciales estocásticas de reversión a la media, ICML 2023. Solución ganadora del desafío NTIRE 2023 de eliminación de sombras en imágenes.

    722+0Variación de estrellas de los últimos 7 días
  • mdlm@kuleshov-group

    [NeurIPS 2024] Modelo de lenguaje de difusión enmascarada simple y efectivo.

    711+2Variación de estrellas de los últimos 7 días
  • [ICML 2025] Implementación oficial en PyTorch de "History-Guided Video Diffusion".

    709+1Variación de estrellas de los últimos 7 días
  • Una lista seleccionada de increíbles modelos mundiales de video con difusión AR: abarca algoritmos, aplicaciones e infraestructura, con el objetivo de servir como un recurso integral para investigadores, profesionales y entusiastas.

    701+5Variación de estrellas de los últimos 7 días
  • CRM@thu-ml

    [ECCV 2024] De una sola imagen a una malla 3D texturizada en 10 segundos con un modelo de reconstrucción convolucional.

    696+0Variación de estrellas de los últimos 7 días
  • Flow-Factory@X-GenGroup

    Un marco unificado para el aprendizaje por refuerzo sencillo en modelos de Flow-Matching

    690+7Variación de estrellas de los últimos 7 días
  • Colección de artículos y códigos para CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC.

    677+1Variación de estrellas de los últimos 7 días
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Un modelo de difusión eficiente para generación de texto a imagen en alta resolución (2K)

    675+0Variación de estrellas de los últimos 7 días
  • Make-An-Audio@Text-to-Audio

    Implementación en PyTorch de Make-An-Audio (ICML'23) con un modelo generativo de texto a audio.

    668+0Variación de estrellas de los últimos 7 días
  • OneDiffusion@lehduong

    Implementación oficial del artículo OneDiffusion (CVPR 2025).

    665+0Variación de estrellas de los últimos 7 días
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Da vida a videos mudos con sonidos realistas y sincronizados.

    663+0Variación de estrellas de los últimos 7 días
  • flash-diffusion@gojasper

    Flash Diffusion: aceleración de modelos de difusión condicional (AAAI 2025 Oral).

    663+1Variación de estrellas de los últimos 7 días
  • NOVA@baaivision

    [ICLR 2025] Generación de video autorregresiva sin cuantización vectorial

    660-1Variación de estrellas de los últimos 7 días
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]: Compresión sin pérdida de LLMs y DiTs para una inferencia eficiente en GPU.

    654-1Variación de estrellas de los últimos 7 días
  • Open-dLLM@pengzhangzhi

    Modelo de lenguaje de difusión abierto para generación de código: incluye preentrenamiento, evaluación, inferencia y puntos de control.

    652+3Variación de estrellas de los últimos 7 días
  • blended-latent-diffusion@omriav

    Implementación oficial de "Blended Latent Diffusion" [SIGGRAPH 2023]

    632+0Variación de estrellas de los últimos 7 días
  • OpenMusic@ivcylc

    OpenMusic: Generación de texto a música (TTM) de última generación.

    631+1Variación de estrellas de los últimos 7 días
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto: Escalado de edición de video basada en instrucciones con un conjunto de datos sintéticos de alta calidad

    628+4Variación de estrellas de los últimos 7 días
  • radial-attention@mit-han-lab

    [NeurIPS 2025] Radial Attention: Atención dispersa O(nlogn) con decaimiento de energía para la generación de videos largos.

    607-1Variación de estrellas de los últimos 7 días
  • BrushEdit@TencentARC

    [TPAMI] Implementación oficial del artículo "BrushEdit: All-In-One Image Inpainting and Editing"

    590+0Variación de estrellas de los últimos 7 días
  • semantic-draw@ironjr

    Código oficial para el artículo de CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models".

    588-1Variación de estrellas de los últimos 7 días
  • VEnhancer@Vchitect

    Código oficial de VEnhancer: mejora espacio-temporal generativa para la generación de video.

    579+0Variación de estrellas de los últimos 7 días
  • EDGE@Stanford-TML

    Implementación oficial en PyTorch de EDGE (CVPR 2023)

    577+2Variación de estrellas de los últimos 7 días
← Volver a temas