Saltar al contenido principal
buildradar
Sign in
Tema · diffusion-models

diffusion-models

Repositorios de código abierto monitorizados etiquetados con diffusion-models, ordenados por estrellas.

163 repositorios
  • verl-omni@verl-project

    Framework de entrenamiento de aprendizaje por refuerzo multimodal para modelos de difusión y omnimodales

    955+56Variación de estrellas de los últimos 7 días
  • Resumen del procesamiento de imágenes basado en difusión, incluyendo restauración, mejora, codificación y evaluación de calidad

    954-1Variación de estrellas de los últimos 7 días
  • Skyfall-GS@jayin92

    [ECCV 2026] Skyfall-GS: Síntesis de escenas urbanas 3D inmersivas a partir de imágenes satelitales.

    953+4Variación de estrellas de los últimos 7 días
  • Causal-Forcing@thu-ml

    [ICML 2026] Repositorio oficial para "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" y Causal Forcing++

    948+9Variación de estrellas de los últimos 7 días
  • ODISE@NVlabs

    Implementación oficial en PyTorch de ODISE: Segmentación panóptica de vocabulario abierto con modelos de difusión de texto a imagen [CVPR 2023 Highlight]

    943+0Variación de estrellas de los últimos 7 días
  • Resumen de artículos y blogs clave sobre modelos de difusión para aprender sobre el tema. Lista detallada de todos los artículos publicados sobre robótica de difusión.

    920+1Variación de estrellas de los últimos 7 días
  • MindAct@candle-org

    MindSpore + 🤗Huggingface: Ejecute cualquier modelo de Transformers/Diffusers en MindSpore con compatibilidad y aceleración perfectas.

    920+0Variación de estrellas de los últimos 7 días
  • Aplicación que muestra múltiples pipelines de modelos de difusión en tiempo real con Diffusers.

    916+0Variación de estrellas de los últimos 7 días
  • UniPic@SkyworkAI

    Modelo de edición multi-imagen SOTA de código abierto

    874+1Variación de estrellas de los últimos 7 días
  • MiniGPT-5@UCSB-AI

    Implementación oficial del artículo "MiniGPT-5: Interleaved Vision-and-Language Generation via Generative Vokens"

    869+0Variación de estrellas de los últimos 7 días
  • OpenWorldLib@OpenDCAI

    Base de código unificada para modelos de mundo avanzados.

    866+1Variación de estrellas de los últimos 7 días
  • Open-DiffusionGS@caiyuanhao1998

    Integración de Gaussian Splatting en un eliminador de ruido de difusión para la generación y reconstrucción de imágenes a 3D de una sola etapa, rápida y escalable (ICCV 2025)

    861-2Variación de estrellas de los últimos 7 días
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight] Generación de video a partir de texto con preservación de identidad mediante descomposición de frecuencia.

    856+1Variación de estrellas de los últimos 7 días
  • instruct-nerf2nerf@ayaanzhaque

    Instruct-NeRF2NeRF: Edición de escenas 3D con instrucciones (ICCV 2023)

    852+0Variación de estrellas de los últimos 7 días
  • Lista de artículos relacionados con la cuantización de redes neuronales en conferencias y revistas de IA recientes.

    851+5Variación de estrellas de los últimos 7 días
  • DiffuSeq@Shark-NLP

    [ICLR'23] DiffuSeq: Generación de texto secuencia a secuencia con modelos de difusión.

    838+0Variación de estrellas de los últimos 7 días
  • MeshDiffusion@lzzcd001

    Implementación oficial de "MeshDiffusion: Score-based Generative 3D Mesh Modeling" (ICLR 2023 Spotlight).

    832+0Variación de estrellas de los últimos 7 días
  • GaussianDreamer@hustvl

    [CVPR 2024] GaussianDreamer: Generación rápida de texto a 3D Gaussians mediante la conexión de modelos de difusión 2D y 3D.

    829-1Variación de estrellas de los últimos 7 días
  • Implementación oficial de "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026) y UltraImage.

    827+0Variación de estrellas de los últimos 7 días
  • Una lista curada de artículos de visión 3D relacionados con el dominio de la robótica en la era de los grandes modelos, es decir, LLMs/VLMs, inspirada en awesome-computer-vision, que incluye artículos, códigos y sitios web relacionados

    820+1Variación de estrellas de los últimos 7 días
  • daclip-uir@Algolzw

    [ICLR 2024] Control de modelos de lenguaje visual para la restauración universal de imágenes. Quinto lugar en el desafío NTIRE 2024 Restore Any Image Model in the Wild.

    817+1Variación de estrellas de los últimos 7 días
  • Paint3D@OpenTexture

    [CVPR 2024] Paint3D: Paint Anything 3D with Lighting-Less Texture Diffusion Models, un modelo generativo de texturas sin iluminación integrada.

    808-1Variación de estrellas de los últimos 7 días
  • deepinv@deepinv

    DeepInverse: una biblioteca de PyTorch para resolver problemas inversos de imágenes mediante aprendizaje profundo

    802+5Variación de estrellas de los últimos 7 días
  • audio-diffusion@teticio

    Aplica modelos de difusión usando el nuevo paquete diffusers de Hugging Face para sintetizar música en lugar de imágenes.

    795+1Variación de estrellas de los últimos 7 días
  • smalldiffusion@yuanchenyang

    Código simple y legible para entrenar y realizar muestreos a partir de modelos de difusión

    785+0Variación de estrellas de los últimos 7 días
  • Una colección de estudios impresionantes sobre generación de video.

    782+0Variación de estrellas de los últimos 7 días
  • Fusión de modelos en LLMs, MLLMs y más allá: métodos, teorías, aplicaciones y oportunidades. ACM Computing Surveys, 2026.

    779+2Variación de estrellas de los últimos 7 días
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (también conocido como MagicDance): reorientación realista de poses humanas y expresiones faciales con difusión consciente de la identidad.

    776+0Variación de estrellas de los últimos 7 días
  • dift@Tsingularity

    [NeurIPS'23] Correspondencia emergente a partir de difusión de imágenes

    775+0Variación de estrellas de los últimos 7 días
  • Attend-and-Excite@yuval-alaluf

    Implementación oficial de "Attend-and-Excite: Attention-Based Semantic Guidance for Text-to-Image Diffusion Models" (SIGGRAPH 2023)

    770+0Variación de estrellas de los últimos 7 días
← Volver a temas