Aller au contenu principal
buildradar
Sign in
Sujet · diffusion

diffusion

Dépôts open source suivis étiquetés diffusion, triés par étoiles.

76 dépôts
  • Helios@PKU-YuanGroup

    Helios : Modèle de génération de vidéos longues en temps réel

    2 129+18Évolution des étoiles sur les 7 derniers jours
  • Modèles de diffusion en imagerie médicale (publié dans la revue Medical Image Analysis).

    2 110+2Évolution des étoiles sur les 7 derniers jours
  • ICEdit@River-Zhang

    [NeurIPS 2025] L'édition d'images vaut bien un seul LoRA ! 0,1 % de données d'entraînement pour une édition d'image fantastique ! Surpasse GPT-4o en persistance d'identité ~ Checkpoint MoE publié ! Seulement 4 Go de VRAM suffisent pour l'exécuter !

    2 104+1Évolution des étoiles sur les 7 derniers jours
  • LlamaGen@FoundationVision

    Le modèle autorégressif surpasse la diffusion : Llama pour la génération d'images à grande échelle

    1 966+0Évolution des étoiles sur les 7 derniers jours
  • BrushNet@TencentARC

    [ECCV 2024] Implémentation officielle de l'article « BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion »

    1 744-1Évolution des étoiles sur les 7 derniers jours
  • REPA@sihyun-yu

    [ICLR'25 Oral] Alignement de représentation pour la génération : entraîner des Diffusion Transformers est plus simple que vous ne le pensez.

    1 706+2Évolution des étoiles sur les 7 derniers jours
  • fantasy-talking@Fantasy-AMAP

    [ACM MM 2025] FantasyTalking : Génération de portraits parlants réalistes via la synthèse de mouvement cohérent

    1 628+0Évolution des étoiles sur les 7 derniers jours
  • AngelSlim@Tencent

    Boîte à outils de compression de modèles conçue pour une meilleure utilisabilité, exhaustivité et efficacité.

    1 619+58Évolution des étoiles sur les 7 derniers jours
  • Pallaidium@tin2tin

    PALLAIDIUM : studio de cinéma basé sur l'IA générative, intégré à l'éditeur vidéo de Blender (VSE), permettant une production complète du script à l'écran.

    1 523+0Évolution des étoiles sur les 7 derniers jours
  • UNO@bytedance

    [ICCV 2025] UNO : Une méthode de personnalisation universelle pour le conditionnement mono et multi-sujets

    1 362+0Évolution des étoiles sur les 7 derniers jours
  • finetrainers@huggingface

    Entraînement évolutif et optimisé en mémoire de modèles de diffusion

    1 359+0Évolution des étoiles sur les 7 derniers jours
  • Extension Inpaint Anything effectuant de l'inpainting stable diffusion via une interface web utilisant des masques de Segment Anything.

    1 298+0Évolution des étoiles sur les 7 derniers jours
  • tango@declare-lab

    Une famille de modèles de diffusion pour la génération de texte vers audio.

    1 238-1Évolution des étoiles sur les 7 derniers jours
  • MixGRPO@Tencent-Hunyuan

    [ECCV 2026] MixGRPO : Libérer l'efficacité du GRPO basé sur les flux avec des ODE-SDE mixtes

    1 177+0Évolution des étoiles sur les 7 derniers jours
  • mlx-serve@ddalcu

    Serveur d'inférence LLM natif pour Apple Silicon. Compatible avec les API OpenAI et Anthropic. Sans Python. Inclut l'application macOS MLX Core avec chat, mode agent et appel d'outils.

    1 115+245Évolution des étoiles sur les 7 derniers jours
  • dial-mpc@LeCAR-Lab

    Implémentation officielle de l'article "Full-Order Sampling-Based MPC for Torque-Level Locomotion Control via Diffusion-Style Annealing". DIAL-MPC est un nouveau framework MPC basé sur l'échantillonnage pour le contrôle de couple complet des robots à pattes, alliant précision et agilité sans entraînement préalable.

    997+1Évolution des étoiles sur les 7 derniers jours
  • Liste de conceptions moléculaires et matérielles utilisant l'IA générative et l'apprentissage profond.

    952+1Évolution des étoiles sur les 7 derniers jours
  • Causal-Forcing@thu-ml

    [ICML 2026] Base de code officielle pour "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++

    948+10Évolution des étoiles sur les 7 derniers jours
  • FireRedTTS@FireRedTeam

    Un système de synthèse vocale (TTS) open source basé sur des LLM.

    921+2Évolution des étoiles sur les 7 derniers jours
  • UniWorld@PKU-YuanGroup

    UniWorld : encodeurs sémantiques haute résolution pour la compréhension et la génération visuelles unifiées

    890+0Évolution des étoiles sur les 7 derniers jours
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight] Génération de texte vers vidéo préservant l'identité par décomposition fréquentielle.

    856+1Évolution des étoiles sur les 7 derniers jours
  • LION@nv-tlabs

    Modèles de diffusion de points latents pour la génération de formes 3D

    835+0Évolution des étoiles sur les 7 derniers jours
  • Implémentation officielle pour « RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers » (ICML 2025), UltraViCo (ICLR 2026) et UltraImage

    827+2Évolution des étoiles sur les 7 derniers jours
  • Adan@sail-sg

    Adan : Algorithme de momentum de Nesterov adaptatif pour une optimisation plus rapide des modèles profonds.

    822+0Évolution des étoiles sur les 7 derniers jours
  • kandinsky-5@kandinskylab

    Kandinsky 5.0 : Une famille de modèles de diffusion pour la génération d'images et de vidéos.

    819+3Évolution des étoiles sur les 7 derniers jours
  • [TMLR 2025🔥] Étude sur les modèles autorégressifs en vision.

    808+1Évolution des étoiles sur les 7 derniers jours
  • daam@castorini

    Cartes d'attribution basées sur l'attention pour l'interprétation de Stable Diffusion.

    802+0Évolution des étoiles sur les 7 derniers jours
  • rcm@NVlabs

    rCM & Causal-rCM : Algorithmes et infrastructures de pointe unifiés pour la distillation de diffusion vidéo bidirectionnelle/autorégressive à grande échelle

    800+6Évolution des étoiles sur les 7 derniers jours
  • smalldiffusion@yuanchenyang

    Code simple et lisible pour l'entraînement et l'échantillonnage de modèles de diffusion.

    785+2Évolution des étoiles sur les 7 derniers jours
  • FRESCO@williamyang1991

    [CVPR 2024] FRESCO : Correspondance spatio-temporelle pour la traduction vidéo zero-shot.

    782-1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets