Lompat ke konten utama
buildradar
Sign in
Topik · diffusion-models

diffusion-models

Repositori open source terpantau bertanda diffusion-models, diurutkan berdasarkan bintang.

163 repositori
  • MOFA-Video@MyNiuuu

    [ECCV 2024] MOFA-Video: Animasi Gambar Terkendali melalui Adaptasi Medan Gerak Generatif dalam Model Difusi Gambar-ke-Video yang Dibekukan.

    766+0Perubahan bintang dalam 7 hari terakhir
  • Kumpulan studi pembuatan teks-ke-gambar yang luar biasa.

    765+0Perubahan bintang dalam 7 hari terakhir
  • PMRF@ohayonguy

    [ICLR 2025] Implementasi resmi Posterior-Mean Rectified Flow: Menuju Restorasi Gambar Fotorealistik dengan MSE Minimum

    754+0Perubahan bintang dalam 7 hari terakhir
  • MagicDrive-V2@flymin

    [ICCV 2025] Implementasi resmi dari makalah “MagicDrive-V2: Pembuatan Video Panjang Resolusi Tinggi untuk Berkendara Otonom dengan Kontrol Adaptif”

    729+1Perubahan bintang dalam 7 hari terakhir
  • distrifuser@mit-han-lab

    [CVPR 2024 Highlight] DistriFusion: Inferensi paralel terdistribusi untuk model difusi resolusi tinggi

    728+0Perubahan bintang dalam 7 hari terakhir
  • nano-world-model@simchowitzlabpublic

    Repositori minimalis yang lengkap untuk memajukan sains World Model.

    725+6Perubahan bintang dalam 7 hari terakhir
  • DL4Proteins-notebooks@Graylab

    Notebook Colab yang mencakup alat deep learning untuk prediksi dan desain struktur biomolekuler

    724+1Perubahan bintang dalam 7 hari terakhir
  • Restorasi Gambar dengan Mean-Reverting Stochastic Differential Equations, ICML 2023. Solusi pemenang NTIRE 2023 Image Shadow Removal Challenge.

    722+0Perubahan bintang dalam 7 hari terakhir
  • mdlm@kuleshov-group

    [NeurIPS 2024] Masked Diffusion Language Model yang Sederhana dan Efektif

    711+2Perubahan bintang dalam 7 hari terakhir
  • [ICML 2025] Implementasi Resmi PyTorch dari "History-Guided Video Diffusion"

    709+1Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi model dunia video (Video World Models) dengan AR Diffusion: mencakup algoritma, aplikasi, dan infrastruktur, yang bertujuan sebagai sumber daya komprehensif bagi peneliti, praktisi, dan penggemar.

    701+5Perubahan bintang dalam 7 hari terakhir
  • CRM@thu-ml

    [ECCV 2024] Single Image to 3D Textured Mesh dalam 10 detik dengan Convolutional Reconstruction Model.

    696+0Perubahan bintang dalam 7 hari terakhir
  • Flow-Factory@X-GenGroup

    Kerangka kerja terpadu untuk reinforcement learning yang mudah pada model Flow-Matching

    690+7Perubahan bintang dalam 7 hari terakhir
  • Koleksi Makalah dan Kode untuk CVPR2026/CVPR2025/ICCV2025/CVPR2024/ECCV2026/ECCV2024 AIGC

    677+1Perubahan bintang dalam 7 hari terakhir
  • HunyuanImage-2.1@Tencent-Hunyuan

    HunyuanImage-2.1: Model Difusi yang Efisien untuk Pembuatan Teks-ke-Gambar Resolusi Tinggi (2K)

    675+0Perubahan bintang dalam 7 hari terakhir
  • Make-An-Audio@Text-to-Audio

    Implementasi PyTorch untuk Make-An-Audio (ICML'23) dengan Model Generatif Text-to-Audio

    668+0Perubahan bintang dalam 7 hari terakhir
  • OneDiffusion@lehduong

    Implementasi resmi makalah OneDiffusion (CVPR 2025)

    665+0Perubahan bintang dalam 7 hari terakhir
  • flash-diffusion@gojasper

    Flash Diffusion — mempercepat model difusi bersyarat (AAAI 2025 Oral).

    663+1Perubahan bintang dalam 7 hari terakhir
  • FoleyCrafter@open-mmlab

    [IJCV 2026] FoleyCrafter: Hidupkan Video Bisu dengan Suara yang Realistis dan Sinkron.

    663+0Perubahan bintang dalam 7 hari terakhir
  • NOVA@baaivision

    [ICLR 2025] Pembuatan Video Autoregresif tanpa Kuantisasi Vektor.

    660-1Perubahan bintang dalam 7 hari terakhir
  • DFloat11@LeanModels

    DFloat11 [NeurIPS '25]: Kompresi lossless LLM dan DiT untuk inferensi GPU yang efisien

    654-1Perubahan bintang dalam 7 hari terakhir
  • Open-dLLM@pengzhangzhi

    Model bahasa difusi terbuka untuk pembuatan kode — merilis pra-pelatihan, evaluasi, inferensi, dan titik pemeriksaan.

    652+3Perubahan bintang dalam 7 hari terakhir
  • blended-latent-diffusion@omriav

    Implementasi resmi untuk "Blended Latent Diffusion" [SIGGRAPH 2023]

    632+0Perubahan bintang dalam 7 hari terakhir
  • OpenMusic@ivcylc

    OpenMusic: Generasi Text-to-music (TTM) SOTA

    631+1Perubahan bintang dalam 7 hari terakhir
  • Ditto@EzioBy

    [CVPR'26 Highlight] Ditto: Menskalakan Pengeditan Video Berbasis Instruksi dengan Dataset Sintetis Berkualitas Tinggi.

    628+2Perubahan bintang dalam 7 hari terakhir
  • radial-attention@mit-han-lab

    [NeurIPS 2025] Radial Attention: O(nlogn) Sparse Attention dengan Energy Decay untuk Pembuatan Video Berdurasi Panjang

    607-1Perubahan bintang dalam 7 hari terakhir
  • BrushEdit@TencentARC

    [TPAMI] Implementasi resmi untuk makalah "BrushEdit: All-In-One Image Inpainting and Editing"

    590+0Perubahan bintang dalam 7 hari terakhir
  • semantic-draw@ironjr

    Kode resmi untuk makalah CVPR 2025 "SemanticDraw: Towards Real-Time Interactive Content Creation from Image Diffusion Models."

    588-1Perubahan bintang dalam 7 hari terakhir
  • VEnhancer@Vchitect

    Kode resmi VEnhancer: Generative Space-Time Enhancement untuk pembuatan video.

    579+0Perubahan bintang dalam 7 hari terakhir
  • EDGE@Stanford-TML

    Implementasi Resmi PyTorch dari EDGE (CVPR 2023)

    577+2Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik