diffusion-models
Repositori open source terpantau bertanda diffusion-models, diurutkan berdasarkan bintang.
- #61
Pelatihan diffusion models yang berskala dan teroptimasi memorinya
★ 1.359+1Perubahan bintang dalam 7 hari terakhir - #62
[ICASSP 2024] 🍵 Matcha-TTS: Arsitektur TTS cepat dengan pencocokan alur bersyarat
★ 1.353+4Perubahan bintang dalam 7 hari terakhir - #63★ 1.351+2Perubahan bintang dalam 7 hari terakhir
- #64
FireRed-Image-Edit adalah fondasi pengeditan gambar yang kuat yang mencapai kinerja mutakhir sumber terbuka dengan pematuhan instruksi yang tepat, pembuatan fidelitas tinggi, konsistensi identitas yang unggul, dan fusi multi-elemen yang mulus.
★ 1.350+6Perubahan bintang dalam 7 hari terakhir - #65
[AAAI 2025]👔IMAGDressing👔: Pembuatan Pakaian Modular Interaktif untuk Pakaian Virtual. Ini memungkinkan pembuatan gambar manusia yang dapat disesuaikan dengan kontrol pakaian, pose, dan adegan yang fleksibel, memastikan fidelitas tinggi dan konsistensi pakaian untuk pakaian virtual.
★ 1.343+0Perubahan bintang dalam 7 hari terakhir - #66
[TPAMI 2025🔥] MagicTime: Model Pembuatan Video Selang Waktu sebagai Simulator Metamorfik
★ 1.337-1Perubahan bintang dalam 7 hari terakhir - #67
📦 Paket portabel untuk menjalankan Hunyuan3D 2.0/2.1 di Windows. | 混元 3D 2.0/2.1 整合包
★ 1.326+5Perubahan bintang dalam 7 hari terakhir - #68
Pruna adalah kerangka kerja optimasi model yang dibuat untuk pengembang, memungkinkan Anda menghadirkan model yang lebih cepat dan efisien dengan overhead minimal.
★ 1.274+2Perubahan bintang dalam 7 hari terakhir - #69
[CVPR 2025 Oral & Finalis Paper Terbaik] Difix3D+: Meningkatkan Rekonstruksi 3D dengan Model Difusi Satu Langkah
★ 1.267+0Perubahan bintang dalam 7 hari terakhir - #70
[CVPR2024, Highlight] Kode resmi untuk DragDiffusion
★ 1.259+0Perubahan bintang dalam 7 hari terakhir - #71★ 1.238-1Perubahan bintang dalam 7 hari terakhir
- #72
Model Text-to-Speech berbasis Flow Matching dengan Kontrol Gaya berbasis Emoji
★ 1.228+8Perubahan bintang dalam 7 hari terakhir - #73
HunyuanCustom: Arsitektur Berbasis Multimodal untuk Pembuatan Video Kustom
★ 1.228+1Perubahan bintang dalam 7 hari terakhir - #74★ 1.196+0Perubahan bintang dalam 7 hari terakhir
- #75
Wunjo CE: Tukar Wajah, Sinkronisasi Bibir, Hapus Kontrol Objek & Teks & Latar Belakang, Restyling, Pemisah Audio, Kloning Suara, Pembuatan Video. Sumber Terbuka, Lokal & Gratis.
★ 1.170+1Perubahan bintang dalam 7 hari terakhir - #76
[ICLR24] Implementasi resmi dari makalah “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Perubahan bintang dalam 7 hari terakhir - #77
Kumpulan sumber daya tentang pembuatan terkontrol dengan model difusi teks-ke-gambar.
★ 1.110+0Perubahan bintang dalam 7 hari terakhir - #78★ 1.108+4Perubahan bintang dalam 7 hari terakhir
- #79
Stable Diffusion yang diimplementasikan dari awal menggunakan PyTorch
★ 1.078-1Perubahan bintang dalam 7 hari terakhir - #80
[Sorotan ICLR'24] Seri Model Besar Multimodal Bahasa Mandarin dan Inggris (Chat dan Paint) | Berdasarkan model dasar CPM
★ 1.061+0Perubahan bintang dalam 7 hari terakhir - #81
[ECCV 2024 Oral] MotionDirector: Kustomisasi Gerakan pada Model Difusi Text-to-Video.
★ 1.053+3Perubahan bintang dalam 7 hari terakhir - #82
[ICLR 2025 Oral] Implementasi resmi dari "Diffusion-Based Planning for Autonomous Driving with Flexible Guidance"
★ 1.050+5Perubahan bintang dalam 7 hari terakhir - #83
[CVPR 2025 Highlight] 3DTopia-XL: Pembuatan Aset 3D PBR Berkualitas Tinggi melalui Primitive Diffusion.
★ 1.046+1Perubahan bintang dalam 7 hari terakhir - #84
[ICLR 2024 Spotlight] SyncDreamer: Menghasilkan Citra yang Konsisten dari Berbagai Sudut Pandang Berdasarkan Citra Tunggal.
★ 1.044+0Perubahan bintang dalam 7 hari terakhir - #85
Implementasi resmi dari makalah: "FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models"
★ 1.013-1Perubahan bintang dalam 7 hari terakhir - #86★ 986+24Perubahan bintang dalam 7 hari terakhir
- #87
[CVPR 2024] PIA, Personalized Image Animator Anda. Animasikan gambar Anda melalui prompt teks, dikombinasikan dengan Dreambooth, untuk menghasilkan video yang memukau.
★ 975+0Perubahan bintang dalam 7 hari terakhir - #88★ 970+0Perubahan bintang dalam 7 hari terakhir
- #89★ 969+0Perubahan bintang dalam 7 hari terakhir
- #90
[ICLR 2026] Kerangka Kerja Iteratif Tanpa Pelatihan untuk Visualisasi Cerita Panjang
★ 959+1Perubahan bintang dalam 7 hari terakhir