video-generation
Repositori open source terpantau bertanda video-generation, diurutkan berdasarkan bintang.
- #91
[AAAI 2025] Follow-Your-Click: Repositori ini adalah implementasi resmi dari "Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts".
★ 908+0Perubahan bintang dalam 7 hari terakhir - #92★ 896+0Perubahan bintang dalam 7 hari terakhir
- #93
[ACM MM 2025] Ditto: Difusi Ruang-Gerak untuk Sintesis Kepala Berbicara Realtime yang Dapat Dikontrol
★ 877+5Perubahan bintang dalam 7 hari terakhir - #94
[ICLR2026] SeedVR2: Pemulihan Video Satu Langkah melalui Pelatihan Lanjutan Musuh Difusi
★ 863+9Perubahan bintang dalam 7 hari terakhir - #95
[Sorotan CVPR 2025🔥] Pembuatan Video dari Teks dengan Menjaga Identitas melalui Dekomposisi Frekuensi
★ 856+1Perubahan bintang dalam 7 hari terakhir - #96
UniAnimate-DiT: Animasi Gambar Manusia dengan Large-Scale Video Diffusion Transformer
★ 850-1Perubahan bintang dalam 7 hari terakhir - #97
[SIGGRAPH 2025] Diffusion as Shader: 3D-aware Video Diffusion untuk Kontrol Pembuatan Video yang Serbaguna
★ 832+1Perubahan bintang dalam 7 hari terakhir - #98
Implementasi resmi untuk "RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers" (ICML 2025), UltraViCo (ICLR 2026), dan UltraImage
★ 827+0Perubahan bintang dalam 7 hari terakhir - #99
Mesin pelatihan model multimodal yang sederhana dan terpadu. Ringan, fleksibel, dan dirancang untuk peretasan skala besar.
★ 824+0Perubahan bintang dalam 7 hari terakhir - #100
Hasilkan video dari teks menggunakan AI
★ 820+3Perubahan bintang dalam 7 hari terakhir - #101
Kandinsky 5.0: Sekeluarga model difusi untuk pembuatan Video & Gambar
★ 819+7Perubahan bintang dalam 7 hari terakhir - #102
Hasilkan adegan 3D berskala besar yang dapat dijelajahi dengan video panorama berkualitas tinggi dari satu gambar atau prompt teks.
★ 815+17Perubahan bintang dalam 7 hari terakhir - #103
CLI pembuatan media Flatkey untuk gambar, video, audio, teks, kredit, dan penemuan model.
★ 810+132Perubahan bintang dalam 7 hari terakhir - #104
[TMLR 2025🔥] Survei untuk model autoregresif dalam visi.
★ 808+1Perubahan bintang dalam 7 hari terakhir - #105
[CVPR 2024 Highlight] GenAD: Model Prediktif Generalisasi untuk Mengemudi Otonom
★ 805+0Perubahan bintang dalam 7 hari terakhir - #106
Open‑WebUI Tools adalah toolkit modular yang dirancang untuk memperluas dan memperkaya instans Open WebUI Anda, mengubahnya menjadi stasiun kerja AI yang canggih. Dengan rangkaian lebih dari 15 alat khusus, pipa fungsi, dan filter, proyek ini mendukung penelitian akademis, otonomi agen, kreativitas multimodal, alur kerja, dan banyak lagi
★ 805+2Perubahan bintang dalam 7 hari terakhir - #107
rCM & Causal-rCM: Algoritma/Infrastruktur Utama dan Terpadu untuk Distilasi Difusi Video Dua Arah/Autoregresif dalam Skala Besar
★ 800+6Perubahan bintang dalam 7 hari terakhir - #108
[NeurIPS 2025 Oral] Infinity⭐️: Pemodelan AutoRegressive Ruang-Waktu Terpadu untuk Pembuatan Visual
★ 783+3Perubahan bintang dalam 7 hari terakhir - #109
Kumpulan studi pembuatan video yang luar biasa.
★ 782+0Perubahan bintang dalam 7 hari terakhir - #110
[ICML 2024] MagicPose (juga dikenal sebagai MagicDance): Retargeting Pose Manusia dan Ekspresi Wajah Realistis dengan Diffusion yang Sadar Identitas
★ 776+0Perubahan bintang dalam 7 hari terakhir - #111
Runtime dan studio pembuatan visual lokal pertama untuk manusia dan agen pengkodean, dengan alur kerja gambar dan video yang dapat direproduksi di berbagai penyedia.
★ 746+20Perubahan bintang dalam 7 hari terakhir - #112
Survei tentang Pembuatan/Sintesis Teks-ke-Video.
★ 743+0Perubahan bintang dalam 7 hari terakhir - #113
Cosmos-Transfer2.5, dibangun di atas Cosmos-Predict2.5, menghasilkan simulasi dunia berkualitas tinggi yang dikondisikan pada berbagai input kontrol spasial.
★ 733+4Perubahan bintang dalam 7 hari terakhir - #114
[ICCV 2025] Implementasi resmi dari makalah “MagicDrive-V2: Pembuatan Video Panjang Resolusi Tinggi untuk Berkendara Otonom dengan Kontrol Adaptif”
★ 729+1Perubahan bintang dalam 7 hari terakhir - #115
Control plane berbasis agen dan lokal untuk ComfyUI — server MCP + agen sidebar yang menghasilkan gambar, video & audio, menulis dan menjalankan alur kerja, serta mengedit grafik langsung Anda dalam bahasa alami di LLM APA PUN (Claude, ChatGPT, Gemini, Ollama offline, atau model yang dihosting). 178 alat, 36 keterampilan AI, 55 paket installer. Lokal, LAN, VPS, atau Comfy Cloud.
★ 727+24Perubahan bintang dalam 7 hari terakhir - #116
Repositori minimalis yang lengkap untuk memajukan sains World Model.
★ 725+4Perubahan bintang dalam 7 hari terakhir - #117
[ICML 2025] Implementasi Resmi PyTorch dari "History-Guided Video Diffusion"
★ 709+1Perubahan bintang dalam 7 hari terakhir - #118
[ICLR 2026] ChronoEdit: Menuju Penalaran Temporal untuk Pengeditan Gambar dan Simulasi Dunia
★ 706-2Perubahan bintang dalam 7 hari terakhir - #119
[ECCV 2026] SparkVSR: Super-Resolusi Video Interaktif melalui Propagasi Kunci Jarang
★ 702+3Perubahan bintang dalam 7 hari terakhir - #120
Daftar kurasi model dunia video (Video World Models) dengan AR Diffusion: mencakup algoritma, aplikasi, dan infrastruktur, yang bertujuan sebagai sumber daya komprehensif bagi peneliti, praktisi, dan penggemar.
★ 701+4Perubahan bintang dalam 7 hari terakhir