text-to-video
Repositori open source terpantau bertanda text-to-video, diurutkan berdasarkan bintang.
- #31
✨ Hotshot-XL: Model AI text-to-GIF mutakhir yang dilatih untuk bekerja bersama Stable Diffusion XL.
★ 1.110-1Perubahan bintang dalam 7 hari terakhir - #32
[NeurIPS 2024] Implementasi resmi "ShareGPT4Video: Meningkatkan Pemahaman dan Pembuatan Video dengan Keterangan yang Lebih Baik"
★ 1.094+1Perubahan bintang dalam 7 hari terakhir - #33
HunyuanVideo-Foley: Difusi Multimodal dengan Penyelarasan Representasi untuk Pembuatan Audio Foley Berkualitas Tinggi.
★ 1.057+3Perubahan bintang dalam 7 hari terakhir - #34
[ECCV 2024 Oral] MotionDirector: Kustomisasi Gerakan pada Model Difusi Text-to-Video.
★ 1.054+1Perubahan bintang dalam 7 hari terakhir - #35
Daftar kurasi sumber daya, alat, keahlian, tutorial & artikel OpenClaw. OpenClaw (sebelumnya Moltbot / Clawdbot) — agen AI open-source yang di-hosting sendiri untuk WhatsApp, Telegram, Discord & 50+ integrasi.
★ 1.005+8Perubahan bintang dalam 7 hari terakhir - #36
Generator teks ke video dalam bentuk brainrot. Pelajari topik apa pun dari tokoh favorit Anda 😼.
★ 960+0Perubahan bintang dalam 7 hari terakhir - #37
[ICML 2026] Basis kode resmi untuk "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 953+9Perubahan bintang dalam 7 hari terakhir - #38
Pembuatan video dari teks & gambar, generasi pertama
★ 918-2Perubahan bintang dalam 7 hari terakhir - #39
[Sorotan CVPR 2025🔥] Pembuatan Video dari Teks dengan Menjaga Identitas melalui Dekomposisi Frekuensi
★ 857+1Perubahan bintang dalam 7 hari terakhir - #40
Kandinsky 5.0: Sekeluarga model difusi untuk pembuatan Video & Gambar
★ 823+5Perubahan bintang dalam 7 hari terakhir - #41
Hasilkan video dari teks menggunakan AI
★ 821+4Perubahan bintang dalam 7 hari terakhir - #42
Hasilkan adegan 3D berskala besar yang dapat dijelajahi dengan video panorama berkualitas tinggi dari satu gambar atau prompt teks.
★ 816+1Perubahan bintang dalam 7 hari terakhir - #43
CLIP + FFT/DWT/RGB = teks ke gambar/video
★ 789+0Perubahan bintang dalam 7 hari terakhir - #44
Implementasi Phenaki Video, yang menggunakan Mask GIT untuk menghasilkan video berpanduan teks dengan durasi hingga 2 menit, dalam Pytorch
★ 789+0Perubahan bintang dalam 7 hari terakhir - #45
ClipForge (sebelumnya 'daihuo-jianshou'): Alat video pendek e-commerce AI open-source — unggah gambar produk, AI otomatis mengekstrak nilai jual + menulis skrip promosi + mengunci gambar asli produk agar tidak berubah bentuk + menambahkan visual/sulih suara/subitel, menghasilkan video pendek penjualan untuk Douyin / Kuaishou / Xiaohongshu / TikTok Shop dalam satu klik. Produksi massal tanpa biaya, open-source tanpa tanda air, dapat dideploy secara lokal. Juga mendukung pembuatan video dari topik satu kalimat. Generator video pendek e-commerce/UGC AI open-source.
★ 748+67Perubahan bintang dalam 7 hari terakhir - #46
Survei tentang Pembuatan/Sintesis Teks-ke-Video.
★ 744+3Perubahan bintang dalam 7 hari terakhir - #47
Integrasi dan Eksplorasi Multimodal Paddle, mendukung tugas multimodal arus utama, termasuk model pra-pelatihan multimodal skala besar end-to-end dan kotak alat model difusi. Dilengkapi dengan kinerja tinggi dan fleksibilitas.
★ 723-1Perubahan bintang dalam 7 hari terakhir - #48★ 685+0Perubahan bintang dalam 7 hari terakhir
- #49
Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.
★ 683—Perubahan bintang dalam 7 hari terakhir - #50
GPT Image 2 to Seedance 2.5 Early Access workflow guide.
★ 589+2Perubahan bintang dalam 7 hari terakhir - #51★ 579+0Perubahan bintang dalam 7 hari terakhir
- #52★ 553+0Perubahan bintang dalam 7 hari terakhir
- #53
🔥🔥🔥 Daftar kurasi makalah tentang generasi multimodal berbasis LLM (gambar, video, 3D, dan audio).
★ 552+0Perubahan bintang dalam 7 hari terakhir - #54
[ECCV 2024] FreeInit: Menjembatani Kesenjangan Inisialisasi dalam Model Difusi Video
★ 543+0Perubahan bintang dalam 7 hari terakhir - #55
Generasi film AI paralel berbasis multi-model yang didorong oleh DAG — percepatan paralel berskala dengan independensi adegan; Menghasilkan adegan film secara bersamaan alih-alih satu per satu; Mesin penghasil film yang memodelkan ketergantungan narasi adegan sebagai DAG dan digerakkan oleh algoritma CPM untuk penjadwalan paralel.
★ 537+2Perubahan bintang dalam 7 hari terakhir - #56
Ubah coding agent Anda menjadi studio video: deskripsikan video dalam bahasa sehari-hari, dan agent Anda akan menulis linimasa serta menghasilkan file tersebut.
★ 525+0Perubahan bintang dalam 7 hari terakhir - #57
An all-in-one, 100% local AI video, image, and music studio. Director mode plans full music videos and short films from a single prompt. Built on the WanGP pipeline. Install via Pinokio.
★ 524—Perubahan bintang dalam 7 hari terakhir - #58
Kumpulan Google Colab Notebook untuk berbagai proyek
★ 521+1Perubahan bintang dalam 7 hari terakhir - #59
Open-source AI video workbench. Bring any model or your local ComfyUI, and let Claude Code / Codex / Cursor direct it over MCP — storyboard, references, generation, editable first cut on a real timeline. Local-first: projects, prompts, and keys stay on your machine. No account, no telemetry.
★ 505—Perubahan bintang dalam 7 hari terakhir