video-generation
Các kho mã nguồn mở đang theo dõi được gắn thẻ video-generation, sắp xếp theo số sao.
- #61
[TPAMI 2025🔥] MagicTime: Mô hình tạo video tua nhanh thời gian như các trình mô phỏng biến hình
★ 1.337-1Thay đổi số sao trong 7 ngày qua - #62
Một mô hình đa phương thức hợp nhất gốc 3B tham số hoạt động (3B-active-parameter) dành cho việc hiểu, tạo và chỉnh sửa hình ảnh cũng như video.
★ 1.334+3Thay đổi số sao trong 7 ngày qua - #63
Tạo video ngắn cho TikTok, Instagram Reels và YouTube Shorts bằng Model Context Protocol (MCP) và REST API.
★ 1.327+9Thay đổi số sao trong 7 ngày qua - #64
Bernini là một framework thống nhất dành cho việc tạo và chỉnh sửa video, kết hợp bộ lập kế hoạch ngữ nghĩa dựa trên MLLM với trình kết xuất dựa trên DiT.
★ 1.300+10Thay đổi số sao trong 7 ngày qua - #65
Mã nguồn cho bài báo Motion Representations for Articulated Animation
★ 1.277+0Thay đổi số sao trong 7 ngày qua - #66★ 1.260+11Thay đổi số sao trong 7 ngày qua
- #67★ 1.260+327Thay đổi số sao trong 7 ngày qua
- #68
Chúng tôi giới thiệu StableAvatar, mô hình transformer khuếch tán video đầu cuối đầu tiên, tổng hợp các video avatar điều khiển bằng âm thanh chất lượng cao, độ dài vô hạn mà không cần bất kỳ xử lý hậu kỳ nào, được điều kiện hóa dựa trên một hình ảnh tham chiếu và âm thanh.
★ 1.258-1Thay đổi số sao trong 7 ngày qua - #69
Kỹ năng tạo B-roll ảnh ghép giấy bán tông màu: Phê duyệt ba cổng, lắp ráp hoạt ảnh khung hình đầu cuối Gemini Omni Flash | Kỹ năng tác nhân B-roll ảnh ghép giấy biên tập biên tập
★ 1.238+19Thay đổi số sao trong 7 ngày qua - #70
HunyuanCustom: Kiến trúc hướng đa phương thức dành cho việc tạo video tùy chỉnh
★ 1.228-1Thay đổi số sao trong 7 ngày qua - #71
Free open-source project designed for turning youtube-viedos into viral short videos. Highlight detection, subtitles, translation, voiceover, all in one for your content.
★ 1.219—Thay đổi số sao trong 7 ngày qua - #72
Mã nguồn cho bài báo SCIS-2025 "UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation".
★ 1.189-1Thay đổi số sao trong 7 ngày qua - #73
Wunjo CE: Hoán đổi khuôn mặt, Khớp nhép môi, Xóa đối tượng & văn bản & nền điều khiển, Tái tạo phong cách, Tách âm thanh, Nhân bản giọng nói, Tạo video. Mã nguồn mở, Chạy cục bộ & Miễn phí.
★ 1.170+1Thay đổi số sao trong 7 ngày qua - #74
[ICLR24] Triển khai chính thức của bài báo “MagicDrive: Street View Generation with Diverse 3D Geometry Control”
★ 1.167+1Thay đổi số sao trong 7 ngày qua - #75
Máy chủ suy luận LLM gốc cho Apple Silicon. Tương thích với API OpenAI và Anthropic. Không sử dụng Python. Bao gồm ứng dụng MLX Core trên macOS với tính năng trò chuyện, chế độ đại lý và gọi công cụ.
★ 1.115+245Thay đổi số sao trong 7 ngày qua - #76★ 1.110+5Thay đổi số sao trong 7 ngày qua
- #77
[ECCV 2024 Oral] MotionDirector: Tùy chỉnh chuyển động của các mô hình khuếch tán Văn bản sang Video.
★ 1.054+3Thay đổi số sao trong 7 ngày qua - #78
SCAIL: Hướng tới hoạt ảnh nhân vật cấp độ studio thông qua học tập trong ngữ cảnh (In-Context Learning) của các biểu diễn tư thế nhất quán 3D (CVPR 2026 Findings)
★ 1.050+4Thay đổi số sao trong 7 ngày qua - #79
[ICML2025] SpargeAttention: Cơ chế chú ý thưa thớt không cần huấn luyện giúp tăng tốc suy luận của mọi mô hình.
★ 1.047+4Thay đổi số sao trong 7 ngày qua - #80
[AAAI 2026] EchoMimicV3: Chỉ cần 1.3B tham số cho hoạt hình con người đa phương thức và đa tác vụ thống nhất
★ 1.044+10Thay đổi số sao trong 7 ngày qua - #81
Danh sách tổng hợp các tài nguyên, công cụ, kỹ năng, hướng dẫn và bài viết về OpenClaw. OpenClaw (trước đây là Moltbot / Clawdbot) — tác nhân AI tự lưu trữ mã nguồn mở cho WhatsApp, Telegram, Discord và hơn 50 tích hợp.
★ 1.005+8Thay đổi số sao trong 7 ngày qua - #82
Codex Skill trung lập với nhà cung cấp để tạo video người thuyết trình AI đã được xác thực từ kịch bản và hình ảnh người thuyết trình được ủy quyền.
★ 998+25Thay đổi số sao trong 7 ngày qua - #83
[TPAMI 2026] Mô hình hóa Thế giới 3D và 4D: Khảo sát
★ 983+9Thay đổi số sao trong 7 ngày qua - #84
:fire: :fire: :fire: Danh sách bài báo về một số công trình Thị giác Máy tính (CV) gần đây
★ 973+1Thay đổi số sao trong 7 ngày qua - #85
Hoạt ảnh hình ảnh mở miền tinh vi với hướng dẫn chuyển động
★ 971-1Thay đổi số sao trong 7 ngày qua - #86
[ICLR 2024] SEINE: Mô hình khuếch tán video từ ngắn đến dài cho chuyển đổi và dự đoán tạo sinh.
★ 967+0Thay đổi số sao trong 7 ngày qua - #87
Hệ thống bot tự động thu thập clip thông qua các bộ lọc tùy chỉnh, cho phép duyệt clip dễ dàng và tổng hợp thành video hoàn chỉnh để tải lên các nền tảng mạng xã hội. Hỗ trợ VPS đầy đủ, tích hợp hệ thống tài khoản cho nhiều người dùng. Bot được chia thành ba chương trình riêng biệt: server, client và th.
★ 961+3Thay đổi số sao trong 7 ngày qua - #88
Mã nguồn chính thức cho [ICML 2026] "Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation" & Causal Forcing++
★ 953+15Thay đổi số sao trong 7 ngày qua - #89
Mở rộng quy mô huấn luyện trước video hỗn hợp chuyên gia cho Trí tuệ nhân tạo thể hiện
★ 950+9Thay đổi số sao trong 7 ngày qua - #90
Chuỗi clip cho MiniMax H3 trong ComfyUI - chuyển động và âm thanh được tiếp nối liền mạch qua các điểm nối.
★ 929+148Thay đổi số sao trong 7 ngày qua