跳到主要內容
buildradar
登入
主題 · video-generation

video-generation

標記 video-generation 主題、收錄中的開源專案,依星數排序。

共 156 個專案
  • FancyVideo@360CVGroup

    基於文字與圖片的影片生成(第一代)

    918-2近 7 天星數變化
  • FollowYourClick@mayuelala

    [AAAI 2025] Follow-Your-Click:此儲存庫為「Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts」的官方實作

    908+0近 7 天星數變化
  • Vista@OpenDriveLab

    [NeurIPS 2024] 自動駕駛通用世界模型

    896+1近 7 天星數變化
  • ditto-talkinghead@antgroup

    [ACM MM 2025] Ditto:用於可控即時虛擬人像合成的運動空間擴散模型。

    881+6近 7 天星數變化
  • flatkey-cli@flatkey-ai

    用於圖像、影片、音訊、文字、製作名單與模型探索的 Flatkey 媒體生成 CLI

    873+144近 7 天星數變化
  • SeedVR2@IceClear

    [ICLR2026] SeedVR2:透過擴散對抗後訓練實現的單步影片修復

    868+10近 7 天星數變化
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 基於頻率分解的保持身份文字轉視訊生成

    857+1近 7 天星數變化
  • UniAnimate-DiT@ali-vilab

    UniAnimate-DiT:基於大規模視訊擴散Transformer的人像動畫生成

    850-1近 7 天星數變化
  • DiffusionAsShader@IGL-HKUST

    [SIGGRAPH 2025] Diffusion as Shader: 用於多功能影片生成控制的 3D 感知影片 Diffusion

    834+2近 7 天星數變化
  • 「RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers」(ICML 2025)、UltraViCo (ICLR 2026) 與 UltraImage 的官方實作

    827+2近 7 天星數變化
  • lmms-engine@EvolvingLMMs-Lab

    一個簡單、統一的多模態模型訓練引擎。精簡、靈活,專為大規模修改與實驗打造。

    825+1近 7 天星數變化
  • kandinsky-5@kandinskylab

    Kandinsky 5.0:用於影片與圖片生成的擴散模型系列

    823+5近 7 天星數變化
  • Text-To-Video-AI@SamurAIGPT

    使用 AI 從文字產生影片

    821+4近 7 天星數變化
  • Matrix-3D@SkyworkAI

    從單張圖片或文字提示詞生成具備高品質全景影片的大規模可探索 3D 場景。

    816+1近 7 天星數變化
  • open-webui-tools@Haervwe

    Open‑WebUI Tools 是一個模組化工具包,旨在擴充並豐富您的 Open WebUI 實例,將其轉化為強大的 AI 工作站。專案內含超過 15 種專門工具、函式管線與過濾器,支援學術研究、代理自主性、多模態創造力、工作流程等功能。

    808+5近 7 天星數變化
  • [TMLR 2025🔥] 視覺自迴歸模型總覽。

    808+0近 7 天星數變化
  • DriveAGI@OpenDriveLab

    [CVPR 2024 Highlight] GenAD:用於自動駕駛的廣義預測模型

    805+0近 7 天星數變化
  • rcm@NVlabs

    rCM 與 Causal-rCM:大規模雙向/自迴歸影片擴散蒸餾的領先與統一演算法/基礎設施

    802+3近 7 天星數變化
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral] Infinity⭐️:用於視覺生成的統一時空自回歸建模。

    785+3近 7 天星數變化
  • 精選的影片生成研究集合。

    783+1近 7 天星數變化
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (又稱 MagicDance):具備身分識別感知的 Diffusion 實現真實人類姿態與面部表情重定向

    777+1近 7 天星數變化
  • ima2-gen@lidge-jun

    針對人類與 coding agents 的 Local-first 視覺化生成執行環境與工作室,在多個供應商之間提供可重現的圖片與影片工作流程。

    756+21近 7 天星數變化
  • 文字轉影片生成/合成技術綜述。

    744+3近 7 天星數變化
  • cosmos-transfer2.5@nvidia-cosmos

    Cosmos-Transfer2.5 基於 Cosmos-Predict2.5 建構,可根據多種空間控制輸入產生高品質的世界模擬。

    736+4近 7 天星數變化
  • comfyui-mcp@artokun

    本地優先、Agent 原生的 ComfyUI 控制平面——內含 MCP 伺服器與側邊欄 Agent,可使用任何 LLM(Claude、ChatGPT、Gemini、離線 Ollama 或任何託管模型)以自然語言生成圖片、影片與音訊,編寫並執行工作流程,以及編輯即時圖表。具備 178 種工具、36 種 AI 技能、55 種安裝套件。支援本機、區域網路、VPS 或 Comfy Cloud。

    732+21近 7 天星數變化
  • nano-world-model@simchowitzlabpublic

    一個極簡、功能齊全的儲存庫,用於推進世界模型科學。

    731+9近 7 天星數變化
  • anything2explainer@Vincentwei1021

    Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.

    730近 7 天星數變化
  • MagicDrive-V2@flymin

    [ICCV 2025] 論文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」的官方實作。

    729+0近 7 天星數變化
  • [ICML 2025] 「History-Guided Video Diffusion」的官方 PyTorch 實作

    709+0近 7 天星數變化
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit:邁向影像編輯與世界模擬的時間推理

    706+2近 7 天星數變化
← 返回主題列表