跳到主要内容
buildradar
登录
主题 · video-generation

video-generation

标记 video-generation 主题、收录中的开源项目,按星标数排序。

共 156 个项目
  • FancyVideo@360CVGroup

    基于文字与图片的视频生成(第一代)

    918-2近 7 天星标变化
  • flatkey-cli@flatkey-ai

    用于图像、视频、音频、文字、制作名单与模型探索的 Flatkey 媒体生成 CLI

    908+144近 7 天星标变化
  • FollowYourClick@mayuelala

    [AAAI 2025] Follow-Your-Click:此仓库为“Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts”的官方实现

    908+0近 7 天星标变化
  • Vista@OpenDriveLab

    [NeurIPS 2024] 自动驾驶通用世界模型

    897+1近 7 天星标变化
  • ditto-talkinghead@antgroup

    [ACM MM 2025] Ditto:用于可控实时虚拟人像合成的运动空间扩散模型。

    884+6近 7 天星标变化
  • SeedVR2@IceClear

    [ICLR2026] SeedVR2:通过扩散对抗后训练实现的单步视频修复

    871+10近 7 天星标变化
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 基于频率分解的保持身份文本转视频生成

    857+1近 7 天星标变化
  • UniAnimate-DiT@ali-vilab

    UniAnimate-DiT:基于大规模视频扩散Transformer的人像动画生成

    851-1近 7 天星标变化
  • DiffusionAsShader@IGL-HKUST

    [SIGGRAPH 2025] Diffusion as Shader: 用于多功能视频生成控制的 3D 感知视频 Diffusion

    835+2近 7 天星标变化
  • anything2explainer@Vincentwei1021

    Topic in, narrated explainer video out. A Claude Code / Codex skill that turns any topic into a black-canvas motion-graphics explainer video with TTS voiceover, subtitles and a chapter progress bar. Chinese or English; every frame drawn in code with Remotion.

    830近 7 天星标变化
  • “RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers”(ICML 2025)、UltraViCo (ICLR 2026) 与 UltraImage 的官方实现

    827+2近 7 天星标变化
  • lmms-engine@EvolvingLMMs-Lab

    一个简单、统一的多模态模型训练引擎。精简、灵活,专为大规模修改与实验打造。

    825+1近 7 天星标变化
  • kandinsky-5@kandinskylab

    Kandinsky 5.0:用于视频与图像生成的扩散模型系列

    824+5近 7 天星标变化
  • Text-To-Video-AI@SamurAIGPT

    使用 AI 从文字生成视频

    822+4近 7 天星标变化
  • Matrix-3D@SkyworkAI

    从单张图片或文字提示词生成具备高质量全景视频的大规模可探索 3D 场景。

    817+1近 7 天星标变化
  • open-webui-tools@Haervwe

    Open‑WebUI Tools 是一个模块化工具包,旨在扩充并丰富您的 Open WebUI 实例,将其转化为强大的 AI 工作站。项目内含超过 15 种专门工具、函数管线与过滤器,支持学术研究、代理自主性、多模态创造力、工作流程等功能。

    808+5近 7 天星标变化
  • [TMLR 2025🔥] 视觉自回归模型综述。

    808+0近 7 天星标变化
  • DriveAGI@OpenDriveLab

    [CVPR 2024 Highlight] GenAD:用于自动驾驶的广义预测模型

    805+0近 7 天星标变化
  • rcm@NVlabs

    rCM 与 Causal-rCM:大规模双向/自回归视频扩散蒸馏的领先与统一算法/基础设施

    803+3近 7 天星标变化
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral] Infinity⭐️:用于视觉生成的统一时空自回归建模。

    785+3近 7 天星标变化
  • 精选的视频生成研究集合。

    783+1近 7 天星标变化
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (也称 MagicDance):具备身份感知能力的 Diffusion 实现真实人类姿态与面部表情重定向

    777+1近 7 天星标变化
  • ima2-gen@lidge-jun

    针对人类与 coding agents 的 Local-first 可视化生成运行时与工作室,在多个供应商之间提供可重现的图片与视频工作流程。

    759+21近 7 天星标变化
  • 文本转视频生成/合成技术综述。

    744+3近 7 天星标变化
  • comfyui-mcp@artokun

    本地优先、Agent 原生的 ComfyUI 控制平面——内含 MCP 服务器与侧边栏 Agent,可使用任何 LLM(Claude、ChatGPT、Gemini、离线 Ollama 或任何托管模型)以自然语言生成图片、视频与音频,编写并执行工作流程,以及编辑实时图表。具备 178 种工具、36 种 AI 技能、55 种安装套件。支持本地、局域网、VPS 或 Comfy Cloud。

    739+21近 7 天星标变化
  • cosmos-transfer2.5@nvidia-cosmos

    Cosmos-Transfer2.5 基于 Cosmos-Predict2.5 构建,可根据多种空间控制输入产生高质量的世界模拟。

    737+4近 7 天星标变化
  • nano-world-model@simchowitzlabpublic

    一个极简、功能齐全的存储库,用于推进世界模型科学。

    734+9近 7 天星标变化
  • MagicDrive-V2@flymin

    [ICCV 2025] 论文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」的官方实现。

    729+0近 7 天星标变化
  • [ICML 2025] 「History-Guided Video Diffusion」的官方 PyTorch 实现

    709+0近 7 天星标变化
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit:迈向图像编辑与世界模拟的时间推理

    706+2近 7 天星标变化
← 返回主题列表