본문으로 건너뛰기
buildradar
Sign in
토픽 · video-generation

video-generation

video-generation 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 154개
  • ComfyUI용 MiniMax H3 클립 체이닝 - 연결 지점 간 모션과 오디오가 자연스럽게 이어짐

    914+143최근 7일 스타 변화
  • FollowYourClick@mayuelala

    [AAAI 2025] Follow-Your-Click: 이 저장소는 "Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts"의 공식 구현체입니다.

    908-1최근 7일 스타 변화
  • Vista@OpenDriveLab

    [NeurIPS 2024] 자율주행을 위한 일반화 가능한 월드 모델

    896+1최근 7일 스타 변화
  • ditto-talkinghead@antgroup

    [ACM MM 2025] Ditto: 제어 가능한 실시간 토킹 헤드 합성을 위한 모션 공간 확산 모델입니다.

    878+7최근 7일 스타 변화
  • SeedVR2@IceClear

    [ICLR2026] SeedVR2: Diffusion Adversarial Post-Training을 통한 원스텝 비디오 복원

    865+11최근 7일 스타 변화
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 주파수 분해를 통한 아이덴티티 보존형 텍스트-투-비디오 생성

    857+2최근 7일 스타 변화
  • UniAnimate-DiT@ali-vilab

    UniAnimate-DiT: 대규모 비디오 디퓨전 트랜스포머를 활용한 휴먼 이미지 애니메이션

    850-2최근 7일 스타 변화
  • flatkey-cli@flatkey-ai

    이미지, 비디오, 오디오, 텍스트, 크레딧 및 모델 검색을 위한 Flatkey 미디어 생성 CLI

    845+191최근 7일 스타 변화
  • DiffusionAsShader@IGL-HKUST

    [SIGGRAPH 2025] Diffusion as Shader: 다목적 비디오 생성 제어를 위한 3D 인식 비디오 확산 모델

    834+2최근 7일 스타 변화
  • RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers (ICML 2025), UltraViCo (ICLR 2026) 및 UltraImage 공식 구현

    827+2최근 7일 스타 변화
  • lmms-engine@EvolvingLMMs-Lab

    단순하고 통합된 멀티모달 모델 학습 엔진. 슬림하고 유연하며 대규모 커스텀 및 확장을 위해 구축되었습니다.

    825+0최근 7일 스타 변화
  • kandinsky-5@kandinskylab

    Kandinsky 5.0: 비디오 및 이미지 생성을 위한 디퓨전 모델 패밀리

    822+4최근 7일 스타 변화
  • Text-To-Video-AI@SamurAIGPT

    AI를 사용하여 텍스트로부터 비디오 생성

    821+7최근 7일 스타 변화
  • Matrix-3D@SkyworkAI

    단일 이미지나 텍스트 프롬프트로부터 고품질 파노라마 비디오를 포함한 대규모 3D 장면 생성

    816+12최근 7일 스타 변화
  • [TMLR 2025🔥] 비전 분야의 자기회귀 모델(autoregressive models)에 대한 서베이.

    808+1최근 7일 스타 변화
  • open-webui-tools@Haervwe

    Open-WebUI Tools는 Open WebUI 인스턴스를 강력한 AI 워크스테이션으로 확장하고 강화하도록 설계된 모듈형 툴킷입니다. 15개 이상의 특수 도구, 함수 파이프라인 및 필터를 통해 학술 연구, 에이전트 자율성, 멀티모달 창의성, 워크플로우 등을 지원합니다.

    807+5최근 7일 스타 변화
  • DriveAGI@OpenDriveLab

    [CVPR 2024 Highlight] GenAD: 자율 주행을 위한 일반화된 예측 모델

    805+0최근 7일 스타 변화
  • rcm@NVlabs

    대규모 양방향/자기회귀 비디오 확산 증류를 위한 선도적이고 통합된 알고리즘 및 인프라 rCM & Causal-rCM

    800+6최근 7일 스타 변화
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral] Infinity⭐️: 시각적 생성을 위한 통합 시공간 자기회귀 모델링

    784+5최근 7일 스타 변화
  • 멋진 비디오 생성 연구 모음입니다.

    783+0최근 7일 스타 변화
  • MagicDance@Boese0601

    [ICML 2024] MagicPose(MagicDance): ID 인식 확산 모델을 이용한 실감 나는 인체 포즈 및 표정 리타겟팅

    777+0최근 7일 스타 변화
  • ima2-gen@lidge-jun

    사용자와 코딩 에이전트를 위한 로컬 우선 시각적 생성 런타임 및 스튜디오로, 여러 공급자에 걸쳐 재현 가능한 이미지 및 비디오 워크플로우를 제공

    751+30최근 7일 스타 변화
  • 텍스트-비디오 생성 및 합성 기술에 대한 조사 보고서

    744+3최근 7일 스타 변화
  • cosmos-transfer2.5@nvidia-cosmos

    Cosmos-Predict2.5 기반의 Cosmos-Transfer2.5는 다중 공간 제어 입력을 조건으로 고품질 월드 시뮬레이션을 생성합니다.

    736+6최근 7일 스타 변화
  • comfyui-mcp@artokun

    ComfyUI를 위한 로컬 우선 에이전트 네이티브 제어 평면. MCP 서버와 사이드바 에이전트를 통해 이미지, 비디오, 오디오 생성, 워크플로우 작성 및 실행, 자연어로 라이브 그래프 편집 지원 (Claude, ChatGPT, Gemini, Ollama 등 모든 LLM 호환). 178개 도구, 36개 AI 스킬, 55개 설치 팩 포함. 로컬, LAN, VPS, Comfy Cloud 지원.

    729+35최근 7일 스타 변화
  • MagicDrive-V2@flymin

    [ICCV 2025] MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control 논문의 공식 구현

    729+1최근 7일 스타 변화
  • nano-world-model@simchowitzlabpublic

    월드 모델 과학 발전을 위한 미니멀하고 모든 기능이 포함된 리포지토리.

    729+10최근 7일 스타 변화
  • [ICML 2025] History-Guided Video Diffusion 공식 PyTorch 구현

    709+1최근 7일 스타 변화
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit: 이미지 편집 및 월드 시뮬레이션을 위한 시간적 추론을 향하여

    706+1최근 7일 스타 변화
  • SparkVSR@taco-group

    [ECCV 2026] SparkVSR: 희소 키프레임 전파를 통한 인터랙티브 비디오 초해상도

    702+3최근 7일 스타 변화
← 토픽 목록으로