video-generation
Erfasste Open-Source-Repos mit dem Tag video-generation, sortiert nach Sternen.
- #61
[TPAMI 2025🔥] MagicTime: Zeitraffer-Videogenerierungsmodelle als metamorphe Simulatoren
★ 1.337-1Sterne-Änderung der letzten 7 Tage - #62
Ein natives, einheitliches multimodales Modell mit 3B aktiven Parametern für Bild- und Videoverständnis, -generierung und -bearbeitung.
★ 1.334+3Sterne-Änderung der letzten 7 Tage - #63
Erstellt Kurzvideos für TikTok, Instagram Reels und YouTube Shorts mithilfe des Model Context Protocol (MCP) und einer REST-API.
★ 1.327+9Sterne-Änderung der letzten 7 Tage - #64
Bernini ist ein einheitliches Framework für die Videoerstellung und -bearbeitung, das einen MLLM-basierten semantischen Planer mit einem DiT-basierten Renderer kombiniert.
★ 1.300+10Sterne-Änderung der letzten 7 Tage - #65
Code für die Arbeit „Motion Representations for Articulated Animation“
★ 1.277+0Sterne-Änderung der letzten 7 Tage - #66★ 1.260+11Sterne-Änderung der letzten 7 Tage
- #67
Wir präsentieren StableAvatar, den ersten End-to-End-Video-Diffusion-Transformer, der basierend auf einem Referenzbild und Audio unendlich lange, hochwertige, audio-gesteuerte Avatar-Videos ohne Nachbearbeitung synthetisiert.
★ 1.258-1Sterne-Änderung der letzten 7 Tage - #68
Halbton-Papiercollage-B-Roll-Generierungs-Skill: Drei-Tore-Freigabe, Gemini Omni Flash Start- und Endframe-Animationsmontage
★ 1.238+19Sterne-Änderung der letzten 7 Tage - #69
HunyuanCustom: Eine multimodal gesteuerte Architektur zur personalisierten Videogenerierung
★ 1.228-1Sterne-Änderung der letzten 7 Tage - #70
[SIGGRAPH Asia 2026] 4DAnyone: Create Anyone in 4D from a Casual Monocular Video
★ 1.202+275Sterne-Änderung der letzten 7 Tage - #71
Code für das SCIS-2025-Paper „UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation“.
★ 1.189-1Sterne-Änderung der letzten 7 Tage - #72
Wunjo CE: Gesichtstausch, Lippensynchronisation, Entfernen von Steuerelementen, Objekten, Text und Hintergrund, Restyling, Audio-Trenner, Stimmklonung, Videogenerierung. Open Source, lokal & kostenlos.
★ 1.170+1Sterne-Änderung der letzten 7 Tage - #73
[ICLR24] Offizielle Implementierung des Papiers „MagicDrive: Street View Generation with Diverse 3D Geometry Control“
★ 1.167+1Sterne-Änderung der letzten 7 Tage - #74
Nativer LLM-Inferenzserver für Apple Silicon. Kompatibel mit der OpenAI- und Anthropic-API. Kein Python. Inklusive MLX Core macOS-App mit Chat, Agentenmodus und Tool-Aufrufen.
★ 1.115+245Sterne-Änderung der letzten 7 Tage - #75★ 1.108+3Sterne-Änderung der letzten 7 Tage
- #76
[ECCV 2024 Oral] MotionDirector: Bewegungskonibierung von Text-zu-Video-Diffusion-Modellen.
★ 1.053+2Sterne-Änderung der letzten 7 Tage - #77
SCAIL: Towards Studio-Grade Character Animation via In-Context Learning of 3D-Consistent Pose Representations (CVPR 2026 Findings)
★ 1.049+4Sterne-Änderung der letzten 7 Tage - #78
[ICML2025] SpargeAttention: Eine trainingsfreie sparse Attention, die die Inferenz beliebiger Modelle beschleunigt.
★ 1.043+1Sterne-Änderung der letzten 7 Tage - #79
[AAAI 2026] EchoMimicV3: 1,3B Parameter sind alles, was man für eine einheitliche multimodale und Multitask-Mensch-Animation braucht
★ 1.039+9Sterne-Änderung der letzten 7 Tage - #80
Eine kuratierte Liste von OpenClaw-Ressourcen, Tools, Fähigkeiten, Tutorials und Artikeln. OpenClaw (ehemals Moltbot / Clawdbot) – ein Open-Source, selbst gehosteter KI-Agent für WhatsApp, Telegram, Discord und über 50 Integrationen.
★ 1.004+7Sterne-Änderung der letzten 7 Tage - #81
Provider-neutral Codex Skill for producing verified AI presenter videos from a script and an authorized presenter image.
★ 996+24Sterne-Änderung der letzten 7 Tage - #82
[TPAMI 2026] 3D- und 4D-Weltmodellierung: Eine Übersicht
★ 980+7Sterne-Änderung der letzten 7 Tage - #83
:fire: :fire: :fire: Eine Literaturliste zu einigen aktuellen Arbeiten im Bereich Computer Vision (CV)
★ 973+1Sterne-Änderung der letzten 7 Tage - #84
Feingranulare Open-Domain-Bildanimation mit Bewegungslenkung (Motion Guidance)
★ 971-1Sterne-Änderung der letzten 7 Tage - #85
[ICLR 2024] SEINE: Short-to-Long Video Diffusion Model für generative Übergänge und Vorhersagen
★ 967+0Sterne-Änderung der letzten 7 Tage - #86
Ein System aus Bots, das Clips automatisch über benutzerdefinierte Filter sammelt, das einfache Durchsuchen dieser Clips ermöglicht und sie zu einem Zusammenschnitt-Video zusammenfügt, das direkt auf jede Social-Media-Plattform hochgeladen werden kann. Voller VPS-Support wird bereitgestellt, zusammen mit einem Kontosystem, sodass mehrere Benutzer den Bot gleichzeitig verwenden können. Dieser Bot ist in drei separate Programme aufgeteilt: Den Server, den Client und Th
★ 958+2Sterne-Änderung der letzten 7 Tage - #87
[ICML 2026] Offizielle Codebasis für „Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation“ & Causal Forcing++
★ 948+10Sterne-Änderung der letzten 7 Tage - #88
Skalierung des Mixture-of-Experts-Videovortrainings für verkörperte Intelligenz
★ 945+7Sterne-Änderung der letzten 7 Tage - #89
Videogenerierung aus Text und Bild, 1. Generation
★ 919-2Sterne-Änderung der letzten 7 Tage - #90
Free open-source project designed for turning youtube-viedos into viral short videos. Highlight detection, subtitles, translation, voiceover, all in one for your content.
★ 917—Sterne-Änderung der letzten 7 Tage