メインコンテンツへスキップ
buildradar
Sign in
トピック · video-generation

video-generation

video-generation がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

154 件のリポジトリ
  • ComfyUIにおけるMiniMax H3向けのクリップ連鎖 - 結合部分をまたいでモーションとオーディオが自然に継続

    914+143直近 7 日のスター増減
  • FollowYourClick@mayuelala

    [AAAI 2025] Follow-Your-Click: 本リポジトリは論文「Follow-Your-Click: Open-domain Regional Image Animation via Short Prompts」の公式実装です

    908-1直近 7 日のスター増減
  • Vista@OpenDriveLab

    [NeurIPS 2024] 自動運転のための汎用可能なワールドモデル

    896+1直近 7 日のスター増減
  • ditto-talkinghead@antgroup

    [ACM MM 2025] Ditto: 制御可能なリアルタイムトーキングヘッド合成のためのモーション空間拡散モデル

    878+7直近 7 日のスター増減
  • SeedVR2@IceClear

    [ICLR2026] SeedVR2: 拡散敵対的ポストトレーニングによる1ステップ動画復元

    865+11直近 7 日のスター増減
  • ConsisID@PKU-YuanGroup

    [CVPR 2025 Highlight🔥] 周波数分解によるアイデンティティ保持型テキスト動画生成手法

    857+2直近 7 日のスター増減
  • UniAnimate-DiT@ali-vilab

    UniAnimate-DiT: 大規模動画Diffusion Transformerを用いた人物画像アニメーション

    850-2直近 7 日のスター増減
  • DiffusionAsShader@IGL-HKUST

    [SIGGRAPH 2025] Diffusion as Shader: 多様な動画生成制御のための 3D 認識型ビデオディフュージョン

    833+2直近 7 日のスター増減
  • 「RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers」(ICML 2025)、UltraViCo(ICLR 2026)、および UltraImage の公式実装

    827+2直近 7 日のスター増減
  • flatkey-cli@flatkey-ai

    画像、動画、音声、テキスト、クレジット、モデル探索のための Flatkey メディア生成 CLI

    825+191直近 7 日のスター増減
  • lmms-engine@EvolvingLMMs-Lab

    シンプルで統一されたマルチモーダルモデル学習エンジン。軽量で柔軟性があり、大規模なハッキングに対応するように構築されています。

    824+0直近 7 日のスター増減
  • Text-To-Video-AI@SamurAIGPT

    AI を使用してテキストから動画を生成

    821+7直近 7 日のスター増減
  • kandinsky-5@kandinskylab

    Kandinsky 5.0: 動画および画像生成のための拡散モデルファミリー

    820+4直近 7 日のスター増減
  • Matrix-3D@SkyworkAI

    1枚の画像またはテキストプロンプトから、高品質なパノラマ動画を使用して大規模な探索可能な 3D シーンを生成します。

    816+12直近 7 日のスター増減
  • 視覚分野における自己回帰モデルのサーベイ論文。

    808+1直近 7 日のスター増減
  • open-webui-tools@Haervwe

    Open-WebUI Tools は、Open WebUI インスタンスを拡張・強化し、強力な AI ワークステーションへと変えるために設計されたモジュール式ツールキットです。15 種類以上の特化型ツール、関数パイプライン、フィルターを備え、学術研究、エージェントの自律性、マルチモーダルの創造性、ワークフローなどをサポートします。

    806+5直近 7 日のスター増減
  • DriveAGI@OpenDriveLab

    [CVPR 2024 Highlight] GenAD: 自動運転のための汎用予測モデル

    805+0直近 7 日のスター増減
  • rcm@NVlabs

    大規模な双方向/自己回帰ビデオ拡散モデルの蒸留に向けた、主導的かつ統合されたアルゴリズムおよびインフラストラクチャ(rCM & Causal-rCM)

    800+6直近 7 日のスター増減
  • InfinityStar@FoundationVision

    [NeurIPS 2025 Oral]Infinity⭐️: 視覚生成のための統合時空間自己回帰モデリング

    784+5直近 7 日のスター増減
  • 動画生成に関する素晴らしい研究のコレクション。

    782+0直近 7 日のスター増減
  • MagicDance@Boese0601

    [ICML 2024] MagicPose (MagicDance としても知られる): アイデンティティを考慮した Diffusion によるリアルな人物のポーズと表情の再ターゲット

    776+0直近 7 日のスター増減
  • ima2-gen@lidge-jun

    複数のプロバイダー間で再現可能な画像および動画ワークフローを備えた、人間とコーディングエージェントのためのローカルファーストなビジュアル生成ランタイムおよびスタジオ

    749+30直近 7 日のスター増減
  • テキストから動画への生成/合成に関するサーベイ。

    744+3直近 7 日のスター増減
  • cosmos-transfer2.5@nvidia-cosmos

    Cosmos-Predict2.5をベースに構築されたCosmos-Transfer2.5は、複数の空間制御入力を条件とした高品質な世界シミュレーションを生成します。

    735+6直近 7 日のスター増減
  • comfyui-mcp@artokun

    ComfyUI向けのローカルファーストかつエージェントネイティブなコントロールプレーン。MCPサーバーとサイドバーエージェントを備え、あらゆるLLM(Claude、ChatGPT、Gemini、オフラインのOllama、または任意のホステッドモデル)を使用して、自然言語で画像・動画・音声の生成、ワークフローの作成・実行、ライブグラフの編集を行います。178個のツール、36個のAIスキル、55個のインストーラーパックを搭載。ローカル、LAN、VPS、Comfy Cloudに対応。

    729+35直近 7 日のスター増減
  • MagicDrive-V2@flymin

    [ICCV 2025] 論文「MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control」の公式実装。

    729+1直近 7 日のスター増減
  • nano-world-model@simchowitzlabpublic

    ワールドモデル科学の発展を目的とした、ミニマリストで機能が充実したリポジトリ。

    729+10直近 7 日のスター増減
  • [ICML 2025] 「History-Guided Video Diffusion」の公式 PyTorch 実装

    709+1直近 7 日のスター増減
  • ChronoEdit@nv-tlabs

    [ICLR 2026] ChronoEdit: 画像編集とワールドシミュレーションにおける時間的推論に向けて

    706+1直近 7 日のスター増減
  • SparkVSR@taco-group

    [ECCV 2026] SparkVSR: スパースキーフレーム伝播によるインタラクティブ映像超解像手法

    702+3直近 7 日のスター増減
← トピック一覧に戻る