主題 · multi-modal
multi-modal
標記 multi-modal 主題、收錄中的開源專案,依星數排序。
共 42 個專案
- #31★ 979-1近 7 天星數變化
- #32
FarmVibes.AI:用於農業與永續發展的多模態地理空間 ML 模型
★ 895+0近 7 天星數變化 - #33
【ICLR 2024🔥】透過基於語言的語意對齊將視訊語言預訓練擴展至 N 模態
★ 885+0近 7 天星數變化 - #34★ 852+0近 7 天星數變化
- #35
[CVPR 2026🔥] 🧑🎨 OmniLottie,一個開源的多模態指令式向量動畫生成器,可輸出 Lottie JSON。
★ 775+3近 7 天星數變化 - #36
針對 ML 訓練最佳化的多模態 OCR 管線(文字、圖形、數學、表格、圖表)
★ 675+0近 7 天星數變化 - #37
統一的可控視覺生成模型
★ 662+0近 7 天星數變化 - #38★ 609+0近 7 天星數變化
- #39★ 583-1近 7 天星數變化
- #40
FashionCLIP 是一個針對時尚領域微調的類 CLIP 模型。
★ 537+3近 7 天星數變化 - #41
基於 DAG 的多模型平行 AI 影視生成引擎。平行加速隨場景獨立性擴展;同時生成影視場景而非逐一生成;將影視生成的執行圖從拓撲序轉為關鍵路徑最佳排程;唯一將場景敘事依賴建模為 DAG 並以 CPM 演算法驅動平行排程的影視生成引擎。
★ 536+0近 7 天星數變化 - #42★ 511+0近 7 天星數變化