跳到主要内容
buildradar
Sign in
主题 · llava

llava

标记 llava 主题、收录中的开源项目,按星标数排序。

项目数
21
总星标数
66,002
平均星标数
3,143
占比
0.00%

常跟 llava 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 llava 主题的项目。

近 90 天内还没有新项目标记这个主题。

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) 构建至 GPT-4V 级别能力及更高水平。

    25,014+9近 7 天星标变化
  • SUPIR@Fanghua-Yu

    SUPIR 旨在开发野外照片写实图像恢复的实用算法,我们的新线上演示已在 suppixel.ai 上发布。

    5,649-3近 7 天星标变化
  • mlx-vlm@Blaizzy

    MLX-VLM 是一个在 Mac 上使用 MLX 进行 Vision Language Models (VLMs) 推理与微调的套件

    5,462+25近 7 天星标变化
  • VLMEvalKit@open-compass

    开源大型多模态模型评估工具包,支持220+ LMMs与80+基准测试

    4,375+13近 7 天星标变化
  • zero_nlp@yuanzhoulvpi2017

    中文 NLP 解决方案(大模型、数据、模型、训练、推理)

    3,836+2近 7 天星标变化
  • LLamaSharp@SciSharp

    C#/.NET 函式库,可在本机装置高效执行 LLM(🦙LLaMA/LLaVA)

    3,790+2近 7 天星标变化
  • Eagle@NVlabs

    Eagle:采用以数据为中心策略的前沿视觉语言模型

    3,511+32近 7 天星标变化
  • OmAgent@om-ai-lab

    [EMNLP-2024] 构建适用于快速原型与生产的多模态语言代理

    2,666+1近 7 天星标变化
  • Video-ChatGPT@mbzuai-oryx

    [ACL 2024 🔥] Video-ChatGPT 是一个能够针对视频生成有意义对话的视频对话模型。它结合了 LLM 的能力与适应时空视频表示的预训练视觉编码器。我们也为基于视频的对话模型引入了严格的“量化评估基准”。

    1,507+1近 7 天星标变化
  • taggui@jhc13

    图像数据集的标签管理器与说明文字生成器

    1,348+2近 7 天星标变化
  • UForm@unum-cloud

    袖珍型多模态 AI,用于跨多语言文字、图片和视频的内容理解与生成,速度比 OpenAI CLIP 和 LLaVA 快达 5 倍

    1,247+1近 7 天星标变化
  • LLaVA-OneVision-2@EvolvingLMMs-Lab

    用于民主化多模态训练的完全开放框架

    1,195+1近 7 天星标变化
  • TinyLLaVA_Factory@TinyLLaVA

    小型大型多模态模型框架

    1,003+1近 7 天星标变化
  • LLaVA-pp@mbzuai-oryx

    🔥🔥 LLaVA++:使用 Phi-3 与 LLaMA-3 扩充 LLaVA(LLaVA LLaMA-3、LLaVA Phi-3)

    842+0近 7 天星标变化
  • machina@PsyChip

    基于 OpenCV、YOLO 与 LLAVA 的视频监控系统。

    793+1近 7 天星标变化
  • PaddleMIX@PaddlePaddle

    Paddle 多模态整合与探索,支持主流多模态任务,包含端到端大型多模态预训练模型与扩散模型工具箱。具备高性能与灵活性。

    723-1近 7 天星标变化
  • 视觉语言模型论文与模型的顶级前端收集与调查 GitHub 仓库。持续更新中。

    706+3近 7 天星标变化
  • 👁️ + 💬 + 🎧 = 🤖 精选顶级基础与多模态模型列表![论文 + 代码 + 示例 + 教程]

    637+0近 7 天星标变化
  • ComfyUI_VLM_nodes@gokayfem

    用于视觉语言模型的 ComfyUI 节点:Qwen3-VL、Moondream 3、Florence-2、SmolVLM2、InternVL、Gemma 3、MiniCPM-V。另支持开放词汇检测、SAM2/SAM3 分割、视频时序推理、通过 llama.cpp 的 GGUF 以及托管式 LLM/VLM API。

    588-1近 7 天星标变化
  • LLaVA-Mini@ictnlp

    LLaVA-Mini 是一个统一的大型多模态模型 (LMM),能以高效方式支持图像、高分辨率图像及视频的理解。

    577+0近 7 天星标变化
  • llama-assistant@nrl-ai

    AI 驱动的日常任务助手,由 Llama 3、DeepSeek R1 以及 HuggingFace 上的众多模型提供支持。

    530+0近 7 天星标变化
← 返回主题列表