Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · llava

llava

Các kho mã nguồn mở đang theo dõi được gắn thẻ llava, sắp xếp theo số sao.

Kho mã
21
Tổng số sao
66.002
Số sao trung bình
3.143
Tỷ trọng
0,00%

Những chủ đề thường xuất hiện cùng llava trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ llava.

Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.

  • LLaVA@haotian-liu

    [NeurIPS'23 Oral] Tinh chỉnh hướng dẫn trực quan (LLaVA) được xây dựng hướng tới khả năng ngang tầm GPT-4V và xa hơn nữa.

    25.014+12Thay đổi số sao trong 7 ngày qua
  • SUPIR@Fanghua-Yu

    SUPIR nhằm phát triển các thuật toán thực tế để phục hồi ảnh chân thực trong tự nhiên. Bản demo trực tuyến mới của chúng tôi cũng đã được phát hành tại suppixel.ai.

    5.649+0Thay đổi số sao trong 7 ngày qua
  • mlx-vlm@Blaizzy

    MLX-VLM là một gói để suy luận và tinh chỉnh các Mô hình Ngôn ngữ Thị giác (VLM) trên Mac sử dụng MLX.

    5.462+41Thay đổi số sao trong 7 ngày qua
  • VLMEvalKit@open-compass

    Bộ công cụ đánh giá mã nguồn mở cho các mô hình đa phương thức lớn (LMM), hỗ trợ hơn 220 LMM, hơn 80 benchmark

    4.375+15Thay đổi số sao trong 7 ngày qua
  • zero_nlp@yuanzhoulvpi2017

    Giải pháp NLP tiếng Trung (mô hình ngôn ngữ lớn, dữ liệu, mô hình, huấn luyện, suy luận)

    3.836+2Thay đổi số sao trong 7 ngày qua
  • LLamaSharp@SciSharp

    Thư viện C#/.NET để chạy LLM (🦙LLaMA/LLaVA) trên thiết bị cục bộ của bạn một cách hiệu quả.

    3.790+3Thay đổi số sao trong 7 ngày qua
  • Eagle@NVlabs

    Eagle: Mô hình Thị giác-Ngôn ngữ Tiên phong với Chiến lược Lấy Dữ liệu làm Trọng tâm

    3.511+46Thay đổi số sao trong 7 ngày qua
  • OmAgent@om-ai-lab

    [EMNLP-2024] Xây dựng các tác nhân ngôn ngữ đa phương thức để tạo nguyên mẫu và sản xuất nhanh chóng

    2.666+1Thay đổi số sao trong 7 ngày qua
  • Video-ChatGPT@mbzuai-oryx

    Video-ChatGPT là một mô hình hội thoại video có khả năng tạo ra các cuộc hội thoại có ý nghĩa về video. Nó kết hợp khả năng của LLMs với một bộ mã hóa hình ảnh được huấn luyện trước, thích ứng cho biểu diễn video không gian-thời gian. Chúng tôi cũng giới thiệu một 'Đánh giá định lượng chuẩn hóa' nghiêm ngặt cho các mô hình hội thoại dựa trên video.

    1.507+1Thay đổi số sao trong 7 ngày qua
  • taggui@jhc13

    Trình quản lý thẻ và chú thích cho tập dữ liệu hình ảnh

    1.348+2Thay đổi số sao trong 7 ngày qua
  • UForm@unum-cloud

    AI đa phương thức cỡ nhỏ để hiểu và tạo nội dung trên văn bản đa ngôn ngữ, hình ảnh và video, nhanh hơn tới 5 lần so với OpenAI CLIP và LLaVA

    1.247+2Thay đổi số sao trong 7 ngày qua
  • LLaVA-OneVision-2@EvolvingLMMs-Lab

    Khung mã nguồn mở hoàn toàn dành cho đào tạo đa phương thức phi tập trung

    1.195+3Thay đổi số sao trong 7 ngày qua
  • TinyLLaVA_Factory@TinyLLaVA

    Khung mô hình đa phương thức lớn quy mô nhỏ

    1.004+1Thay đổi số sao trong 7 ngày qua
  • LLaVA-pp@mbzuai-oryx

    LLaVA++: Mở rộng LLaVA với Phi-3 và LLaMA-3 (LLaVA LLaMA-3, LLaVA Phi-3).

    842+0Thay đổi số sao trong 7 ngày qua
  • machina@PsyChip

    Hệ thống giám sát video được hỗ trợ bởi OpenCV+YOLO+LLAVA

    794+1Thay đổi số sao trong 7 ngày qua
  • PaddleMIX@PaddlePaddle

    Paddle Multimodal Integration and eXploration, hỗ trợ các tác vụ đa phương thức phổ biến, bao gồm các mô hình tiền huấn luyện đa phương thức quy mô lớn end-to-end và bộ công cụ mô hình khuếch tán. Hiệu suất cao và linh hoạt.

    723+1Thay đổi số sao trong 7 ngày qua
  • Bộ sưu tập Frontend và khảo sát các bài báo, mô hình về vision-language. Cập nhật liên tục.

    705+5Thay đổi số sao trong 7 ngày qua
  • Danh sách tổng hợp các mô hình nền tảng và đa phương thức hàng đầu! [Bài báo + Mã nguồn + Ví dụ + Hướng dẫn]

    637+0Thay đổi số sao trong 7 ngày qua
  • ComfyUI_VLM_nodes@gokayfem

    Các node ComfyUI dành cho mô hình ngôn ngữ - thị giác: Qwen3-VL, Moondream 3, Florence-2, SmolVLM2, InternVL, Gemma 3, MiniCPM-V. Cùng với khả năng phát hiện từ vựng mở, phân đoạn SAM2/SAM3, suy luận thời gian trong video, GGUF qua llama.cpp và các API LLM/VLM được lưu trữ.

    589+1Thay đổi số sao trong 7 ngày qua
  • LLaVA-Mini@ictnlp

    LLaVA-Mini là mô hình đa phương thức lớn (LMM) hợp nhất, hỗ trợ hiểu hình ảnh, hình ảnh độ phân giải cao và video một cách hiệu quả.

    577+0Thay đổi số sao trong 7 ngày qua
  • llama-assistant@nrl-ai

    Trợ lý hỗ trợ công việc hàng ngày được vận hành bởi AI, sử dụng Llama 3, DeepSeek R1 và nhiều mô hình khác trên HuggingFace.

    530+0Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề