Pular para o conteúdo principal
buildradar
Sign in
Tópico · vlm

vlm

Repositórios de código aberto acompanhados marcados com vlm, ordenados por estrelas.

Repositórios
77
Total de estrelas
404.055
Média de estrelas
5.247
Participação
0,02%

Tópicos que aparecem com frequência ao lado de vlm no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com vlm.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • transformers@huggingface

    🤗 Transformers: o framework de definição de modelos para modelos de machine learning de última geração em texto, visão, áudio e modelos multimodais, tanto para inferência quanto para treinamento.

    164.731+119Variação de estrelas nos últimos 7 dias
  • UI-TARS-desktop@bytedance

    A pilha de agentes de IA multimodal de código aberto: Conectando modelos de IA de ponta e infraestrutura de agentes

    38.817+75Variação de estrelas nos últimos 7 dias
  • sglang@sgl-project

    SGLang é um framework de atendimento de alto desempenho para grandes modelos de linguagem e modelos multimodais.

    33.538+791Variação de estrelas nos últimos 7 dias
  • runanywhere-sdks@RunanywhereAI

    Kit de ferramentas pronto para produção para executar IA localmente.

    10.281+1Variação de estrelas nos últimos 7 dias
  • PixelRAG@StarTrail-org

    O fim do parsing web. O início da busca nativa de pixels escalável. link: https://pixelrag.ai/

    9.848+60Variação de estrelas nos últimos 7 dias
  • notebooks@roboflow

    Uma coleção de tutoriais sobre modelos e técnicas de visão computacional de última geração. Explore desde arquiteturas fundamentais como ResNet até modelos de ponta como RF-DETR, YOLO11, SAM 3 e Qwen3-VL.

    9.638+6Variação de estrelas nos últimos 7 dias
  • Livros, artigos, vídeos e toolboxes relacionados à detecção de anomalias. Última atualização no final de 2025 para trabalhos com LLM e VLM!

    9.375+5Variação de estrelas nos últimos 7 dias
  • GenieX@qualcomm

    Execute LLMs e VLMs de ponta localmente em dispositivos Qualcomm via NPU, GPU e CPU com poucas linhas de código

    8.347+9Variação de estrelas nos últimos 7 dias
  • ERNIE@PaddlePaddle

    O repositório oficial do ERNIE 4.5 e do ERNIEKit, seu kit de ferramentas de desenvolvimento de nível industrial baseado no PaddlePaddle.

    7.736-1Variação de estrelas nos últimos 7 dias
  • VLM-R1@om-ai-lab

    Resolver compreensão visual com VLMs reforçados.

    6.018+4Variação de estrelas nos últimos 7 dias
  • UltraRAG@OpenBMB

    Um framework MCP low-code para construir pipelines de RAG complexos e inovadores.

    5.678+4Variação de estrelas nos últimos 7 dias
  • LLM-RL-Visualized@changyeyu

    🌟100+ Mapas conceituais originais de LLM / RL 📚, contribuição do autor de "Algoritmos de Grandes Modelos"!💥 (100+ Mapas de Algoritmos LLM/RL)

    4.838+12Variação de estrelas nos últimos 7 dias
  • star-vector@joanrod

    StarVector é um modelo fundamental para geração de SVG que transforma a vetorização em uma tarefa de geração de código. Utilizando uma arquitetura de modelagem de visão e linguagem, o StarVector processa entradas visuais e textuais para produzir código SVG de alta qualidade com precisão notável.

    4.567+6Variação de estrelas nos últimos 7 dias
  • lmms-eval@EvolvingLMMs-Lab

    Toolkit de avaliação multimodal tudo-em-um para tarefas de texto, imagem, vídeo e áudio.

    4.390+7Variação de estrelas nos últimos 7 dias
  • PromptEnhancer@Hunyuan-PromptEnhancer

    [CVPR 2026] PromptEnhancer é uma ferramenta de reescrita de prompts, refinando prompts em versões mais claras e estruturadas para uma melhor geração de imagens.

    3.766+5Variação de estrelas nos últimos 7 dias
  • MiniMax-01@MiniMax-AI

    Repositório oficial do MiniMax-Text-01 e MiniMax-VL-01, modelos de linguagem e visão baseados em Linear Attention.

    3.467+0Variação de estrelas nos últimos 7 dias
  • evalscope@modelscope

    Uma estrutura simplificada e personalizável para avaliação eficiente de grandes modelos (LLM, VLM, AIGC) e benchmarking de desempenho.

    3.356+25Variação de estrelas nos últimos 7 dias
  • Local-File-Organizer@QiuYannnn

    Ferramenta de gerenciamento de arquivos baseada em IA que garante privacidade ao organizar textos e imagens locais. Utiliza modelos Llama3.2 3B e Llava v1.6 com o Nexa SDK para escanear, reestruturar e organizar arquivos de forma intuitiva para acesso rápido e fácil recuperação.

    3.334+0Variação de estrelas nos últimos 7 dias
  • Skywork-R1V@SkyworkAI

    Skywork-R1V é uma série avançada de modelos de IA multimodal desenvolvida pela Skywork AI, especializada em raciocínio de visão e linguagem.

    3.168+0Variação de estrelas nos últimos 7 dias
  • OSWorld@xlang-ai

    [NeurIPS 2024] OSWorld: Benchmarking de agentes multimodais para tarefas abertas em ambientes computacionais reais.

    3.118+6Variação de estrelas nos últimos 7 dias
  • DeepCamera@SharpAI

    Plataforma de habilidades de câmera com IA de código aberto, NVR de IA e vigilância por CFTV. Análise de vídeo VLM local com Qwen, DeepSeek, SmolVLM, LLaVA, YOLO26. Agente de câmera de segurança baseado em LLM — observa, entende, lembra e protege sua casa via Telegram, Discord ou Slack. Habilidades de IA conectáveis. OpenAI, Google, Anthropic ou IA local. Executa em Mac Mini e PCs com IA.

    3.034+10Variação de estrelas nos últimos 7 dias
  • OmAgent@om-ai-lab

    [EMNLP-2024] Crie agentes de linguagem multimodal para prototipagem rápida e produção

    2.666+1Variação de estrelas nos últimos 7 dias
  • Cradle@BAAI-Agents

    O framework Cradle é uma primeira tentativa de Controle Geral de Computador (GCC). O Cradle permite que agentes realizem qualquer tarefa computacional ao habilitar fortes capacidades de raciocínio, autoaperfeiçoamento e curadoria de habilidades, em um ambiente geral padronizado com requisitos mínimos.

    2.578+2Variação de estrelas nos últimos 7 dias
  • GLM-V@zai-org

    GLM-4.6V/4.5V/4.1V-Thinking: Rumo ao raciocínio multimodal versátil com aprendizado por reforço escalável

    2.379+2Variação de estrelas nos últimos 7 dias
  • comfyui_LLM_party@heshengtao

    Framework de agentes LLM no ComfyUI, incluindo servidor MCP, Omost, GPT-sovits, ChatTTS, GOT-OCR2.0 e nós de prompt FLUX, com acesso a Feishu e Discord, adaptando-se a todos os LLMs com interfaces similares à da OpenAI/aisuite, como o1, ollama, gemini, grok, qwen, GLM, deepseek, kimi e doubao. Adaptado para LLMs locais, VLM e GGUF, como llama-3.3, Janus-Pro e Linkage graphRAG.

    2.348+5Variação de estrelas nos últimos 7 dias
  • paperbanana@llmsresearch

    Implementação e extensão de código aberto do PaperBanana do Google Research para figuras acadêmicas, diagramas e visuais de pesquisa automatizados, expandido para novos domínios como a geração de slides.

    2.298+10Variação de estrelas nos últimos 7 dias
  • Conjunto de ferramentas de replay de protocolo de ponta a ponta para assinaturas ChatGPT Plus/Team/Pro, com resolvedor de hCaptcha e pesquisa empírica sobre mecanismos antifraude

    2.236+7Variação de estrelas nos últimos 7 dias
  • tokenspeed@lightseekorg

    TokenSpeed é um motor de inferência de LLM extremamente rápido.

    2.075+44Variação de estrelas nos últimos 7 dias
  • Awesome-LM-SSP@CryptoAILab

    Uma lista de leitura sobre segurança, proteção e privacidade de grandes modelos (incluindo Awesome LLM Security, Safety, etc.).

    2.070+0Variação de estrelas nos últimos 7 dias
  • Uma implementação de código aberto para o fine-tuning da série Qwen-VL da Alibaba Cloud.

    1.961+1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos