Saltar al contenido principal
buildradar
Sign in
Tema · multi-modal

multi-modal

Repositorios de código abierto monitorizados etiquetados con multi-modal, ordenados por estrellas.

Repositorios
42
Estrellas totales
189.535
Estrellas de media
4513
Proporción
0,01%

Temas que aparecen con frecuencia junto a multi-modal en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con multi-modal.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • agentscope@agentscope-ai

    Construya y ejecute agentes que pueda ver, entender y en los que pueda confiar.

    30.463+420Variación de estrellas de los últimos 7 días
  • MiniCPM-V@OpenBMB

    Un MLLM de bolsillo para la comprensión ultraeficiente de imágenes y videos en tu teléfono

    26.283+27Variación de estrellas de los últimos 7 días
  • ten-framework@TEN-framework

    Framework de código abierto para agentes de IA de voz conversacional

    11.102+10Variación de estrellas de los últimos 7 días
  • InternVL@OpenGVLab

    [CVPR 2024 Oral] Familia InternVL: una alternativa de código abierto pionera a GPT-4o. Un modelo de diálogo multimodal de código abierto con un rendimiento cercano al de GPT-4o

    10.150+3Variación de estrellas de los últimos 7 días
  • modelscope@modelscope

    ModelScope: da vida al concepto de Model-as-a-Service.

    9121+4Variación de estrellas de los últimos 7 días
  • big-AGI@enricoros

    Suite de IA impulsada por modelos de última generación que ofrece funciones avanzadas de IA/AGI. Incluye personajes de IA, funciones de AGI, chats multimodelo Beam de clase mundial, texto a imagen, voz, transmisión de respuestas, resaltado y ejecución de código, importación de PDF, ajustes preestablecidos para desarrolladores y mucho más. Despliegue local o en la nube.

    7108+1Variación de estrellas de los últimos 7 días
  • data-juicer@datajuicer

    ¡Procesamiento de datos para y con modelos fundamentales! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6975+26Variación de estrellas de los últimos 7 días
  • CogVLM@zai-org

    un modelo de lenguaje visual abierto de última generación

    6744+0Variación de estrellas de los últimos 7 días
  • valhalla@valhalla

    Motor de enrutamiento de código abierto para OpenStreetMap

    6154+24Variación de estrellas de los últimos 7 días
  • Chinese-CLIP@OFA-Sys

    Versión en chino de CLIP que logra la recuperación y generación de representaciones multimodales en chino.

    6001+1Variación de estrellas de los últimos 7 días
  • DALLE-pytorch@lucidrains

    Implementación / replicación de DALL-E, el Transformer de texto a imagen de OpenAI, en PyTorch

    5626-2Variación de estrellas de los últimos 7 días
  • marqo@marqo-ai

    Búsqueda y descubrimiento de comercio electrónico - marqo.ai

    5031-1Variación de estrellas de los últimos 7 días
  • DeepKE@zjunlp

    [EMNLP 2022] Un kit de herramientas abierto para la extracción y construcción de grafos de conocimiento

    4476+1Variación de estrellas de los últimos 7 días
  • VLMEvalKit@open-compass

    Kit de herramientas de evaluación de código abierto para grandes modelos multimodales (LMMs), compatible con más de 220 LMMs y más de 80 benchmarks

    4375+13Variación de estrellas de los últimos 7 días
  • OmniGen@VectorSpaceLab

    OmniGen: Generación de imágenes unificada. https://arxiv.org/pdf/2409.11340

    4342+1Variación de estrellas de los últimos 7 días
  • VisualGLM-6B@zai-org

    Modelo de lenguaje conversacional multimodal en chino e inglés | 多模态中英双语对话语言模型

    4155+0Variación de estrellas de los últimos 7 días
  • LLamaSharp@SciSharp

    Una biblioteca de C#/.NET para ejecutar LLM (🦙LLaMA/LLaVA) en tu dispositivo local de manera eficiente.

    3790+2Variación de estrellas de los últimos 7 días
  • Video-LLaVA@PKU-YuanGroup

    【EMNLP 2024🔥】Video-LLaVA: Aprendizaje de representación visual unificada mediante alineación antes de la proyección

    3500+1Variación de estrellas de los últimos 7 días
  • py-xiaozhi@huangjunsen0406

    Ecosistema de asistente de IA de código abierto con integraciones de MCP, flujos de trabajo multimodales, soporte para IoT e interacción de voz multiplataforma.

    3463+9Variación de estrellas de los últimos 7 días
  • docarray@docarray

    Representar, enviar, almacenar y buscar datos multimodales

    3123-1Variación de estrellas de los últimos 7 días
  • LISA@JIA-Lab-research

    Página del proyecto para "LISA: Segmentación de razonamiento mediante un modelo de lenguaje grande"

    2674+0Variación de estrellas de los últimos 7 días
  • CogVLM2@zai-org

    Modelo multimodal de código abierto a nivel de GPT4V basado en Llama3-8B

    2433+0Variación de estrellas de los últimos 7 días
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】 Mixture-of-Experts para grandes modelos de visión y lenguaje

    2322+0Variación de estrellas de los últimos 7 días
  • RecSysPapers@tangxyw

    Una colección de artículos clásicos de la industria y de vanguardia en el campo de la recomendación, publicidad y búsqueda.

    2188-1Variación de estrellas de los últimos 7 días
  • MotionGPT@OpenMotionLab

    [NeurIPS 2023] MotionGPT: Human Motion as a Foreign Language, un modelo unificado de generación de movimiento y lenguaje mediante LLMs

    1963+1Variación de estrellas de los últimos 7 días
  • GPTDiscord@Kav-K

    Una interfaz de GPT robusta y todo en uno para Discord. Conversaciones al estilo de ChatGPT, generación de imágenes, moderación por IA, índices/base de conocimientos personalizados, resumidor de YouTube y más.

    1853-2Variación de estrellas de los últimos 7 días
  • SALMONN@bytedance

    Familia SALMONN: un conjunto de LLMs multimodales avanzados.

    1521+3Variación de estrellas de los últimos 7 días
  • MedMNIST@MedMNIST

    [pip install medmnist] 18 conjuntos de datos estandarizados para la clasificación de imágenes biomédicas 2D y 3D

    1399+0Variación de estrellas de los últimos 7 días
  • transfusion-pytorch@lucidrains

    Implementación en Pytorch de Transfusion, "Predecir el siguiente token y difundir imágenes con un modelo multimodal", de MetaAI

    1398+3Variación de estrellas de los últimos 7 días
  • Este repositorio recopila artículos para "Una encuesta sobre la destilación de conocimiento de modelos de lenguaje grandes". Desglosamos la destilación de conocimiento en algoritmos de obtención y destilación de conocimiento, y exploramos la destilación de habilidades y vertical de los LLM.

    1306+1Variación de estrellas de los últimos 7 días
← Volver a temas