Saltar al contenido principal
buildradar
Sign in
Tema · information-retrieval

information-retrieval

Repositorios de código abierto monitorizados etiquetados con information-retrieval, ordenados por estrellas.

69 repositorios
  • osi.ig@th3unkn0n

    Recopilación de información de Instagram

    1554+0Variación de estrellas de los últimos 7 días
  • Lista de software que permite realizar búsquedas en la web con asistencia de IA: https://hf.co/spaces/felladrin/awesome-ai-web-search

    1426+3Variación de estrellas de los últimos 7 días
  • rank_bm25@dorianbrown

    Una colección de algoritmos BM25 en Python.

    1382+1Variación de estrellas de los últimos 7 días
  • EmbedAnything@StarlightSearch

    Inferencia, ingesta e indexación de alto rendimiento, modulares, seguras para la memoria y listas para producción, construidas en Rust 🦀

    1305-1Variación de estrellas de los últimos 7 días
  • scilla@edoardottt

    Herramienta de recopilación de información: enumeración de DNS, subdominios, puertos y directorios

    1264+1Variación de estrellas de los últimos 7 días
  • anserini@castorini

    Anserini es un kit de herramientas de Lucene para la investigación de recuperación de información reproducible.

    1191+1Variación de estrellas de los últimos 7 días
  • SearchCLI@volcengine

    CLI abierta para integrar búsqueda mediante IA, recomendaciones y recuperación conversacional en sistemas de agentes y sistemas empresariales.

    1176+1Variación de estrellas de los últimos 7 días
  • pisa@pisa-engine

    PISA: Índices y búsqueda de alto rendimiento para el ámbito académico.

    1056+1Variación de estrellas de los últimos 7 días
  • raft@NVIDIA

    RAFT contiene algoritmos y primitivas fundamentales ampliamente utilizados para el aprendizaje automático y la recuperación de información. Los algoritmos están acelerados por CUDA y forman bloques de construcción para escribir aplicaciones de alto rendimiento con mayor facilidad.

    1040+3Variación de estrellas de los últimos 7 días
  • splade@naver

    SPLADE: búsqueda neuronal dispersa (SIGIR21, SIGIR22)

    1011+3Variación de estrellas de los últimos 7 días
  • allRank@allegro

    allRank es un framework para entrenar modelos neuronales de aprendizaje de clasificación (learning-to-rank) basado en PyTorch.

    1009+0Variación de estrellas de los últimos 7 días
  • rag-fusion@Raudaschl

    RAG-Fusion: generación de consultas múltiples + Reciprocal Rank Fusion para una mejor generación aumentada por recuperación. Incluye arnés de evaluación con NFCorpus/BEIR.

    956+2Variación de estrellas de los últimos 7 días
  • pylate@lightonai

    Entrenamiento y recuperación de modelos de interacción tardía

    889+3Variación de estrellas de los últimos 7 días
  • sgpt@Muennighoff

    SGPT: Incrustaciones de oraciones GPT para búsqueda semántica

    872+0Variación de estrellas de los últimos 7 días
  • cuvs@NVIDIA

    cuVS: una biblioteca para búsqueda vectorial y clustering en la GPU

    848+6Variación de estrellas de los últimos 7 días
  • s3@pat-jj

    [EMNLP'25] s3 - ⚡ Entrenamiento eficiente y efectivo de agentes de búsqueda mediante RL para RAG (RLVR para búsqueda con datos mínimos)

    848+0Variación de estrellas de los últimos 7 días
  • RAG-FiT@IntelLabs

    Framework para mejorar LLMs en tareas de RAG mediante ajuste fino (fine-tuning).

    768+0Variación de estrellas de los últimos 7 días
  • tevatron@texttron

    Tevatron: kit de herramientas unificado para la recuperación de documentos a escala, en cualquier idioma y modalidad. Demo en SIGIR 2023, SIGIR 2025.

    750+1Variación de estrellas de los últimos 7 días
  • talisman@Yomguithereal

    Componentes básicos de JavaScript para coincidencia difusa, recuperación de información y PNL.

    732+0Variación de estrellas de los últimos 7 días
  • 729+0Variación de estrellas de los últimos 7 días
  • DeepRetrieval@pat-jj

    [COLM’25] DeepRetrieval — 🔥 Entrenamiento de agentes de búsqueda mediante RLVR con resultados de recuperación

    719+2Variación de estrellas de los últimos 7 días
  • gritlm@ContextualAI

    Ajuste de instrucciones representacionales generativas.

    700+1Variación de estrellas de los últimos 7 días
  • ranx@AmenRa

    ⚡️ Una biblioteca de Python ultrarrápida para evaluación, comparación y fusión de rankings 🐍

    698+5Variación de estrellas de los últimos 7 días
  • Rankify@DataScienceUIBK

    Rankify: Un kit de herramientas integral en Python para recuperación, re-ranking y generación aumentada por recuperación (RAG). Nuestro kit integra 40 conjuntos de datos de referencia pre-recuperados y admite más de 7 técnicas de recuperación, más de 24 modelos de re-ranking de última generación y múltiples métodos RAG.

    682-1Variación de estrellas de los últimos 7 días
  • xyne@xynehq

    Motor de búsqueda y respuestas basado en IA para el trabajo. Alternativa de código abierto a Glean.

    680+1Variación de estrellas de los últimos 7 días
  • Una lista curada de artículos destacados relacionados con modelos preentrenados para recuperación de información (también conocido como preentrenamiento para IR).

    677+0Variación de estrellas de los últimos 7 días
  • RankGPT@sunnweiwei

    ¿Es ChatGPT bueno para buscar? LLMs como agentes de re-ranking [Premio al mejor artículo en EMNLP 2023]

    669-1Variación de estrellas de los últimos 7 días
  • SkillCorpus@EverMind-AI

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    646Variación de estrellas de los últimos 7 días
  • sycamore@aryn-ai

    🍁 Sycamore es una plataforma de búsqueda y análisis impulsada por LLM para datos no estructurados.

    607+0Variación de estrellas de los últimos 7 días
  • MiniSearch@felladrin

    Plataforma de búsqueda web minimalista con un asistente de IA que se ejecuta directamente desde el navegador. Demo: https://felladrin-minisearch.hf.space

    585+0Variación de estrellas de los últimos 7 días
← Volver a temas