search-engine
Repositorios de código abierto monitorizados etiquetados con search-engine, ordenados por estrellas.
- #31
La base de datos nativa de IA diseñada para aplicaciones LLM, que ofrece una búsqueda híbrida increíblemente rápida de vectores densos, vectores dispersos, tensores (multivectoriales) y texto completo.
★ 4700+13Variación de estrellas de los últimos 7 días - #32
Búsqueda semántica en videos usando Gemini Embedding 2 o Qwen3-VL.
★ 4496+60Variación de estrellas de los últimos 7 días - #33
Software de búsqueda de código abierto Apache Lucene y Solr
★ 4364+1Variación de estrellas de los últimos 7 días - #34
Una utilidad de búsqueda rápida de archivos para sistemas tipo Unix basada en GTK3
★ 4342+7Variación de estrellas de los últimos 7 días - #35
Motor de búsqueda y agrupamiento (clustering) rápido y de código abierto × para vectores y objetos arbitrarios × en C++, C, Python, JavaScript, Rust, Java, Objective-C, Swift, C#, GoLang y Wolfram 🔍
★ 4286+2Variación de estrellas de los últimos 7 días - #36★ 4256+0Variación de estrellas de los últimos 7 días
- #37
Motor de búsqueda web y dispositivo de búsqueda para intranets distribuido de igual a igual (Peer-to-Peer)
★ 4025+4Variación de estrellas de los últimos 7 días - #38★ 3995+1Variación de estrellas de los últimos 7 días
- #39★ 3907-1Variación de estrellas de los últimos 7 días
- #40
Una lista de proyectos prácticos para la construcción de conocimiento.
★ 3726+1Variación de estrellas de los últimos 7 días - #41★ 3553+3Variación de estrellas de los últimos 7 días
- #42★ 3548+288Variación de estrellas de los últimos 7 días
- #43★ 3543+0Variación de estrellas de los últimos 7 días
- #44★ 3197+2Variación de estrellas de los últimos 7 días
- #45
Aplicación web que indexa todos los sitios de torrents populares y los guarda en la base de datos local.
★ 3093+1Variación de estrellas de los últimos 7 días - #46
Búsqueda por IA y RAG sin mover tus datos. Obtén respuestas instantáneas de la base de conocimientos de tu empresa en más de 100 aplicaciones manteniendo los datos seguros. Despliegue en minutos, no en meses.
★ 3043+0Variación de estrellas de los últimos 7 días - #47
🔍 Pequeño motor de búsqueda de texto completo para sitios web estáticos construido con Rust y Wasm
★ 2965+0Variación de estrellas de los últimos 7 días - #48
🎁 Más de 7,400,000 imágenes de Unsplash disponibles para investigación y machine learning
★ 2783+3Variación de estrellas de los últimos 7 días - #49
Investigación de SEO de Google y monetización de tráfico web
★ 2781+3Variación de estrellas de los últimos 7 días - #50
Plataforma todo en uno para búsqueda, recomendaciones, RAG y análisis ofrecida a través de API
★ 2716-1Variación de estrellas de los últimos 7 días - #51
🚀 Colección de librerías de algoritmos de búsqueda de vecinos más cercanos aproximados eficientes escrita en Rust 🦀.
★ 2658+0Variación de estrellas de los últimos 7 días - #52
Artículos increíbles de Deep Learning para búsqueda, recomendación y publicidad industrial. Se centran en embedding, coincidencia, preclasificación, clasificación, posclasificación, relevancia, LLM y RL. Por favor cite nuestro artículo "Deep Learning to Rank in Industrial Search Engines, Recommender Systems, and Online Advertising - An Overview and New Perspectives" (TOIS 2026).
★ 2589+0Variación de estrellas de los últimos 7 días - #53
rats-search: Motor de búsqueda P2P de BitTorrent multiplataforma para escritorio y servidores Web con cliente torrent integrado
★ 1964+3Variación de estrellas de los últimos 7 días - #54
Motor de búsqueda en Internet para sitios web orientados a texto. Indexando la web pequeña, antigua y extraña.
★ 1938+11Variación de estrellas de los últimos 7 días - #55★ 1915+24Variación de estrellas de los últimos 7 días
- #56
SeekStorm: búsqueda vectorial y léxica, biblioteca en proceso y servidor multiinquilino, en Rust.
★ 1908+0Variación de estrellas de los últimos 7 días - #57★ 1845+0Variación de estrellas de los últimos 7 días
- #58
XERJ es la nueva forma para que la IA busque datos. Su capacidad de autoindexación activa a los agentes para conocer sus datos sin el desperdicio de tokens de grep y sed. Un comando indexa código, documentos, registros y PDF para búsqueda, RAG, auditorías de seguridad y memoria de agentes, utilizando un 40% menos de tokens que grep. Compatible con Elasticsearch, por lo que los clientes existentes simplemente funcionan.
★ 1812+95Variación de estrellas de los últimos 7 días - #59★ 1744+1Variación de estrellas de los últimos 7 días
- #60★ 1671+2Variación de estrellas de los últimos 7 días