Aller au contenu principal
buildradar
Sign in
Sujet · big-data

big-data

Dépôts open source suivis étiquetés big-data, triés par étoiles.

110 dépôts
  • Daft@Eventual-Inc

    Moteur de données haute performance pour l'IA et les charges de travail multimodales. Traitez des images, de l'audio, de la vidéo et des données structurées à n'importe quelle échelle.

    5 736+4Évolution des étoiles sur les 7 derniers jours
  • SynapseML@microsoft

    Bibliothèque Python d'apprentissage automatique simple et distribuée, portant des algorithmes ML pour Spark

    5 245+3Évolution des étoiles sur les 7 derniers jours
  • calcite@apache

    Apache Calcite

    5 180+2Évolution des étoiles sur les 7 derniers jours
  • ignite@apache

    Apache Ignite

    5 082+2Évolution des étoiles sur les 7 derniers jours
  • Stream-Framework@tschellenbach

    Stream Framework est une bibliothèque Python permettant de créer des flux d'actualités, des flux d'activités et des systèmes de notification en utilisant Cassandra et/ou Redis. Les auteurs de Stream-Framework proposent également un service cloud pour la technologie de flux.

    4 742-2Évolution des étoiles sur les 7 derniers jours
  • Composant Vue supportant de grands volumes de données avec des performances de rendu élevées et efficaces.

    4 505-1Évolution des étoiles sur les 7 derniers jours
  • img2dataset@rom1504

    Transformez facilement de grands ensembles d'URL d'images en un jeu de données. Capable de télécharger, redimensionner et empaqueter 100 millions d'URL en 20 heures sur une seule machine.

    4 445+2Évolution des étoiles sur les 7 derniers jours
  • crate@crate

    CrateDB est une base de données SQL distribuée et évolutive conçue pour stocker et analyser des volumes massifs de données en temps quasi réel, même avec des requêtes complexes. Compatible avec PostgreSQL et basée sur Lucene.

    4 432+3Évolution des étoiles sur les 7 derniers jours
  • fastjson2@alibaba

    FASTJSON2 est une bibliothèque JSON pour Java offrant d'excellentes performances.

    4 399+2Évolution des étoiles sur les 7 derniers jours
  • Data-Science-Roadmap@Moataz-Elmesmary

    Feuille de route complète pour la science des données

    4 354+3Évolution des étoiles sur les 7 derniers jours
  • GraphScope@alibaba

    🔨 🍇 💻 🚀 GraphScope : Un système de calcul sur graphes à grande échelle tout-en-un par Alibaba

    3 557+1Évolution des étoiles sur les 7 derniers jours
  • Analyseur lexical et syntaxique SQL extensible pour Rust.

    3 446+9Évolution des étoiles sur les 7 derniers jours
  • paimon@apache

    Apache Paimon est un format de lac de données permettant de construire une architecture Lakehouse en temps réel avec Flink et Spark pour les opérations de streaming et de traitement par lots.

    3 388+3Évolution des étoiles sur les 7 derniers jours
  • koalas@databricks

    Koalas : API pandas sur Apache Spark

    3 374+1Évolution des étoiles sur les 7 derniers jours
  • sail@lakehq

    Remplacement prêt à l'emploi pour Apache Spark écrit en Rust, unifiant le traitement par lots, le traitement de flux et les charges de travail IA intensives.

    3 341+4Évolution des étoiles sur les 7 derniers jours
  • hugegraph@apache

    Une base de données orientée graphe supportant plus de 100 milliards de données, avec des performances et une scalabilité élevées (inclut moteur OLTP, API REST et backends).

    3 167+6Évolution des étoiles sur les 7 derniers jours
  • CBoard@TuiQiao

    Une plateforme de reporting BI et de tableaux de bord en libre-service, facile à utiliser.

    3 098+1Évolution des étoiles sur les 7 derniers jours
  • kafka-ui@kafbat

    Interface Web open source pour la gestion des clusters Apache Kafka.

    2 656+14Évolution des étoiles sur les 7 derniers jours
  • ArcticDB@man-group

    ArcticDB est une base de données DataFrame haute performance et sans serveur, conçue pour l'écosystème de science des données Python.

    2 505+8Évolution des étoiles sur les 7 derniers jours
  • quary@quarylabs

    Outil de BI open source pour les ingénieurs.

    2 379+2Évolution des étoiles sur les 7 derniers jours
  • ambari@apache

    Apache Ambari simplifie le provisionnement, la gestion et la surveillance des clusters Apache Hadoop.

    2 311+0Évolution des étoiles sur les 7 derniers jours
  • ytsaurus@ytsaurus

    YTsaurus est une plateforme de Big Data open source, évolutive et tolérante aux pannes.

    2 203+0Évolution des étoiles sur les 7 derniers jours
  • fluss@apache

    Apache Fluss est un stockage de flux conçu pour l'analyse en temps réel.

    2 131+11Évolution des étoiles sur les 7 derniers jours
  • Moteur de requête distribué Apache DataFusion Ballista

    2 127+7Évolution des étoiles sur les 7 derniers jours
  • drill@apache

    Apache Drill est une couche de requête MPP distribuée pour les données auto-descriptives

    2 022+0Évolution des étoiles sur les 7 derniers jours
  • bookkeeper@apache

    Apache BookKeeper : un service de stockage évolutif, tolérant aux pannes et à faible latence, optimisé pour les charges de travail en ajout seul.

    2 011+1Évolution des étoiles sur les 7 derniers jours
  • fluid@fluid-cloudnative

    Abstraction et accélération de données fluides et élastiques pour les applications BigData/IA dans le cloud. (Projet sous CNCF)

    1 967+0Évolution des étoiles sur les 7 derniers jours
  • kudu@apache

    Miroir d'Apache Kudu.

    1 913+0Évolution des étoiles sur les 7 derniers jours
  • awesome-data-analysis@PavelGrigoryevDS

    Plus de 500 ressources sélectionnées pour l'analyse de données et la science des données : Python, SQL, statistiques, ML, IA, visualisation, aide-mémoire, feuilles de route, préparation aux entretiens. Pour débutants et experts.

    1 890+8Évolution des étoiles sur les 7 derniers jours
  • auron@apache

    L'accélérateur Auron pour les frameworks de calcul distribué (ex: Spark) exploite l'exécution vectorisée native pour accélérer le traitement des requêtes

    1 798+2Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets