bigdata
Dépôts open source suivis étiquetés bigdata, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de bigdata sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés bigdata.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Un répertoire contenant des liens vers tout ce que vous pourriez vouloir apprendre sur l'ingénierie des données.
★ 43 905+88Évolution des étoiles sur les 7 derniers jours - #2
2,3 fois plus rapide que MinIO pour des charges utiles d'objets de 4 Ko. RustFS est un système de stockage d'objets haute performance open source compatible S3, prenant en charge la migration et la coexistence avec d'autres plateformes compatibles S3 telles que MinIO et Ceph.
★ 31 528+238Évolution des étoiles sur les 7 derniers jours - #3
Base de données de séries temporelles haute performance et évolutive, conçue pour les scénarios de l'Internet des objets industriel (IIoT).
★ 25 093+15Évolution des étoiles sur les 7 derniers jours - #4
Renforcer l'intelligence des données grâce au SQL distribué pour le sharding, l'évolutivité et la sécurité sur toutes les bases de données.
★ 20 791+10Évolution des étoiles sur les 7 derniers jours - #5
Guide d'introduction au Big Data :star:
★ 16 958+6Évolution des étoiles sur les 7 derniers jours - #6
Une liste organisée de frameworks, ressources et autres éléments remarquables liés au Big Data.
★ 14 601+63Évolution des étoiles sur les 7 derniers jours - #7★ 14 371+19Évolution des étoiles sur les 7 derniers jours
- #8
Data Agent Ready Warehouse : pour l'analytique, la recherche, l'IA et le bac à sable Python. Entièrement reconstruit. Architecture unifiée sur votre S3.
★ 9 426+3Évolution des étoiles sur les 7 derniers jours - #9
DataFrame hybride Apache Arrow/NumPy hors mémoire pour Python, ML, visualisation et exploration de grands jeux de données tabulaires à un milliard de lignes par seconde.
★ 8 509+1Évolution des étoiles sur les 7 derniers jours - #10★ 6 227+12Évolution des étoiles sur les 7 derniers jours
- #11
Un système de traitement par lots natif pour le cloud (projet sous l'égide de la CNCF).
★ 5 907+30Évolution des étoiles sur les 7 derniers jours - #12
Plus de 100 modèles HTML5 de visualisation de données pour grands écrans, couvrant divers secteurs tels que la communauté, l'immobilier, l'administration et la finance.
★ 5 298+21Évolution des étoiles sur les 7 derniers jours - #13★ 4 100+1Évolution des étoiles sur les 7 derniers jours
- #14
Utilisez JSON pour générer des requêtes SQL structurées. Basé sur Vue3, TypeScript, Vite, Ant Design et MonacoEditor, ce projet est simple, axé sur la logique et idéal pour s'exercer.
★ 3 424-3Évolution des étoiles sur les 7 derniers jours - #15★ 3 301+3Évolution des étoiles sur les 7 derniers jours
- #16
Apprentissage du Big Data, de zéro, incluant des vidéos de formation et des ressources pour les entretiens à chaque étape.
★ 3 219+9Évolution des étoiles sur les 7 derniers jours - #17
GridDB est une base de données open source de nouvelle génération qui rend les séries temporelles IoT et le big data rapides et faciles.
★ 2 475+0Évolution des étoiles sur les 7 derniers jours - #18
Aix-DB, basé sur les frameworks LangChain/LangGraph et l'architecture de collaboration multi-agents MCP Skills, pour convertir le langage naturel en insights de données de bout en bout.
★ 2 237+10Évolution des étoiles sur les 7 derniers jours - #19
.NET for Apache® Spark™ rend Apache Spark™ facilement accessible aux développeurs .NET.
★ 2 097+0Évolution des étoiles sur les 7 derniers jours - #20
Extension du SQL temps réel basée sur Flink open source ; implémente principalement la jointure entre flux et tables de dimension, tout en prenant en charge la syntaxe native Flink SQL.
★ 2 051+0Évolution des étoiles sur les 7 derniers jours - #21
Byzer (anciennement MLSQL) : un langage de programmation open-source low-code pour les pipelines de données, l'analytique et l'IA.
★ 1 835-1Évolution des étoiles sur les 7 derniers jours - #22
Dépôt de connaissances sur le Big Data couvrant la modélisation d'entrepôts de données, le calcul en temps réel, le Big Data, les plateformes de données, la conception de systèmes, Java et les algorithmes.
★ 1 808+3Évolution des étoiles sur les 7 derniers jours - #23★ 1 767+0Évolution des étoiles sur les 7 derniers jours
- #24
Web crawler d'images multiprocessus pour Google et Naver (Selenium)
★ 1 691-1Évolution des étoiles sur les 7 derniers jours - #25
Tutoriels Apache Spark et Python (pySpark) pour l'analyse de Big Data et le Machine Learning sous forme de notebooks IPython / Jupyter
★ 1 660+1Évolution des étoiles sur les 7 derniers jours - #26
Flux de travail de préparation de données agiles simplifiés avec Pandas, Dask, cuDF, Dask-cuDF, Vaex et PySpark
★ 1 536+0Évolution des étoiles sur les 7 derniers jours - #27
Première plateforme open source de découverte et d'observabilité des données. Nous simplifions la vie des praticiens de la donnée pour que vous puissiez vous concentrer sur votre activité.
★ 1 426+2Évolution des étoiles sur les 7 derniers jours - #28
Apache Celeborn est un service élastique et haute performance pour le shuffle et les données déversées.
★ 1 061-1Évolution des étoiles sur les 7 derniers jours - #29★ 979+0Évolution des étoiles sur les 7 derniers jours
- #30
Apache Livy est une interface REST open source permettant d'interagir avec Apache Spark depuis n'importe où.
★ 960+0Évolution des étoiles sur les 7 derniers jours