big-data
big-data 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 big-data 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 big-data 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1
확장 가능하고 신뢰할 수 있으며 성능이 뛰어난 대규모 시스템의 패턴
★ 73,681+79최근 7일 스타 변화 - #2
ClickHouse®는 실시간 분석 데이터베이스 관리 시스템입니다.
★ 49,619+96최근 7일 스타 변화 - #3★ 43,943+42최근 7일 스타 변화
- #4
데이터 과학 Python 노트북: 딥러닝(TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, 빅데이터(Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, Python 기초, AWS 및 다양한 커맨드라인.
★ 29,339+5최근 7일 스타 변화 - #5★ 26,324+22최근 7일 스타 변화
- #6
오픈소스 IoT 플랫폼 - 디바이스 관리, 데이터 수집, 처리 및 시각화
★ 22,355+28최근 7일 스타 변화 - #7★ 19,129+1최근 7일 스타 변화
- #8
빅데이터 입문 가이드 :star:
★ 16,962+4최근 7일 스타 변화 - #9★ 16,730+5최근 7일 스타 변화
- #10★ 15,397+14최근 7일 스타 변화
- #11★ 13,200+6최근 7일 스타 변화
- #12★ 12,372+5최근 7일 스타 변화
- #13★ 12,278+6최근 7일 스타 변화
- #14
데이터 레이크하우스 내부와 외부 모두에서 1초 미만의 분석을 제공하는 세계에서 가장 빠른 오픈 쿼리 엔진입니다. 거의 모든 시나리오를 지원하는 유연성을 갖춘 StarRocks는 다차원 분석, 실시간 분석, 애드혹 쿼리를 위한 동급 최강의 성능을 제공합니다. Linux Foundation 프로젝트입니다.
★ 12,071+14최근 7일 스타 변화 - #15★ 11,563+7최근 7일 스타 변화
- #16★ 10,842+6최근 7일 스타 변화
- #17
Apache DataFusion SQL 쿼리 엔진
★ 9,267+19최근 7일 스타 변화 - #18
Python, R, Java, C++용 랭킹, 분류, 회귀 및 기타 머신러닝 작업에 사용되는 빠르고 확장 가능하며 고성능인 Gradient Boosting on Decision Trees 라이브러리. CPU 및 GPU 연산을 지원합니다.
★ 9,086+1최근 7일 스타 변화 - #19
Spark, PrestoDB, Flink, Trino, Hive 등의 연산 엔진과 API를 사용하여 Lakehouse 아키텍처를 구축할 수 있는 오픈소스 스토리지 프레임워크
★ 8,984+22최근 7일 스타 변화 - #20★ 8,658+5최근 7일 스타 변화
- #21
H2O는 오픈 소스 분산형 고성능 확장 가능한 머신러닝 플랫폼입니다: 딥러닝, 그래디언트 부스팅(GBM) 및 XGBoost, 랜덤 포레스트, 일반화 선형 모델(Elastic Net이 포함된 GLM), K-Means, PCA, 일반화 가법 모델(GAM), RuleFit, 서포트 벡터 머신(SVM), 스택 앙상블, 자동 머신러닝(AutoML) 등
★ 7,499+3최근 7일 스타 변화 - #22★ 7,461+1최근 7일 스타 변화
- #23★ 7,244+5최근 7일 스타 변화
- #24★ 7,075+3최근 7일 스타 변화
- #25★ 6,944+0최근 7일 스타 변화
- #26★ 6,655+0최근 7일 스타 변화
- #27
Hazelcast는 스트림 처리와 빠른 데이터 저장을 결합한 통합 실시간 데이터 플랫폼으로, 고객이 실시간 인사이트를 위해 이동 중인 데이터에 즉각적으로 대응할 수 있도록 지원합니다.
★ 6,606+2최근 7일 스타 변화 - #28★ 6,389+4최근 7일 스타 변화
- #29★ 6,309+1최근 7일 스타 변화
- #30★ 6,016+1최근 7일 스타 변화