big-data
big-data 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #61★ 1,766-1최근 7일 스타 변화
- #62★ 1,694+0최근 7일 스타 변화
- #63
IPython / Jupyter 노트북 형태의 빅데이터 분석 및 머신러닝을 위한 Apache Spark & Python (pySpark) 튜토리얼
★ 1,660+0최근 7일 스타 변화 - #64★ 1,618+3최근 7일 스타 변화
- #65
:bar_chart: :clipboard: YAML 또는 JSON 파일을 사용한 대시보드
★ 1,582+1최근 7일 스타 변화 - #66
Dremio - 현대 데이터 아키텍처의 빠진 연결고리
★ 1,492+1최근 7일 스타 변화 - #67
고성능 데이터 저장소 솔루션
★ 1,452+0최근 7일 스타 변화 - #68★ 1,384+0최근 7일 스타 변화
- #69
고급스럽고 성숙한 오픈 소스 MPP(Massively Parallel Processing) 데이터베이스. Greenplum Database의 오픈 소스 대안.
★ 1,382+5최근 7일 스타 변화 - #70
Scikit-learn 애플리케이션의 속도를 높이는 원활한 방법인 Scikit-learn용 확장 기능
★ 1,356+0최근 7일 스타 변화 - #71
PySpark-튜토리얼은 PySpark를 사용한 기본 알고리즘을 제공합니다.
★ 1,280+0최근 7일 스타 변화 - #72★ 1,270+1최근 7일 스타 변화
- #73
Apache Parquet 파일을 조회하고 쿼리하기 위한 간단한 Windows 데스크톱 애플리케이션
★ 1,231+2최근 7일 스타 변화 - #74
DataFrame 기반 그래프를 제공하는 Apache Spark용 패키지 GraphFrames
★ 1,202+0최근 7일 스타 변화 - #75★ 1,171+0최근 7일 스타 변화
- #76★ 1,165+2최근 7일 스타 변화
- #77
ClickBench: 분석용 데이터베이스 벤치마크
★ 1,100+2최근 7일 스타 변화 - #78
📙 멋진 데이터 카탈로그 및 옵저버빌리티 플랫폼 모음
★ 1,068+5최근 7일 스타 변화 - #79
ADAM은 Apache Avro, Apache Spark, Apache Parquet을 사용하여 구축된 특수 파일 형식을 갖춘 유전체 분석 플랫폼입니다. Apache 2 라이선스가 적용됩니다.
★ 1,059+2최근 7일 스타 변화 - #80★ 1,040+0최근 7일 스타 변화
- #81
Apache Flink Kubernetes 오퍼레이터
★ 1,031+3최근 7일 스타 변화 - #82
데이터 사이언스, 머신러닝, 빅데이터, 비즈니스 애널리틱스 커리어 리소스 저장소
★ 1,022+2최근 7일 스타 변화 - #83
제공되는 프런트엔드(JavaScript/React) 코드와 LB가 사용하는 모든 데이터 처리 컴포넌트를 포함하는 ListenBrainz 프로젝트 서버.
★ 1,006+4최근 7일 스타 변화 - #84
Apache Spark용 NVIDIA cuDF 플러그인 - GPU로 Apache Spark 가속화
★ 998+1최근 7일 스타 변화 - #85
Spark 클러스터 내에서 H2O 기능을 제공하는 Sparkling Water
★ 980+1최근 7일 스타 변화 - #86
안전한 데이터 공유를 위한 개방형 프로토콜
★ 957-1최근 7일 스타 변화 - #87
통계를 위한 단일 패스 알고리즘
★ 897+0최근 7일 스타 변화 - #88
데이터 엔지니어링의 기본 개념, 기술적 과제 및 리소스를 다루는 스페인어 저장소
★ 896+1최근 7일 스타 변화 - #89
전통적인 인덱스보다 훨씬 적은 공간을 사용하여 수십억 개의 아이템 배열에서 빠른 조회, 선행자, 범위 검색 및 업데이트를 가능하게 하는 최신 학습형 데이터 구조입니다.
★ 873+1최근 7일 스타 변화 - #90
AI 프로젝트 모음.
★ 868+1최근 7일 스타 변화