본문으로 건너뛰기
buildradar
Sign in
토픽 · big-data

big-data

big-data 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
110
총 스타
639,180
평균 스타
5,811
비중
0.03%

같은 리포지토리에 big-data 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 big-data 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • 확장 가능하고 신뢰할 수 있으며 성능이 뛰어난 대규모 시스템의 패턴

    73,681+79최근 7일 스타 변화
  • ClickHouse@ClickHouse

    ClickHouse®는 실시간 분석 데이터베이스 관리 시스템입니다.

    49,619+96최근 7일 스타 변화
  • spark@apache

    Apache Spark - 대규모 데이터 처리를 위한 통합 분석 엔진

    43,943+42최근 7일 스타 변화
  • 데이터 과학 Python 노트북: 딥러닝(TensorFlow, Theano, Caffe, Keras), scikit-learn, Kaggle, 빅데이터(Spark, Hadoop MapReduce, HDFS), matplotlib, pandas, NumPy, SciPy, Python 기초, AWS 및 다양한 커맨드라인.

    29,339+5최근 7일 스타 변화
  • flink@apache

    Apache Flink

    26,324+22최근 7일 스타 변화
  • thingsboard@thingsboard

    오픈소스 IoT 플랫폼 - 디바이스 관리, 데이터 수집, 처리 및 시각화

    22,355+28최근 7일 스타 변화
  • gun@amark

    탈중앙화된 그래프 데이터 동기화를 위한 오픈소스 사이버 보안 프로토콜

    19,129+1최근 7일 스타 변화
  • BigData-Notes@heibaiying

    빅데이터 입문 가이드 :star:

    16,962+4최근 7일 스타 변화
  • presto@prestodb

    빅데이터를 위한 Presto 분산 SQL 쿼리 엔진의 공식 홈페이지

    16,730+5최근 7일 스타 변화
  • Cookbook@andkret

    데이터 엔지니어링 쿡북

    15,397+14최근 7일 스타 변화
  • trino@trinodb

    빅데이터를 위한 분산 SQL 쿼리 엔진 Trino(구 PrestoSQL)의 공식 저장소 (https://trino.io)

    13,200+6최근 7일 스타 변화
  • nebula@vesoft-inc

    수평적 확장성과 고가용성을 갖춘 분산형 고성능 오픈소스 그래프 데이터베이스

    12,372+5최근 7일 스타 변화
  • kafka-ui@provectus

    Apache Kafka 관리를 위한 오픈소스 웹 UI

    12,278+6최근 7일 스타 변화
  • starrocks@StarRocks

    데이터 레이크하우스 내부와 외부 모두에서 1초 미만의 분석을 제공하는 세계에서 가장 빠른 오픈 쿼리 엔진입니다. 거의 모든 시나리오를 지원하는 유연성을 갖춘 StarRocks는 다차원 분석, 실시간 분석, 애드혹 쿼리를 위한 동급 최강의 성능을 제공합니다. Linux Foundation 프로젝트입니다.

    12,071+14최근 7일 스타 변화
  • quickwit@quickwit-oss

    관측 가능성을 위한 클라우드 네이티브 OSS 검색 엔진

    11,563+7최근 7일 스타 변화
  • cython@cython

    가장 널리 사용되는 Python-to-C 컴파일러

    10,842+6최근 7일 스타 변화
  • datafusion@apache

    Apache DataFusion SQL 쿼리 엔진

    9,267+19최근 7일 스타 변화
  • catboost@catboost

    Python, R, Java, C++용 랭킹, 분류, 회귀 및 기타 머신러닝 작업에 사용되는 빠르고 확장 가능하며 고성능인 Gradient Boosting on Decision Trees 라이브러리. CPU 및 GPU 연산을 지원합니다.

    9,086+1최근 7일 스타 변화
  • delta@delta-io

    Spark, PrestoDB, Flink, Trino, Hive 등의 연산 엔진과 API를 사용하여 Lakehouse 아키텍처를 구축할 수 있는 오픈소스 스토리지 프레임워크

    8,984+22최근 7일 스타 변화
  • beam@apache

    Apache Beam은 배치 및 스트리밍 데이터 처리를 위한 통합 프로그래밍 모델입니다.

    8,658+5최근 7일 스타 변화
  • h2o-3@h2oai

    H2O는 오픈 소스 분산형 고성능 확장 가능한 머신러닝 플랫폼입니다: 딥러닝, 그래디언트 부스팅(GBM) 및 XGBoost, 랜덤 포레스트, 일반화 선형 모델(Elastic Net이 포함된 GLM), K-Means, PCA, 일반화 가법 모델(GAM), RuleFit, 서포트 벡터 머신(SVM), 스택 앙상블, 자동 머신러닝(AutoML) 등

    7,499+3최근 7일 스타 변화
  • arkime@arkime

    Arkime은 오픈소스 대규모 전체 패킷 캡처, 인덱싱 및 데이터베이스 시스템입니다.

    7,461+1최근 7일 스타 변화
  • feast@feast-dev

    AI/ML을 위한 오픈소스 피처 스토어

    7,244+5최근 7일 스타 변화
  • vespa@vespa-engine

    AI 검색 플랫폼

    7,075+3최근 7일 스타 변화
  • couchdb@apache

    신뢰성을 위해 설계된 직관적인 HTTP/JSON API를 갖춘 매끄러운 멀티 프라이머리 동기화 데이터베이스

    6,944+0최근 7일 스타 변화
  • zeppelin@apache

    SQL, Scala 등을 사용하여 데이터 기반의 대화형 데이터 분석 및 공동 작업 문서를 지원하는 웹 기반 노트북.

    6,655+0최근 7일 스타 변화
  • hazelcast@hazelcast

    Hazelcast는 스트림 처리와 빠른 데이터 저장을 결합한 통합 실시간 데이터 플랫폼으로, 고객이 실시간 인사이트를 위해 이동 중인 데이터에 즉각적으로 대응할 수 있도록 지원합니다.

    6,606+2최근 7일 스타 변화
  • iotdb@apache

    Apache IoTDB

    6,389+4최근 7일 스타 변화
  • pachyderm@pachyderm

    데이터 중심 파이프라인 및 데이터 버전 관리

    6,309+1최근 7일 스타 변화
  • hive@apache

    Apache Hive

    6,016+1최근 7일 스타 변화
← 토픽 목록으로