본문으로 건너뛰기
buildradar
Sign in
토픽 · big-data

big-data

big-data 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 110개
  • genie@Netflix

    분산 빅데이터 오케스트레이션 서비스

    1,766-1최근 7일 스타 변화
  • matano@matanolabs

    AWS에서 페타바이트 규모의 위협 탐지, 대응 및 사이버 보안 분석을 위한 오픈 소스 보안 데이터 레이크

    1,694+0최근 7일 스타 변화
  • spark-py-notebooks@jadianes

    IPython / Jupyter 노트북 형태의 빅데이터 분석 및 머신러닝을 위한 Apache Spark & Python (pySpark) 튜토리얼

    1,660+0최근 7일 스타 변화
  • tonbo@tonbo-io

    Tonbo는 서버리스 및 엣지 런타임을 위한 임베디드 데이터베이스입니다.

    1,618+3최근 7일 스타 변화
  • just-dashboard@kantord

    :bar_chart: :clipboard: YAML 또는 JSON 파일을 사용한 대시보드

    1,582+1최근 7일 스타 변화
  • dremio-oss@dremio

    Dremio - 현대 데이터 아키텍처의 빠진 연결고리

    1,492+1최근 7일 스타 변화
  • carbondata@apache

    고성능 데이터 저장소 솔루션

    1,452+0최근 7일 스타 변화
  • avsc@mtth

    JavaScript용 Avro :zap:

    1,384+0최근 7일 스타 변화
  • 고급스럽고 성숙한 오픈 소스 MPP(Massively Parallel Processing) 데이터베이스. Greenplum Database의 오픈 소스 대안.

    1,382+5최근 7일 스타 변화
  • scikit-learn-intelex@uxlfoundation

    Scikit-learn 애플리케이션의 속도를 높이는 원활한 방법인 Scikit-learn용 확장 기능

    1,356+0최근 7일 스타 변화
  • pyspark-tutorial@mahmoudparsian

    PySpark-튜토리얼은 PySpark를 사용한 기본 알고리즘을 제공합니다.

    1,280+0최근 7일 스타 변화
  • ozone@apache

    데이터 분석 및 객체 저장소 워크로드에 최적화된 확장 가능하고 안정적인 분산 스토리지 시스템

    1,270+1최근 7일 스타 변화
  • Apache Parquet 파일을 조회하고 쿼리하기 위한 간단한 Windows 데스크톱 애플리케이션

    1,231+2최근 7일 스타 변화
  • graphframes@graphframes

    DataFrame 기반 그래프를 제공하는 Apache Spark용 패키지 GraphFrames

    1,202+0최근 7일 스타 변화
  • amoro@apache

    Apache Amoro(incubating)은 오픈 데이터 레이크 포맷 기반으로 구축된 레이크하우스 관리 시스템입니다.

    1,171+0최근 7일 스타 변화
  • accumulo@apache

    Apache Accumulo

    1,165+2최근 7일 스타 변화
  • ClickBench@ClickHouse

    ClickBench: 분석용 데이터베이스 벤치마크

    1,100+2최근 7일 스타 변화
  • awesome-data-catalogs@opendatadiscovery

    📙 멋진 데이터 카탈로그 및 옵저버빌리티 플랫폼 모음

    1,068+5최근 7일 스타 변화
  • adam@bigdatagenomics

    ADAM은 Apache Avro, Apache Spark, Apache Parquet을 사용하여 구축된 특수 파일 형식을 갖춘 유전체 분석 플랫폼입니다. Apache 2 라이선스가 적용됩니다.

    1,059+2최근 7일 스타 변화
  • MyScaleDB@myscale

    고성능 벡터 검색 및 전문 검색(full-text search)을 지원하는 @ClickHouse 포크

    1,040+0최근 7일 스타 변화
  • Apache Flink Kubernetes 오퍼레이터

    1,031+3최근 7일 스타 변화
  • 데이터 사이언스, 머신러닝, 빅데이터, 비즈니스 애널리틱스 커리어 리소스 저장소

    1,022+2최근 7일 스타 변화
  • listenbrainz-server@metabrainz

    제공되는 프런트엔드(JavaScript/React) 코드와 LB가 사용하는 모든 데이터 처리 컴포넌트를 포함하는 ListenBrainz 프로젝트 서버.

    1,006+4최근 7일 스타 변화
  • cudf-spark@NVIDIA

    Apache Spark용 NVIDIA cuDF 플러그인 - GPU로 Apache Spark 가속화

    998+1최근 7일 스타 변화
  • Spark 클러스터 내에서 H2O 기능을 제공하는 Sparkling Water

    980+1최근 7일 스타 변화
  • delta-sharing@delta-io

    안전한 데이터 공유를 위한 개방형 프로토콜

    957-1최근 7일 스타 변화
  • OnlineStats.jl@joshday

    통계를 위한 단일 패스 알고리즘

    897+0최근 7일 스타 변화
  • 데이터 엔지니어링의 기본 개념, 기술적 과제 및 리소스를 다루는 스페인어 저장소

    896+1최근 7일 스타 변화
  • PGM-index@gvinciguerra

    전통적인 인덱스보다 훨씬 적은 공간을 사용하여 수십억 개의 아이템 배열에서 빠른 조회, 선행자, 범위 검색 및 업데이트를 가능하게 하는 최신 학습형 데이터 구조입니다.

    873+1최근 7일 스타 변화
  • ai_projects@miguelgfierro

    AI 프로젝트 모음.

    868+1최근 7일 스타 변화
← 토픽 목록으로