본문으로 건너뛰기
buildradar
Sign in
토픽 · pyspark

pyspark

pyspark 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
23
총 스타
43,799
평균 스타
1,904
비중
0.00%

같은 리포지토리에 pyspark 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 pyspark 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • ibis@ibis-project

    휴대용 Python 데이터프레임 라이브러리

    6,650+1최근 7일 스타 변화
  • SynapseML@microsoft

    Spark용 ML 알고리즘을 포팅한 간단하고 분산된 머신러닝 Python 라이브러리

    5,245+3최근 7일 스타 변화
  • spark-nlp@JohnSnowLabs

    최첨단 자연어 처리

    4,160+1최근 7일 스타 변화
  • linkis@apache

    Apache Linkis는 상위 애플리케이션과 하위 데이터 엔진 간의 연결, 거버넌스 및 오케스트레이션을 용이하게 하는 연산 미들웨어 계층을 구축합니다.

    3,409+2최근 7일 스타 변화
  • sail@lakehq

    배치 처리, 스트림 처리, 연산 집약적 AI 워크로드를 통합하는 Rust로 작성된 Apache Spark 드롭인 대체재입니다.

    3,341+4최근 7일 스타 변화
  • awesome-spark@awesome-spark

    Apache Spark 관련 우수 패키지 및 리소스 모음

    1,893+0최근 7일 스타 변화
  • petastorm@uber

    Petastorm 라이브러리는 Apache Parquet 형식의 데이터셋을 사용하여 단일 장치 또는 분산 환경에서 딥러닝 모델의 학습 및 평가를 가능하게 합니다. Tensorflow, Pytorch, PySpark 같은 ML 프레임워크를 지원하며 순수 Python 코드에서도 사용할 수 있습니다.

    1,892+0최근 7일 스타 변화
  • narwhals@narwhals-dev

    데이터프레임 라이브러리 간의 가볍고 확장 가능한 호환성 레이어!

    1,714+4최근 7일 스타 변화
  • spark-py-notebooks@jadianes

    IPython / Jupyter 노트북 형태의 빅데이터 분석 및 머신러닝을 위한 Apache Spark & Python (pySpark) 튜토리얼

    1,660+0최근 7일 스타 변화
  • optimus@hi-primus

    Pandas, Dask, cuDF, Dask-cuDF, Vaex, PySpark를 활용한 간편한 애자일 데이터 준비 워크플로

    1,536+0최근 7일 스타 변화
  • sparkmagic@jupyter-incubator

    원격 Spark 클러스터 작업을 위한 Jupyter magics 및 커널

    1,365-1최근 7일 스타 변화
  • hopsworks@logicalclocks

    Hopsworks - 피처 스토어가 포함된 데이터 집약적 AI 플랫폼

    1,304+1최근 7일 스타 변화
  • pyspark-tutorial@mahmoudparsian

    PySpark-튜토리얼은 PySpark를 사용한 기본 알고리즘을 제공합니다.

    1,280+0최근 7일 스타 변화
  • graphframes@graphframes

    DataFrame 기반 그래프를 제공하는 Apache Spark용 패키지 GraphFrames

    1,202+0최근 7일 스타 변화
  • data-algorithms-book@mahmoudparsian

    Data Algorithms 도서를 위한 MapReduce, Spark, Java 및 Scala

    1,080-2최근 7일 스타 변화
  • Spark 클러스터 내에서 H2O 기능을 제공하는 Sparkling Water

    980+1최근 7일 스타 변화
  • DevOps-Python-tools@HariSekhon

    80개 이상의 DevOps 및 데이터 CLI 도구 - AWS, GCP, GCF Python Cloud Functions, 로그 익명화 도구, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark 데이터 변환기 및 검증기(Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr 등

    824+0최근 7일 스타 변화
  • koheesio@Nike-Inc

    효율적인 데이터 파이프라인 구축을 위한 Python 프레임워크. 모듈성과 협업을 장려하며, 간단하고 재사용 가능한 구성 요소로 복잡한 파이프라인을 생성할 수 있습니다.

    818+0최근 7일 스타 변화
  • Scriptis@WeBankFinTech

    스크립트 개발(SQL, Pyspark, HiveQL), 작업 제출(Spark, Hive), UDF, 함수, 리소스 관리 및 지능형 진단을 지원하는 대화형 데이터 분석 도구 Scriptis

    814+0최근 7일 스타 변화
  • chispa@MrPowers

    명확하고 직관적인 에러 메시지를 제공하는 PySpark 테스트 헬퍼 메서드

    772-1최근 7일 스타 변화
  • quinn@mrpowers-io

    개발자 생산성을 향상시키는 pyspark 메서드 📣 👯 🎉

    689+0최근 7일 스타 변화
  • datacompy@capitalone

    Pandas, Polars, Spark, Snowpark DataFrame을 위한 인간 중심의 비교 도구 등!

    658+0최근 7일 스타 변화
  • spark-standalone-cluster-on-docker@cluster-apps-on-docker

    Docker의 JupyterLab 인터페이스에서 자신만의 클러스터를 구축하여 Scala, Python(PySpark), R(SparkR)로 Apache Spark를 학습하세요. :zap:

    512+0최근 7일 스타 변화
← 토픽 목록으로