big-data
big-data 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31★ 5,736+4최근 7일 스타 변화
- #32★ 5,245+3최근 7일 스타 변화
- #33★ 5,180+2최근 7일 스타 변화
- #34★ 5,082+2최근 7일 스타 변화
- #35
Stream Framework은 Cassandra 및/또는 Redis를 사용하여 뉴스 피드, 액티비티 스트림, 알림 시스템을 구축할 수 있는 Python 라이브러리입니다. Stream-Framework 개발자들은 피드 기술을 위한 클라우드 서비스도 제공합니다:
★ 4,742-2최근 7일 스타 변화 - #36
⚡️ 대용량 데이터 리스트를 고성능 렌더링과 효율성으로 지원하는 Vue 컴포넌트
★ 4,505-1최근 7일 스타 변화 - #37
대규모 이미지 URL 세트를 이미지 데이터셋으로 쉽게 변환합니다. 단일 머신에서 20시간 만에 1억 개의 URL을 다운로드, 크기 조정 및 패키징할 수 있습니다.
★ 4,445+2최근 7일 스타 변화 - #38
CrateDB는 복잡한 쿼리에서도 대량의 데이터를 실시간에 가깝게 저장하고 분석하기 위한 분산형 확장 가능 SQL 데이터베이스입니다. PostgreSQL과 호환되며 Lucene을 기반으로 합니다.
★ 4,432+3최근 7일 스타 변화 - #39★ 4,399+2최근 7일 스타 변화
- #40
A부터 Z까지의 데이터 사이언스 로드맵
★ 4,354+3최근 7일 스타 변화 - #41
🔨 🍇 💻 🚀 GraphScope: 알리바바의 올인원 대규모 그래프 컴퓨팅 시스템
★ 3,557+1최근 7일 스타 변화 - #42
Rust를 위한 확장 가능한 SQL Lexer 및 Parser
★ 3,446+9최근 7일 스타 변화 - #43
Apache Paimon은 Flink 및 Spark를 사용하여 스트리밍 및 배치 작업 모두에 실시간 레이크하우스 아키텍처를 구축할 수 있는 레이크 포맷입니다.
★ 3,388+3최근 7일 스타 변화 - #44★ 3,374+1최근 7일 스타 변화
- #45★ 3,341+4최근 7일 스타 변화
- #46★ 3,167+6최근 7일 스타 변화
- #47★ 3,098+1최근 7일 스타 변화
- #48★ 2,656+14최근 7일 스타 변화
- #49★ 2,505+8최근 7일 스타 변화
- #50★ 2,379+2최근 7일 스타 변화
- #51★ 2,311+0최근 7일 스타 변화
- #52★ 2,203+0최근 7일 스타 변화
- #53★ 2,131+11최근 7일 스타 변화
- #54
Apache DataFusion Ballista 분산 쿼리 엔진
★ 2,127+7최근 7일 스타 변화 - #55★ 2,022+0최근 7일 스타 변화
- #56
Apache BookKeeper - 추가 전용(append-only) 워크로드에 최적화된 확장 가능하고 내결함성을 갖춘 저지연 스토리지 서비스
★ 2,011+1최근 7일 스타 변화 - #57★ 1,967+0최근 7일 스타 변화
- #58★ 1,913+0최근 7일 스타 변화
- #59
🚀 데이터 분석 및 데이터 과학을 위한 500개 이상의 엄선된 리소스: Python, SQL, 통계, ML, AI, 시각화, 치트시트, 로드맵, 면접 준비. 초보자와 전문가 모두를 위함.
★ 1,890+8최근 7일 스타 변화 - #60★ 1,798+2최근 7일 스타 변화