data-engineering
data-engineering 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #61★ 1,498+0최근 7일 스타 변화
- #62
도서 부수 소스 코드: Data Science on the Google Cloud Platform, Valliappa Lakshmanan, O'Reilly 2017
★ 1,429+1최근 7일 스타 변화 - #63
최초의 오픈 소스 데이터 디스커버리 및 가시성 플랫폼. 데이터 전문가의 삶을 편하게 만들어 비즈니스에 집중할 수 있도록 돕습니다.
★ 1,427+1최근 7일 스타 변화 - #64
MLOps 이니셔티브와 데이터 파이프라인을 시작하고 표준화하기 위한 종합적인 Python 패키지 템플릿입니다.
★ 1,416+0최근 7일 스타 변화 - #65
주요 기술 기업의 엔지니어링 블로그 아티클 300여 개를 엄선한 컬렉션입니다. 최고의 엔지니어링 팀이 대규모 환경에서 실제 문제를 해결하는 방법을 배울 수 있습니다.
★ 1,388+8최근 7일 스타 변화 - #66
실무 전문가가 전하는 가장 포괄적인 SQL 가이드! 기초부터 고급 쿼리, 최적화, 실무 SQL까지 모든 것을 배워보세요.
★ 1,384+7최근 7일 스타 변화 - #67
Quilt는 버전 관리와 맥락이 풍부한 데이터 패키지를 통해 팀과 AI가 데이터를 찾고, 신뢰하고, 재사용할 수 있도록 돕는 AWS 기반 과학 데이터 관리 플랫폼입니다.
★ 1,370+0최근 7일 스타 변화 - #68
자체 서버나 클라우드에 배포하는 오픈소스 ETL/ELT. DuckDB 기반: 노코드/로우코드 비주얼 파이프라인 또는 SQL, 385개의 컴포넌트, dbt, CDC, 데이터 품질, 리버스 ETL, 리니지, AI 에이전트를 위한 MCP. 벤더 클라우드 없음, 행(row)별 과금 없음.
★ 1,262+15최근 7일 스타 변화 - #69
데이터 중심 AI(Data-centric AI) 리소스의 엄선되었지만 완성되지는 않은 목록입니다.
★ 1,159+1최근 7일 스타 변화 - #70
데이터 엔지니어링 및 머신러닝 지식 허브
★ 1,146+0최근 7일 스타 변화 - #71
Open Data Contract Standard (ODCS) 공식 홈페이지
★ 1,118+18최근 7일 스타 변화 - #72
📙 멋진 데이터 카탈로그 및 옵저버빌리티 플랫폼 모음
★ 1,068+5최근 7일 스타 변화 - #73
데이터 계약(Data Contracts) 강제 적용
★ 1,060+8최근 7일 스타 변화 - #74★ 972+7최근 7일 스타 변화
- #75
FlyFish는 데이터 시각화 코딩 플랫폼입니다. 간단한 방식으로 데이터 모델을 빠르게 생성하고, 드래그 앤 드롭을 통해 데이터 시각화 솔루션 세트를 빠르게 생성할 수 있습니다.
★ 961+0최근 7일 스타 변화 - #76
ETL 프로세스, 데이터 모델링 및 분석을 포함하여 SQL Server로 현대적인 데이터 웨어하우스를 구축하기 위한 종합 가이드.
★ 934+14최근 7일 스타 변화 - #77★ 921+0최근 7일 스타 변화
- #78
데이터 엔지니어링의 기본 개념, 기술적 과제 및 리소스를 다루는 스페인어 저장소
★ 896+1최근 7일 스타 변화 - #79★ 871+1최근 7일 스타 변화
- #80★ 867+0최근 7일 스타 변화
- #81
The Complete dbt (Data Build Tool) Bootcamp Udemy 강의를 위한 보조 자료
★ 827+0최근 7일 스타 변화 - #82
실용적인 데이터 엔지니어링: 핸즈온 부동산 프로젝트 가이드
★ 823+2최근 7일 스타 변화 - #83
효율적인 데이터 파이프라인 구축을 위한 Python 프레임워크. 모듈성과 협업을 장려하며, 간단하고 재사용 가능한 구성 요소로 복잡한 파이프라인을 생성할 수 있습니다.
★ 818+0최근 7일 스타 변화 - #84
dbt, SQL 및 클라우드 데이터 웨어하우스를 위한 오픈소스 에이전트 데이터 엔지니어링 하네스입니다. 100개 이상의 도구, 10개의 웨어하우스, AI 기반 기능을 제공합니다.
★ 808+3최근 7일 스타 변화 - #85★ 761+1최근 7일 스타 변화
- #86
BigFunctions을 사용하여 BigQuery의 성능을 극대화하세요.
★ 759+0최근 7일 스타 변화 - #87★ 751+0최근 7일 스타 변화
- #88
VectorFlow는 원시 데이터를 수집하여 벡터로 변환하고 선택한 벡터 DB에 저장하는 고성능 벡터 임베딩 파이프라인입니다.
★ 703+0최근 7일 스타 변화 - #89
데이터 통합, 동기화, 교환, 공유, 작업 구성 및 스케줄링을 위한 하위 수준 데이터 기반 엔진입니다. 파이프라인과 실행의 분리, 다중 스트림 계층, 플러그인 라이브러리 아키텍처를 사용하여 대규모 데이터 작업, 고빈도 데이터 보고 및 수집, 이기종 데이터 호환성 문제를 해결합니다.
★ 696+0최근 7일 스타 변화 - #90★ 626+2최근 7일 스타 변화