data-processing
Các kho mã nguồn mở đang theo dõi được gắn thẻ data-processing, sắp xếp theo số sao.
Chủ đề liên quan
Những chủ đề thường xuất hiện cùng data-processing trên cùng một kho mã.
Mới nổi gần đây
Các kho mã tạo trong 90 ngày qua và được gắn thẻ data-processing.
Không có kho mã mới nào gắn thẻ chủ đề này trong 90 ngày qua.
- #1
Khung ETL Python dành cho xử lý luồng, phân tích thời gian thực, đường ống LLM và RAG.
★ 62.365-36Thay đổi số sao trong 7 ngày qua - #2
Công cụ gia tăng cho các tác nhân tầm nhìn dài hạn 🌟 Hãy đánh dấu sao nếu bạn thích!
★ 11.430+48Thay đổi số sao trong 7 ngày qua - #3
Bộ sưu tập các câu lệnh Bash một dòng tiện dụng và thủ thuật terminal để xử lý dữ liệu và bảo trì hệ thống Linux.
★ 10.767+5Thay đổi số sao trong 7 ngày qua - #4
Miller giống như awk, sed, cut, join và sort dành cho dữ liệu được lập chỉ mục theo tên như CSV, TSV và JSON dạng bảng.
★ 10.005+4Thay đổi số sao trong 7 ngày qua - #5
Truy vấn, chuyển đổi và chỉnh sửa hợp nhất các định dạng JSON, TOML, YAML, XML, INI, HCL, KDL và CSV.
★ 8.028+7Thay đổi số sao trong 7 ngày qua - #6★ 7.825+164Thay đổi số sao trong 7 ngày qua
- #7
Công cụ pipeline AI hiệu năng cao với lõi C++ và hơn 50 node mở rộng bằng Python. Xây dựng, gỡ lỗi và mở rộng quy trình làm việc LLM với hơn 13 nhà cung cấp mô hình, hơn 8 cơ sở dữ liệu vector và điều phối agent, tất cả ngay từ IDE của bạn. Bao gồm tiện ích mở rộng VS Code, SDK TypeScript/Python và triển khai Docker.
★ 7.371+416Thay đổi số sao trong 7 ngày qua - #8
Xử lý dữ liệu cho và bằng foundation models! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6.949+28Thay đổi số sao trong 7 ngày qua - #9
Thư viện tăng tốc bằng GPU chứa các khối xây dựng được tối ưu hóa cao và công cụ thực thi để xử lý dữ liệu nhằm tăng tốc các ứng dụng huấn luyện và suy luận học sâu.
★ 5.738+4Thay đổi số sao trong 7 ngày qua - #10★ 5.002+5Thay đổi số sao trong 7 ngày qua
- #11★ 4.443+5Thay đổi số sao trong 7 ngày qua
- #12★ 2.827+2Thay đổi số sao trong 7 ngày qua
- #13
Lớp ngữ cảnh cho dữ liệu phi cấu trúc: các tập dữ liệu có kiểu và có phiên bản trên S3, GCS, Azure
★ 2.814+3Thay đổi số sao trong 7 ngày qua - #14★ 2.680+1Thay đổi số sao trong 7 ngày qua
- #15
Bộ công cụ học máy, xử lý ngôn ngữ tự nhiên và tạo văn bản trong TensorFlow. Đây là một phần của dự án CASL: http://casl-project.ai/
★ 2.388+0Thay đổi số sao trong 7 ngày qua - #16★ 2.048+1Thay đổi số sao trong 7 ngày qua
- #17★ 1.742+12Thay đổi số sao trong 7 ngày qua
- #18★ 1.538+2Thay đổi số sao trong 7 ngày qua
- #19★ 1.518+0Thay đổi số sao trong 7 ngày qua
- #20
Mã nguồn đi kèm sách: Data Science on the Google Cloud Platform, Valliappa Lakshmanan, O'Reilly 2017
★ 1.429+1Thay đổi số sao trong 7 ngày qua - #21
Phân phối và chạy các workload AI trên Kubernetes một cách kỳ diệu bằng Python, giống như PyTorch cho cơ sở hạ tầng ML.
★ 1.224+0Thay đổi số sao trong 7 ngày qua - #22
Công cụ dòng lệnh để tải xuống và trích xuất dữ liệu từ các trang HTML/XML hoặc JSON-API, sử dụng CSS, XPath 3.0, XQuery 3.0, JSONiq hoặc khớp mẫu. Nó cũng có thể tạo mới hoặc chuyển đổi các tài liệu XML/HTML/JSON.
★ 843+0Thay đổi số sao trong 7 ngày qua - #23
Công cụ khử trùng lặp văn bản tất cả trong một
★ 763+0Thay đổi số sao trong 7 ngày qua - #24
HStreamDB là cơ sở dữ liệu streaming mã nguồn mở, cloud-native dành cho IoT và hơn thế nữa. Hiện đại hóa ngăn xếp dữ liệu của bạn cho các ứng dụng thời gian thực.
★ 722+0Thay đổi số sao trong 7 ngày qua - #25★ 705+1Thay đổi số sao trong 7 ngày qua
- #26
Danh sách về Apache Kafka
★ 591+0Thay đổi số sao trong 7 ngày qua - #27★ 581+1Thay đổi số sao trong 7 ngày qua
- #28
Công cụ sử dụng mô phỏng Monte Carlo nâng cao và xử lý song song Turbit để tạo ra các kịch bản dự đoán Bitcoin khả thi.
★ 526+0Thay đổi số sao trong 7 ngày qua - #29
MARVIS-Agent: Tác nhân rủi ro tín dụng đa năng cho việc phát triển mô hình, xác thực, xử lý dữ liệu, kỹ thuật đặc trưng và quy trình chiến lược.
★ 518+2Thay đổi số sao trong 7 ngày qua - #30★ 505+1Thay đổi số sao trong 7 ngày qua