मुख्य सामग्री पर जाएँ
buildradar
Sign in
विषय · data-processing

data-processing

data-processing टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
30
कुल स्टार
1,65,877
औसत स्टार
5,529
हिस्सा
0.01%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर data-processing के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और data-processing टैग वाली रिपॉजिटरी।

  • marvis-risk-agent@eddyzzl

    MARVIS-Agent: मॉडल विकास, सत्यापन, डेटा प्रोसेसिंग, फ़ीचर इंजीनियरिंग और रणनीति वर्कफ़्लो के लिए सर्व-उद्देश्यीय क्रेडिट रिस्क एजेंट।

    518
  • pathway@pathwaycom

    स्ट्रीम प्रोसेसिंग, रीयल-टाइम एनालिटिक्स, LLM पाइपलाइन और RAG के लिए Python ETL फ्रेमवर्क।

    62,365-36पिछले 7 दिनों में स्टार का बदलाव
  • cocoindex@cocoindex-io

    लंबे समय के एजेंटों के लिए वृद्धिशील इंजन 🌟 यदि आपको यह पसंद आए तो स्टार दें!

    11,430+48पिछले 7 दिनों में स्टार का बदलाव
  • डेटा प्रोसेसिंग और Linux सिस्टम रखरखाव के लिए उपयोगी Bash वन-लाइनर्स और टर्मिनल ट्रिक्स का संग्रह।

    10,767+5पिछले 7 दिनों में स्टार का बदलाव
  • miller@johnkerl

    Miller नाम-अनुक्रमित डेटा जैसे CSV, TSV और सारणीबद्ध JSON के लिए awk, sed, cut, join और sort की तरह है।

    10,005+4पिछले 7 दिनों में स्टार का बदलाव
  • dasel@TomWright

    JSON, TOML, YAML, XML, INI, HCL, KDL और CSV की एकीकृत क्वेरी, परिवर्तन और संशोधन।

    8,028+7पिछले 7 दिनों में स्टार का बदलाव
  • DataFlow@OpenDCAI

    नवीनतम LLM-आधारित ऑपरेटरों और पाइपलाइनों के साथ आसान डेटा तैयारी।

    7,825+164पिछले 7 दिनों में स्टार का बदलाव
  • rocketride-server@rocketride-org

    C++ कोर और 50+ पायथन-एक्सटेंसिबल नोड्स के साथ उच्च-प्रदर्शन AI पाइपलाइन इंजन। अपने IDE से 13+ मॉडल प्रदाताओं, 8+ वेक्टर डेटाबेस और एजेंट ऑर्केस्ट्रेशन के साथ LLM वर्कफ़्लो बनाएं, डीबग करें और स्केल करें। इसमें VS Code एक्सटेंशन, TypeScript/Python SDKs और Docker परिनियोजन शामिल हैं।

    7,371+416पिछले 7 दिनों में स्टार का बदलाव
  • data-juicer@datajuicer

    फाउंडेशन मॉडल के लिए और उनके साथ डेटा प्रोसेसिंग! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6,949+28पिछले 7 दिनों में स्टार का बदलाव
  • DALI@NVIDIA

    डीप लर्निंग ट्रेनिंग और इन्फेरेंस एप्लीकेशन को तेज करने के लिए डेटा प्रोसेसिंग के वास्ते अत्यधिक अनुकूलित बिल्डिंग ब्लॉक और एक निष्पादन इंजन वाली GPU-त्वरित लाइब्रेरी।

    5,738+4पिछले 7 दिनों में स्टार का बदलाव
  • smallpond@deepseek-ai

    DuckDB और 3FS पर बना एक हल्का डेटा प्रोसेसिंग फ्रेमवर्क।

    5,002+5पिछले 7 दिनों में स्टार का बदलाव
  • pandera@unionai-oss

    एक हल्का, लचीला और अभिव्यंजक सांख्यिकीय डेटा परीक्षण पुस्तकालय

    4,443+5पिछले 7 दिनों में स्टार का बदलाव
  • numaflow@numaproj

    बड़े पैमाने पर समानांतर डेटा/स्ट्रीमिंग जॉब चलाने के लिए Kubernetes-नेटिव प्लेटफ़ॉर्म

    2,827+2पिछले 7 दिनों में स्टार का बदलाव
  • datachain@datachain-ai

    असंरचित डेटा के लिए संदर्भ परत (Context Layer): S3, GCS, Azure पर टाइप्ड, वर्شन्ड डेटासेट

    2,811+3पिछले 7 दिनों में स्टार का बदलाव
  • broadway@elixir-broadway

    Elixir के साथ समवर्ती और बहु-चरणीय डेटा अंतर्ग्रहण और डेटा प्रोसेसिंग

    2,677+1पिछले 7 दिनों में स्टार का बदलाव
  • texar@asyml

    TensorFlow में मशीन लर्निंग, नेचुरल लैंग्वेज प्रोसेसिंग और टेक्स्ट जनरेशन के लिए टूलकिट। यह CASL प्रोजेक्ट का हिस्सा है: http://casl-project.ai/

    2,389+0पिछले 7 दिनों में स्टार का बदलाव
  • bytewax@bytewax

    Python स्ट्रीम प्रोसेसिंग।

    2,048+1पिछले 7 दिनों में स्टार का बदलाव
  • Curator@NVIDIA-NeMo

    LLMs के लिए स्केलेबल डेटा प्री-प्रोसेसिंग और क्यूरेशन टूलकिट

    1,740+12पिछले 7 दिनों में स्टार का बदलाव
  • dolma@allenai

    OLMo प्री-ट्रेनिंग डेटा उत्पन्न करने और उनका निरीक्षण करने के लिए डेटा और टूल।

    1,538+2पिछले 7 दिनों में स्टार का बदलाव
  • pyper@pyper-dev

    कॉन्करेंट Python को सरल बनाया गया

    1,518+0पिछले 7 दिनों में स्टार का बदलाव
  • data-science-on-gcp@GoogleCloudPlatform

    पुस्तक के साथ आने वाला स्रोत कोड: Data Science on the Google Cloud Platform, Valliappa Lakshmanan, O'Reilly 2017

    1,428+1पिछले 7 दिनों में स्टार का बदलाव
  • kubetorch@run-house

    ML इंफ्रा के लिए PyTorch की तरह, Python में Kubernetes पर AI वर्कलोड को जादुई रूप से वितरित और चलाएं।

    1,224+0पिछले 7 दिनों में स्टार का बदलाव
  • xidel@benibela

    CSS, XPath 3.0, XQuery 3.0, JSONiq या पैटर्न मैचिंग का उपयोग करके HTML/XML पेजों या JSON-APIs से डेटा डाउनलोड और एक्सट्रैक्ट करने के लिए कमांड लाइन टूल। यह नए या रूपांतरित XML/HTML/JSON दस्तावेज़ भी बना सकता है।

    843+0पिछले 7 दिनों में स्टार का बदलाव
  • text-dedup@ChenghaoMou

    ऑल-इन-वन टेक्स्ट डी-डुप्लीकेशन।

    765+0पिछले 7 दिनों में स्टार का बदलाव
  • hstream@hstreamdb

    HStreamDB IoT और उससे आगे के लिए एक ओपन-सोर्स, क्लाउड-नेटिव स्ट्रीमिंग डेटाबेस है। रियल-टाइम एप्लिकेशन के लिए अपने डेटा स्टैक को आधुनिक बनाएं।

    722+0पिछले 7 दिनों में स्टार का बदलाव
  • collapse@fastverse

    R में उन्नत और तेज़ डेटा परिवर्तन

    705+1पिछले 7 दिनों में स्टार का बदलाव
  • Apache Kafka के बारे में एक सूची।

    591+0पिछले 7 दिनों में स्टार का बदलाव
  • eternal@kousun12

    👾~ संगीत, शाश्वत ~ 👾

    581+1पिछले 7 दिनों में स्टार का बदलाव
  • synthBTC@jofpin

    एक टूल जो संभावित Bitcoin प्रेडिक्शन परिदृश्य बनाने के लिए उन्नत मोंटे कार्लो सिमुलेशन और Turbit समानांतर प्रोसेसिंग का उपयोग करता है।

    526+0पिछले 7 दिनों में स्टार का बदलाव
  • marvis-risk-agent@eddyzzl

    MARVIS-Agent: मॉडल विकास, सत्यापन, डेटा प्रोसेसिंग, फ़ीचर इंजीनियरिंग और रणनीति वर्कफ़्लो के लिए सर्व-उद्देश्यीय क्रेडिट रिस्क एजेंट।

    518+2पिछले 7 दिनों में स्टार का बदलाव
  • Musoq@Puchaczov

    बिना किसी डेटाबेस के SQL रनटाइम

    505+1पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस