synthetic-data
synthetic-data टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर synthetic-data के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और synthetic-data टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
ट्रेडिंग के लिए मशीन लर्निंग का कोड, तीसरा संस्करण - डेटा सोर्सिंग से लेकर लाइव निष्पादन तक।
★ 20,762+43पिछले 7 दिनों में स्टार का बदलाव - #2
फाउंडेशन मॉडल के लिए और उनके साथ डेटा प्रोसेसिंग! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷
★ 6,975+26पिछले 7 दिनों में स्टार का बदलाव - #3
AI सिस्टम बनाएं, मूल्यांकन करें और अनुकूलित करें। इसमें मूल्यांकन, RAG, एजेंट, फाइन-ट्यूनिंग, सिंथेटिक डेटा जनरेशन, डेटासेट प्रबंधन, MCP और बहुत कुछ शामिल है।
★ 5,042+5पिछले 7 दिनों में स्टार का बदलाव - #4
Mimesis कई भाषाओं और लोकेल में नकली लेकिन यथार्थवादी डेटा उत्पन्न करने के लिए एक Python लाइब्रेरी है।
★ 4,839+0पिछले 7 दिनों में स्टार का बदलाव - #5
फोटोरीलिस्टिक ट्रेनिंग इमेज जनरेशन के लिए एक प्रक्रियात्मक Blender पाइपलाइन
★ 3,693+5पिछले 7 दिनों में स्टार का बदलाव - #6★ 3,551+0पिछले 7 दिनों में स्टार का बदलाव
- #7
Distilabel उन इंजीनियरों के लिए सिंथेटिक डेटा और AI फीडबैक के लिए एक फ्रेमवर्क है जिन्हें सत्यापित शोध पत्रों के आधार पर तेज़, विश्वसनीय और स्केलेबल पाइपलाइन की आवश्यकता होती है।
★ 3,384+3पिछले 7 दिनों में स्टार का बदलाव - #8★ 3,323+2पिछले 7 दिनों में स्टार का बदलाव
- #9★ 3,322+5पिछले 7 दिनों में स्टार का बदलाव
- #10
SDG उच्च गुणवत्ता वाला संरचित सारणीबद्ध डेटा उत्पन्न करने के लिए डिज़ाइन किया गया एक विशेष फ्रेमवर्क है।
★ 2,436+1पिछले 7 दिनों में स्टार का बदलाव - #11★ 2,209+0पिछले 7 दिनों में स्टार का बदलाव
- #12
🎨 NeMo Data Designer: शुरुआत से या सीड डेटा से उच्च गुणवत्ता वाला सिंथेटिक डेटा जनरेट करें।
★ 2,197+7पिछले 7 दिनों में स्टार का बदलाव - #13★ 1,757+4पिछले 7 दिनों में स्टार का बदलाव
- #14★ 1,722+2पिछले 7 दिनों में स्टार का बदलाव
- #15
सारणीबद्ध और समय-श्रृंखला डेटा के लिए सिंथेटिक डेटा जनरेटर
★ 1,654+0पिछले 7 दिनों में स्टार का बदलाव - #16
नो-कोड के साथ AI मॉडल का उपयोग करके डेटासेट बनाएं, समृद्ध करें और रूपांतरित करें
★ 1,641-1पिछले 7 दिनों में स्टार का बदलाव - #17★ 1,565+3पिछले 7 दिनों में स्टार का बदलाव
- #18★ 1,484+0पिछले 7 दिनों में स्टार का बदलाव
- #19
सिमुलेटेड, यथार्थवादी सिंथेटिक इंटरैक्शन का उपयोग करके एजेंटों के व्यापक निदान और अनुकूलन के लिए एक फ्रेमवर्क
★ 1,257+0पिछले 7 दिनों में स्टार का बदलाव - #20
DataDreamer: प्रॉम्प्ट। सिंथेटिक डेटा उत्पन्न करें। मॉडल को प्रशिक्षित और संरेखित करें।
★ 1,117+0पिछले 7 दिनों में स्टार का बदलाव - #21
Synthadoc: एक ओपन-सोर्स LLM ज्ञान संकलन इंजन जो कच्चे दस्तावेजों को संरचित, स्थानीय-प्रथम विकी में बदलता है। पारंपरिक RAG का एक पारदर्शी, मानव-पठनीय विकल्प।
★ 1,116+2पिछले 7 दिनों में स्टार का बदलाव - #22
एक ही पाइपलाइन में उच्च-गुणवत्ता वाले सिंथेटिक्स उत्पन्न करें, प्रशिक्षित करें, मापें और मूल्यांकन करें
★ 885+3पिछले 7 दिनों में स्टार का बदलाव - #23
[ICLR 2025] संरेखित LLMs को कुछ भी न देकर प्रॉम्प्टिंग के माध्यम से शून्य से संरेखण डेटा संश्लेषण। आपका कुशल और उच्च गुणवत्ता वाला सिंथेटिक डेटा जनरेशन पाइपलाइन!
★ 881+1पिछले 7 दिनों में स्टार का बदलाव - #24
GPT के बिना आपके डेटा के लिए सिंथेटिक इंस्ट्रक्शन ट्यूनिंग डेटासेट तैयार करने हेतु एक लाइटवेट लाइब्रेरी।
★ 829+0पिछले 7 दिनों में स्टार का बदलाव - #25
Verbalized Sampling, LLMs में मोड कोलैप्स को कम करने के लिए एक ट्रेनिंग-फ्री प्रॉम्प्टिंग रणनीति जो संभावनाओं के साथ प्रतिक्रियाओं का अनुरोध करती है। गुणवत्ता बनाए रखते हुए 2-3 गुना विविधता में सुधार करती है। रचनात्मक लेखन, सिंथेटिक डेटा जनरेशन और संवाद सिमुलेशन के लिए CLI/API के साथ मॉडल-अज्ञेयवादी फ्रेमवर्क।
★ 803+1पिछले 7 दिनों में स्टार का बदलाव - #26★ 798+5पिछले 7 दिनों में स्टार का बदलाव
- #27★ 795+6पिछले 7 दिनों में स्टार का बदलाव
- #28★ 715+1पिछले 7 दिनों में स्टार का बदलाव
- #29
गोपनीयता, निष्पक्षता और डेटा संवर्धन के लिए सिंथेटिक सारणीबद्ध डेटा उत्पन्न करने और उसका मूल्यांकन करने के लिए एक लाइब्रेरी।
★ 681+3पिछले 7 दिनों में स्टार का बदलाव - #30★ 652+0पिछले 7 दिनों में स्टार का बदलाव