synthetic-data
Dépôts open source suivis étiquetés synthetic-data, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de synthetic-data sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés synthetic-data.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Code pour « Machine Learning for Trading », 3e édition — de l'acquisition de données à l'exécution en temps réel.
★ 20 762+91Évolution des étoiles sur les 7 derniers jours - #2
Traitement de données pour et avec des modèles de fondation !
★ 6 975+35Évolution des étoiles sur les 7 derniers jours - #3
Construisez, évaluez et optimisez des systèmes d'IA. Inclut des évaluations, RAG, agents, fine-tuning, génération de données synthétiques, gestion de jeux de données, MCP, et plus encore.
★ 5 042+7Évolution des étoiles sur les 7 derniers jours - #4
Mimesis est une bibliothèque Python permettant de générer des données fictives mais réalistes dans plusieurs langues et paramètres régionaux.
★ 4 839+0Évolution des étoiles sur les 7 derniers jours - #5
Pipeline procédural Blender pour la génération d'images d'entraînement photoréalistes.
★ 3 693+9Évolution des étoiles sur les 7 derniers jours - #6★ 3 551+2Évolution des étoiles sur les 7 derniers jours
- #7
Distilabel est un framework de données synthétiques et de rétroaction IA pour les ingénieurs ayant besoin de pipelines rapides, fiables et évolutifs basés sur des articles de recherche vérifiés.
★ 3 384+6Évolution des étoiles sur les 7 derniers jours - #8★ 3 323+5Évolution des étoiles sur les 7 derniers jours
- #9★ 3 322+9Évolution des étoiles sur les 7 derniers jours
- #10
SDG est un framework spécialisé conçu pour générer des données tabulaires structurées de haute qualité.
★ 2 436+2Évolution des étoiles sur les 7 derniers jours - #11★ 2 209+0Évolution des étoiles sur les 7 derniers jours
- #12
🎨 NeMo Data Designer : Générez des données synthétiques de haute qualité à partir de zéro ou de données sources.
★ 2 197+11Évolution des étoiles sur les 7 derniers jours - #13★ 1 757+7Évolution des étoiles sur les 7 derniers jours
- #14
Curation de données synthétiques pour le post-entraînement et l'extraction de données structurées.
★ 1 722+3Évolution des étoiles sur les 7 derniers jours - #15
Générateurs de données synthétiques pour données tabulaires et séries temporelles
★ 1 654+0Évolution des étoiles sur les 7 derniers jours - #16
Construire, enrichir et transformer des jeux de données à l'aide de modèles d'IA sans écrire de code.
★ 1 641-1Évolution des étoiles sur les 7 derniers jours - #17★ 1 565+3Évolution des étoiles sur les 7 derniers jours
- #18★ 1 484+0Évolution des étoiles sur les 7 derniers jours
- #19
Un framework pour le diagnostic complet et l'optimisation d'agents via des interactions synthétiques réalistes simulées
★ 1 257+0Évolution des étoiles sur les 7 derniers jours - #20
DataDreamer : Créer des prompts, générer des données synthétiques, entraîner et aligner des modèles.
★ 1 117+0Évolution des étoiles sur les 7 derniers jours - #21
Synthadoc : un moteur de compilation de connaissances LLM open-source qui transforme des documents bruts en wikis structurés et locaux. Une alternative transparente et lisible par l'humain au RAG traditionnel, auto-hébergée et auto-améliorée sans outils tiers.
★ 1 116+1Évolution des étoiles sur les 7 derniers jours - #22
Générer des données synthétiques de haute qualité, entraîner, mesurer et évaluer dans un pipeline unique
★ 885+2Évolution des étoiles sur les 7 derniers jours - #23
[ICLR 2025] Synthèse de données d'alignement à partir de zéro en sollicitant des LLM alignés sans données préalables. Votre pipeline efficace de génération de données synthétiques de haute qualité.
★ 880+0Évolution des étoiles sur les 7 derniers jours - #24
Une bibliothèque légère pour générer des jeux de données d'instruction tuning synthétiques pour vos données sans GPT.
★ 829+0Évolution des étoiles sur les 7 derniers jours - #25
Verbalized Sampling, une stratégie de prompting sans entraînement pour atténuer l'effondrement de mode dans les LLM en demandant des réponses avec probabilités. Permet une amélioration de la diversité de 2 à 3 fois tout en maintenant la qualité. Cadre agnostique au modèle avec CLI/API pour l'écriture créative, la génération de données synthétiques et la simulation de dialogue.
★ 803+2Évolution des étoiles sur les 7 derniers jours - #26★ 798+5Évolution des étoiles sur les 7 derniers jours
- #27★ 793+3Évolution des étoiles sur les 7 derniers jours
- #28
Génération configurable de schémas synthétiques et de graphes de connaissances à portée de main
★ 715+1Évolution des étoiles sur les 7 derniers jours - #29
Une bibliothèque pour générer et évaluer des données tabulaires synthétiques pour la confidentialité, l'équité et l'augmentation de données.
★ 680+3Évolution des étoiles sur les 7 derniers jours - #30★ 652+1Évolution des étoiles sur les 7 derniers jours