Aller au contenu principal
buildradar
Sign in
Sujet · synthetic-data

synthetic-data

Dépôts open source suivis étiquetés synthetic-data, triés par étoiles.

Dépôts
35
Total d'étoiles
84 901
Étoiles en moyenne
2 426
Part
0,00%

Sujets qui apparaissent souvent aux côtés de synthetic-data sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés synthetic-data.

Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.

  • machine-learning-for-trading@stefan-jansen

    Code pour « Machine Learning for Trading », 3e édition — de l'acquisition de données à l'exécution en temps réel.

    20 762+91Évolution des étoiles sur les 7 derniers jours
  • data-juicer@datajuicer

    Traitement de données pour et avec des modèles de fondation !

    6 975+35Évolution des étoiles sur les 7 derniers jours
  • Kiln@Kiln-AI

    Construisez, évaluez et optimisez des systèmes d'IA. Inclut des évaluations, RAG, agents, fine-tuning, génération de données synthétiques, gestion de jeux de données, MCP, et plus encore.

    5 042+7Évolution des étoiles sur les 7 derniers jours
  • mimesis@lk-geimfari

    Mimesis est une bibliothèque Python permettant de générer des données fictives mais réalistes dans plusieurs langues et paramètres régionaux.

    4 839+0Évolution des étoiles sur les 7 derniers jours
  • BlenderProc@DLR-RM

    Pipeline procédural Blender pour la génération d'images d'entraînement photoréalistes.

    3 693+9Évolution des étoiles sur les 7 derniers jours
  • SDV@sdv-dev

    Génération de données synthétiques pour les données tabulaires

    3 551+2Évolution des étoiles sur les 7 derniers jours
  • distilabel@argilla-io

    Distilabel est un framework de données synthétiques et de rétroaction IA pour les ingénieurs ayant besoin de pipelines rapides, fiables et évolutifs basés sur des articles de recherche vérifiés.

    3 384+6Évolution des étoiles sur les 7 derniers jours
  • pgmpy@pgmpy

    Boîte à outils Python pour le raisonnement causal et probabiliste

    3 323+5Évolution des étoiles sur les 7 derniers jours
  • synthea@synthetichealth

    Simulateur de population de patients synthétiques

    3 322+9Évolution des étoiles sur les 7 derniers jours
  • SDG est un framework spécialisé conçu pour générer des données tabulaires structurées de haute qualité.

    2 436+2Évolution des étoiles sur les 7 derniers jours
  • unrealcv@unrealcv

    UnrealCV : Connecter la vision par ordinateur à Unreal Engine

    2 209+0Évolution des étoiles sur les 7 derniers jours
  • DataDesigner@NVIDIA-NeMo

    🎨 NeMo Data Designer : Générez des données synthétiques de haute qualité à partir de zéro ou de données sources.

    2 197+11Évolution des étoiles sur les 7 derniers jours
  • greenmask@GreenmaskIO

    Anonymisation de base de données et gestion des données de test

    1 757+7Évolution des étoiles sur les 7 derniers jours
  • curator@bespokelabsai

    Curation de données synthétiques pour le post-entraînement et l'extraction de données structurées.

    1 722+3Évolution des étoiles sur les 7 derniers jours
  • fg-data-synthetic@Data-Centric-AI-Community

    Générateurs de données synthétiques pour données tabulaires et séries temporelles

    1 654+0Évolution des étoiles sur les 7 derniers jours
  • aisheets@huggingface

    Construire, enrichir et transformer des jeux de données à l'aide de modèles d'IA sans écrire de code.

    1 641-1Évolution des étoiles sur les 7 derniers jours
  • CTGAN@sdv-dev

    GAN conditionnel pour la génération de données tabulaires synthétiques.

    1 565+3Évolution des étoiles sur les 7 derniers jours
  • synth@shuttle-hq

    Générateur de données déclaratif

    1 484+0Évolution des étoiles sur les 7 derniers jours
  • intellagent@plurai-ai

    Un framework pour le diagnostic complet et l'optimisation d'agents via des interactions synthétiques réalistes simulées

    1 257+0Évolution des étoiles sur les 7 derniers jours
  • DataDreamer@datadreamer-dev

    DataDreamer : Créer des prompts, générer des données synthétiques, entraîner et aligner des modèles.

    1 117+0Évolution des étoiles sur les 7 derniers jours
  • synthadoc@axoviq-ai

    Synthadoc : un moteur de compilation de connaissances LLM open-source qui transforme des documents bruts en wikis structurés et locaux. Une alternative transparente et lisible par l'humain au RAG traditionnel, auto-hébergée et auto-améliorée sans outils tiers.

    1 116+1Évolution des étoiles sur les 7 derniers jours
  • deepfabric@nolabs-ai

    Générer des données synthétiques de haute qualité, entraîner, mesurer et évaluer dans un pipeline unique

    885+2Évolution des étoiles sur les 7 derniers jours
  • magpie@magpie-align

    [ICLR 2025] Synthèse de données d'alignement à partir de zéro en sollicitant des LLM alignés sans données préalables. Votre pipeline efficace de génération de données synthétiques de haute qualité.

    880+0Évolution des étoiles sur les 7 derniers jours
  • bonito@BatsResearch

    Une bibliothèque légère pour générer des jeux de données d'instruction tuning synthétiques pour vos données sans GPT.

    829+0Évolution des étoiles sur les 7 derniers jours
  • verbalized-sampling@CHATS-lab

    Verbalized Sampling, une stratégie de prompting sans entraînement pour atténuer l'effondrement de mode dans les LLM en demandant des réponses avec probabilités. Permet une amélioration de la diversité de 2 à 3 fois tout en maintenant la qualité. Cadre agnostique au modèle avec CLI/API pour l'écriture créative, la génération de données synthétiques et la simulation de dialogue.

    803+2Évolution des étoiles sur les 7 derniers jours
  • mostlyai@mostly-ai

    SDK de données synthétiques ✨

    798+5Évolution des étoiles sur les 7 derniers jours
  • mamma@cuevhv

    Code officiel de MAMMA : Markerless Accurate Multi-person Motion Acquisition.

    793+3Évolution des étoiles sur les 7 derniers jours
  • pygraft@nicolas-hbt

    Génération configurable de schémas synthétiques et de graphes de connaissances à portée de main

    715+1Évolution des étoiles sur les 7 derniers jours
  • synthcity@vanderschaarlab

    Une bibliothèque pour générer et évaluer des données tabulaires synthétiques pour la confidentialité, l'équité et l'augmentation de données.

    680+3Évolution des étoiles sur les 7 derniers jours
  • Copulas@sdv-dev

    Une bibliothèque pour modéliser des données multivariées à l'aide de copules.

    652+1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets