Pular para o conteúdo principal
buildradar
Sign in
Tópico · synthetic-data

synthetic-data

Repositórios de código aberto acompanhados marcados com synthetic-data, ordenados por estrelas.

Repositórios
35
Total de estrelas
84.901
Média de estrelas
2.426
Participação
0,00%

Tópicos que aparecem com frequência ao lado de synthetic-data no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com synthetic-data.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • machine-learning-for-trading@stefan-jansen

    Código para Machine Learning for Trading, 3ª edição — desde a obtenção de dados até a execução em tempo real.

    20.762+43Variação de estrelas nos últimos 7 dias
  • data-juicer@datajuicer

    Processamento de dados para e com modelos de fundação! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

    6.975+26Variação de estrelas nos últimos 7 dias
  • Kiln@Kiln-AI

    Construa, avalie e otimize sistemas de IA. Inclui avaliações, RAG, agentes, ajuste fino, geração de dados sintéticos, gerenciamento de conjuntos de dados, MCP e muito mais.

    5.042+5Variação de estrelas nos últimos 7 dias
  • mimesis@lk-geimfari

    Mimesis é uma biblioteca Python para gerar dados falsos, porém realistas, em vários idiomas e localidades.

    4.839+0Variação de estrelas nos últimos 7 dias
  • BlenderProc@DLR-RM

    Um pipeline procedural do Blender para geração de imagens de treinamento fotorrealistas

    3.693+5Variação de estrelas nos últimos 7 dias
  • SDV@sdv-dev

    Geração de dados sintéticos para dados tabulares

    3.551+0Variação de estrelas nos últimos 7 dias
  • distilabel@argilla-io

    Distilabel é um framework para dados sintéticos e feedback de IA para engenheiros que precisam de pipelines rápidos, confiáveis e escaláveis baseados em artigos de pesquisa verificados.

    3.384+3Variação de estrelas nos últimos 7 dias
  • pgmpy@pgmpy

    Kit de ferramentas Python para raciocínio causal e probabilístico

    3.323+2Variação de estrelas nos últimos 7 dias
  • synthea@synthetichealth

    Simulador de população de pacientes sintéticos.

    3.322+5Variação de estrelas nos últimos 7 dias
  • SDG é um framework especializado projetado para gerar dados tabulares estruturados de alta qualidade.

    2.436+1Variação de estrelas nos últimos 7 dias
  • unrealcv@unrealcv

    UnrealCV: Conectando Visão Computacional ao Unreal Engine

    2.209+0Variação de estrelas nos últimos 7 dias
  • DataDesigner@NVIDIA-NeMo

    🎨 NeMo Data Designer: Gere dados sintéticos de alta qualidade do zero ou a partir de dados semente.

    2.197+7Variação de estrelas nos últimos 7 dias
  • greenmask@GreenmaskIO

    Anonimização de banco de dados e gerenciamento de dados de teste.

    1.757+4Variação de estrelas nos últimos 7 dias
  • curator@bespokelabsai

    Curadoria de dados sintéticos para pós-treinamento e extração de dados estruturados.

    1.722+2Variação de estrelas nos últimos 7 dias
  • fg-data-synthetic@Data-Centric-AI-Community

    Geradores de dados sintéticos para dados tabulares e séries temporais

    1.654+0Variação de estrelas nos últimos 7 dias
  • aisheets@huggingface

    Construa, aprimore e transforme conjuntos de dados usando modelos de IA sem código

    1.641-1Variação de estrelas nos últimos 7 dias
  • CTGAN@sdv-dev

    GAN condicional para gerar dados tabulares sintéticos.

    1.565+3Variação de estrelas nos últimos 7 dias
  • synth@shuttle-hq

    O gerador de dados declarativo

    1.484+0Variação de estrelas nos últimos 7 dias
  • intellagent@plurai-ai

    Um framework para diagnóstico abrangente e otimização de agentes usando interações sintéticas realistas e simuladas

    1.257+0Variação de estrelas nos últimos 7 dias
  • DataDreamer@datadreamer-dev

    DataDreamer: Crie prompts. Gere dados sintéticos. Treine e alinhe modelos.

    1.117+0Variação de estrelas nos últimos 7 dias
  • synthadoc@axoviq-ai

    Synthadoc: Um motor de compilação de conhecimento LLM de código aberto que transforma documentos brutos em wikis estruturadas e locais. Uma alternativa transparente e legível por humanos ao RAG tradicional, que pode ser autogerenciada e autoaprimorada sem o uso de ferramentas externas.

    1.116+2Variação de estrelas nos últimos 7 dias
  • deepfabric@nolabs-ai

    Gere sintéticos de alta qualidade, treine, meça e avalie em um único pipeline

    885+3Variação de estrelas nos últimos 7 dias
  • magpie@magpie-align

    [ICLR 2025] Síntese de dados de alinhamento do zero, solicitando LLMs alinhados com nada. Seu pipeline de geração de dados sintéticos eficiente e de alta qualidade!

    881+2Variação de estrelas nos últimos 7 dias
  • bonito@BatsResearch

    Uma biblioteca leve para gerar conjuntos de dados de ajuste de instrução sintéticos para seus dados sem usar GPT.

    829+0Variação de estrelas nos últimos 7 dias
  • verbalized-sampling@CHATS-lab

    Verbalized Sampling, uma estratégia de prompting sem treinamento para mitigar o colapso de modo em LLMs solicitando respostas com probabilidades. Alcança uma melhoria de diversidade de 2-3x mantendo a qualidade. Framework agnóstico ao modelo com CLI/API para escrita criativa, geração de dados sintéticos e simulação de diálogo.

    803+1Variação de estrelas nos últimos 7 dias
  • mostlyai@mostly-ai

    SDK de Dados Sintéticos ✨

    798+5Variação de estrelas nos últimos 7 dias
  • mamma@cuevhv

    Código oficial para MAMMA: Markerless Accurate Multi-person Motion Acquisition.

    797+8Variação de estrelas nos últimos 7 dias
  • pygraft@nicolas-hbt

    Geração configurável de esquemas sintéticos e grafos de conhecimento ao seu alcance.

    715+1Variação de estrelas nos últimos 7 dias
  • synthcity@vanderschaarlab

    Uma biblioteca para gerar e avaliar dados tabulares sintéticos para privacidade, equidade e aumento de dados.

    681+4Variação de estrelas nos últimos 7 dias
  • Copulas@sdv-dev

    Uma biblioteca para modelar dados multivariados usando cópulas.

    652+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos