gpt-oss
Repositórios de código aberto acompanhados marcados com gpt-oss, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de gpt-oss no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com gpt-oss.
- #1
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543
- #1
Comece a usar Kimi-K2.6, GLM-5.2, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma e outros modelos.
★ 180.007+268Variação de estrelas nos últimos 7 dias - #2
Um mecanismo de inferência e atendimento de alto rendimento e eficiente em memória para LLMs
★ 90.817+402Variação de estrelas nos últimos 7 dias - #3
SGLang é um framework de atendimento de alto desempenho para grandes modelos de linguagem e modelos multimodais.
★ 33.538+791Variação de estrelas nos últimos 7 dias - #4
[MLsys2026]: RAG em tudo com LEANN. Desfrute de 97% de economia de armazenamento enquanto executa uma aplicação RAG rápida, precisa e 100% privada no seu dispositivo pessoal.
★ 12.885+39Variação de estrelas nos últimos 7 dias - #5
Faça o ajuste fino, avalie e implante facilmente Qwen, Gemma ou qualquer LLM de pesos abertos!
★ 9.383+3Variação de estrelas nos últimos 7 dias - #6
Execute LLMs e VLMs de ponta localmente em dispositivos Qualcomm via NPU, GPU e CPU com poucas linhas de código
★ 8.347+9Variação de estrelas nos últimos 7 dias - #7
Um motor de treinamento de próxima geração construído para modelos MoE ultra-grandes
★ 5.188+3Variação de estrelas nos últimos 7 dias - #8
Um aplicativo nativo para macOS que permite aos usuários conversar com um LLM local, capaz de responder com informações de arquivos, pastas e sites no seu Mac sem instalar nenhum software adicional. Desenvolvido com llama.cpp.
★ 3.312-2Variação de estrelas nos últimos 7 dias - #9
Um poderoso plugin de IA e MCP para Zotero com ChatGPT, Gemini 3.6, Claude Fable 5, Claude Sonnet 5, DeepSeek V4, Grok, OpenRouter, Kimi k3, GLM 5.2, SiliconFlow, GPT-oss, Gemma 4, Qwen 3.7
★ 2.624+6Variação de estrelas nos últimos 7 dias - #10
TokenSpeed é um motor de inferência de LLM extremamente rápido.
★ 2.075+44Variação de estrelas nos últimos 7 dias - #11
Aplicativo de IA local e motor de inferência para agentes. Execute LLMs de pesos abertos localmente — privado, 100% offline no seu computador. Entre no nosso Discord: https://discord.com/invite/8wGSsvmg4V
★ 1.413+20Variação de estrelas nos últimos 7 dias - #12
Estação de trabalho leve para Codex CLI + Claude Code — com agendador de tarefas, git worktree e controle remoto
★ 911+8Variação de estrelas nos últimos 7 dias - #13
Biblioteca de treinamento distribuído nativo em PyTorch para LLMs/VLMs com suporte imediato ao Hugging Face.
★ 905+24Variação de estrelas nos últimos 7 dias - #14
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—Variação de estrelas nos últimos 7 dias