본문으로 건너뛰기
buildradar
Sign in
토픽 · qwen

qwen

qwen 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 107개
  • SINQ@huawei-csl

    SINQ 공식 저장소입니다. 정확도를 유지하면서 모든 대규모 언어 모델(LLM)의 크기를 줄이도록 설계된 새롭고 빠르며 고품질인 양자화 방법입니다 [ICML 2026].

    630+1최근 7일 스타 변화
  • Swiftlet@leonickson1

    Swiftlet은 Apple 기기에서 대규모 Qwen Mixture-of-Experts 모델을 로컬로 실행하기 위한 Swift 및 Metal 런타임입니다. 스토리지에서 전문가 가중치를 스트리밍하여 iPhone을 포함한 저사양 RAM 환경에서도 35B 및 80B 모델을 실행할 수 있습니다.

    624+48최근 7일 스타 변화
  • ComfyUI-DyPE@wildminder

    아티팩트 없는 4K+ 이미지 생성을 지원하는 ComfyUI DyPE+SEGA: Z-Image, Qwen, Flux, Krea2

    622+6최근 7일 스타 변화
  • LLamaTuner@jianzhnie

    LLM의 쉽고 효율적인 미세 조정 (Llama, Llama2, Llama3, Qwen, Baichuan, GLM, Falcon 지원). 대형 모델의 고효율 양자화 훈련 및 배포

    621+0최근 7일 스타 변화
  • harvester@wzdnzd

    GitHub 및 웹 소스를 위한 지능형 데이터 수집 프레임워크

    605+1최근 7일 스타 변화
  • 방대한 AI 도구 목록. 2026년 업데이트 버전

    577+5최근 7일 스타 변화
  • Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3), UnoCSS 기반의 2차 개발 가능한 단일 턴 챗봇 웹 MVP 프로토타입 템플릿입니다. 대규모 언어 모델 API 통합, SSE 스트리밍 출력, 마크다운 및 수식 미리보기, 주요 AI 모델(Deepseek 등)을 지원합니다.

    574+0최근 7일 스타 변화
  • KuiperLLama@zjhellofss

    신입 채용 및 인턴십을 위한 프로젝트로, LLama2/3 및 Qwen2.5를 지원하는 대규모 언어 모델 추론 프레임워크를 처음부터 직접 구현합니다.

    573+1최근 7일 스타 변화
  • Mac(M1/M2/M3/M4)에서 Qwen3-TTS 텍스트 음성 변환을 로컬로 실행합니다. MLX를 사용하여 음성 복제, 음성 디자인, 사용자 지정 음성을 100% 오프라인으로 지원합니다.

    561+4최근 7일 스타 변화
  • qwen600@yassa9

    정적 suckless 단일 배치 CUDA 전용 qwen3-0.6B 미니 추론 엔진

    559+0최근 7일 스타 변화
  • MARTI@TsinghuaC3I

    LLM 기반 멀티 에이전트 강화 학습 및 추론을 위한 프레임워크

    554+2최근 7일 스타 변화
  • FlashRT@flashrt-project

    FlashRT는 소규모 배치 및 지연 시간에 민감한 AI 워크로드를 위한 고성능 실시간 추론 엔진입니다. Pi0, Pi0.5, GROOT N1.6 및 Pi0-FAST를 위한 프로덕션 VLA 제어를 지원하며, qwen3.6-27B와 같은 LLM도 지원합니다.

    550+11최근 7일 스타 변화
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    543최근 7일 스타 변화
  • mco@mco-org

    CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.

    513+7최근 7일 스타 변화
  • eLLM@lucienhuangfu

    eLLM: Run Long-Horizon Inference Faster on CPUs Than on GPUs

    510최근 7일 스타 변화
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    506최근 7일 스타 변화
  • A curated list of awesome tools, extensions, and resources for Gemini CLI.

    504최근 7일 스타 변화
← 토픽 목록으로