본문으로 건너뛰기
buildradar
로그인
토픽 · mixture-of-experts

mixture-of-experts

mixture-of-experts 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
18
총 스타
71,279
평균 스타
3,960
비중
0.00%

같은 리포지토리에 mixture-of-experts 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 mixture-of-experts 태그가 달린 리포지토리예요.

  • kimi-k3-in-c@FareedKhan-dev

    단일 CPU와 8.24 GB RAM에서 2조 7,800억 개의 파라미터를 가진 Kimi K3 추론 실행. 포터블 C99: BLAS, 프레임워크, GPU 없음.

    7,547
  • Swiftlet@leonickson1

    Swiftlet은 Apple 기기에서 대규모 Qwen Mixture-of-Experts 모델을 로컬로 실행하기 위한 Swift 및 Metal 런타임입니다. 스토리지에서 전문가 가중치를 스트리밍하여 iPhone을 포함한 저사양 RAM 환경에서도 35B 및 80B 모델을 실행할 수 있습니다.

    634
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    552
  • slotstream@carloslfu

    Run Qwen3.8-Flash-Next (125B MoE, 104 GB at 4-bit) on Macs with a fraction of that RAM by streaming experts from SSD. MLX + Swift, Ollama-compatible API.

    287
  • DeepSpeed@deepspeedai

    DeepSpeed는 분산 학습과 추론을 쉽고, 효율적이며, 효과적으로 만들어주는 딥러닝 최적화 라이브러리입니다.

    43,058+0최근 7일 스타 변화
  • kimi-k3-in-c@FareedKhan-dev

    단일 CPU와 8.24 GB RAM에서 2조 7,800억 개의 파라미터를 가진 Kimi K3 추론 실행. 포터블 C99: BLAS, 프레임워크, GPU 없음.

    7,547+490최근 7일 스타 변화
  • optillm@algorithmicsuperintelligence

    LLM을 위한 추론 프록시 최적화

    4,260+0최근 7일 스타 변화
  • hivemind@learning-at-home

    PyTorch 기반의 탈중앙화 딥러닝. 전 세계 수천 명의 자원봉사자 참여자를 바탕으로 모델을 학습하도록 구축되었습니다.

    2,515+0최근 7일 스타 변화
  • mixtral-offloading@dvmazur

    Colab 또는 일반 데스크톱에서 Mixtral-8x7B 모델 실행

    2,334+0최근 7일 스타 변화
  • MoE-LLaVA@PKU-YuanGroup

    【TMM 2025🔥】 대형 비전-언어 모델을 위한 Mixture-of-Experts

    2,322+0최근 7일 스타 변화
  • mixture-of-experts@davidmrau

    Noam Shazeer 외 공저 "The Sparsely-Gated Mixture-of-Experts Layer"의 PyTorch 재구현 버전 (https://arxiv.org/abs/1701.06538)

    1,253+0최근 7일 스타 변화
  • Aria@rhymes-ai

    오픈 멀티모달 네이티브 MoE인 Aria의 코드베이스

    1,088+1최근 7일 스타 변화
  • Tutel@microsoft

    Tutel MoE: 최적화된 Mixture-of-Experts 라이브러리, FP8/NVFP4/MXFP4를 사용하여 GptOss/DeepSeek/Kimi-K2/Qwen3 지원

    1,018+2최근 7일 스타 변화
  • llama-moe@pjlab-sys4nlp

    ⛷️ LLaMA-MoE: 지속적 사전 학습을 통한 LLaMA 기반 Mixture-of-Experts 구축 (EMNLP 2024)

    1,002+1최근 7일 스타 변화
  • cudnn-frontend@NVIDIA

    cuDNN Frontend는 NVIDIA의 현대적인 오픈 소스 cuDNN 라이브러리 진입점이자 고성능 오픈 소스 커널의 성장하는 컬렉션입니다.

    932+9최근 7일 스타 변화
  • smt@SMTorg

    SMT: 대리 모델링 툴박스

    912+0최근 7일 스타 변화
  • makeMoE@AviSoori1x

    Andrej Karpathy의 makemore에서 영감을 받아 처음부터 구현한 희소 혼합 전문가(sparse mixture of experts) 언어 모델

    815+0최근 7일 스타 변화
  • Swiftlet@leonickson1

    Swiftlet은 Apple 기기에서 대규모 Qwen Mixture-of-Experts 모델을 로컬로 실행하기 위한 Swift 및 Metal 런타임입니다. 스토리지에서 전문가 가중치를 스트리밍하여 iPhone을 포함한 저사양 RAM 환경에서도 35B 및 80B 모델을 실행할 수 있습니다.

    634+51최근 7일 스타 변화
  • Chinese-Mixtral@ymcui

    중국어 Mixtral 혼합 전문가 대형 언어 모델(Chinese Mixtral MoE LLMs)

    612+0최근 7일 스타 변화
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    552+19최근 7일 스타 변화
  • krasis@brontoguana

    Krasis는 소비자용 VRAM 제한 하드웨어에서 대형 모델을 효율적으로 실행하는 데 중점을 둔 하이브리드 LLM 런타임입니다.

    519+3최근 7일 스타 변화
  • mergoo@Leeroo-AI

    여러 LLM 전문가를 쉽게 병합하고 효율적으로 학습시키기 위한 라이브러리

    516+0최근 7일 스타 변화
← 토픽 목록으로