본문으로 건너뛰기
buildradar
Sign in
토픽 · local-llm

local-llm

local-llm 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
51
총 스타
169,831
평균 스타
3,330
비중
0.01%

같은 리포지토리에 local-llm 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 local-llm 태그가 달린 리포지토리예요.

  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1,200
  • deltafin@gavamedia

    단일 기기에서 전체 Kimi K3 실행 및 로컬 채팅과 코딩 에이전트를 위한 OpenAI 호환 API 서버

    799
  • mlx-dspark@ARahim3

    Apple Silicon에서 최대 4배 빨라진 무손실 LLM 디코딩. DeepSeek의 DSpark 및 z-lab의 DFlash 추정 디코딩(speculative decoding)의 네이티브 MLX 포팅 — Gemma-4, Qwen3.8, Muse-Glimmer, Nemotron, Ornith-1.0, 3진(ternary) Bonsai-27B 지원.

    640
  • awesome-ai-companion@DasterProkio

    Open-source AI companions, desktop pets, long-term memory & proactive chat. 人机恋开源项目大全。让你的家机能够脱离官端自主存在,拥有记忆和主动性。

    633
  • Swiftlet@leonickson1

    Swiftlet은 Apple 기기에서 대규모 Qwen Mixture-of-Experts 모델을 로컬로 실행하기 위한 Swift 및 Metal 런타임입니다. 스토리지에서 전문가 가중치를 스트리밍하여 iPhone을 포함한 저사양 RAM 환경에서도 35B 및 80B 모델을 실행할 수 있습니다.

    624
  • nanobot@HKUDS

    Python으로 작성된 초경량, 오픈소스, 자체 호스팅 개인 AI 에이전트 프레임워크. WebUI, 도구, 메모리, MCP, 멀티 에이전트 워크플로우, 자동화 및 채팅 앱 지원

    47,662+140최근 7일 스타 변화
  • llamafile@mozilla-ai

    단일 파일로 LLM을 배포하고 실행하세요.

    25,859+113최근 7일 스타 변화
  • local-deep-research@LearningCircuit

    SimpleQA에서 약 95% 성능 (예: 3090에서의 Qwen3.6-27B). 모든 로컬 및 클라우드 LLM(llama.cpp, Ollama, Google 등) 지원. arXiv, PubMed, 개인 문서 등 10개 이상의 검색 엔진. 모든 데이터는 로컬 저장 및 암호화됨.

    9,023+18최근 7일 스타 변화
  • open-multi-agent@open-multi-agent

    동적 워크플로우를 지원하는 TypeScript AI 에이전트 오케스트레이션 프레임워크. 그래프가 아닌 목표를 정의하세요. 코디네이터가 런타임에 작업 DAG를 계획하고 Claude, ChatGPT, Gemini, DeepSeek 또는 로컬 모델 등 어떤 LLM에서든 실행합니다.

    6,860+20최근 7일 스타 변화
  • dograh@dograh-hq

    오픈소스 음성 AI 플랫폼. Vapi 및 Retell의 셀프 호스팅 대안. 온프레미스, 음성 간(Speech to Speech) 또는 LLM/STT/TTS 전반의 BYOK 지원, 시각적 워크플로우 빌더, MCP 네이티브 및 telephony 지원.

    5,568+45최근 7일 스타 변화
  • openmed@maziyarpanahi

    로컬 우선 헬스케어 AI: 100% 온디바이스로 실행되는 임상 NER 및 HIPAA PII 비식별화. 2,200개 이상의 의료 모델, 21개 언어, Apple MLX + Python 지원, 클라우드 및 네트워크 외부 유출 없음. Apache-2.0

    5,199+20최근 7일 스타 변화
  • Soup@MakazhanAlpamys

    단일 YAML로 LLM 파인튜닝. 레이어 스트리밍을 통해 4GB 노트북 GPU에서 8B 모델 학습 가능

    4,929+1,365최근 7일 스타 변화
  • langroid@langroid

    멀티 에이전트 프로그래밍으로 LLM 활용하기

    4,102+1최근 7일 스타 변화
  • Rapid-MLX@raullenchai

    Apple Silicon을 위한 가장 빠른 로컬 AI 엔진. Ollama보다 4.2배 빠름, 0.08초 캐시된 TTFT, 100% 툴 콜링 지원. 17개의 툴 파서, 프롬프트 캐시, 추론 분리, 클라우드 라우팅 제공. OpenAI 드롭인 대체재. Claude Code, Cursor, Aider와 호환.

    3,647+81최근 7일 스타 변화
  • surf@deta

    개인용 AI 노트북. 파일과 웹페이지를 정리하고 이로부터 노트를 생성합니다. 오픈 소스, 로컬 및 개방형 데이터, (로컬 포함) 오픈 모델 선택을 지원합니다.

    3,554+10최근 7일 스타 변화
  • claude-code-local@nicedreamzapp

    Apple Silicon에서 로컬 AI를 사용하여 Claude Code를 100% 온디바이스로 실행합니다. MLX 네이티브 Anthropic API 서버. Muse-Glimmer 30B(멀티모달 지원, 이미지 판독 가능, 검열 해제됨), Gemma 4 31B, Qwen 3.5 122B(초당 65토큰), DeepSeek V4 Flash(1M 컨텍스트) 등 6개 모델 탑재. 개인용, 오프라인, 에어갭 환경 지원. NDA, 법률, 의료 워크플로우를 위해 제작되었습니다.

    3,255+12최근 7일 스타 변화
  • algernon@xyproto

    Lua, Teal, Markdown, HTTP/2, QUIC, Redis, TypeScript, npm 없는 React 19, SQLite 및 PostgreSQL 지원을 포함하는 작고 독립적인 순수 Go 웹 서버

    3,028+1최근 7일 스타 변화
  • 로컬에서 LLM을 실행하는 데 도움이 되는 훌륭한 플랫폼, 도구, 모범 사례 및 리소스 모음

    2,823+23최근 7일 스타 변화
  • little-coder@itayinbarr

    소형 LLM에 최적화된 하니스

    2,528+16최근 7일 스타 변화
  • atomic-agent@AtomicBot-ai

    로컬 우선 AI 에이전트. 로컬 AI 모델에 최적화됨. 긴 컨텍스트 윈도우. 적절한 도구 호출. 기기에서 비공개로 실행됨.

    2,452+0최근 7일 스타 변화
  • Ollama, OpenAI(호환), Gemini, Mistral, Poe 또는 OpenRouter를 사용하여 전체 길이의 책과 문서 번역. 서식 유지. 중단된 부분부터 다시 시작. 파일 크기 제한 없음.

    2,368+31최근 7일 스타 변화
  • openai-edge-tts@travisvn

    OpenAI, Azure, ElevenLabs를 대체할 수 있는 무료 고품질 텍스트 음성 변환 API 엔드포인트

    2,075+5최근 7일 스타 변화
  • parlor@fikrikarim

    GPT-Live와 유사한 기능을 갖춘 온디바이스 실시간 멀티모달 AI

    2,048+7최근 7일 스타 변화
  • vllm-mlx@waybarrios

    Apple Silicon을 위한 고성능 OpenAI 및 Anthropic 호환 LLM 추론 서버. 네이티브 MLX, 연속 배치, 멀티모달 모델, MCP 도구 호출 및 Claude Code 지원.

    1,557+6최근 7일 스타 변화
  • row-bot@siddsachar

    Row-Bot - 개인 AI 주권. 통합 도구, 개인 지식 그래프, 음성, 비전, 셸, 브라우저 자동화, 예약 작업, 건강 추적, 메시징 채널을 갖춘 로컬 우선 AI 어시스턴트입니다. Ollama를 통해 로컬에서 실행하거나 옵트인 클라우드 모델을 추가할 수 있습니다. 데이터는 사용자의 기기에 유지됩니다.

    1,480+11최근 7일 스타 변화
  • Atomic-Chat@AtomicBot-ai

    에이전트를 위한 로컬 AI 앱 및 추론 엔진. 비공개로 컴퓨터에서 100% 오프라인으로 오픈 웨이트 LLM을 로컬에서 실행하세요. Discord 참여하기: https://discord.com/invite/8wGSsvmg4V

    1,413+20최근 7일 스타 변화
  • mlx-tune@ARahim3

    Apple Silicon Mac에서 LLM 파인튜닝. MLX 네이티브 기반 SFT, DPO, GRPO, Vision, TTS, STT, Embedding, OCR 파인튜닝 지원. Unsloth 호환 API.

    1,398+8최근 7일 스타 변화
  • locally-uncensored@PurpleDoubleD

    플러그앤플레이 방식의 로컬 AI 스튜디오: 검열 없는 채팅, 이미지 및 비디오 생성, 코딩 에이전트. abliterated LLM + ComfyUI 100% 오프라인 구동. 원 클릭 설치, Docker 및 클라우드 불필요.

    1,351+185최근 7일 스타 변화
  • Soul-of-Waifu@jofizcd

    🌌 좋아하는 캐릭터에게 영혼을 불어넣으세요. Soul of Waifu는 Live2D/VRM 아바타, 음성 채팅 및 로컬 LLM을 지원하는 데스크톱 롤플레잉 & AI 동반자 앱입니다. 몰입감 넘치는 채팅, RPG 모험, 데스크톱 환경에서 함께 진화해 보세요.

    1,281+15최근 7일 스타 변화
  • ouroboros@razzant

    Ouroboros — 스스로 생성되는 AI 에이전트. 2026년 2월 16일 탄생.

    1,254+18최근 7일 스타 변화
  • gawkbot@najmuzzaman-mohammad

    WUPHF를 사용하면 공유된 컨텍스트를 기반으로 협업하는 AI 팀원으로 구성된 개인 사무실을 구축할 수 있습니다. Claude Code, Codex, OpenClaw, OpenCode, 로컬 LLM을 지원합니다.

    1,253+6최근 7일 스타 변화
  • Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks

    1,200+316최근 7일 스타 변화
  • web-search-mcp@mrkrsl

    로컬 LLM과 함께 사용할 수 있는 간단하고 로컬에서 호스팅되는 웹 검색 MCP 서버

    1,122+8최근 7일 스타 변화
  • synthadoc@axoviq-ai

    Synthadoc: 원시 문서를 구조화된 로컬 우선 위키로 변환하는 오픈소스 LLM 지식 컴파일 엔진. 도구 없이도 자체 관리 및 자체 개선이 가능한, 기존 RAG에 대한 투명하고 사람이 읽을 수 있는 대안입니다.

    1,116+2최근 7일 스타 변화
  • mlx-serve@ddalcu

    Apple Silicon용 네이티브 LLM 추론 서버. OpenAI 및 Anthropic API 호환. Python 미사용. 채팅, 에이전트 모드, 도구 호출을 지원하는 MLX Core macOS 앱 포함.

    1,115+245최근 7일 스타 변화
← 토픽 목록으로