voice-ai
voice-ai 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 voice-ai 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 voice-ai 태그가 달린 리포지토리예요.
- #1
에이전트가 대화하고, 작업하고, 상주할 수 있도록 유지하는 실시간 음성 런타임. AI 에이전트를 위한 실시간 음성 런타임
★ 2,362 - #2
AI 음성 에이전트를 위한 지출 측정기 및 예산 제한 도구. STT, TTS, LLM, 전화 통화당 비용을 즉시 측정하며(Pipecat, LiveKit - Python & TypeScript), 설정한 예산을 초과하기 전에 다음 턴을 강제로 중단함. 로컬 실행, 계정 불필요, 텔레메트리 없음. Floe 제작.
★ 434
- #1★ 52,177+379최근 7일 스타 변화
- #2★ 20,664+85최근 7일 스타 변화
- #3
VoiceStudio는 완전 로컬 환경에서 실행되는 오픈 소스 ElevenLabs 대안으로, 646개 언어의 음성 복제, 음성 디자인, 비디오 더빙, 받아쓰기, 전사 및 오디오북 생성을 지원합니다.
★ 14,835+2,880최근 7일 스타 변화 - #4
로컬에서 AI를 실행하기 위한 프로덕션 준비 완료 툴킷
★ 10,281+1최근 7일 스타 변화 - #5
중국어, 광동어, 영어, 일본어, 한국어 ASR, 언어 식별, 감정 인식 및 오디오 이벤트 감지를 위한 오픈 소스 SenseVoiceSmall 모델입니다.
★ 9,209+37최근 7일 스타 변화 - #6
Stream의 Open Vision Agents. 모든 모델이나 비디오 제공자를 사용하여 음성 및 비전 에이전트를 빠르게 빌드하세요. 초저지연을 위해 Stream의 엣지 네트워크를 사용합니다.
★ 8,113+9최근 7일 스타 변화 - #7
Apple Silicon에서 로컬 AI를 사용하여 Claude Code를 100% 온디바이스로 실행합니다. MLX 네이티브 Anthropic API 서버. Muse-Glimmer 30B(멀티모달 지원, 이미지 판독 가능, 검열 해제됨), Gemma 4 31B, Qwen 3.5 122B(초당 65토큰), DeepSeek V4 Flash(1M 컨텍스트) 등 6개 모델 탑재. 개인용, 오프라인, 에어갭 환경 지원. NDA, 법률, 의료 워크플로우를 위해 제작되었습니다.
★ 3,255+12최근 7일 스타 변화 - #8
Voice AI SDK는 몇 분 만에 모든 앱에 완전한 음성 기반 AI 대화 파이프라인을 제공하는 재사용 가능한 안드로이드 라이브러리입니다.
★ 2,580+0최근 7일 스타 변화 - #9
앱을 위한 셀프 코딩 시스템 — 웹용 Alan AI SDK
★ 2,427-3최근 7일 스타 변화 - #10
에이전트가 대화하고, 작업하고, 상주할 수 있도록 유지하는 실시간 음성 런타임. AI 에이전트를 위한 실시간 음성 런타임
★ 2,362+72최근 7일 스타 변화 - #11
앱을 위한 셀프 코딩 시스템 — iOS용 Alan AI SDK
★ 1,878-3최근 7일 스타 변화 - #12
앱을 위한 자체 코딩 시스템 — Flutter용 Alan AI SDK
★ 1,756-1최근 7일 스타 변화 - #13
앱을 위한 셀프 코딩 시스템 — Ionic용 Alan AI SDK
★ 1,649-1최근 7일 스타 변화 - #14
구 Better Chatbot. 에이전트, MCP 및 워크플로우 자동화를 위한 오픈소스 AI 워크스페이스인 Navigator
★ 1,171+1최근 7일 스타 변화 - #15
오픈소스 음성 AI SDK. 스택을 직접 소유하려는 개발자를 위한 Vapi/Retell 대안. 4줄의 코드로 AI 에이전트에 전화번호 부여 — Python 및 TypeScript, MIT 라이선스, Twilio, Telnyx, Plivo 지원
★ 1,051+11최근 7일 스타 변화 - #16
스트리밍 및 온디바이스 사용을 위해 최적화된 Whisper 모델
★ 897+0최근 7일 스타 변화 - #17
실시간 음성 비서로 WebRTC 스트리밍, faster-whisper ASR, 로컬 LLM, Vui Nano(300M) TTS를 지원합니다. OpenAI Realtime API와 호환되며 음성 복제, 끼어들기(barge-in) 기능을 제공하고 4090 환경에서 실시간 대비 약 9배 속도로 작동합니다. Apache 2.0 라이선스.
★ 757+10최근 7일 스타 변화 - #18★ 723+16최근 7일 스타 변화
- #19
Rapida는 오디오 스트리밍, STT, TTS, VAD, 다중 채널 통합, 에이전트 상태 관리 및 관찰 가능성을 제공하여 실시간 대화형 음성 에이전트를 구축할 수 있는 오픈소스 엔드투엔드 음성 AI 오케스트레이션 플랫폼입니다.
★ 721+1최근 7일 스타 변화 - #20
프로덕션 AI 시스템을 위한 검색 계층. 벡터 데이터베이스 없이 10ms 미만의 초고속 검색을 제공하며 브라우저, 엣지, 온디바이스 및 클라우드 환경을 위해 구축되었습니다.
★ 670+4최근 7일 스타 변화 - #21
TypeScript AI 에이전트 프레임워크: 인지 메모리, 런타임 도구 생성, 멀티 에이전트 오케스트레이션 및 11개의 LLM 제공업체를 지원합니다.
★ 622+2최근 7일 스타 변화 - #22
앱을 위한 셀프 코딩 시스템 — React Native용 Alan AI SDK.
★ 575+0최근 7일 스타 변화 - #23★ 563-1최근 7일 스타 변화
- #24
개인화된 음성 복제 기능을 갖춘 세계 최초의 오픈소스 실시간 엔드투엔드 음성 대화 모델
★ 549-1최근 7일 스타 변화