stt
stt 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 stt 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 stt 태그가 달린 리포지토리예요.
- #1
AI 음성 에이전트를 위한 지출 측정기 및 예산 제한 도구. STT, TTS, LLM, 전화 통화당 비용을 즉시 측정하며(Pipecat, LiveKit - Python & TypeScript), 설정한 예산을 초과하기 전에 다음 턴을 강제로 중단함. 로컬 실행, 계정 불필요, 텔레메트리 없음. Floe 제작.
★ 434
- #1
당신의 AI 제2의 뇌. 셀프 호스팅 가능. 웹 또는 문서에서 답변 얻기. 커스텀 에이전트 구축, 자동화 예약, 심층 리서치 수행. 온라인 또는 로컬 LLM을 개인용 자율 AI(gpt, claude, gemini, llama, qwen, mistral)로 변환. 시작하기 - 무료.
★ 37,010+223최근 7일 스타 변화 - #2★ 15,101+17최근 7일 스타 변화
- #3★ 10,997+33최근 7일 스타 변화
- #4
Stream의 Open Vision Agents. 모든 모델이나 비디오 제공자를 사용하여 음성 및 비전 에이전트를 빠르게 빌드하세요. 초저지연을 위해 Stream의 엣지 네트워크를 사용합니다.
★ 8,113+9최근 7일 스타 변화 - #5★ 4,780+9최근 7일 스타 변화
- #6★ 3,068+2최근 7일 스타 변화
- #7★ 2,606+1최근 7일 스타 변화
- #8
tensorflow 딥러닝 프레임워크와 시퀀스 대 시퀀스 신경망을 사용한 음성 인식
★ 2,173+0최근 7일 스타 변화 - #9
보안 Websockets 및 Edge Functions를 사용하여 Arduino ESP32에서 100개 이상의 모델로 AI 동반자 및 장치를 위한 실시간 음성 AI 장난감
★ 1,938+5최근 7일 스타 변화 - #10
WhatsApp 에이전트, Ava를 만나보세요
★ 1,675+2최근 7일 스타 변화 - #11★ 1,622+8최근 7일 스타 변화
- #12
Android용 Dicio 어시스턴트 앱
★ 1,463+3최근 7일 스타 변화 - #13
🍦 Speech-AI-Forge는 TTS 생성 모델을 중심으로 개발된 프로젝트로, API 서버 및 Gradio 기반 WebUI를 구현합니다.
★ 1,418+0최근 7일 스타 변화 - #14
비디오 동기화 번역. 비디오 더빙
★ 1,413+2최근 7일 스타 변화 - #15
💎 ASR, TTS 및 기타 음성 기술을 위한 접근 가능한 음성 말뭉치(speech corpora) 목록
★ 1,399+0최근 7일 스타 변화 - #16
샤오즈(小智) ESP32를 위한 Java 엔터프라이즈급 관리 플랫폼으로, 장치 모니터링, 음성 커스텀, 역할 전환 및 대화 기록 관리를 위한 프론트엔드/백엔드 통합 솔루션을 제공합니다.
★ 1,337+1최근 7일 스타 변화 - #17
Gp.nvim (GPT 프롬프트) Neovim AI 플러그인: ChatGPT 세션, 지시 가능한 텍스트/코드 작업 및 음성-텍스트 변환 [OpenAI, Ollama, Anthropic, ..]
★ 1,320+0최근 7일 스타 변화 - #18
실시간 음성 번역 — macOS 및 Windows, 무료 TTS, 서버 없음, 사용자 API 키만 사용
★ 1,278+2최근 7일 스타 변화 - #19
이중 언어 회의를 위한 실시간 양방향 음성 번역기. 언어를 자동 감지하여 양방향으로 번역하며, 클라우드 또는 완전 오프라인 온디바이스 모드를 지원함. Zoom, Meet, Teams 및 모든 앱에서 사용 가능한 데스크톱(Windows, macOS, Linux) 및 브라우저 확장 프로그램(Chrome, Edge) 제공
★ 1,186+40최근 7일 스타 변화 - #20★ 1,094+13최근 7일 스타 변화
- #21
🎙️ 음성을 깔끔한 텍스트, 유용한 작업, 구조화된 지식으로 변환해주는 지능형 음성 생산성 어시스턴트입니다. 사용자가 아이디어를 포착하고, 자연스럽게 소통하며, 반복 작업을 자동화하고, 다양한 앱과 워크플로우에서 생산성을 유지할 수 있도록 돕습니다.
★ 806+3최근 7일 스타 변화 - #22★ 805+1최근 7일 스타 변화
- #23
Speech to Text to Speech. 현재 재생 중인 곡. 텍스트를 OSC 메시지로 VRChat에 전송하여 아바타에 표시합니다. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 803+3최근 7일 스타 변화 - #24
Apple Silicon의 MLX를 활용한 오디오 처리를 위한 모듈형 Swift SDK
★ 772+6최근 7일 스타 변화 - #25
로컬 머신의 Unity3d에서 음성 인식 모델(whisper.cpp) 실행하기.
★ 751+1최근 7일 스타 변화 - #26
Apple Silicon(M 시리즈) 칩에 최적화된 Apple MLX 프레임워크 기반 로컬 추론 서버. OpenAI 호환 API 엔드포인트를 구현하여 기존 OpenAI SDK 클라이언트와 원활하게 통합 가능
★ 741+1최근 7일 스타 변화 - #27★ 671+0최근 7일 스타 변화
- #28★ 638+0최근 7일 스타 변화
- #29
오디오 및 비디오의 자동 전사 수정 작업을 더 쉽고 빠르게 만들어주는 React 컴포넌트. BBC News Labs 제작. - 개발 중
★ 620-1최근 7일 스타 변화 - #30
다국어 ASR 및 TTS 모델을 위한 C++ ggml 런타임 허브: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2 등 지원 및 범용 강제 정렬(forced alignment) 기능 제공
★ 609+21최근 7일 스타 변화