본문으로 건너뛰기
buildradar
Sign in
토픽 · whisper

whisper

whisper 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 126개
  • mlx-tune@ARahim3

    Apple Silicon Mac에서 LLM 파인튜닝. MLX 네이티브 기반 SFT, DPO, GRPO, Vision, TTS, STT, Embedding, OCR 파인튜닝 지원. Unsloth 호환 API.

    1,398+8최근 7일 스타 변화
  • 멀티 백엔드 whisper 앱. 매우 빠른 속도. Mac-arm 최적화. 간편한 설치. 로컬 파일이나 URL을 입력하면 Whisper AI를 사용하여 텍스트로 변환합니다. 완전 프라이빗 및 무료 🤯🤯🤯

    1,394+0최근 7일 스타 변화
  • CrisperWhisper@nyrahealth

    제어 가능한 전사(Transcription) 기능. 단어 수준의 타임스탬프와 함께 축어적(모든 단어, 추임새, 일시 정지, 말더듬, 음성 소리) 또는 의도적(화자가 말하고자 한 내용, 가독성 최적화) 방식으로 제공.

    1,371+13최근 7일 스타 변화
  • voicemode@mbailey

    Claude Code와의 자연스러운 음성 대화

    1,347+6최근 7일 스타 변화
  • whisper-ctranslate2@Softcatala

    CTranslate2 기반의 원본 OpenAI 클라이언트와 호환되는 Whisper 명령 줄 클라이언트

    1,346+2최근 7일 스타 변화
  • voxtype@peteonrails

    Wayland 컴포지터를 위한 푸시투토크(PTK) 지원 음성 텍스트 변환(STT)

    1,338+42최근 7일 스타 변화
  • gp.nvim@Robitx

    Gp.nvim (GPT 프롬프트) Neovim AI 플러그인: ChatGPT 세션, 지시 가능한 텍스트/코드 작업 및 음성-텍스트 변환 [OpenAI, Ollama, Anthropic, ..]

    1,320+0최근 7일 스타 변화
  • MTools@HG-ha

    MTools는 오디오/비디오 처리, 이미지 편집, 텍스트 조작 및 코딩 도구가 통합된 강력한 다기능 데스크톱 애플리케이션으로, AI 강화 기능이 내장되어 있습니다. 작업 흐름을 단순화하고 생산성을 향상시키도록 설계되었습니다.

    1,305+5최근 7일 스타 변화
  • claude-video-vision@jordanrendric

    Claude에게 동영상을 시청하고 이해할 수 있는 능력을 부여하세요 — 프레임 추출 및 멀티모달 오디오 분석 기능이 포함된 Claude Code 플러그인

    1,281+6최근 7일 스타 변화
  • whisper@graphite-project

    Graphite을 위한 파일 기반 시계열 데이터베이스 포맷 Whisper

    1,262+0최근 7일 스타 변화
  • kubeai@kubeai-project

    Kubernetes용 AI 추론 오퍼레이터. 프로덕션 환경에서 ML 모델을 서빙하는 가장 쉬운 방법. VLM, LLM, 임베딩 및 음성 인식(STT) 지원.

    1,256+2최근 7일 스타 변화
  • Whisper-Finetune@yeyupiaoling

    타임스탬프 데이터 없는 학습, 타임스탬프 데이터가 있는 학습, 음성 데이터 없는 학습을 지원하도록 Whisper 음성 인식 모델을 파인튜닝합니다. 추론을 가속화하고 Web 배포, Windows 데스크톱 배포 및 Android 배포를 지원합니다.

    1,222-1최근 7일 스타 변화
  • truss@basetenlabs

    AI/ML 모델을 프로덕션 환경에서 서비스하는 가장 간단한 방법

    1,199+3최근 7일 스타 변화
  • hyprwhspr@goodroot

    Linux용 네이티브 음성 인식(STT) - 빠르고 정확하며 프라이버시가 보장되고 시스템 전역에서 사용 가능한 커스텀 가능한 딕테이션 도구

    1,189+10최근 7일 스타 변화
  • 타사 API 신청 없이 로컬에서 오디오를 텍스트로 변환하여 비디오 및 오디오 자막(srt 파일)을 생성하는 Transformer 기반 프레임워크입니다.

    1,179+3최근 7일 스타 변화
  • biniou@Woolverine94

    30개 이상의 생성형 AI를 위한 자체 호스팅 웹 UI

    1,150+1최근 7일 스타 변화
  • AI-Waifu-Vtuber@ardha27

    Youtube 및 Twitch 스트리밍을 위한 AI Vtuber

    1,116+2최근 7일 스타 변화
  • Whisperboard@Saik0s

    모바일 기기에서 고품질 음성 전사를 더욱 쉽게 사용할 수 있도록 하는 오픈소스 iOS 앱

    1,102+8최근 7일 스타 변화
  • whisper-writer@savbell

    💬📝 OpenAI의 Whisper 음성 인식 모델을 사용하는 소형 구술 앱.

    1,100+2최근 7일 스타 변화
  • voquill@voquill

    오픈 소스 음성 받아쓰기 기술

    1,006-2최근 7일 스타 변화
  • whisper-flow@dimastatz

    Whisper-Flow는 OpenAI의 Whisper 모델을 사용하여 오디오 콘텐츠를 실시간으로 변환할 수 있도록 설계된 프레임워크입니다. 파일 업로드 후 전체를 처리하는 대신(배치 모드) 연속적인 오디오 청크 스트림을 받아 즉시 점진적인 텍스트 변환을 생성합니다.

    964+28최근 7일 스타 변화
  • transcriptionstream@transcriptionstream

    LLM 요약 기능이 포함된 턴키 방식의 자체 호스팅 오프라인 음성 변환 및 화자 분리 서비스

    948+2최근 7일 스타 변화
  • whisper.api@innovatorved

    이 프로젝트는 미세조정 및 처리된 Whisper ASR 모델을 사용하여 음성을 텍스트로 변환하는 사용자 수준 액세스 지원 API를 제공합니다.

    914+0최근 7일 스타 변화
  • OpenCluely@TechyCSR

    OpenCluely는 DSA, OA, CP 같은 기술 면접을 위해 제작된 무료 오픈 소스 Cluely 대안입니다. 인비저블 오버레이, 실시간 AI 지원, 문제 캡처를 위한 스마트 이미지 처리, 다국어 지원을 제공하며 100% 커스텀 가능하고 프라이버시가 보장됩니다.

    912+41최근 7일 스타 변화
  • TwitchLib@TwitchLib

    C# Twitch 채팅, 귓속말, API 및 PubSub 라이브러리. 채팅, 귓속말, 스트림 이벤트 구독 및 채널/계정 수정 지원. .NETStandard 2.0 호환 환경 지원

    892+3최근 7일 스타 변화
  • VideoSubtitleGenerator@buxuku

    로컬 비디오용 자막 파일을 일괄 생성하고 자막 파일을 다른 언어로 번역할 수 있는 도구, Windows 및 macOS 크로스 플랫폼 지원

    873+2최근 7일 스타 변화
  • subvert@aschmelyun

    비디오에서 몇 초 만에 자막, 요약, 챕터 생성

    868+0최근 7일 스타 변화
  • OpenAI-Unity@srcnalt

    Unity 게임 엔진에서 OpenAI API를 직접 사용할 수 있도록 지원하는 비공식 OpenAI Unity 패키지입니다.

    843+1최근 7일 스타 변화
  • whisper-playground@saharmor

    OpenAI의 Whisper를 사용하여 실시간 speech2text 웹 앱 구축 https://openai.com/blog/whisper/

    835+0최근 7일 스타 변화
  • go-carbon@go-graphite

    클래식 아키텍처(Agent -> Cache -> Persister)를 사용하는 Graphite/Carbon 서버의 Golang 구현

    829+0최근 7일 스타 변화
← 토픽 목록으로