본문으로 건너뛰기
buildradar
Sign in
토픽 · transcription

transcription

transcription 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
53
총 스타
175,951
평균 스타
3,320
비중
0.01%

같은 리포지토리에 transcription 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 transcription 태그가 달린 리포지토리예요.

  • claude-real-video@HUANGCHIHHUNGLeo

    Claude(또는 기타 LLM)가 URL이나 로컬 파일에서 텍스트와 함께 장면 인식 기능 및 중복이 제거된 프레임을 통해 동영상을 실제로 시청할 수 있도록 지원합니다. 로컬에서 실행되며, MIT 라이선스입니다.

    2,109
  • rescript@wassgha

    🎬 브라우저에서 실행되는 오픈 소스 기반의 스크립트 편집 비디오/오디오 에디터

    864
  • meetily@Zackriya-Solutions

    프라이버시를 최우선으로 하는 AI 미팅 어시스턴트입니다. Rust 기반으로 제작되었으며, 4배 더 빠른 Parakeet/Whisper 실시간 전사, 화자 분할, Ollama 요약 기능을 제공합니다. 100% 로컬 처리로 클라우드가 필요하지 않습니다. Meetily는 macOS 및 Windows를 위한 최고의 자체 호스팅 오픈 소스 AI 회의록 작성 도구입니다.

    30,252+195최근 7일 스타 변화
  • FunASR@modelscope

    학습, 추론, 스트리밍 ASR, VAD, 구두점, 화자 분리 파이프라인, OpenAI 호환/MCP 서빙을 위한 오픈소스 음성 인식 툴킷.

    20,136+64최근 7일 스타 변화
  • VoiceStudio@debpalash

    VoiceStudio는 완전 로컬 환경에서 실행되는 오픈 소스 ElevenLabs 대안으로, 646개 언어의 음성 복제, 음성 디자인, 비디오 더빙, 받아쓰기, 전사 및 오디오북 생성을 지원합니다.

    14,835+2,880최근 7일 스타 변화
  • omi@BasedHardware

    화면을 보고 대화를 들으며 무엇을 해야 할지 알려주는 AI

    13,377+46최근 7일 스타 변화
  • voice-pro@abus-aikorea

    크리에이터와 개발자를 위한 Gradio WebUI. 주요 TTS(Edge-TTS, kokoro) 및 제로샷 음성 복제(E2 & F5-TTS, CosyVoice)를 지원하며, Whisper 오디오 처리, YouTube 다운로드, Demucs 보컬 분리 및 다국어 번역 기능을 제공합니다.

    12,730+54최근 7일 스타 변화
  • SenseVoice@QwenAudio

    중국어, 광동어, 영어, 일본어, 한국어 ASR, 언어 식별, 감정 인식 및 오디오 이벤트 감지를 위한 오픈 소스 SenseVoiceSmall 모델입니다.

    9,209+37최근 7일 스타 변화
  • FunClip@modelscope

    FunASR 기반 비디오 전사, 자막 생성 및 로컬 Gradio UI가 포함된 LLM 지원 클리핑 도구.

    6,210+13최근 7일 스타 변화
  • basic-pitch@spotify

    피치 벤드 감지 기능을 갖춘 가볍고 강력한 오디오-MIDI 변환기

    5,522+21최근 7일 스타 변화
  • auto-subs@tmoroney

    DaVinci Resolve, Premiere, After Effects에 직접 연결되는 온디바이스 자막 생성

    4,122+20최근 7일 스타 변화
  • speaches@speaches-ai
    3,638+8최근 7일 스타 변화
  • whishper@pluja

    웹 UI를 사용하여 100% 로컬에서 오디오를 텍스트로 변환하고 자막을 번역 및 편집합니다. Whisper 모델 구동!

    3,068+2최근 7일 스타 변화
  • Scriberr@rishikanthc

    셀프 호스팅 방식의 AI 오디오 전사 도구

    3,016+14최근 7일 스타 변화
  • Hex@kitlangton

    VOICE → WORDS

    2,893+2최근 7일 스타 변화
  • vexa@Vexa-ai

    Google Meet, Microsoft Teams 및 Zoom을 위한 오픈소스 미팅 전사 API. 자동 참가 봇, 실시간 WebSocket 전사, AI 에이전트를 위한 MCP 서버. 셀프 호스팅 또는 SaaS 이용 가능.

    2,741+15최근 7일 스타 변화
  • awesome-whisper@sindresorhus

    🔊 OpenAI가 개발한 오픈소스 AI 기반 음성 인식 시스템인 Whisper를 위한 멋진 목록

    2,375+1최근 7일 스타 변화
  • kalosm@floneum

    Rust로 구현된 즉각적이고 제어 가능한 로컬 사전 학습 AI 모델

    2,226+3최근 7일 스타 변화
  • noScribe@kaixxx

    자동 오디오 트랜스크립션을 위한 최첨단 AI 기술. OpenAI Whisper 및 pyannote(화자 식별)를 위한 편리한 GUI

    2,145+8최근 7일 스타 변화
  • claude-real-video@HUANGCHIHHUNGLeo

    Claude(또는 기타 LLM)가 URL이나 로컬 파일에서 텍스트와 함께 장면 인식 기능 및 중복이 제거된 프레임을 통해 동영상을 실제로 시청할 수 있도록 지원합니다. 로컬에서 실행되며, MIT 라이선스입니다.

    2,109+20최근 7일 스타 변화
  • diart@juanmc2005

    AI 기반 실시간 오디오 애플리케이션을 구축하기 위한 파이썬 패키지

    2,024+1최근 7일 스타 변화
  • audapolis@bugbakery

    자동 전사가 지원되는 음성 오디오 편집기

    1,892+2최근 7일 스타 변화
  • typewhisper-mac@TypeWhisper

    macOS용 로컬 음성 인식(speech-to-text) 온디바이스 AI, 완전한 프라이버시 보장, 선택적 클라우드 지원

    1,759+12최근 7일 스타 변화
  • AI를 이용한 로컬 음성 인식 및 자막 생성을 위한 OBS 플러그인

    1,597+8최근 7일 스타 변화
  • amical@amicalhq

    🎙️ AI 받아쓰기 앱 - 오픈소스 및 로컬 퍼스트 ⚡ 키보드 없이 3배 더 빠르게 타이핑하세요. 🆓 오픈소스 모델 기반, 오프라인 작동, 빠르고 정확합니다.

    1,520+8최근 7일 스타 변화
  • pianotrans@azuwis

    페달을 지원하는 ByteDance의 피아노 전사(Piano Transcription)를 위한 간단한 GUI

    1,514+3최근 7일 스타 변화
  • Fun-ASR@QwenAudio

    FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리

    1,512+10최근 7일 스타 변화
  • minutes@silverstein

    모든 회의, 모든 아이디어, 모든 음성 메모를 AI로 검색할 수 있습니다. 오픈소스, 프라이버시 우선 대화 메모리 계층.

    1,462+6최근 7일 스타 변화
  • 멀티 백엔드 whisper 앱. 매우 빠른 속도. Mac-arm 최적화. 간편한 설치. 로컬 파일이나 URL을 입력하면 Whisper AI를 사용하여 텍스트로 변환합니다. 완전 프라이빗 및 무료 🤯🤯🤯

    1,394+0최근 7일 스타 변화
  • CrisperWhisper@nyrahealth

    제어 가능한 전사(Transcription) 기능. 단어 수준의 타임스탬프와 함께 축어적(모든 단어, 추임새, 일시 정지, 말더듬, 음성 소리) 또는 의도적(화자가 말하고자 한 내용, 가독성 최적화) 방식으로 제공.

    1,371+13최근 7일 스타 변화
  • book@hardhackerlabs

    "인디 해커 - 두 달 만에 $12000 ARR 달성기"는 인디 해커 팀이 저술한 책으로, Podwise 제품의 여정을 충실히 기록하고 있습니다. 영감, 구축, 출시, 성장, 회고의 5개 장으로 구성되어 있습니다.

    1,370+0최근 7일 스타 변화
  • 타사 API 신청 없이 로컬에서 오디오를 텍스트로 변환하여 비디오 및 오디오 자막(srt 파일)을 생성하는 Transformer 기반 프레임워크입니다.

    1,179+3최근 7일 스타 변화
← 토픽 목록으로