Lompat ke konten utama
buildradar
Sign in
Topik · speech-to-text

speech-to-text

Repositori open source terpantau bertanda speech-to-text, diurutkan berdasarkan bintang.

Repositori
152
Total bintang
640.857
Rata-rata bintang
4.216
Porsi
0,03%

Topik yang sering muncul berdampingan dengan speech-to-text di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-to-text.

  • audio.cpp@0xShug0

    Mesin inferensi C++ murni yang lengkap untuk model audio, didukung oleh ggml. Mendukung TTS, STT, VAD, konversi suara, pembuatan musik, dan lainnya, dengan performa yang sangat dioptimalkan. Tanpa dependensi Python.

    2.214
  • LiveStream-Agent-Studio@HanyuanWang

    面向抖音直播电商的 Windows 本地 AI Agent Studio,贯通主播发现、直播洞察、直播复盘与短视频内容编导的统一智能工作流。

    970
  • Talkify@tornikegomareli

    Dikte suara lokal yang sangat cepat, gratis, dan mengutamakan privasi untuk macOS dengan transkripsi pada perangkat

    541
  • localstudio@ErickWendel

    Browser-only Canva-style presentation studio, powered by local Web AI.

    541
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • whisper.cpp@ggml-org

    Porting model Whisper dari OpenAI ke dalam C/C++.

    53.389+103Perubahan bintang dalam 7 hari terakhir
  • Handy@cjpais

    Aplikasi speech-to-text gratis, sumber terbuka, dan dapat diperluas yang bekerja sepenuhnya secara offline.

    30.916+280Perubahan bintang dalam 7 hari terakhir
  • meetily@Zackriya-Solutions

    Asisten rapat AI yang mengutamakan privasi dengan transkripsi langsung Parakeet/Whisper 4x lebih cepat, diaritisasi pembicara, dan ringkasan Ollama yang dibangun dengan Rust. Pemrosesan 100% lokal, tidak memerlukan cloud. Meetily (Meetly Ai - https://meetily.ai) adalah pencatat rapat AI open-source yang di-host sendiri nomor 1 untuk macOS & Windows. Pahami cara menulis notulen rapat.

    30.252+195Perubahan bintang dalam 7 hari terakhir
  • llamafile@mozilla-ai

    Distribusikan dan jalankan LLM dengan satu file.

    25.859+113Perubahan bintang dalam 7 hari terakhir
  • faster-whisper@SYSTRAN

    Transkripsi Faster Whisper dengan CTranslate2

    25.206+71Perubahan bintang dalam 7 hari terakhir
  • whisperX@m-bain

    WhisperX: Pengenalan Ucapan Otomatis dengan stempel waktu tingkat kata (& Diarisasi)

    23.864+61Perubahan bintang dalam 7 hari terakhir
  • screenpipe@screenpipe

    YC (S26) | Open Computer History | Rekam layar Anda secara terus-menerus di lokal dan berikan konteks ke agen Anda (Claude, Codex, Openclaw, Hermes, Runner...)

    21.376+80Perubahan bintang dalam 7 hari terakhir
  • FunASR@modelscope

    Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.

    20.136+64Perubahan bintang dalam 7 hari terakhir
  • pyvideotrans@jianchang512

    Menerjemahkan video dari satu bahasa ke bahasa lain serta menyematkan sulih suara dan takarir.

    18.871+38Perubahan bintang dalam 7 hari terakhir
  • leon@leon-ai

    Leon adalah asisten pribadi open source Anda.

    17.476+1Perubahan bintang dalam 7 hari terakhir
  • kaldi@kaldi-asr

    kaldi-asr/kaldi adalah lokasi resmi dari proyek Kaldi.

    15.474+3Perubahan bintang dalam 7 hari terakhir
  • vosk-api@alphacep

    API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.

    15.101+17Perubahan bintang dalam 7 hari terakhir
  • VoiceStudio@debpalash

    VoiceStudio adalah alternatif ElevenLabs sumber terbuka yang sepenuhnya lokal — kloning suara, desain suara, sulih suara video, dikte, transkripsi, & pembuatan buku audio dalam 646 bahasa.

    14.835+2.880Perubahan bintang dalam 7 hari terakhir
  • sherpa-onnx@k2-fsa

    Speech-to-text, text-to-speech, speaker diarization, peningkatan kualitas suara, pemisahan sumber, dan VAD menggunakan next-gen Kaldi dengan onnxruntime tanpa koneksi internet. Mendukung sistem embedded, Android, iOS, HarmonyOS, Raspberry Pi, RISC-V, RK NPU, Axera NPU, Ascend NPU, server x86_64, websocket server/client, serta mendukung 12 bahasa pemrograman.

    14.575+95Perubahan bintang dalam 7 hari terakhir
  • speech-to-speech@huggingface

    Membangun agen suara dengan model open-source

    13.015+82Perubahan bintang dalam 7 hari terakhir
  • voice-pro@abus-aikorea

    Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.

    12.730+54Perubahan bintang dalam 7 hari terakhir
  • speechbrain@speechbrain

    Toolkit ucapan berbasis PyTorch

    11.802+10Perubahan bintang dalam 7 hari terakhir
  • WhisperLiveKit@QuentinFuxa

    Speech-to-text lokal waktu nyata dengan streaming ASR, diarization pembicara, penerjemahan, dan API yang kompatibel dengan OpenAI/Deepgram

    10.990+16Perubahan bintang dalam 7 hari terakhir
  • RealtimeSTT@KoljaB

    Pustaka speech-to-text yang tangguh, efisien, dan berlatensi rendah dengan deteksi aktivitas suara tingkat lanjut, aktivasi kata pemicu, dan transkripsi instan.

    10.108+18Perubahan bintang dalam 7 hari terakhir
  • SenseVoice@QwenAudio

    Model SenseVoiceSmall sumber terbuka untuk ASR bahasa Mandarin, Kanton, Inggris, Jepang, dan Korea, identifikasi bahasa, pengenalan emosi, dan deteksi peristiwa audio.

    9.209+37Perubahan bintang dalam 7 hari terakhir
  • Modul pengenalan ucapan untuk Python, mendistribusikan beberapa mesin dan API, online dan offline.

    8.987+0Perubahan bintang dalam 7 hari terakhir
  • Sistem pengenalan suara bahasa Mandarin berbasis Deep Learning.

    8.386+0Perubahan bintang dalam 7 hari terakhir
  • mlx-audio@Blaizzy

    Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.

    7.826+23Perubahan bintang dalam 7 hari terakhir
  • annyang@TalAter

    💬 Pengenalan ucapan untuk situs Anda

    6.815-1Perubahan bintang dalam 7 hari terakhir
  • argmax-oss-swift@argmaxinc

    AI Suara On-device untuk Apple Silicon

    6.353+8Perubahan bintang dalam 7 hari terakhir
  • FunClip@modelscope

    Alat transkripsi video, pembuatan subtitle, dan pemotongan berbasis LLM yang didukung oleh FunASR dengan antarmuka Gradio lokal.

    6.210+13Perubahan bintang dalam 7 hari terakhir
  • openwhispr@OpenWhispr

    Aplikasi dikte suara-ke-teks dengan model lokal (Nvidia Parakeet/Whisper) dan cloud (BYOK). Mengutamakan privasi dan tersedia lintas platform.

    6.133+305Perubahan bintang dalam 7 hari terakhir
  • silero-models@snakers4

    Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana

    6.084-1Perubahan bintang dalam 7 hari terakhir
  • ODS@Osmantic

    Ubah PC, Mac, atau perangkat Linux Anda menjadi server AI. Inferensi LLM, UI obrolan, suara, agen, alur kerja, RAG, dan pembuatan gambar.

    5.931+1.108Perubahan bintang dalam 7 hari terakhir
  • whisper-diarization@MahmoudAshraf97

    Pengenalan Ucapan Otomatis (ASR) dengan Speaker Diarization berbasis OpenAI Whisper

    5.634+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik