Lompat ke konten utama
buildradar
Sign in
Topik · speech-recognition

speech-recognition

Repositori open source terpantau bertanda speech-recognition, diurutkan berdasarkan bintang.

Repositori
156
Total bintang
675.280
Rata-rata bintang
4.329
Porsi
0,04%

Topik yang sering muncul berdampingan dengan speech-recognition di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-recognition.

  • qwen-audio-agent@QwenAudio

    Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.

    2.362
  • Talkify@tornikegomareli

    Dikte suara lokal yang sangat cepat, gratis, dan mengutamakan privasi untuk macOS dengan transkripsi pada perangkat

    541
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501
  • hayamimi@oboroge0

    早耳 - Real-time multilingual speech-to-text on CPU only. Live subtitles, browser dashboard, speaker labels, translation. No GPU, no cloud.

    327
  • transformers@huggingface

    🤗 Transformers: kerangka kerja definisi model untuk model pembelajaran mesin canggih dalam teks, penglihatan, audio, dan model multimodal, baik untuk inferensi maupun pelatihan.

    164.731+119Perubahan bintang dalam 7 hari terakhir
  • whisper.cpp@ggml-org

    Porting model Whisper dari OpenAI ke dalam C/C++.

    53.389+103Perubahan bintang dalam 7 hari terakhir
  • faster-whisper@SYSTRAN

    Transkripsi Faster Whisper dengan CTranslate2

    25.206+71Perubahan bintang dalam 7 hari terakhir
  • whisperX@m-bain

    WhisperX: Pengenalan Ucapan Otomatis dengan stempel waktu tingkat kata (& Diarisasi)

    23.864+61Perubahan bintang dalam 7 hari terakhir
  • FunASR@modelscope

    Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.

    20.136+64Perubahan bintang dalam 7 hari terakhir
  • leon@leon-ai

    Leon adalah asisten pribadi open source Anda.

    17.476+1Perubahan bintang dalam 7 hari terakhir
  • kaldi@kaldi-asr

    kaldi-asr/kaldi adalah lokasi resmi dari proyek Kaldi.

    15.474+3Perubahan bintang dalam 7 hari terakhir
  • vosk-api@alphacep

    API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.

    15.101+17Perubahan bintang dalam 7 hari terakhir
  • DeepLearningExamples@NVIDIA

    Skrip Deep Learning mutakhir yang diatur berdasarkan model - mudah dilatih dan diterapkan dengan akurasi serta performa yang dapat direproduksi pada infrastruktur kelas perusahaan.

    14.846+4Perubahan bintang dalam 7 hari terakhir
  • Pelajari Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision, dan NLP melalui materi kuliah yang menarik ini!

    12.939+3Perubahan bintang dalam 7 hari terakhir
  • voice-pro@abus-aikorea

    Gradio WebUI untuk kreator dan pengembang, menampilkan TTS utama (Edge-TTS, kokoro) dan Kloning Suara zero-shot (E2 & F5-TTS, CosyVoice), dengan pemrosesan audio Whisper, unduhan YouTube, isolasi vokal Demucs, dan terjemahan multibahasa.

    12.730+54Perubahan bintang dalam 7 hari terakhir
  • PaddleSpeech@PaddlePaddle

    Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.

    12.676+5Perubahan bintang dalam 7 hari terakhir
  • speechbrain@speechbrain

    Toolkit ucapan berbasis PyTorch

    11.802+10Perubahan bintang dalam 7 hari terakhir
  • WhisperLiveKit@QuentinFuxa

    Speech-to-text lokal waktu nyata dengan streaming ASR, diarization pembicara, penerjemahan, dan API yang kompatibel dengan OpenAI/Deepgram

    10.990+16Perubahan bintang dalam 7 hari terakhir
  • openvino@openvinotoolkit

    OpenVINO™ adalah toolkit open source untuk mengoptimalkan dan menerapkan inferensi AI.

    10.793+30Perubahan bintang dalam 7 hari terakhir
  • espnet@espnet

    Toolkit Pemrosesan Suara End-to-End

    9.949+3Perubahan bintang dalam 7 hari terakhir
  • SenseVoice@QwenAudio

    Model SenseVoiceSmall sumber terbuka untuk ASR bahasa Mandarin, Kanton, Inggris, Jepang, dan Korea, identifikasi bahasa, pengenalan emosi, dan deteksi peristiwa audio.

    9.209+37Perubahan bintang dalam 7 hari terakhir
  • Modul pengenalan ucapan untuk Python, mendistribusikan beberapa mesin dan API, online dan offline.

    8.987+0Perubahan bintang dalam 7 hari terakhir
  • Sistem pengenalan suara bahasa Mandarin berbasis Deep Learning.

    8.386+0Perubahan bintang dalam 7 hari terakhir
  • mlx-audio@Blaizzy

    Pustaka text-to-speech (TTS), speech-to-text (STT), dan speech-to-speech (STS) yang dibangun di atas framework MLX Apple, menyediakan analisis suara yang efisien di Apple Silicon.

    7.826+23Perubahan bintang dalam 7 hari terakhir
  • annyang@TalAter

    💬 Pengenalan ucapan untuk situs Anda

    6.815-1Perubahan bintang dalam 7 hari terakhir
  • wav2letter@flashlight

    Toolkit Automatic Speech Recognition dari Facebook AI Research

    6.437+1Perubahan bintang dalam 7 hari terakhir
  • argmax-oss-swift@argmaxinc

    AI Suara On-device untuk Apple Silicon

    6.353+8Perubahan bintang dalam 7 hari terakhir
  • PaddleX@PaddlePaddle

    Alat pengembangan All-in-One berbasis PaddlePaddle

    6.254+3Perubahan bintang dalam 7 hari terakhir
  • FunClip@modelscope

    Alat transkripsi video, pembuatan subtitle, dan pemotongan berbasis LLM yang didukung oleh FunASR dengan antarmuka Gradio lokal.

    6.210+13Perubahan bintang dalam 7 hari terakhir
  • whisper-diarization@MahmoudAshraf97

    Pengenalan Ucapan Otomatis (ASR) dengan Speaker Diarization berbasis OpenAI Whisper

    5.634+1Perubahan bintang dalam 7 hari terakhir
  • wenet@wenet-e2e

    Toolkit Pengenalan Ucapan End-to-End yang siap pakai dan mengutamakan produksi

    5.229+1Perubahan bintang dalam 7 hari terakhir
  • porcupine@Picovoice

    Deteksi kata bangun (wake word) pada perangkat yang didukung oleh deep learning.

    4.928+3Perubahan bintang dalam 7 hari terakhir
  • ml-road@yanshengjia

    Sumber daya, praktik, dan penelitian Machine Learning serta Agentic AI.

    4.927+5Perubahan bintang dalam 7 hari terakhir
  • stt@jianchang512

    Alat pengenalan suara ke teks, alat konversi audio/video ke subtitle yang berjalan secara lokal (offline), mendukung format output json, srt, dan teks biasa.

    4.780+9Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik