funasr
Repositori open source terpantau bertanda funasr, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan funasr di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda funasr.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Toolkit pengenalan suara open source untuk pelatihan, inferensi, streaming ASR, VAD, tanda baca, pipeline diarization pembicara, dan penyajian yang kompatibel dengan OpenAI/MCP.
★ 20.136+64Perubahan bintang dalam 7 hari terakhir - #2
Model SenseVoiceSmall sumber terbuka untuk ASR bahasa Mandarin, Kanton, Inggris, Jepang, dan Korea, identifikasi bahasa, pengenalan emosi, dan deteksi peristiwa audio.
★ 9.209+37Perubahan bintang dalam 7 hari terakhir - #3
Alat transkripsi video, pembuatan subtitle, dan pemotongan berbasis LLM yang didukung oleh FunASR dengan antarmuka Gradio lokal.
★ 6.210+13Perubahan bintang dalam 7 hari terakhir - #4
Alat desktop open-source gratis untuk membuat, menerjemahkan, mengisi suara, dan membakar subtitle video. Menggunakan model lokal Whisper/FunASR untuk transkripsi offline, pemrosesan batch, akselerasi GPU, dan mendukung Windows, macOS, serta Linux.
★ 4.863+48Perubahan bintang dalam 7 hari terakhir - #5
Ekstraksi cepat konten audio dan video, disusun menjadi catatan markdown terstruktur
★ 2.483+7Perubahan bintang dalam 7 hari terakhir - #6
Alternatif Wispr Flow sumber terbuka dan gratis | Alur kerja suara desktop Tiongkok generasi berikutnya yang mengintegrasikan model lokal FunASR dan LLM yang dapat dikonfigurasi
★ 2.278+5Perubahan bintang dalam 7 hari terakhir - #7
Bailing adalah bot dialog suara yang mirip dengan GPT-4o, diimplementasikan melalui ASR+LLM+TTS, mengintegrasikan model besar yang luar biasa seperti DeepSeek R1, terhubung ke openClaw, asisten suara pribadi sejati, latensi serendah 800ms, dapat berjalan di spesifikasi rendah seperti Mac, dan mendukung interupsi.
★ 1.759+2Perubahan bintang dalam 7 hari terakhir - #8
Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.
★ 1.512+10Perubahan bintang dalam 7 hari terakhir - #9
MTools adalah aplikasi desktop multifungsi yang kuat, mengintegrasikan pemrosesan audio/video, pengeditan gambar, operasi teks, dan alat encoding, dengan fitur AI yang ditingkatkan. Dirancang untuk menyederhanakan alur kerja Anda dan meningkatkan produktivitas.
★ 1.305+5Perubahan bintang dalam 7 hari terakhir - #10
VocoType adalah alat input suara lokal yang menjaga privasi, memungkinkan konversi suara ke teks secara real-time dan input otomatis ke aplikasi saat ini melalui pintasan keyboard. Mendukung MCP suara-ke-teks, optimasi teks AI, kamus penggantian kustom, transkripsi rekaman video, dan lainnya untuk input suara yang lebih efisien dan aman.
★ 928+9Perubahan bintang dalam 7 hari terakhir - #11
Terjemahan audio waktu nyata, menangkap audio sistem + mik, menjalankan ASR (Whisper/SenseVoice), menerjemahkan melalui LLM API dengan tampilan streaming. Sempurna untuk VTuber, streamer langsung, dan menonton konten asing.
★ 625+38Perubahan bintang dalam 7 hari terakhir