speech-to-text
Repositori open source terpantau bertanda speech-to-text, diurutkan berdasarkan bintang.
- #61
Ucapan-ke-teks lokal untuk macOS berbasis AI di perangkat, sepenuhnya privat, opsi cloud tersedia
★ 1.759+0Perubahan bintang dalam 7 hari terakhir - #62
Cara deklaratif untuk menjalankan model AI di React Native secara on-device, didukung oleh ExecuTorch.
★ 1.707+0Perubahan bintang dalam 7 hari terakhir - #63
Mengumpulkan semua konten Hu Chenfeng
★ 1.650+0Perubahan bintang dalam 7 hari terakhir - #64
Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.
★ 1.622+0Perubahan bintang dalam 7 hari terakhir - #65
Plugin OBS untuk pengenalan ucapan lokal dan pembuatan teks keterangan menggunakan AI
★ 1.597+0Perubahan bintang dalam 7 hari terakhir - #66
Server inferensi LLM yang kompatibel dengan OpenAI dan Anthropic berkinerja tinggi untuk Apple Silicon. Dilengkapi MLX asli, continuous batching, model multimodal, pemanggilan alat MCP, dan dukungan Claude Code.
★ 1.557+0Perubahan bintang dalam 7 hari terakhir - #67
TikTok LIVE API untuk Python: Pustaka pihak ketiga definitif untuk menerima event siaran langsung (komentar, hadiah, dll.) secara real-time dari TikTok LIVE.
★ 1.544+0Perubahan bintang dalam 7 hari terakhir - #68
Bicaralah dengan Mac Anda, kueri dokumen Anda, tidak perlu cloud. AI suara di perangkat + RAG
★ 1.542+0Perubahan bintang dalam 7 hari terakhir - #69
Node kustom yang memperluas kemampuan Comfyui
★ 1.525+0Perubahan bintang dalam 7 hari terakhir - #70
🎙️ Aplikasi Dikte AI - Sumber Terbuka dan Utamakan Lokal ⚡ Ketik 3x lebih cepat, tanpa perlu keyboard. 🆓 Didukung oleh model sumber terbuka, bekerja secara offline, cepat dan akurat.
★ 1.520+0Perubahan bintang dalam 7 hari terakhir - #71
Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.
★ 1.512+0Perubahan bintang dalam 7 hari terakhir - #72
Setiap rapat, setiap ide, setiap catatan suara, dapat dicari oleh AI Anda. Lapisan memori percakapan open-source yang mengutamakan privasi.
★ 1.462+0Perubahan bintang dalam 7 hari terakhir - #73
Terjemahan Tersinkronisasi untuk Video. Sulih suara video
★ 1.413+0Perubahan bintang dalam 7 hari terakhir - #74
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #75
Fine-tune LLM di Mac Anda dengan Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding, dan fine-tuning OCR — secara native di MLX. API yang kompatibel dengan Unsloth.
★ 1.398+0Perubahan bintang dalam 7 hari terakhir - #76
Aplikasi whisper multi-backend. Sangat cepat. Dioptimalkan untuk Mac-arm. Mudah dipasang. Masukkan file lokal atau URL dan layanan ini akan mentranskripsikannya menggunakan Whisper AI. Sepenuhnya privat dan gratis
★ 1.394+0Perubahan bintang dalam 7 hari terakhir - #77
Klien baris perintah Whisper yang kompatibel dengan klien asli OpenAI berbasis CTranslate2.
★ 1.346+0Perubahan bintang dalam 7 hari terakhir - #78★ 1.338+0Perubahan bintang dalam 7 hari terakhir
- #79
Plugin AI Neovim Gp.nvim (GPT prompt): Sesi ChatGPT & operasi teks/kode yang dapat diinstruksikan & Ucapan ke teks [OpenAI, Ollama, Anthropic, ..]
★ 1.320+0Perubahan bintang dalam 7 hari terakhir - #80
Mesin inferensi luring untuk seni, percakapan suara waktu nyata, chatbot bertenaga LLM, dan alur kerja otomatis
★ 1.314+0Perubahan bintang dalam 7 hari terakhir - #81
StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.
★ 1.288+0Perubahan bintang dalam 7 hari terakhir - #82★ 1.212+0Perubahan bintang dalam 7 hari terakhir
- #83
Speech-to-text bawaan untuk Linux - Dikte seluruh sistem yang cepat, akurat, privat, dan dapat dimodifikasi
★ 1.189+0Perubahan bintang dalam 7 hari terakhir - #84
Studio AI lokal tanpa sensor untuk Windows, Linux, dan macOS. GUI tanpa pengaturan untuk Pembuatan Gambar, LLM GGUF, Text-to-Speech & Speech-to-Text
★ 1.118+13Perubahan bintang dalam 7 hari terakhir - #85
AI Vtuber untuk streaming di Youtube/Twitch
★ 1.116+3Perubahan bintang dalam 7 hari terakhir - #86
Muesli - transkripsi rapat lokal berbasis agen + dikte untuk macOS (alternatif Granola + WisprFlow)
★ 1.105+35Perubahan bintang dalam 7 hari terakhir - #87
Aplikasi iOS sumber terbuka yang membuat transkripsi suara berkualitas lebih mudah diakses di perangkat seluler.
★ 1.102+6Perubahan bintang dalam 7 hari terakhir - #88
💬📝 Aplikasi dikte kecil menggunakan model pengenalan suara Whisper dari OpenAI.
★ 1.100+0Perubahan bintang dalam 7 hari terakhir - #89
Speech-to-Text lintas platform yang sepenuhnya lokal, privat, dengan pemrosesan pasca LLM
★ 1.056+9Perubahan bintang dalam 7 hari terakhir - #90
SDK voice-AI open-source. Alternatif Vapi/Retell bagi pembuat yang ingin memiliki stack sendiri. Berikan agen AI Anda nomor telepon dalam 4 baris — Python dan TypeScript, lisensi MIT, Twilio, Telnyx, dan Plivo.
★ 1.051+7Perubahan bintang dalam 7 hari terakhir