stt
Repositori open source terpantau bertanda stt, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan stt di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda stt.
- #1
Pengukur pengeluaran dan gerbang anggaran untuk agen suara AI. Mengukur STT + TTS + LLM + telepon per panggilan secara langsung (Pipecat, LiveKit — Python & TypeScript). Menghentikan paksa giliran berikutnya sebelum melebihi batas Anda. Lokal, tanpa akun, tanpa telemetri. Dibangun oleh Floe — kontrol biaya untuk Voice AI.
★ 434
- #1
Otak kedua AI Anda. Dapat di-self-host. Dapatkan jawaban dari web atau dokumen Anda. Bangun agen kustom, jadwalkan otomatisasi, lakukan riset mendalam. Ubah LLM online atau lokal apa pun menjadi AI otonom pribadi Anda (gpt, claude, gemini, llama, qwen, mistral). Mulai secara gratis.
★ 37.010+223Perubahan bintang dalam 7 hari terakhir - #2
API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.
★ 15.101+17Perubahan bintang dalam 7 hari terakhir - #3
Speech-to-text, pengenalan maksud, dan text-to-speech dengan latensi sangat rendah untuk membangun agen dan antarmuka suara
★ 10.997+33Perubahan bintang dalam 7 hari terakhir - #4
Open Vision Agents oleh Stream. Bangun agen suara dan visi dengan cepat menggunakan model atau penyedia video apa pun. Menggunakan jaringan edge Stream untuk latensi ultra-rendah.
★ 8.113+9Perubahan bintang dalam 7 hari terakhir - #5
Alat pengenalan suara ke teks, alat konversi audio/video ke subtitle yang berjalan secara lokal (offline), mendukung format output json, srt, dan teks biasa.
★ 4.780+9Perubahan bintang dalam 7 hari terakhir - #6
Transkripsikan audio apa pun menjadi teks, terjemahkan, dan edit subtitle 100% secara lokal dengan antarmuka web. Didukung oleh model whisper!
★ 3.068+2Perubahan bintang dalam 7 hari terakhir - #7
🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.
★ 2.606+1Perubahan bintang dalam 7 hari terakhir - #8
🎙 Pengenalan ucapan menggunakan kerangka kerja deep learning tensorflow, jaringan saraf sequence-to-sequence
★ 2.173+0Perubahan bintang dalam 7 hari terakhir - #9
Mainan AI Suara Real-time dengan 100+ Model di Arduino ESP32 dengan Secure Websockets dan Edge Functions untuk perangkat dan pendamping AI
★ 1.938+5Perubahan bintang dalam 7 hari terakhir - #10
Kenalan dengan Ava, WhatsApp Agent
★ 1.675+2Perubahan bintang dalam 7 hari terakhir - #11
Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.
★ 1.622+8Perubahan bintang dalam 7 hari terakhir - #12
Aplikasi asisten Dicio untuk Android
★ 1.463+3Perubahan bintang dalam 7 hari terakhir - #13
🍦 Speech-AI-Forge adalah proyek yang dikembangkan di sekitar model generasi TTS, mengimplementasikan API Server dan WebUI berbasis Gradio.
★ 1.418+0Perubahan bintang dalam 7 hari terakhir - #14
Terjemahan Tersinkronisasi untuk Video. Sulih suara video
★ 1.413+2Perubahan bintang dalam 7 hari terakhir - #15
💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya
★ 1.399+0Perubahan bintang dalam 7 hari terakhir - #16
Platform manajemen tingkat perusahaan Java untuk Xiaozhi ESP32, menyediakan solusi ujung depan-belakang dan sisi server terpadu untuk pemantauan perangkat, penyesuaian suara, peralihan peran, dan manajemen catatan dialog
★ 1.337+1Perubahan bintang dalam 7 hari terakhir - #17
Plugin AI Neovim Gp.nvim (GPT prompt): Sesi ChatGPT & operasi teks/kode yang dapat diinstruksikan & Ucapan ke teks [OpenAI, Ollama, Anthropic, ..]
★ 1.320+0Perubahan bintang dalam 7 hari terakhir - #18
Terjemahan ucapan waktu nyata — macOS & Windows, TTS gratis, tanpa server, hanya menggunakan kunci API Anda
★ 1.278+2Perubahan bintang dalam 7 hari terakhir - #19
Terjemahan suara dua arah secara real-time untuk rapat bilingual — mendeteksi bahasa yang diucapkan secara otomatis dan menerjemahkan ke dua arah, berbasis cloud atau sepenuhnya luring di perangkat. Desktop (Windows · macOS · Linux) + ekstensi browser (Chrome · Edge) untuk Zoom, Meet, Teams & aplikasi apa pun.
★ 1.186+40Perubahan bintang dalam 7 hari terakhir - #20
NobodyWho adalah mesin inferensi yang memungkinkan Anda menjalankan LLM secara lokal dan efisien di perangkat apa pun.
★ 1.094+13Perubahan bintang dalam 7 hari terakhir - #21
🎙️ Asisten produktivitas suara cerdas yang mengubah ucapan menjadi teks bersih, tindakan yang berguna, dan pengetahuan terstruktur. Membantu pengguna menangkap ide, berkomunikasi secara alami, mengotomatiskan tugas repetitif, dan tetap produktif di berbagai aplikasi dan alur kerja.
★ 806+3Perubahan bintang dalam 7 hari terakhir - #22
🎤 Lobe TTS - Pustaka TTS/STT yang berkualitas tinggi & andal untuk Server dan Browser
★ 805+1Perubahan bintang dalam 7 hari terakhir - #23
Speech to Text to Speech. Lagu sedang diputar. Mengirim teks sebagai pesan OSC ke VRChat untuk ditampilkan di avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)
★ 803+3Perubahan bintang dalam 7 hari terakhir - #24
SDK Swift modular untuk pemrosesan audio dengan MLX di Apple Silicon
★ 772+6Perubahan bintang dalam 7 hari terakhir - #25
Menjalankan model speech-to-text (whisper.cpp) di Unity3d pada mesin lokal Anda.
★ 751+1Perubahan bintang dalam 7 hari terakhir - #26
MLX Omni Server adalah server inferensi lokal yang didukung oleh framework MLX Apple, yang dirancang khusus untuk chip Apple Silicon (seri M). Ini mengimplementasikan endpoint API yang kompatibel dengan OpenAI, memungkinkan integrasi yang mulus dengan klien SDK OpenAI yang ada sekaligus memanfaatkan kekuatan inferensi ML lokal.
★ 741+1Perubahan bintang dalam 7 hari terakhir - #27★ 671+0Perubahan bintang dalam 7 hari terakhir
- #28
:speech_balloon: /so.nus/ STT (speech to text) untuk Node dengan deteksi kata kunci offline.
★ 638+0Perubahan bintang dalam 7 hari terakhir - #29
Komponen React untuk membuat koreksi transkripsi audio dan video otomatis menjadi lebih mudah dan cepat. Oleh BBC News Labs. - Sedang dikerjakan
★ 620-1Perubahan bintang dalam 7 hari terakhir - #30
Pusat runtime C++ ggml untuk model ASR dan TTS multibahasa: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2, dll., ditambah penyelarasan paksa universal, dan lainnya
★ 609+21Perubahan bintang dalam 7 hari terakhir