speech-to-text
Các kho mã nguồn mở đang theo dõi được gắn thẻ speech-to-text, sắp xếp theo số sao.
- #61
Chuyển đổi giọng nói thành văn bản cục bộ cho macOS trên thiết bị AI, hoàn toàn riêng tư, có đám mây tùy chọn
★ 1.759+0Thay đổi số sao trong 7 ngày qua - #62
Cách khai báo để chạy các mô hình AI trong React Native trên thiết bị, được hỗ trợ bởi ExecuTorch.
★ 1.707+0Thay đổi số sao trong 7 ngày qua - #63
Thu thập tất cả nội dung của Hộ Thần Phong
★ 1.650+0Thay đổi số sao trong 7 ngày qua - #64
Ứng dụng Speech Note trên Linux. Ghi chú, đọc và dịch với tính năng Chuyển giọng nói thành văn bản, Chuyển văn bản thành giọng nói và Dịch máy ngoại tuyến.
★ 1.622+0Thay đổi số sao trong 7 ngày qua - #65
Plugin OBS dành cho nhận diện giọng nói và tạo phụ đề cục bộ sử dụng AI.
★ 1.597+0Thay đổi số sao trong 7 ngày qua - #66
Máy chủ suy luận LLM hiệu năng cao tương thích với OpenAI và Anthropic dành cho Apple Silicon. Hỗ trợ MLX native, continuous batching, các mô hình đa phương thức, gọi công cụ MCP và Claude Code.
★ 1.557+0Thay đổi số sao trong 7 ngày qua - #67
TikTok LIVE API cho Python: Thư viện bên thứ ba tối ưu để nhận sự kiện phát trực tiếp (bình luận, quà tặng, v.v.) theo thời gian thực từ TikTok LIVE.
★ 1.544+0Thay đổi số sao trong 7 ngày qua - #68
Trò chuyện với Mac của bạn, truy vấn tài liệu mà không cần đám mây. AI giọng nói trên thiết bị + RAG
★ 1.542+0Thay đổi số sao trong 7 ngày qua - #69
Các node tùy chỉnh mở rộng tính năng của ComfyUI
★ 1.525+0Thay đổi số sao trong 7 ngày qua - #70
🎙️ Ứng dụng đọc chính tả AI - Mã nguồn mở và ưu tiên cục bộ ⚡ Gõ nhanh hơn 3 lần, không cần bàn phím. 🆓 Được hỗ trợ bởi các mô hình mã nguồn mở, hoạt động ngoại tuyến, nhanh chóng và chính xác.
★ 1.520+0Thay đổi số sao trong 7 ngày qua - #71
Dòng mô hình ASR dựa trên LLM mã nguồn mở cho tiếng Trung, phương ngữ, tiếng địa phương và giọng nói đa ngôn ngữ, với các thời gian chạy FunASR, vLLM, streaming và llama.cpp.
★ 1.512+0Thay đổi số sao trong 7 ngày qua - #72
Mọi cuộc họp, mọi ý kiến, mọi ghi chú giọng nói, có thể tìm kiếm bằng AI của bạn. Lớp bộ nhớ cuộc trò chuyện mã nguồn mở, ưu tiên quyền riêng tư.
★ 1.462+0Thay đổi số sao trong 7 ngày qua - #73
Dịch đồng bộ cho video. Lồng tiếng video
★ 1.413+0Thay đổi số sao trong 7 ngày qua - #74
💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác
★ 1.399+0Thay đổi số sao trong 7 ngày qua - #75
Tinh chỉnh LLM trên máy Mac của bạn với Apple Silicon. SFT, DPO, GRPO, Vision, TTS, STT, Embedding và tinh chỉnh OCR — chạy gốc trên MLX. API tương thích với Unsloth.
★ 1.398+0Thay đổi số sao trong 7 ngày qua - #76
Ứng dụng Whisper hỗ trợ đa backend. Cực kỳ nhanh. Tối ưu hóa cho Mac-arm. Dễ dàng cài đặt. Nhập tệp cục bộ hoặc URL và dịch vụ này sẽ chuyển nó thành văn bản bằng Whisper AI. Hoàn toàn riêng tư và miễn phí 🤯🤯🤯
★ 1.394+0Thay đổi số sao trong 7 ngày qua - #77
Client dòng lệnh Whisper tương thích với client gốc của OpenAI dựa trên CTranslate2.
★ 1.346+0Thay đổi số sao trong 7 ngày qua - #78
Chuyển giọng nói thành văn bản với tính năng nhấn để nói dành cho Wayland compositor
★ 1.338+0Thay đổi số sao trong 7 ngày qua - #79
Plugin Neovim Gp.nvim (GPT prompt) AI: Phiên ChatGPT & Thao tác văn bản/mã có thể hướng dẫn & Chuyển giọng nói thành văn bản [OpenAI, Ollama, Anthropic, ..]
★ 1.320+0Thay đổi số sao trong 7 ngày qua - #80
Công cụ suy luận ngoại tuyến cho nghệ thuật, trò chuyện thoại thời gian thực, chatbot hỗ trợ bởi LLM và quy trình làm việc tự động
★ 1.314+0Thay đổi số sao trong 7 ngày qua - #81
StreamSpeech là một mô hình liền mạch "tất cả trong một" dành cho nhận dạng giọng nói ngoại tuyến và đồng thời, dịch giọng nói và tổng hợp giọng nói.
★ 1.288+0Thay đổi số sao trong 7 ngày qua - #82★ 1.212+0Thay đổi số sao trong 7 ngày qua
- #83
Công cụ chuyển giọng nói thành văn bản gốc cho Linux - Nhập liệu toàn hệ thống nhanh, chính xác, riêng tư và dễ tùy chỉnh
★ 1.189+0Thay đổi số sao trong 7 ngày qua - #84
Studio AI cục bộ không kiểm duyệt dành cho Windows, Linux và macOS. Giao diện đồ họa thiết lập bằng không cho Tạo ảnh, GGUF LLM, Chuyển văn bản thành giọng nói & Chuyển giọng nói thành văn bản
★ 1.118+13Thay đổi số sao trong 7 ngày qua - #85
AI Vtuber để phát trực tuyến trên Youtube/Twitch
★ 1.116+3Thay đổi số sao trong 7 ngày qua - #86
Muesli - ghi chép cuộc họp cục bộ dành cho agent trên macOS + đọc chính tả (thay thế cho Granola + WisprFlow)
★ 1.105+35Thay đổi số sao trong 7 ngày qua - #87
Ứng dụng iOS mã nguồn mở giúp việc chuyển đổi giọng nói thành văn bản chất lượng cao trở nên dễ tiếp cận hơn trên thiết bị di động.
★ 1.102+6Thay đổi số sao trong 7 ngày qua - #88
💬📝 Một ứng dụng chính tả nhỏ sử dụng mô hình nhận dạng giọng nói Whisper của OpenAI.
★ 1.100+0Thay đổi số sao trong 7 ngày qua - #89
Công cụ chuyển đổi giọng nói thành văn bản hoàn toàn nội bộ, bảo mật và đa nền tảng với tính năng hậu xử lý bằng LLM
★ 1.056+9Thay đổi số sao trong 7 ngày qua - #90
SDK AI giọng nói mã nguồn mở. Giải pháp thay thế Vapi/Retell cho các nhà phát triển muốn làm chủ ngăn xếp công nghệ. Cung cấp số điện thoại cho AI agent của bạn chỉ với 4 dòng code — Python và TypeScript, giấy phép MIT, hỗ trợ Twilio, Telnyx và Plivo.
★ 1.051+7Thay đổi số sao trong 7 ngày qua