voice-ai
voice-ai がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。
関連トピック
voice-ai と同じリポジトリに頻繁に登場するトピック。
最近の急上昇
直近 90 日以内に作成され、voice-ai がタグ付けされたリポジトリ。
- #1
エージェントの対話、作業、存在感を維持するリアルタイム音声ランタイム。AI エージェント向けのリアルタイム音声ランタイム
★ 2,356 - #2
AI音声エージェント用の利用メーターと予算制限ゲート。通話ごとのSTT + TTS + LLM + テレフォニーを標準で計測(Pipecat、LiveKit — Python & TypeScript)。予算上限を超える前に次回のターンをハードストップ。ローカル動作、アカウント不要、テレメトリーなし。FloeによるVoice AI向けコスト管理。
★ 434
- #1★ 52,177+609直近 7 日のスター増減
- #2★ 20,664+132直近 7 日のスター増減
- #3
VoiceStudioは、完全にローカルで動作するオープンソースのElevenLabs代替ツールです。646言語で音声クローニング、音声デザイン、ビデオダビング、ディクテーション、文字起こし、オーディオブック作成に対応しています。
★ 14,835+3,076直近 7 日のスター増減 - #4
ローカルでAIを実行するための本番環境対応ツールキット
★ 10,281+0直近 7 日のスター増減 - #5
Mandarin、Cantonese、English、Japanese、Korean向けのオープンソースのSenseVoiceSmallモデル。ASR、言語ID、感情認識、音声イベント検出に対応。
★ 9,209+53直近 7 日のスター増減 - #6
StreamによるOpen Vision Agents。任意のモデルまたはビデオプロバイダーを使用して、音声およびビジョンエージェントを迅速に構築できます。超低遅延のためにStreamのエッジネットワークを利用しています。
★ 8,113+13直近 7 日のスター増減 - #7
Apple Silicon 上のローカル AI により、Claude Code を 100% デバイス上で実行します。MLX ネイティブの Anthropic API サーバー。Muse-Glimmer 30B(マルチモーダル対応、画像読み取り可能)、Gemma 4 31B、Qwen 3.5 122B(65 tok/s)、DeepSeek V4 Flash(100万コンテキスト)など6つのモデルを搭載。プライベート、オフライン、エアギャップ環境に対応。NDA、法務、医療ワークフロー向けに構築されています。
★ 3,255+15直近 7 日のスター増減 - #8
Voice AI SDK は、あらゆるアプリに音声駆動型の完全な AI 会話パイプラインを数分で組み込める、再利用可能な Android ライブラリです。Voice Assistant + Android Voice AI + SDK + MVVM + Kotlin
★ 2,580+2直近 7 日のスター増減 - #9
アプリのためのセルフコーディングシステム — Web用 Alan AI SDK
★ 2,427-3直近 7 日のスター増減 - #10
エージェントの対話、作業、存在感を維持するリアルタイム音声ランタイム。AI エージェント向けのリアルタイム音声ランタイム
★ 2,356+54直近 7 日のスター増減 - #11
アプリのためのセルフコーディングシステム — iOS 向け Alan AI SDK
★ 1,878-3直近 7 日のスター増減 - #12
アプリ向けセルフコーディングシステム — Flutter 用 Alan AI SDK
★ 1,756-1直近 7 日のスター増減 - #13
アプリのためのセルフコーディングシステム — Ionic 向け Alan AI SDK
★ 1,649-1直近 7 日のスター増減 - #14
旧名Better Chatbot。Navigatorは、エージェント、MCP、ワークフロー自動化のためのオープンソースAIワークスペースです。
★ 1,171+2直近 7 日のスター増減 - #15
オープンソースの音声AI SDK。スタックを自社所有したい開発者向けの Vapi/Retell 代替ソリューション。4行のコードでAIエージェントに電話番号を付与 — Python と TypeScript、MITライセンス、Twilio、Telnyx、Plivoに対応。
★ 1,050+5直近 7 日のスター増減 - #16
ストリーミングおよびオンデバイス利用向けに最適化されたWhisperモデル
★ 897+1直近 7 日のスター増減 - #17
リアルタイム音声アシスタント — WebRTC ストリーミング、faster-whisper ASR、ローカル LLM、Vui Nano (300M) TTS。OpenAI Realtime API 互換。音声クローン、発話割り込み (barge-in)、RTX 4090 で約 9 倍のリアルタイム処理。Apache 2.0 ライセンス。
★ 756+5直近 7 日のスター増減 - #18
Rapidaは、音声ストリーミング、STT、TTS、VAD、マルチチャネル統合、エージェント状態管理、オブザーバビリティを備えたリアルタイム会話型音声エージェントを構築するための、オープンソースのエンドツーエンド音声AIオーケストレーションプラットフォームです。
★ 721-1直近 7 日のスター増減 - #19★ 716+3直近 7 日のスター増減
- #20★ 671+2直近 7 日のスター増減
- #21★ 621+1直近 7 日のスター増減
- #22
アプリのためのセルフコーディングシステム — React Native 向け Alan AI SDK
★ 575+0直近 7 日のスター増減 - #23★ 563+0直近 7 日のスター増減
- #24
パーソナライズされた音声クローン機能を備えた、世界初のオープンソースのリアルタイムエンドツーエンド音声対話モデル
★ 549-1直近 7 日のスター増減