メインコンテンツへスキップ
buildradar
Sign in
トピック · transcription

transcription

transcription がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
53
総スター数
175,951
平均スター数
3,320
シェア
0.01%

transcription と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、transcription がタグ付けされたリポジトリ。

  • claude-real-video@HUANGCHIHHUNGLeo

    URL またはローカルファイルから、Claude(または任意の LLM)に実際に動画を視聴させる。シーン認識、重複排除されたフレーム + トランスクリプト。ローカルで実行、MIT ライセンス。

    2,109
  • rescript@wassgha

    🎬 ブラウザ上で動作する、オープンソースのトランスクリプトベースの動画・音声エディタ

    865
  • meetily@Zackriya-Solutions

    プライバシー優先のAI会議アシスタント。Rustベースで、Parakeet/Whisperのライブ文字起こし、話者ダイアライゼーション、Ollama要約を4倍高速化。100%ローカル処理。クラウド不要。Meetily (Meetly Ai - https://meetily.ai) はmacOSおよびWindows向けのNo.1セルフホスト型オープンソースAI会議ノートテイカー。議事録の書き方を知る

    30,252+195直近 7 日のスター増減
  • FunASR@modelscope

    トレーニング、推論、ストリーミングASR、VAD、句読点、話者ダイアライゼーションパイプライン、およびOpenAI互換/MCPサービングのためのオープンソース音声認識ツールキット

    20,136+64直近 7 日のスター増減
  • VoiceStudio@debpalash

    VoiceStudioは、完全にローカルで動作するオープンソースのElevenLabs代替ツールです。646言語で音声クローニング、音声デザイン、ビデオダビング、ディクテーション、文字起こし、オーディオブック作成に対応しています。

    14,835+2,880直近 7 日のスター増減
  • omi@BasedHardware

    画面を認識し、会話を聴き取り、次に何をすべきかを指示するAI

    13,377+46直近 7 日のスター増減
  • voice-pro@abus-aikorea

    クリエイターと開発者のためのGradio WebUI。主要なTTS (Edge-TTS, kokoro) およびゼロショット音声クローニング (E2 & F5-TTS, CosyVoice) を特徴とし、Whisperオーディオ処理、YouTubeダウンロード、Demucsによるボーカル分離、多言語翻訳に対応。

    12,730+54直近 7 日のスター増減
  • SenseVoice@QwenAudio

    Mandarin、Cantonese、English、Japanese、Korean向けのオープンソースのSenseVoiceSmallモデル。ASR、言語ID、感情認識、音声イベント検出に対応。

    9,209+37直近 7 日のスター増減
  • FunClip@modelscope

    FunASRを搭載した動画文字起こし、字幕生成、LLM支援型クリッピングツール(ローカルGradio UI付き)

    6,210+13直近 7 日のスター増減
  • basic-pitch@spotify

    ピッチベンド検出機能を備えた軽量ながら強力なオーディオ-to-MIDIコンバーター

    5,522+21直近 7 日のスター増減
  • auto-subs@tmoroney

    DaVinci Resolve、Premiere、After Effectsに直接接続するオンデバイス字幕生成機能。

    4,122+20直近 7 日のスター増減
  • speaches@speaches-ai
    3,638+8直近 7 日のスター増減
  • whishper@pluja

    Web UIを使って、あらゆる音声を100%ローカルでテキスト化、翻訳、字幕編集ができるツール。whisperモデルを採用!

    3,068+2直近 7 日のスター増減
  • Scriberr@rishikanthc

    セルフホスト型の AI 音声文字起こし

    3,016+14直近 7 日のスター増減
  • Hex@kitlangton

    VOICE → WORDS

    2,893+2直近 7 日のスター増減
  • vexa@Vexa-ai

    Google Meet、Microsoft Teams、Zoom向けのオープンソースの会議文字起こしAPI。ボットの自動参加、リアルタイムWebSocket文字起こし、AIエージェント向けMCPサーバーを搭載。セルフホストまたはSaaSを利用可能。

    2,741+15直近 7 日のスター増減
  • awesome-whisper@sindresorhus

    🔊 OpenAI が開発したオープンソースの AI 音声認識システム Whisper に関する素晴らしいリソースのまとめ

    2,375+1直近 7 日のスター増減
  • kalosm@floneum

    Rustによる、即座に制御可能なローカル事前学習済みAIモデル

    2,226+3直近 7 日のスター増減
  • noScribe@kaixxx

    自動音声文字起こしのための最先端 AI 技術。OpenAI の Whisper と pyannote(話者識別)向けの優れた GUI。

    2,145+8直近 7 日のスター増減
  • claude-real-video@HUANGCHIHHUNGLeo

    URL またはローカルファイルから、Claude(または任意の LLM)に実際に動画を視聴させる。シーン認識、重複排除されたフレーム + トランスクリプト。ローカルで実行、MIT ライセンス。

    2,109+20直近 7 日のスター増減
  • diart@juanmc2005

    AIを活用したリアルタイム音声アプリケーションを構築するためのPythonパッケージ

    2,024+1直近 7 日のスター増減
  • audapolis@bugbakery

    自動文字起こし機能付き音声エディタ

    1,892+2直近 7 日のスター増減
  • typewhisper-mac@TypeWhisper

    macOS 向けローカル音声文字変換、オンデバイス AI、完全プライベート、クラウド連携(オプション)

    1,759+12直近 7 日のスター増減
  • AIを使用したローカル音声認識および字幕生成のためのOBSプラグイン

    1,597+8直近 7 日のスター増減
  • amical@amicalhq

    🎙️ AIディクテーションアプリ - オープンソース&ローカルファースト ⚡ キーボードなしで3倍速く入力。🆓 オープンソースモデル搭載、オフライン動作、高速かつ高精度。

    1,520+8直近 7 日のスター増減
  • pianotrans@azuwis

    ペダル付き ByteDance Piano Transcription 用のシンプルな GUI

    1,514+3直近 7 日のスター増減
  • Fun-ASR@QwenAudio

    中国語、方言、アクセント、多言語音声に対応した、オープンソースの LLM ベース ASR モデルファミリ。FunASR、vLLM、ストリーミング、llama.cpp ランタイムをサポート。

    1,512+10直近 7 日のスター増減
  • minutes@silverstein

    すべてのミーティング、すべてのアイデア、すべてのボイスメモを AI で検索可能にする、オープンソースかつプライバシーファーストの会話メモリレイヤー

    1,462+6直近 7 日のスター増減
  • マルチバックエンド対応のWhisperアプリ。超高速、Mac-arm最適化済み、簡単インストール。ローカルファイルやURLを入力すると、Whisper AIを使用して文字起こしを実行。完全なプライバシー保護と無料を実現

    1,394+0直近 7 日のスター増減
  • CrisperWhisper@nyrahealth

    制御可能な文字起こし。単語単位のタイムスタンプ付きで、逐語的(フィラー、ポーズ、言い淀み、発声を含む)または意図通り(話し手の意図を反映し、読みやすさを最適化)の出力が可能

    1,371+13直近 7 日のスター増減
  • book@hardhackerlabs

    「ハードコアハッカー - 2ヶ月で12000ドルARRの実践の道」はハードコアハッカーチームによって編纂された書籍であり、Podwise製品の歩みを忠実に記録したものです。内容は、インスピレーション、構築、リリース、成長、振り返りの5つの章で構成されています。1人での読書物足りない方は、ぜひ「ハードコアハッカー」公式知識星球に参加し、専門家たちと一緒に議論しましょう!Podwiseの物語は始まったばかりであり、私たちは星球で引き続き私たちの認知を共有していきます。成功は模倣できないかもしれませんが、失敗は必ず参考にできます。今すぐ下のリンクをクリックして参加しましょう!

    1,370+0直近 7 日のスター増減
  • 動画や音声から字幕や srt ファイルを生成する GUI ツール。

    1,179+3直近 7 日のスター増減
← トピック一覧に戻る