VidTranscriber

VidTranscriber

VidTranscriberは、YouTubeリンク、ローカルの動画・音声ファイル、Zoomの録画を検索可能な文字起こしに変換できます。最大6名の話者を自動識別し、AIチャプター生成、TXT・SRT・VTT・Markdown・DOCX形式での書き出しに対応しています。

freemium
動画の文字起こしYouTubeの文字起こしZoom会議の議事録話者識別字幕生成議事録ポッドキャスト多言語
登録日
更新日
3.1 (0 レビュー数)

ログイン後に評価できます

製品概要

VidTranscriber は、動画や音声を編集可能な文字起こしテキストに変換するWebツールです。YouTubeのリンクを貼り付けたり、MP4、MOV、MP3、WAV、M4A、WEBMなどのローカルファイルをアップロードしたり、Zoomの録画を指定したりできます。生成された文字起こしはブラウザ内で検索・編集が可能で、最大6人までの話者に自動で話者ラベルが付与されます。

AIと多言語対応

プレーンテキストの文字起こしに加えて、VidTranscriber はAIによるチャプター分割と要約を自動生成し、会話の中から重要な論点を抽出します。公式サイトでは100以上の言語に対応と記載されており、講義、国際会議、ポッドキャスト番組などのシーンに利用できます。その後の翻訳やノート作成のプロセスにもつなげやすいのが特徴です。

  • 入力ソース:YouTubeリンク、ローカルファイルのアップロード、Zoom録画。
  • エクスポート形式:TXT、SRT、VTT、Markdown、DOCX。
  • データ保持ポリシー:アップロードされたファイルは24時間後に自動削除されます。

プランと料金

登録不要のゲストモードでは、60分間のトライアルを1回利用できます。無料版には、毎月300分の利用枠と30日間の文字起こし保存が含まれます。Pro版は月額9ドルで、毎月1500分、無制限の保存、さらに高精度な文字起こしモードが利用できます。

よくある質問

VidTranscriberとは?

VidTranscriberは、YouTubeリンク、ローカルの動画・音声ファイル、Zoomの録画を検索可能な文字起こしに変換できます。最大6名の話者を自動識別し、AIチャプター生成、TXT・SRT・VTT・Markdown・DOCX形式での書き出しに対応しています。

VidTranscriberは無料ですか、有料ですか?

VidTranscriberはフリーミアム型で、無料プランに加えて有料アップグレードも用意されています。

もっと見る

類似ツール

SonaVoice

SonaVoice

SonaVoiceはWindows向け音声入力ツールです。任意のアプリでカーソルを置き、右Ctrlを押しながら話すと、句読点付きの整ったテキストを挿入できます。また、カスタム辞書を使って人名や用語の認識をサポートします。

uho Dictation

uho Dictation は macOS 専用の音声入力ツールです。Apple Silicon 上のローカル Whisper モデルを利用し、音声を直接テキストに変換して現在のアプリケーションに書き込みます。Fnキーを1回押すと録音を開始し、もう1回押すと終了します。認識結果は自動的にカーソル位置に挿入されます。音声はアップロードされず、アカウント登録も不要で、サブスクリプションではなく買い切りライセンスです。

Synopsule

Synopsule

Synopsule は Mac と iPhone 向けの会議文字起こしアプリで、1.99ドルの買い切りです。音声と Whisper による文字起こしはすべてローカルで行われ、話者識別、タイムラインでのメモ、さまざまな形式での書き出しに対応しています。

WhisperScribe Pro

WhisperScribe Pro

WhisperScribe Proは、OpenAIのWhisperモデルを利用してMac上でローカルに音声文字起こしを行うアプリです。データがデバイス外に出ることはなく、クリエイター、ジャーナリスト、プライバシー重視のユーザー向けに設計されています。話者識別、バッチ処理、5つの書き出し形式に対応し、3日間の無料トライアルを提供します。ユーザーデータは常にデバイス上に保持され、買い切りまたはサブスクリプションで利用できます。

オープンソース代替

Steno:オープンソースのAIメモツール、高い機密性を重視

Stenoは、高い機密性を備えた会話向けに設計されたオープンソースのAIメモツールです。ローカル環境またはプライベートサーバーにデプロイでき、会議の録音から構造化されたメモを自動生成するため、データが管理された環境外に出ることはありません。政府、防衛、法務、経営幹部チームに適しています。主要言語はTypeScriptで、MITライセンスを採用しています。

vexa:オープンソースの会議文字起こしAPI

vexaはオープンソースの会議文字起こしAPIで、Google Meet、Microsoft Teams、Zoomに対応しています。会議に自動参加し、WebSocketを介してリアルタイムの文字起こしを提供します。また、AIエージェント統合用のMCPサーバーを備えています。プロジェクトはセルフホスティングまたはSaaSとしてデプロイ可能で、Pythonで書かれており、GitHubで2500以上のスターを獲得しています。

typewhisper-mac:ローカルAIで音声をテキストに変換するmacOSアプリ

typewhisper-macは、オンデバイスで音声をテキストに変換するためのオープンソースのmacOSアプリです。Apple SiliconまたはIntelのローカルAI機能を利用し、リアルタイムでプライバシーを重視した文字起こしを、インターネット接続不要で実現します。中国語・英語など複数の言語に対応し、精度向上のためのオプションのクラウドモードも提供しています。Swiftで書かれ、GPL-3.0ライセンスに準拠しており、GitHubで1500以上のスターを獲得しています。

Handy

これは完全にオフラインで動作する音声テキスト化デスクトップアプリです。ショートカットキーを押して話すと、認識結果が現在のカーソル位置に直接貼り付けられます。プライバシー保護とシンプル操作が特徴です。

amical:ローカルファーストのAI音声書き起こしアプリ、オフラインで音声をテキスト変換

amicalはオープンソースのローカルファーストAI音声書き起こしアプリです。Whisperなどのオープンモデルを利用し、高速・正確・オフラインでの音声テキスト変換を実現します。説明によると、キーボードなしでタイピング速度を3倍に向上でき、多言語に対応し、ユーザーのプライバシーを優先して保護します。すべてのデータ処理はデバイス上で行われます。プロジェクトはTypeScriptで構築されており、開発者から一般ユーザーまで適しています。