プロダクトの位置づけ
OttBot Vision は、Max Smart Digital の公式サイトでは、OttBot エコシステムにおける「メディアインテリジェンス層」と位置づけられています。動画を構造化検索が可能な知識へ変換し、音声は自動でテキスト化、画面上の文字は OCR で抽出して、結果にインデックスを構築します。これによりユーザーは、動画ライブラリに自然言語で質問できるようになり、手動でタイムラインをドラッグして区間ごとに探す必要がなくなります。
コア機能
- 音声文字起こし:アップロードまたは接続した動画内の音声を認識します。
- 画面文字認識:字幕、スライド、インターフェースのテキストなど、画面上に表示される文字を抽出します。
- 動画インデックス:検索可能なクリップライブラリを構築します。
- 自然言語検索:公式サイトでは「研修動画では返金についてどのように説明されているか?」を例に、モデルがタイムスタンプ付きの回答を返すことを示しています。
プロダクトマトリクスと位置づけ
公式サイトでは、Vision は OttBot シリーズのモジュールの1つとして、Build(プロセス自動化)、Connect(対話ランタイム)、Data(CRM 層)と並び、Voice、Insights、Create は「近日公開」とされています。一連のモジュールはマーケティングおよび顧客コミュニケーションのシーンを対象としており、組み合わせて利用できます。チームはまず Vision を単独で有効化し、その後段階的に他のモジュールを導入することも可能です。公開されている技術仕様と価格情報は限られているため、詳細は公式サイトをご確認ください。











コメント
コメントはまだありません
最初のコメントを書きましょう