产品定位
OttBot Vision 在 Max Smart Digital 的官网被称作 OttBot 生态里的「媒体智能层」。它把视频转成可结构化搜索的知识:语音自动转写为文字,屏幕上的文字被 OCR 提取,再对结果建立索引,让使用者用自然语言在视频库中提问,而不必手动拖动时间轴逐段查找。
核心能力
- 语音转写:识别上传或接入的视频中的语音内容。
- 屏幕文字识别:抓取字幕、幻灯片、界面文案等画面上的文字。
- 视频索引:构建可检索的片段库。
- 自然语言检索:官网以「培训视频里关于退款怎么说?」为示例,展示模型返回带时间戳的答案。
产品矩阵与定位
官网将 Vision 列为 OttBot 系列的模块之一,与 Build(流程自动化)、Connect(对话运行时)、Data(CRM 层)并列,Voice、Insights、Create 则标注为即将推出。整套模块面向营销与客户沟通场景,可组合使用,团队可先启用 Vision 单点,再逐步接入其余模块。公开技术规格与价格信息有限,详情以官网为准。











评论
暂无评论
成为第一个评论的人