Overview
产品概述
Capabilities
核心能力
多媒体内容理解平台
综合运用语音技术、自然语言处理、计算机视觉等 AI 能力组件,对视音频、直播等媒体内容进行解析和语义理解,支持内容打标、内容精准推送等场景,可应用于内容运营、分发推荐和生产管理。
音视频效率工具
提供字幕制作与语音转写能力。字幕制作可自动识别中文、英文和中英混合音视频内容,生成字幕文字与时间轴,并一键翻译为中英双语字幕;语音转写可将语音和录音识别为文本,1小时音频最快5分钟出稿,支持区分说话人、中英文混合识别。
语音/NLP/CV能力组件
提供丰富的 AI 原子能力:语音技术含一句话识别、录音文件转写、实时语音识别;自然语言处理含对话平台、文本纠错、文本生成、短文本相似度;计算机视觉含通用文字识别、自动抠图、人脸识别、视频标签等。可应用于语音质检、语音反垃圾、客服对话机器人、内容安全审核和电商平台运营等场景。
Use Cases
适用场景
-
01
客服语音质检与语音反垃圾
将客服通话录音转为文字并进行违规内容判断,实现全量自动化智能质检;同时支持海量语音转文本,过滤敏感词和拦截词等违规内容,保证音频内容合法合规。
-
02
视频字幕制作与英文视频学习
为影视文件、短视频、课程视频自动生成带时间码的字幕,支持一键生成中英双语字幕,帮助用户轻松观看和学习英文视频。
-
03
会议纪要整理与音频内容查询
自动识别会议音频并区分说话人,帮助整理会议纪要;用户可通过文本查询快速定位手机录音等音频中的关键信息。
-
04
内容打标与精准推送
通过高精准机器识别模型分析多媒体内容并标识特征标签,为内容精细化运营提供抓手;按标签精准匹配并触达目标人群,提升重点宣发内容的推荐分发效果。