Overview
产品概述
Capabilities
核心能力
多模态内容审核与风险检测
覆盖图片、文本、音视频、文档等多模态内容,检测内容合规、敏感数据、提示词攻击、恶意文件、恶意URL、模型幻觉、Prompt爬虫等风险,并支持对生成内容进行数字水印嵌入。
灵活接入与自定义防护配置
支持API、AI网关、WAF、百炼模型、百炼智能体、Dify智能体、OpenClaw插件等接入方式;可在防护配置中自定义检测项、风险阈值和过滤词。
AI生成合成内容鉴别
提供图片、文本、音频、视频是否由AI生成合成的检测服务,帮助平台方鉴别并标识AI生成合成内容。
基于通义定制的内容审核大模型
推出基于通义定制的内容审核大模型服务,支持图片、文本、视频、图文混合模态审核,能更好地理解前后文、隐喻及低像素等疑难场景违规内容。
Use Cases
适用场景
-
01
大模型与AI Agent安全防护
为大模型、AI Agent提供输入和输出的一站式防护服务,覆盖内容合规、敏感数据、提示词攻击、模型幻觉等风险场景,构建安全可控的AI应用体系。
-
02
UGC内容安全审核
面向直播、视频、社交、游戏、教育、娱乐等场景,对视频、图片、语音、文本、文档内容进行全维度风险审核,并提供OSS违规扫描和人工审核,降低内容违规风险。
-
03
AI生成内容合规标识
依据《人工智能生成合成内容标识办法》等规定,为图片、文本、语音、视频提供AI生成合成内容检测和标识服务,帮助平台方履行AI生成内容标识义务。
Integrations
集成能力
阿里云百炼
支持百炼模型、百炼智能体一键开启AI安全护栏。
Dify
支持通过Dify平台接入AI安全护栏。
OpenClaw
支持通过OpenClaw插件接入,安全护栏已发布OpenClaw运行时防护插件。
对象存储 OSS
支持对OSS中的图片、视频、音频、文档文件进行自动扫描,识别风险内容并通知用户。