阿里云盾 页面截图
产品页面 点击查看大图

阿里云盾

阿里云盾(AI安全护栏)是针对AI应用、UGC内容的审核与防护产品,覆盖图文音视文档多模态,提供内容合规、提示词攻击、敏感数据、模型幻觉、AI鉴别等检测功能,精准识别违规、攻击、有害等风险内容,保障AI应用与用户内容的合规可信。

文本审核多语言检测违规识别
价格
产品售卖通用资源包,可用于内容审核相关服务,具体价格需询价。
01

Overview

产品概述

AI安全护栏是阿里云面向AI应用、UGC内容推出的审核与防护产品,覆盖图片、文本、音视频、文档等多模态内容,提供内容审核、提示词攻击、敏感数据、模型幻觉、AI鉴别等检测功能。产品包含安全护栏与内容安全两大能力:安全护栏面向大模型、AI Agent提供输入和输出的一站式防护,支持自定义检测项、风险阈值和过滤词;内容安全面向UGC场景提供图片、视频、文本、语音、文档等多模态审核,并支持AI生成合成内容鉴别、OSS违规扫描和URL风险检测。
02

Capabilities

核心能力

01

多模态内容审核与风险检测

覆盖图片、文本、音视频、文档等多模态内容,检测内容合规、敏感数据、提示词攻击、恶意文件、恶意URL、模型幻觉、Prompt爬虫等风险,并支持对生成内容进行数字水印嵌入。

02

灵活接入与自定义防护配置

支持API、AI网关、WAF、百炼模型、百炼智能体、Dify智能体、OpenClaw插件等接入方式;可在防护配置中自定义检测项、风险阈值和过滤词。

03

AI生成合成内容鉴别

提供图片、文本、音频、视频是否由AI生成合成的检测服务,帮助平台方鉴别并标识AI生成合成内容。

04

基于通义定制的内容审核大模型

推出基于通义定制的内容审核大模型服务,支持图片、文本、视频、图文混合模态审核,能更好地理解前后文、隐喻及低像素等疑难场景违规内容。

03

Use Cases

适用场景

  1. 01

    大模型与AI Agent安全防护

    为大模型、AI Agent提供输入和输出的一站式防护服务,覆盖内容合规、敏感数据、提示词攻击、模型幻觉等风险场景,构建安全可控的AI应用体系。

  2. 02

    UGC内容安全审核

    面向直播、视频、社交、游戏、教育、娱乐等场景,对视频、图片、语音、文本、文档内容进行全维度风险审核,并提供OSS违规扫描和人工审核,降低内容违规风险。

  3. 03

    AI生成内容合规标识

    依据《人工智能生成合成内容标识办法》等规定,为图片、文本、语音、视频提供AI生成合成内容检测和标识服务,帮助平台方履行AI生成内容标识义务。

04

Integrations

集成能力

01

阿里云百炼

支持百炼模型、百炼智能体一键开启AI安全护栏。

02

Dify

支持通过Dify平台接入AI安全护栏。

03

OpenClaw

支持通过OpenClaw插件接入,安全护栏已发布OpenClaw运行时防护插件。

04

对象存储 OSS

支持对OSS中的图片、视频、音频、文档文件进行自动扫描,识别风险内容并通知用户。