Overview
产品概述
Capabilities
核心能力
自然文本转语音
使用预生成的可自定义多语言语音 AI 模型将文本转换为自然语音,可用于构建能自然说话的机器人。
自定义声音与品牌风格
支持使用定制的、真实的声音和说话风格来区分品牌,并可通过神经网络定制声音生成自然声音。
虚拟形象生成
使用预构建或自定义的带有自然声音的虚拟形象使品牌生动起来。
灵活部署
支持在数据驻留位置的任何位置运行 AI 模型,可使用容器在云中或边缘部署应用,也支持嵌入式语音场景。
Use Cases
适用场景
-
01
构建支持语音的智能体
使用基础模型以及自定义音频传入和音频输出模型为智能体提供语音支持,构建支持语音的 AI 应用和智能体。
-
02
将文本转换为语音
将文本转换为自然语音,构建能自然说话的机器人。
-
03
生成自定义品牌语音
使用定制的、真实的声音和说话风格来区分品牌,并通过神经网络定制声音生成自然的声音。
-
04
启用多语言通信
在受支持的语言中翻译音频或视频数据,语言列表在不断扩大,支持音频字幕走向全球。
Integrations
集成能力
Microsoft Foundry
在一个平台上获取开发生成式 AI 应用程序和自定义智能体所需的一切内容。
Azure OpenAI
整合多模态,并使用组合多种类型的数据(如文本、图像、视频和音频)的模型增强应用。
Azure 翻译工具
使用超过 100 种语言实时或批量翻译文档和文本,以实现全球覆盖。
Azure 内容理解
加速将多模式数据转换为见解,可与 Azure 语音协同构建更全面的方案。