产品定位
Azure 文本转语音(Azure TTS,中文称 Azure 语音)是微软 Azure AI 服务中的语音合成能力,使用预生成的可自定义多语言语音 AI 模型,将文本转换为自然逼真的语音,为应用和智能体提供语音支持。它帮助开发者构建能自然说话的机器人和语音应用。
核心功能
- 自然语音合成:使用神经网络级文本转语音模型生成自然、逼真的语音,支持多种语言和声音。
- 自定义语音:使用神经网络定制声音,生成符合品牌风格的自然声音和说话风格。
- 实时音频:支持实时语音 API,将语音能力与 AI 智能体集成,实现端到端的交互式语音。
- 多语言支持:支持超过 100 种语言的语音,可用于全球范围的语音应用。
- 灵活部署:可在云中或边缘使用容器部署,支持数据驻留任意位置运行 AI 模型。
- 计费灵活:即用即付模式,按转换为音频的字符数计费。
应用场景
Azure TTS 适用于语音助手、客服机器人、有声内容、语音播报、无障碍辅助和虚拟形象等场景,帮助开发者和企业构建支持语音的生成式 AI 应用,为品牌和产品提供自然的人机交互体验。
展开
收起