---
title: "文本转语音"
method: POST
path: "/paas/v4/audio/speech"
tags: ["模型 API"]
---

# 文本转语音

`POST /paas/v4/audio/speech`

使用 `GLM-TTS` 将文本转换为自然语音，支持多种声音、情感控制和语调调整。点击 **Try it** 按钮可快速试用。

## Request body

- AudioSpeechRequest
  - `model` 'glm-tts', required — 要使用的`TTS`模型
  - `input` string, required — 要转换为语音的文本
  - `voice` 'tongtong' | 'chuichui' | 'xiaochen' | 'jam' | 'kazi' | 'douji' | 'luodo', required — 生成音频时使用的音色，支持系统音色以及复刻音色两种类型，其中系统音色如下： `tongtong`: 彤彤，默认音色 `chuichui`: 锤锤 `xiaochen`: 小陈 `jam`: 动动动物圈`jam`音色 `kazi`: 动动动物圈`kazi`音色 `douji`: 动动动物圈`douji`音色 `luodo`: 动动动物圈`luodo`音色
  - `watermark_enabled` boolean — 控制`AI`生成音频时是否添加水印。去水印操作路径：右上角个人中心-安全管理-去水印管理-打开开关。 - `true`: 默认启用`AI`生成的显式水印及隐式数字水印，符合政策要求。 - `false`: 关闭所有水印，仅对已完成去水印动作的用户生效。
  - `stream` boolean — 是否启用流式输出。 - `true`: 启用流式输出，模型将通过标准`Event Stream`逐块返回生成的音频内容。 - `false`: 关闭流式输出，模型在生成所有内容后一次性返回所有内容。默认值为`false`。
  - `speed` number — 语速，默认1.0，取值范围[0.5, 2]
  - `volume` number — 音量，默认1.0，取值范围(0, 10]
  - `encode_format` 'base64' | 'hex' — 仅流式返回时，决定返回的编码格式。默认返回对应音频文件格式的`base64`字符串。
  - `response_format` 'wav' | 'pcm' — 音频输出格式，默认返回`pcm`格式的文件。流式生成音频时，仅支持返回`pcm`格式的文件

## Response `200`

业务处理成功 
 - 采样率建议设置为24000

## Other responses

- `default` — 请求失败。

---

[API](https://skmtc.net/bigmodel/apis/zhipu-ai-api.md) · [All operations](https://skmtc.net/bigmodel/apis/zhipu-ai-api/llms.txt) · [OpenAPI document](https://skmtc-service-staging.skmtc.workers.dev/v1/apis/bigmodel/zhipu-ai-api/revisions/37de2d7b73de/schema)
