---
title: "语音合成接口"
method: POST
path: "/audio/speech"
tags: ["Audio"]
---

# 语音合成接口

`POST /audio/speech`

将文本转换为语音的接口，支持多种语音模型、声音角色和音频格式。

## Request body

- object
  - `model` string, required — 语音模型
  - `input` string, required — 需要转换的文本内容
  - `voice` string — 声音角色，不同平台支持的声音角色可能不一样，更多细节请查看[文本转语音示例](https://docs.geekai.co/cn/audio/tts)。
  - `response_format` string — 音频格式，不同平台支持格式可能不一样，更多细节请查看[文本转语音示例](https://docs.geekai.co/cn/audio/tts)。
  - `stream_format` 'sse' | 'audio' — 语音输出格式，支持 sse/audio 两种格式，sse表示流式输出，audio表示输出音频文件，默认为audio
  - `speed` 0.25 | 0.5 | 1 | 2 | 4 — 语速，取值范围[0.25, 1.0, 4.0]，默认1.0，其中豆包语音模型仅支持[0.5, 1, 2]三个档位
  - `instructions` string — 使用额外指令来控制生成的音频音调，仅 `gpt-4o-mini-tts` 模型支持该参数
  - `retries` integer — 自动重试次数，默认0，表示失败不重试

## Response `200`

成功响应

## Other responses

- `400` — 参数验证错误
- `401` — 未授权
- `413` — 输入文本过长
- `500` — 标准错误响应

---

[API](https://skmtc.dev/geekai/apis/api.md) · [All operations](https://skmtc.dev/geekai/apis/api/llms.txt) · [OpenAPI document](https://skmtc-service-production.skmtc.workers.dev/v1/apis/geekai/api/revisions/2bf0c8f70a39/schema)
