POST
Gemini 格式
/v1beta/models/{model}:generateContent

Gemini 音频生成

使用 Gemini 原生 generateContent 格式生成语音音频。

身份认证

所有模型调用都需要在请求头中携带 Bearer API Key。

Authorization: Bearer YOUR_API_KEY

参数

路径参数

1
model
必填
路径参数
string
模型名称。

请求体

2
contents
必填
请求体
array<object>
输入内容数组。
generationConfig
必填
请求体
object
生成配置,包含 responseModalities 和 speechConfig。

请求示例

application/json
{ "contents": [ { "role": "user", "parts": [{ "text": "请用自然语气朗读这句话。" }] } ], "generationConfig": { "responseModalities": ["AUDIO"], "speechConfig": { "voiceConfig": { "prebuiltVoiceConfig": { "voiceName": "Kore" } } } } }

响应示例

200
application/json
Gemini 内容响应,音频数据在 parts 中返回。
{ "candidates": [ { "content": { "role": "model", "parts": [ { "text": "Generated content" } ] }, "finishReason": "STOP", "safetyRatings": [] } ], "usageMetadata": { "promptTokenCount": 12, "candidatesTokenCount": 20, "totalTokenCount": 32 } }