---
title: "Text-to-Speech-Google 音频处理-API黄页|万维易源ShowAPI"
canonical_url: "https://www.showapi.com/playground/302ai/302ai/google-text-to-speech"
last_updated: "2026-09-20T12:55:02.957Z"
meta:
  description: "Google TTS API提供高质量的文本转语音服务，支持多种语言和声音，价格实惠仅40 PTC/百万字符，适用于各类语音合成应用场景。"
  keywords: "Google TTS API，文本转语音服务，语音合成API，TTS云服务，Google语音技术"
  "og:description": "Google TTS API提供高质量的文本转语音服务，支持多种语言和声音，价格实惠仅40 PTC/百万字符，适用于各类语音合成应用场景。"
  "og:title": "Text-to-Speech-Google 音频处理-API黄页|万维易源ShowAPI"
---

*

*

*

# **Google 音频处理**

[302 AI-302 AI](https://www.showapi.com/playground/302ai/302ai) [** 产品首页](https://302ai.apifox.cn/309787721e0) [**API文档](https://302ai.apifox.cn/309787721e0) [**应用示例](https://www.showapi.com/aiapp/302ai/302ai/google-text-to-speech.html)

**5657

2025-08-25更新

**383 [提交收录](https://www.showapi.com/island/feedback-page?submitrequire=true) [反馈问题](https://www.showapi.com/island/feedback-page?apiurl=/playground/302ai/302ai/google-text-to-speech) [ 创建我的API](https://www.showapi.com/playground)

该API允许用户将文本转换为语音，支持多种音频编码格式和语音效果配置。用户可以通过设置音频配置、输入文本和语音参数来生成所需的语音文件。

**基础配置**

**YOUR\_API\_KEY**[去获取YOUR\_API\_KEY](https://dash.302.ai/apis/list)

选择接入点：

**POST**

**

**Run

**接入点文档：**[查看](https://302ai.apifox.cn/309787721e0)

Run: Ctrl+

↵

接入点描述：来自Google的TTS模型，参考：https://cloud.google.com/text-to-speech#demo \*\*价格：40 PTC/百万字符\*\*

**请求参数**

**response\_format**

url或data

**

**input.text****\***

输入需要转换的文本

**voice.languageCode****\***

必填。参考值：https://cloud.google.com/text-to-speech/docs/voices?hl=zh-cn 语音的语言（也可能包括地区）以BCP-47语言标签表示，例如“en-US”。此参数不应包含脚本标签（例如，使用“cmn-cn”而不是“cmn-Hant-cn”），因为脚本将根据 SynthesisInput 提供的输入推断出来。TTS 服务将使用此参数来帮助选择合适的语音。请注意，TTS 服务可能会选择与所选语音语言代码略有不同的语音；它可能会替换为其他地区（例如，如果没有可用的加拿大语音，则使用 en-US 而不是 en-CA），甚至使用其他语言，例如，使用“nb”（挪威博克马尔语）而不是“no”（挪威语）。

**voice.name****\***

语音的名称。如果名称和性别均未设置，服务将根据其他参数（例如 languageCode）选择语音

**audioConfig.audioEncoding****\***

值来源：https://cloud.google.com/speech-to-text/docs/encoding?hl=zh-cn Codec 名称 无损 使用说明 MP3 MPEG 第三层音频 否 MP3 编码是一项 Beta 版功能，仅在 v1p1beta1 中提供。如需了解详情，请参阅 RecognitionConfig 参考文档。 FLAC 免费无损音频编解码器 是 信息流要求使用 16 位或 24 位的位深 LINEAR16 线性 PCM 是 16 位线性脉冲编码调制 (PCM) 编码。文件头必须包含采样率。 MULAW μ 律 否 8 位 PCM 编码 AMR 自适应多速率窄带 否 采样率必须为 8000 Hz AMR\_WB 自适应多速率宽带 否 采样率必须为 16000 Hz OGG\_OPUS Ogg 容器中的 Opus 编码音频帧 否 采样率必须为 8000 Hz、12000 Hz、16000 Hz、24000 Hz 或 48000 Hz 之一 SPEEX\_WITH\_HEADER\_BYTE Speex 宽带 否 采样率必须为 16000 Hz WEBM\_OPUS WebM Opus 否 采样率必须为 8000 Hz、12000 Hz、16000 Hz、24000 Hz 或 48000 Hz 之一

**

**audioConfig.effectsProfileId**

值来源：https://cloud.google.com/text-to-speech/docs/audio-profiles?hl=zh-cn wearable-class-device 智能手表和其他可穿戴设备，例如 Apple Watch、Wear OS 手表 handset-class-device 智能手机，如 Google Pixel、Samsung Galaxy、Apple iPhone headphone-class-device 用于音频播放的耳塞或耳机，如 Sennheiser 耳机 small-bluetooth-speaker-class-device 小型家庭扬声器，例如 Google Home Mini medium-bluetooth-speaker-class-device 智能家居扬声器，例如 Google Home large-home-entertainment-class-device 家庭娱乐系统或智能电视，例如 Google Home Max、LG TV large-automotive-class-device 车载扬声器 telephony-class-application 交互式语音响应 (IVR) 系统

headphone-class-device**

**audioConfig.pitch**

可选。仅用于输入。说话音调，范围为 \[-20.0, 20.0]。20 表示在原始音调上提高 20 个半音。-20 表示在原始音调上降低 20 个半音。

**audioConfig.speakingRate**

可选。仅用于输入。语速/语速，范围为 \[0.25, 2.0]。1.0 表示特定语音支持的正常原生语速。2.0 表示两倍，0.5 表示一半。如果未设置 (0.0)，则默认为原生语速 1.0。任何其他小于 0.25 或大于 2.0 的值都将返回错误。

**返回结果**

当前为示例返回

**

返回体

返回头

**使用其他软件测试API**

您可以拷贝Curl语句，直接导入Postman进行测试

**拷贝Curl语句