跳到正文
北京时间
原文
Philipp Schmid· @_philschmid · X·· 11 天前精选AI 评分69
AI 导读

Philipp Schmid 介绍 Gemini 3.8 TTS 支持通过录制 20 秒语音加同意句复刻个人声音,或用提示词设计完全自定义的语音。通过 API 调用创建后可在任意请求中使用,风格通过 speech_metadata 设置,作者还提供了博客链接和一段可交给智能体的完整操作提示词。

推荐理由

原文给出录制片段、API 创建与调用的具体步骤和可复用提示词,方便读者快速试用自己的语音复刻。

正文 · AI 翻译

使用 Gemini 3.8 TTS,你可以复刻自己的声音,或通过提示词设计一个完全自定义的声音

  1. 录制 20 秒的你说话 + 同意声明
  2. 通过 API 调用创建你的声音
  3. 在任何请求中使用它,风格写在 speech_metadata 中

把这段粘贴到你的 agent 里
"阅读 https://www.philschmid.de/gemini-3-8-tts 并带我一步步为 Gemini 3.8 TTS 创建我自己的声音。先检查我的环境(GEMINI_API_KEY、ffmpeg、gemini-skills),帮我录制两段音频,创建声音,并生成一句我可以试听的测试语句。"
或阅读下文。

引用Philipp Schmid@_philschmid
https://x.com/i/article/2103140786292269056
在 X 查看被引用的帖子

来源:Philipp Schmid · x.com