语音合成 speech
编辑点评
文本转语音(OpenAI API)。做播客、有声内容、视频配音时可以批量化,不用手工录。
适用场景与注意事项
做播客、有声书、视频旁白需要大量配音时用它批量化。适合内容创作者省掉录音环节。情感表达的细腻程度不如 ElevenLabs 这类专精工具。
一、功能概述
使用 OpenAI API 从文本生成语音。该技能让 AI 在「语音」领域具备专项能力,适合希望通过自然语言快速完成相关任务的用户。
二、功能介绍
- 语音合成(speech)的核心能力:使用 OpenAI API 从文本生成语音。
- 由 OpenAI 提供,来源 VoltAgent,归类于「语音」分类。
- 「语音合成」可文本转语音,生成自然流畅的配音。
- 「语音合成」可语音转文字,支持多语言与说话人分离。
三、使用方式
- 第 1 步:在支持 Skill 的 AI 客户端(如 Claude、CodeBuddy)中安装「语音合成」技能
- 第 2 步:用自然语言描述你的需求,例如:把这段文案转成普通话配音,语速中等(由「语音合成」负责执行)
- 第 3 步:AI 会自动调用该技能完成任务,并在对话中交付结果
- 第 4 步:需要修改时,直接告诉 AI 调整点,无需从头再来
四、来源信息
| 来源仓库 | https://github.com/openai/skills |
| 提供方 | OpenAI(官方技能) |
| 开源许可 | 详见来源仓库,多为 Apache 2.0 / MIT 等开源许可 |