语音转文字 transcribe
编辑点评
语音转文字,支持说话人分离。会议记录、访谈整理、字幕生成的自动化入口;中文识别质量取决于所用模型。
适用场景与注意事项
会议记录、访谈整理、字幕生成时用。适合需要把长音频转成可编辑文字的场景。中文识别质量取决于底层模型,专业术语多的内容要人工校对。
一、功能概述
将音频文件转录为文字,支持说话人分离。该技能让 AI 在「语音」领域具备专项能力,适合希望通过自然语言快速完成相关任务的用户。
二、功能介绍
- 语音转文字(transcribe)的核心能力:将音频文件转录为文字,支持说话人分离。
- 由 OpenAI 提供,来源 VoltAgent,归类于「语音」分类。
- 「语音转文字」可文本转语音,生成自然流畅的配音。
- 「语音转文字」可语音转文字,支持多语言与说话人分离。
三、使用方式
- 第 1 步:在支持 Skill 的 AI 客户端(如 Claude、CodeBuddy)中安装「语音转文字」技能
- 第 2 步:用自然语言描述你的需求,例如:把这段文案转成普通话配音,语速中等(由「语音转文字」负责执行)
- 第 3 步:AI 会自动调用该技能完成任务,并在对话中交付结果
- 第 4 步:需要修改时,直接告诉 AI 调整点,无需从头再来
四、来源信息
| 来源仓库 | https://github.com/openai/skills |
| 提供方 | OpenAI(官方技能) |
| 开源许可 | 详见来源仓库,多为 Apache 2.0 / MIT 等开源许可 |