语音转文字 transcribe

来源 · VoltAgent 分类 · 语音 团队 · OpenAI

编辑点评

语音转文字,支持说话人分离。会议记录、访谈整理、字幕生成的自动化入口;中文识别质量取决于所用模型。

适用场景与注意事项

会议记录、访谈整理、字幕生成时用。适合需要把长音频转成可编辑文字的场景。中文识别质量取决于底层模型,专业术语多的内容要人工校对。

一、功能概述

将音频文件转录为文字,支持说话人分离。该技能让 AI 在「语音」领域具备专项能力,适合希望通过自然语言快速完成相关任务的用户。

二、功能介绍

三、使用方式

  1. 第 1 步:在支持 Skill 的 AI 客户端(如 Claude、CodeBuddy)中安装「语音转文字」技能
  2. 第 2 步:用自然语言描述你的需求,例如:把这段文案转成普通话配音,语速中等(由「语音转文字」负责执行)
  3. 第 3 步:AI 会自动调用该技能完成任务,并在对话中交付结果
  4. 第 4 步:需要修改时,直接告诉 AI 调整点,无需从头再来

四、来源信息

来源仓库https://github.com/openai/skills
提供方OpenAI(官方技能)
开源许可详见来源仓库,多为 Apache 2.0 / MIT 等开源许可

← 返回技能包列表