OpenAI 语音转写

把会议、访谈、录音或视频中的语音转成文字;支持普通转写、说话人区分、已知说话人提示,以及文本、JSON 和分段结果。

站长已收录待实测视频音频

效果预览

OpenAI · 使用示意
输入内容音频或视频文件支持常见录音和视频文件;长文件可先分段,再按统一格式输出。
输入内容
转写结果正文、时间段与说话人可生成纯文本,也可保留分段信息;多人会议可选择说话人区分模式。
转写结果

这个 Skill 能做什么

站长点评:功能完整、来源明确,适合会议和访谈。不过媒体会上传到 OpenAI,必须在详情页把隐私和费用写清楚。

语音转文字

将本地音频或视频发送到转写模型,输出可直接整理的文字结果。

区分说话人

可使用 diarization 模型标注不同说话人,也能提供已知说话人的参考提示。

批量输出

支持多个文件、指定输出目录,以及文本、JSON、分段 JSON 等格式。

三步开始使用

1

复制安装指令

把 OpenAI skills 仓库与 transcribe 子目录交给智能体。

2

配置 API Key

在本机环境变量中设置 OPENAI_API_KEY,不要把密钥贴进聊天。

3

选择转写方式

上传文件并说明是否需要时间段、说话人标签或批量输出。

安全与验证 ! 需要 OPENAI_API_KEY ! 音视频会上传到 OpenAI ! API 调用可能产生费用 ✓ 不要求在聊天中粘贴密钥 ✓ 源码检查:2026-09-09·</> 原始源码·Apache-2.0·来源:OpenAI