语音转文字
将本地音频或视频发送到转写模型,输出可直接整理的文字结果。
把会议、访谈、录音或视频中的语音转成文字;支持普通转写、说话人区分、已知说话人提示,以及文本、JSON 和分段结果。
站长点评:功能完整、来源明确,适合会议和访谈。不过媒体会上传到 OpenAI,必须在详情页把隐私和费用写清楚。
将本地音频或视频发送到转写模型,输出可直接整理的文字结果。
可使用 diarization 模型标注不同说话人,也能提供已知说话人的参考提示。
支持多个文件、指定输出目录,以及文本、JSON、分段 JSON 等格式。
把 OpenAI skills 仓库与 transcribe 子目录交给智能体。
在本机环境变量中设置 OPENAI_API_KEY,不要把密钥贴进聊天。
上传文件并说明是否需要时间段、说话人标签或批量输出。