ChatGPT 新增音频上传,可以围绕录音转写和提问
付费用户及工作空间可以上传录音,转写、整理笔记并继续提问。支持情况受格式和账号等条件影响,关键内容仍需回听核对。
手机里有一段采访、一堂课或一场会议录音,想知道其中提到了什么,现在可以把音频文件直接带进 ChatGPT 对话。OpenAI 在 10 月 6 日的更新记录中公布了音频上传功能,支持围绕录音转写、总结和继续提问。
这和直接开着语音聊天不一样:你提供的是已经录好的材料,可以带着一个具体问题去找内容。例如,“对方最后确认了哪天交付?还有哪些事情没有答复?”比“总结这段录音”更容易得到有用的结果。这是编辑建议的用法。
先找事实,再整理笔记
一段讨论里,提议、反对意见和最后决定常常混在一起。让 AI 直接写成流畅的会议纪要,容易让尚未决定的事情看起来已经有结论。可以先要求它把“明确决定”“有人提出但未确定”“需要继续确认”分开,听不清的地方标出来。
然后只核对关键部分:人名、数字、日期,以及究竟是谁答应做什么。别急着把整份笔记发送给别人。对于采访,尤其应回听准备引用的那句话,确认没有删掉前提或把犹豫改成肯定。
文件与音频帮助页列出了 MP3、WAV、M4A 等支持格式,音频文件上限为 512 MB。功能目前向付费订阅及工作空间开放,Free 暂不支持;地区、客户端、模型和工作空间设置也会影响可用性。文件大小通过检查,不等于很长的录音一定能处理完。
官方还提醒,转写可能出错,说话人识别也未必可靠。因此,第一次不妨用一小段自己熟悉的录音,先看看它能否正确区分内容,再处理更长的材料。带口音、背景声或多人重叠发言的录音,也需要留出人工核对的时间。
对普通使用者,这项更新降低了把现有录音拿来讨论的门槛。真正节省时间的地方,应是更快找到你需要回听的位置、整理出下一步,而不是得到一份看起来非常完整、却没法放心采用的文本。