

GPT Transcribe 是一个基于浏览器的工具,旨在增强 OpenAI gpt-transcribe 语音转文本模型的功能。虽然 gpt-transcribe 提供准确的纯文本,但该平台通过提供 SRT 字幕、说话人标签和词级时间戳来弥补关键不足,这些对于许多专业工作流程至关重要。 该服务采用 OpenAI Whisper 并结合说话人分离技术,允许用户上传最长 60 分钟的音频或视频文件、实时录音或粘贴媒体链接。它支持 100 种语言的转录,自动区分说话人并提供精确的时间戳。新用户可获得五分钟免费时长,无需配置 API 密钥即可开始使用。 用户可以利用 GPT Transcribe 简化视频字幕制作、采访转录或会议记录等任务。它通过直接在浏览器标签页中提供即用型字幕文件和说话人分离的转录文本,并支持 SRT、VTT、DOCX、JSON、PDF 和 TXT 等多种格式导出,从而简化了整个过程。