音频转文字,下一步直接交给 Agent

选择一段录音,生成文字稿和字幕文件。后续总结、会议纪要、翻译或访谈分析,都会把转录稿作为文件交给 Agent,而不是塞进提示词。

拖入音频或视频

MP3、M4A、WAV、FLAC、OGG、WEBM、AAC、MP4、MOV · 25 MB 内

三步完成

  1. 1

    选择录音

    添加一个不超过 25 MB 的音频或视频文件。未登录时文件只在浏览器本地暂存,登录后再开始转录。

  2. 2

    生成转录文件

    Vecbase 会生成纯文本、SRT 字幕和分段 JSON,可以下载,也可以继续交给 Agent 使用。

  3. 3

    交给 Agent 继续处理

    继续处理时,转录稿会作为文件附件传给 Agent,长录音不会变成一大段提示词。

为什么结果更容易使用

直接输出团队要用的文件

TXT 便于阅读和检索,SRT 可以做字幕,segments.json 保留结构化时间信息给后续工具使用。

后续任务基于文件引用

Agent 会拿到转录文件附件,再做总结、翻译或分析,不需要把整份转录塞进 prompt。

上传前限制清楚

首版限制单文件 25 MB;格式或转录请求不被接受时,会直接显示可理解的错误。

开始前常见问题

可以上传哪些文件?

支持 MP3、M4A、WAV、FLAC、OGG、WEBM、AAC、MP4、MOV,单文件不超过 25 MB。长录音优先用压缩音频。

转录后会得到什么?

可以下载 transcript.txt、transcript.srt 和 segments.json。如果上游模型没有返回精确分段时间,Vecbase 会根据文本和时长生成可复核的近似字幕段。

Agent 可以继续总结这份转录吗?

可以。转录完成后选择摘要、会议纪要、翻译、字幕或访谈分析,转录稿会以文件附件交给 Agent。

这能替代人工复核吗?

不能。人名、术语、噪声片段和多人抢话仍需要人工复核,尤其是要发布字幕或作为证据使用时。

Vecbase

现在开始:音频转文字

任务:音频转文字。请先添加所需材料(音频或视频文件),并说明重点。Vecbase Agent 会根据要求整理出TXT、SRT 和分段 JSON 文件,你可以继续复核和修改。