STT — Speech to Text
为那些你本来得坐着一行行打出来的录音而做的语音转文字工具 — 会议录音、访谈、录下来的课。上传音频,拿回可以核对和修改的文本。
สิ่งที่ต้องใส่: audio · สิ่งที่ได้กลับมา: text
可以用来做什么
拿回来的是可搜索的文本,这让一堆录音变成真正能用的东西。
- 把会议录音变成日后能搜的会议记录
- 把访谈转成文字,再整理成文章
- 从已经录好的片子里做出字幕或脚本
- 把自言自语想事情时的语音备忘变成可编辑的文本
怎么用
- 上传音频文件,或从素材库里选一个
- 运行转写,等待结果
- 核对文本,改掉不对的地方,再往下用
什么会影响准确度
最重要的是源音频的质量。安静的房间、一次只有一个人说话、没有杂音干扰 — 这样的条件永远胜过在咖啡馆录的、或者大家抢着说话的录音。几个人同时说话时,系统没法告诉你哪句是谁说的。
คำถามที่พบบ่อย
支持泰语吗?
支持,还有很多其他语言,包括语言混着说的录音。
能区分说话人吗?
不会自动区分。结果是一段连续的文本,分段要你自己来。
音频可以多长?
文件越长耗时越久,费用也相应更高。每次运行前会显示预估价格。