这是给谁的
周日录下的一场礼拜,要送到当时不在场、也不讲这种语言的人手里。只拍一次却要在四个国家观看的培训。所有报名者都必须能读到其讲稿的会议。任何只说一次却要被理解很多次的东西。
怎么运作
- 1
你上传录音,并选择想从中得到哪些语言。
- 2
我们找出讲话部分,告诉你那是多少分钟、要花多少钱,然后等你确认。
- 3
它只被转写一次,每一种语言都从这一份转写翻译而来。
- 4
你按语言下载文本、字幕,或带时间码的原始发言段落。
你得到什么
- 从一段录音里最多得到十五种语言。
- 每种语言都有文本、SRT、VTT 和 JSON。
- 还包括原始转写,用当时讲的语言。
- 时间码保留下来,所以任何一种语言都能变成字幕。
- 只对讲话计费——沉默不花钱。
- 你上传的文件在任务完成的那一刻就被删除。
边界在哪里: 四小时音频、一小时视频,每份录音 800 MB,同时三个任务,每个任务最多五种语言。
问题
- 是从文本翻译还是从音频翻译?
- 来自转写,所以真正花钱的是第一种语言:听懂说了什么只发生一次。这也意味着转写的错误会传到所有语言:在这里,录音质量比在任何地方都更重要。
- 之后可以再加一种语言吗?
- 可以,如果原文件还在,就作为一个新任务提交。音频会被重新听一遍,所以也会重新计费。
- 翻译质量好吗?
- 这是机器翻译:好到足以让人看懂,不足以让人签字。涉及法律或医疗的,请让人过一遍。
- 有哪些语言?
- 阿拉伯语、中文、荷兰语、英语、法语、德语、意大利语、日语、韩语、波兰语、葡萄牙语、俄语和西班牙语。
- 会给我原文吗?
- 一直都会。用当时讲的语言写成的转写随每个任务一起给出,不额外收费。
对一个文件还能做的事
同一个文件、同一个引擎、同一个积分钱包。几乎没人只需要其中一项:转写完一场会议,最后总会想知道是谁在说。
只有你们那里才用的词
一个机构自己的名字——人名、街名、编号、职务——正是通用模型从没听过的东西,也正是它出错的地方:它会换成一个听起来差不多的普通词。写一次,就不再出错。 写在任务里,对那段录音生效。
- 这是一份清单,不是训练:写下来,从第一句话就生效。
- 它什么都不收集。不收你的音频,不收你的文本,一秒都不收。
- 而且是包含在内的。不是额外的套餐,也不是账单上的一行。