沉淀了烤肉的流程和 skill

这周测了不少的新的 ASR 模型,比如说微软出的 MAI Transcribe 2和 Mossland 的模型。 测下来感觉大部分模型已经进入了白热化的竞争阶段,实际上几家的错误率都不相上下,这个时候就到了后处理上需要发力的时候了。

之前其实我就有一个专门的 Skill 用来走考虑的流程,但是之前的流程花费的 Token 比较多,是因为我没有形成一个沉淀知识库的环节,导致每次都会派发出两到三个 Agent 去进行搜索和调研背景信息的情况,这就导致消耗掉的 Token 甚至在还没有开始翻译之前,就已经消耗了十来 M 了。

于是这周刚好 GPT 6 Extra 发布了,我就让它帮我按照我的思路优化了一下我的这个 Skill。现在在一开始翻译的时候会尝试对本地的知识库进行命中,如果有命中,那么就直接使用,没有命中的部分会再派发一个搜索子代理除去翻译信息,然后按照原来的流程写好简报和术语表。在最后修正完成了熟肉之后,会把这次用到的可以沉淀的术语写回到知识库里,在下一次翻译的时候进行使用。

不同领域会建立不同目录,比如声优的就专门有个声优文件夹,CS 的话就会有专门的 CS 文件夹。

不过目前我的知识库里面只有日语女声优相关的一些信息,我也没有测试,如果我选择其他的语种,比如英语或者其他小语种,如俄语、德语、法语等等的效果如何。不过这个东西反正目前来说也只是自用,做大兼容的话,暂时还不是那么急。

可以在这里进行查看:https://github.com/Sallyn0225/sallyn-skill/blob/main/skills/translate-srt

也可以通过这个命令进行安装 npx skills add Sallyn0225/sallyn-skill --skill translate-srt