网站可能被墙,请记住以下域名:subhd.me subhd.one
账号管理出问题了吗?
liongliong

没办法退出账号,tw地址无法登陆账号,下载字幕一直停留在验证状态
发表留言 共 1 条

Jack
修复了

最新评论
@蒙太奇字幕组:建议回复内容: 小p你好!非常感谢蒙太奇字幕组的认可,看到你的留言和长文思考我非常有共鸣,比如你说的这个大部分LLM模型都是基于文本为主的 但是实际上多模态是更重要的 即了解这句话在当前语境(例如视频展现的情绪等多重因素)代表的到底是什么意思,这可以说是直击了传统机器翻译和通用大模型做字幕时的最大难题,但是实际上这个问题确实可以被以一种妥协的方式来解决,如果让AI直接看视频来翻译,实际上是有相对应的多模态模型可以做到,大家经常调侃的北美豆包Gemini实际上多模态能力十分强大,但是资源消耗成本将无比巨大 而且时间也很久,不如人工进行校对(也不需要刻意校对 看一遍这个字幕带的美剧即可)更精确也更省成本和时间。 我说的妥协的方式就是 1遍AI翻译 1遍AI校对 对于有争议的地方 例如可以写个promot告诉模型,哪些词属于多意词 更容易出现多重含义 再喂给AI大量美剧精品人工翻译字幕后 大模型自己是可以找到这个规律的 他发现有争议的地方 则调用第三方软件提取原版美剧视频里的对应前后10秒钟的每秒的自动帧截图并且使用图像多模态的方式来帮助识别这句话到底应该怎么翻译更正确。 关于你和朋友讨论的“通用大模型已经看过互联网所有字幕,专项训练/微调是否还有必要”这个问题,结合我这次使用精品美剧字幕喂养/微调模型的实际反馈,分享一下我的看法: 见过”不等于“学精”:预训练解决“海量”,微调解决“质量与审美” 你朋友说的没错,基座模型在预训练阶段确实抓取了海量互联网字幕。但互联网上的字幕泥沙俱下(大量劣质机翻、语用不当、格式错乱)。大模型预训练只是获得了泛化语言能力,并没有建立起对“高水平字幕翻译”的审美和对齐 这也是为啥我强调我用的都是大量人工精翻的字幕。 我们用精选的精品美剧字幕对模型进行针对性优化,本质上是给它做领域对齐让它内化优质译者的口语化风格、凝练度、信达雅的语气,以及对美剧梗和潜台词的敏感度。 而且你说的互联网上的所有的字幕早就被AI公司拿去训练模型了 这句话 其实准确来说是互联网上所有的数据都99%被拿去做了训练,他们并没有人去刻意把字幕拿下来做训练,是无限制的抓取吞噬一切数据,所以现在的模型参数越来越大已经到达了3T参数还有更多的,但是实际上每次激活的没这么多 ,也就是能力太过泛化 他懂的是多 但是很有可能出现幻觉忘记掉字幕相关的专业内容 所以针对字幕包括美剧相关知识等进行蒸馏 微调 是非常有必要的 只用于翻译的模型参数量将会非常 非常 非常的迷你(对比较全功能的基座超大模型) 甚至可以运行在移动设备和家用电脑上,这种大规模的普及将会为大量第三国家地区的人带来很大的文化 知识的普及作用,我认为这个才是最重要的。 - AIWorld