← 返回产品
纠错系统 · Yanlan-LLM V3.0

言澜纠错系统

全新 V3.0:中文发布前纠错的业内新标杆。覆盖文本、视频字幕、音频转录、图片 OCR,可直接投入生产部署。

8/8加权综合指标全胜(对比 V2.0)
43/47总对比项胜出
95.74%准确率
94.16%完美修正率

言澜是中文发布前纠错系统,由采用多阶段强化学习训练的 Yanlan-LLM V3.0 驱动,优化目标直接来自生产部署的真实约束:误报要低到不占用编辑精力,吞吐要接得住日更新闻流水线,成本要能跑在一张中端 GPU 上。文本之外,视频字幕、音频转录、图片 OCR 一样在管——内容在哪里生成,纠错就在哪里发生。

在完整工作台中查看与复核

从原文排版到字幕画面,点击标记查看建议,逐项接受或忽略。Yanlan-expand 将单字差异扩展为词组,保留修改上下文。

原文配图:服务器机房
富文本交互示例:保留原文排版与配图,点击红色轮廓框或「识别结果」展开复核面板。文稿加入 2 处示例错字,展示「错误原文 → 修正建议」。

多场景内容检查

视频字幕纠错

接入字幕流水线后逐行实时审校,错别字、识别错误、术语不一致都管:准确率 99%+,每分钟视频只花 1–5 秒。已服务从事每日多语言字幕生产的编辑团队。

音频转写纠错

ASR 转录稿往往噪声很大。言澜结合音频上下文来读:修正听错的同音字,规范专有名词,方言说法保留原样而不是一律抹平。主流普通话变体上准确率 96%+。

人脸识别检测

不止文本:言澜内置专为广电与流媒体合规审核训练的人脸核验头,识别准确率 98%+,比人工审核流水线快 20–30 倍。

法规合规检测

对接 16,740 部中国法律法规语料库,每日自动更新,可标记与现行法规冲突的内容,适合政府、媒体、教育内容的法务复核。

V3.0 升级说明

深入了解言澜 V3.0 的系统升级

按样本量加权的 8 项核心指标全面优于 V2.0,47 项直接对比胜出 43 项。独立升级页集中呈现评测证据、方法说明与生产部署价值。

了解 V3.0 升级

生产级部署

准确率只是一半。准确但跑不快的,进不了生产;快但成本高的,过不了预算。言澜在单张中端 GPU 上同时跨过这两道门槛,再与当前最强的商用基线逐项对比。

15×速度提升——30,000 字/秒
10×成本降低——4090 级,无需 H100
0.5%误报率——仅为商用基线的 1/10
99%+视频字幕纠错准确率

工作原理

言澜以一层多模态感知把文本、音频、图像、视频字幕统一成同一种 token 流,再通过一个分类器在标准中文中央词库、按部署调优的自定义词库与纠错模型之间路由。最后由后处理整合层把结果合并输出。

训练是多阶段强化学习:先在人工校对过的纠错样本上做监督微调,再用编辑奖励做强化学习,并显式惩罚误报——误报率能压到 0.5%,关键就在这一步。

言澜 V3.0 现已全面上线

已服务新闻出版、政务、金融法务、影视字幕等高标准内容场景,欢迎政企客户联系试用。

立即体验 → 联系业务团队