← 返回新闻
新闻发布 · 2026 年 5 月 18 日
言澜大模型 V3.0 上线:中文发布前纠错再上一个大台阶
与 V2.0 逐项对比:8 项核心指标全胜,47 项对比胜出 43 项。检得更全,报得更准。
网景盛世 AI 实验室
Yanlan V3.0 · 中文发布前纠错 · 高难度纠错评测集
2026 年 5 月 18 日约 7 分钟阅读

言澜 V3.0 正式上线,中文发布前纠错再上一个大台阶。与 V2.0 逐项对比,8 项核心指标全胜,47 项对比胜出 43 项:漏报率近乎腰斩,误报率再探新低,完美修正率突破 94%。
中文发布前纠错的天花板,被言澜 V3.0 又顶高了一截。漏报接近减半,误报继续下探——误报本已处于行业低位。这一版,可以正式接进发布前审校流程。
适用场景:内容出版与政企文本
言澜 V3.0 主要服务对内容质量有高标准要求的政企客户:新闻出版机构的发稿前审校、出版社的图书与期刊定稿、政务部门的公文与新闻发布稿、金融与法务机构的合规文本、影视字幕与转写稿的成片质检。任何对外发布前需要一道严格中文校对的文本场景,言澜 V3.0 都能稳定承接。
专攻发布前最难查的错误
常规错别字检出率不再是主要目标。V3.0 对准的,是发布前最难处理的那类内容:错误隐蔽、强依赖上下文、行业术语密集、改错容错率极低。为此我们重构了高难度中文纠错评测集,升级了数据合成引擎,训练文本更贴近真实发布流程。
查得更狠。
漏报率直降超 6 个百分点,C-Recall 同步跃升。再隐蔽的错误,也漏不过这一版。
误伤更少。
误报率继续走低,C-Precision 稳在 98.30%。审校团队不再被无效告警打断。
一步改到位。
完美修正率提升近 10 个百分点——给出的修正基本可以直接采用。
8 项核心指标,全面胜出
三组高难度样本(484 / 991 / 2933)按数量加权后,八项指标 V3.0 全部胜出:准确率、F1、F0.5、漏报率、误报率、修正精度、修正召回、完美修正率,一项不落。
三组高难度样本(n=484 / 991 / 2933)按数量加权综合。8 项指标 V3.0 全面胜出,无回退。
95.74%准确率 · V3.0(+3.32 pp)
7.04%漏报率 · V3.0(−6.02 pp)
1.71%误报率 · V3.0(−0.28 pp)
94.16%完美修正率 · V3.0(+9.50 pp)
47 项对比,43 项胜出:系统性领先
发布前纠错从来不是单项比拼:检错、修正、误伤控制、生产稳定性,缺一项都可能出事故。V3.0 在 47 项对比中胜出 43 项,覆盖每个数据集、每个指标。系统性领先,不靠单项拉分。
拆分到单数据集 × 单指标的 39 项明细中,V3.0 也以 35:4 大幅领先;加权综合 8 项全胜。
最大的提升,来自「真正改对」这一关
指出「这里可能有问题」不难,难的是给出能直接采用的修正,多数校对模型恰好卡在这一步。V3.0 提升最大的指标也正好落在这里:三组数据集上的完美修正率全部站上 93%。
言澜 V3.0
言澜 V2.0
三项高难度评测任务(任务 1:n=484;任务 2:n=991;任务 3:n=2933)上完美修正率同步抬升,提升幅度都在 +9 个百分点以上——三组同时成立,提升是系统性的。
评测在三组高难度发布前任务上完成,共 4,408 条样本,覆盖多类高标准内容;方法、样本与逐项数据全部开放给业务团队复核。
更新后的发布前校对工作台
8 月前端更新通过 Yanlan-expand 提供词组级差异展示,并配合富文本与音频字幕复核。下方交互工作台展示词组标记、原文配图与逐项复核流程。
富文本校对,结合原有排版复核
富文本工作台保留标题、图片与段落排版,在文稿中标注需要复核的表达。审校人员可以粘贴内容或上传 .docx 文档,结合图文版式查看修改建议。
富文本交互示例:保留原文排版与配图,点击红色轮廓框或「识别结果」展开复核面板。文稿加入 2 处示例错字,展示「错误原文 → 修正建议」。音频与字幕,双轨分别复核
音视频工作台将音轨转写与字幕轨的建议分别展示,通过带时间戳的片段关联媒体位置。审校人员可以在同一工作台核对语音内容与画面字幕,逐项查看问题来源和处理状态。
音视频双轨交互示例:切换音轨与字幕轨,分别查看建议。点击字幕问题切换对应静帧,红色轮廓框定位画面中的错误词。了解 GEC 前端更新 →
言澜 V3.0 现已全面上线
发布前文字纠错的业内新标杆。8 项核心指标全胜,47 项对比胜出 43 项,漏报率 7.04%,完美修正率 94.16%。已服务新闻出版、政务、金融法务、影视字幕等高标准内容场景,欢迎政企客户联系试用。
开始使用 →
联系业务团队