← 返回新闻 新闻发布 · 2026 年 5 月 18 日

言澜大模型 V3.0 上线:中文发布前纠错再上一个大台阶

与 V2.0 逐项对比:8 项核心指标全胜,47 项对比胜出 43 项。检得更全,报得更准。

开始使用 产品详情 V3.0 升级说明
8/8加权综合指标全胜
43/47总对比项胜出
95.74%准确率
94.16%完美修正率

言澜 V3.0 正式上线,中文发布前纠错再上一个大台阶。与 V2.0 逐项对比,8 项核心指标全胜,47 项对比胜出 43 项:漏报率近乎腰斩,误报率再探新低,完美修正率突破 94%。

中文发布前纠错的天花板,被言澜 V3.0 又顶高了一截。漏报接近减半,误报继续下探——误报本已处于行业低位。这一版,可以正式接进发布前审校流程。

适用场景:内容出版与政企文本

言澜 V3.0 主要服务对内容质量有高标准要求的政企客户:新闻出版机构的发稿前审校、出版社的图书与期刊定稿、政务部门的公文与新闻发布稿、金融与法务机构的合规文本、影视字幕与转写稿的成片质检。任何对外发布前需要一道严格中文校对的文本场景,言澜 V3.0 都能稳定承接。

专攻发布前最难查的错误

常规错别字检出率不再是主要目标。V3.0 对准的,是发布前最难处理的那类内容:错误隐蔽、强依赖上下文、行业术语密集、改错容错率极低。为此我们重构了高难度中文纠错评测集,升级了数据合成引擎,训练文本更贴近真实发布流程。

查得更狠。 漏报率直降超 6 个百分点,C-Recall 同步跃升。再隐蔽的错误,也漏不过这一版。
误伤更少。 误报率继续走低,C-Precision 稳在 98.30%。审校团队不再被无效告警打断。
一步改到位。 完美修正率提升近 10 个百分点——给出的修正基本可以直接采用。

8 项核心指标,全面胜出

三组高难度样本(484 / 991 / 2933)按数量加权后,八项指标 V3.0 全部胜出:准确率、F1、F0.5、漏报率、误报率、修正精度、修正召回、完美修正率,一项不落。

V3.0 相对 V2.0 的提升幅度(百分点) 完美修正率 +9.50 漏报率 (FPR) ↓ −6.02 修正召回 +6.02 F0.5 +4.39 准确率 +3.32 F1 +2.84 修正精度 +0.52 误报率 (FNR) ↓ −0.28
三组高难度样本(n=484 / 991 / 2933)按数量加权综合。8 项指标 V3.0 全面胜出,无回退。
95.74%准确率 · V3.0(+3.32 pp)
7.04%漏报率 · V3.0(−6.02 pp)
1.71%误报率 · V3.0(−0.28 pp)
94.16%完美修正率 · V3.0(+9.50 pp)

47 项对比,43 项胜出:系统性领先

发布前纠错从来不是单项比拼:检错、修正、误伤控制、生产稳定性,缺一项都可能出事故。V3.0 在 47 项对比中胜出 43 项,覆盖每个数据集、每个指标。系统性领先,不靠单项拉分。

47 项对比的胜负分布 V3.0 赢 43 项 · 91.5% V2.0 赢 4 项 · 8.5%
拆分到单数据集 × 单指标的 39 项明细中,V3.0 也以 35:4 大幅领先;加权综合 8 项全胜。

最大的提升,来自「真正改对」这一关

指出「这里可能有问题」不难,难的是给出能直接采用的修正,多数校对模型恰好卡在这一步。V3.0 提升最大的指标也正好落在这里:三组数据集上的完美修正率全部站上 93%。

完美修正率:三项任务上 V2.0 → V3.0 全线跃升 横轴展示 80% – 100% 区间 任务 1 V3.0 · 95.59% V2.0 · 85.25% +10.34 pp 任务 2 V3.0 · 94.82% V2.0 · 84.22% +10.60 pp 任务 3 V3.0 · 93.78% V2.0 · 84.68% +9.10 pp
言澜 V3.0 言澜 V2.0
三项高难度评测任务(任务 1:n=484;任务 2:n=991;任务 3:n=2933)上完美修正率同步抬升,提升幅度都在 +9 个百分点以上——三组同时成立,提升是系统性的。

评测在三组高难度发布前任务上完成,共 4,408 条样本,覆盖多类高标准内容;方法、样本与逐项数据全部开放给业务团队复核。

更新后的发布前校对工作台

8 月前端更新通过 Yanlan-expand 提供词组级差异展示,并配合富文本与音频字幕复核。下方交互工作台展示词组标记、原文配图与逐项复核流程。

富文本校对,结合原有排版复核

富文本工作台保留标题、图片与段落排版,在文稿中标注需要复核的表达。审校人员可以粘贴内容或上传 .docx 文档,结合图文版式查看修改建议。

原文配图:服务器机房
富文本交互示例:保留原文排版与配图,点击红色轮廓框或「识别结果」展开复核面板。文稿加入 2 处示例错字,展示「错误原文 → 修正建议」。

音频与字幕,双轨分别复核

音视频工作台将音轨转写与字幕轨的建议分别展示,通过带时间戳的片段关联媒体位置。审校人员可以在同一工作台核对语音内容与画面字幕,逐项查看问题来源和处理状态。

视频示例画面
音视频双轨交互示例:切换音轨与字幕轨,分别查看建议。点击字幕问题切换对应静帧,红色轮廓框定位画面中的错误词。

了解 GEC 前端更新 →

言澜 V3.0 现已全面上线

发布前文字纠错的业内新标杆。8 项核心指标全胜,47 项对比胜出 43 项,漏报率 7.04%,完美修正率 94.16%。已服务新闻出版、政务、金融法务、影视字幕等高标准内容场景,欢迎政企客户联系试用。

开始使用 → 联系业务团队