← 返回言澜产品页 产品升级 · 言澜 V3.0

重新定义中文发布前纠错标准。

V3.0 检得更全、误报更低,给出的修正也更可直接采用,稳定服务新闻出版、政务传播、金融法务与广电媒体等高标准内容流程。

95.74%准确率
7.04%漏报率 · FPR
1.71%误报率 · FNR
94.16%完美修正率
01 · 评测证据

把 V3.0 与 V2.0,放回同一把标尺。

四项部署核心指标保留双版本绝对值对比,下方八项指标账本完整呈现样本加权结果。V3.0 在提升纠错质量的同时,进一步降低漏报与误报。

准确率数值越高越好
V2.092.42%
V3.095.74%
+3.32 pp
漏报率 · FPR数值越低越好
V2.013.06%
V3.07.04%
−6.02 pp
误报率 · FNR数值越低越好
V2.01.99%
V3.01.71%
−0.28 pp
完美修正率数值越高越好
V2.084.66%
V3.094.16%
+9.50 pp
检出与告警控制4 项指标
准确率+3.32 pp
漏报率 · FPR ↓−6.02 pp
误报率 · FNR ↓−0.28 pp
修正召回 · C-Recall+6.02 pp
修正质量4 项指标
修正精度 · C-Precision+0.52 pp
F1+2.84 pp
F0.5+4.39 pp
完美修正率+9.50 pp

评测口径:V2.0 与 V3.0 使用同一任务定义;三组高难度样本共 4,408 条(n=484 / 991 / 2933),按样本量加权。漏报率与误报率越低越好,其余六项指标越高越好。

02 · 跨任务一致性

最大的提升,在三组任务上同时成立。

三组评测任务的完美修正率均超过 93%,相对 V2.0 的提升稳定在 +9.10 至 +10.60 个百分点,并非由单一优势样本集拉动。

任务 01

n=484
+10.34 pp完美修正率
V3.095.59%
V2.085.25%

任务 02

n=991
+10.60 pp完美修正率
V3.094.82%
V2.084.22%

任务 03

n=2,933
+9.10 pp完美修正率
V3.093.78%
V2.084.68%
样本总量4,408
样本集3
直接对比项47
综合加权方式按样本量
03 · 升级重点

围绕内容发布前的最后一道质量关重构。

V3.0 聚焦高标准发布场景中的隐蔽错误、上下文依赖、密集行业术语,以及不必要修改同样会带来生产风险的内容流程。

更高难度的评测标准

评测集围绕高标准内容流程中的上下文型难例重构,不以常规错别字检出作为主要能力边界。

更多可直接采用的修正

完美修正率提升 9.50 个百分点,进一步增强模型给出可由编辑直接采用之修正的能力。

更克制的告警控制

漏报显著下降,误报同步收窄,帮助审校团队集中注意力,并稳定接入发布前质量审核流程。

04 · 系统级结果

单项提升之外,是整套能力的系统性领先。

在全部数据集与指标的直接对比中,V3.0 赢下 47 项中的 43 项;按样本量加权的 8 项综合指标全部优于 V2.0。

43/47直接对比项胜出

91.5% 的实测对比由 V3.0 胜出。

优势覆盖检出、修正、精度、召回与最终修正质量,呈现整套系统能力的同步提升。

单任务 × 指标35–4

三组独立样本集共形成 39 项对比,V3.0 在其中 35 项领先。

样本加权综合指标8–0

按样本量完成综合加权后,V3.0 在全部八项指标上领先。

05 · 生产部署

稳定承接高标准内容生产。

言澜 V3.0 现已全面上线,支持政企客户部署与私有化环境,并可适配机构专有术语及既有审核流程。

新闻与出版发稿前审校、图书期刊定稿与编辑终审。
政务传播公文、公开发布稿与政策传播内容。
金融与法务合规敏感文本与受监管内容审核。
广电媒体字幕、转写稿、OCR 文本与成片质检。

言澜 V3.0 现已全面上线。

欢迎政企客户结合代表性生产文本与部署要求,开展升级评测与试用。