← 返回新闻 新闻发布 · 2025 年 10 月 29 日

言澜大模型全新升级:全模态中文纠错系统上线

误报率降至十分之一,处理速度提升 15 倍,部署成本降至十分之一。文本、视频字幕、音频转写与人脸识别,一套系统稳定承接。

开始使用 产品详情 V3.0 升级说明
言澜插画形象
10×误报率降低 · 5% → 0.5%
15×处理速度提升 · 2,000 → 30,000 字/秒
10×部署成本降低 · 200 万 → 20 万
99.9%年度系统可用性 SLA

2025 年 10 月 29 日,网景盛世 AI 实验室发布言澜大模型全新升级版本,已于 9 月 28 日推送至各服务节点。新版本基于网景自研全模态架构,采用 6 阶段混合监督微调(SFT)与强化学习(RL)训练:误报率从 5% 降至 0.5%,单机处理速度从 2,000 字/秒提升至 30,000 字/秒,整机部署成本从 200 万降至 20 万。

一次升级,三项硬指标同时跨越。误报率降至十分之一,处理速度提升 15 倍,部署成本降至十分之一。文本、视频字幕、音频转写与人脸识别在同一套系统内完成,已服务政务、新闻出版、教育培训与企业办公等高标准内容场景。

三项硬指标,一次跨越

本次升级把三项决定落地成本的指标同时刷新。误报率从上一代的 5% 降至 0.5%;单机处理速度从 2,000 字/秒提升至 30,000 字/秒;整机部署成本从 H100 级别的 ¥2,000,000(200 万)降至 RTX 4090 级别的 ¥200,000(20 万),降幅 90%。

三项硬指标:上一代 → 言澜大模型每一行按各自量级单独缩放,数值以标签为准误报率越低越好5%0.5%↓ 10 倍处理速度越高越好2,000 字/秒30,000 字/秒↑ 15 倍部署成本越低越好¥2,000,000(200 万)¥200,000(20 万)↓ 10 倍
灰条为上一代模型,蓝条为言澜大模型新版本。三行各自独立缩放,跨行长度不可比较。
更少误伤。误报率仅 0.5%,审校团队不再被无效告警分散精力。
更快出稿。单机每秒 30,000 字——日更千万字的流水线,一张中端 GPU 即可承接。
更低门槛。RTX 4090 / 5090 等消费级显卡即可部署,同时全面适配华为昇腾、海光 DCU 等国产芯片。

6 阶段混合训练与智能路由

言澜采用 6 阶段混合监督微调(SFT)与强化学习(RL)训练,逐阶段收紧模型的判错与改错边界。推理侧由分类模型预判文本类型(政务、法律、媒体等),把输入分配到中央词库、纠错模型或自定义词库的专用路径,再经后处理优化与结果合并层输出。这条路由把整体复杂度从 O(n²) 降到 O(nlogn + kn),并行处理能力提升约 30 倍,内存占用减少 60%。

多路处理(Routed-Processing)架构6 阶段 SFT + RL 训练 · 分类器决定处理路径输入数据多模态感知模型分类模型多路处理中央词库纠错模型自定义词库后处理优化结果合并层高质量输出结果分类器先判断文本类型,专用路径再各自处理。
系统架构示意。三条路径并行处理后由结果合并层统一输出,后处理优化把误报率压到 0.5%。

处理链路按精度分层,各层处理均在毫秒级完成,端到端 P99 延迟低于 50ms。每一层可独立优化,粗筛与精校各司其职,误报率因此稳定在 0.5%。

全模态纠错,一套系统承接

文本之外,视频字幕、音频转写与人脸识别检测同在一套系统内完成,共用同一份词库与同一条后处理链路。

各模态纠错准确率横轴展示 90% – 100% 区间100%90%文本纠错99%+视频字幕纠错99%+音频转写纠错96%+人脸识别检测98%+四类模态同处一套系统,无需分别接入。
内部评测口径。横轴自 90% 起算,仅展示高位区间差异。
视频字幕纠错。视觉与文本联合理解,结合画面内容判断上下文;1 分钟视频 1–5 秒完成处理,政务、法律等专业术语与机构名称准确无误。
音频转写纠错。基于网景自研全模态架构的语音特征识别,支持多地方言与噪声环境;1 分钟音频 1–5 秒处理,稳定承接会议录音与视频音轨。
人脸识别检测。落马官员检测准确率 98%+,1 小时视频 2–3 分钟审完;新增人物 24 小时内生效,无需重新训练。

十亿级训练数据与权威词库

训练数据从百万级跃升至十亿级,规模提升 1000 倍,语料取自权威媒体与官方文献,每日自动采集更新,错误模式覆盖更完整。

法规侧全量接入国家法律法规数据库,覆盖宪法、法律、行政法规、地方法规与司法解释,与官方数据源每日同步,并自动识别废止与修订条款,避免引用历史失效内容。落马官员词库每日自动采集中央纪委国家监委官网,新增信息 24 小时内入库,支持图片、视频与文档批量检测,职位变动自动更新。

本地部署与生产可靠性

所有数据本地处理,不出内网,端到端延迟较云端方案降低 90%。硬件侧支持 RTX 4090 / 5090 等消费级显卡,并全面适配华为昇腾、海光 DCU 等国产芯片;20 万预算的单机配置即可支持千万字/小时的处理量。部署形态可选本地部署(数据不出内网、安全等级最高)、私有云部署(专属资源与弹性扩展)与网景云部署(核心数据本地、计算资源上云)。

99.9%年度可用性 SLA
<50msP99 延迟 · 99% 请求低于 50 毫秒
1000+单机并发 QPS
>4K单卡吞吐 · 字/秒/卡

系统按 7×24 小时不间断服务设计。健康检查实时监控运行状态并自动隔离异常,服务异常自动重启,高负载时自动降级以保住核心功能;QPS、延迟与吞吐量实时监控,异常告警支持邮件、短信与钉钉多渠道通知,并定期输出性能分析报告。数据侧配多级权限管理与完整操作日志,支持安全审计与问题追溯。

已服务的内容场景

言澜大模型已在以下高标准内容场景稳定运行。

政务领域。政府机构与事业单位的公文、报告、通知等文档发布前审校,实时检测政治错误与法规引用错误。
媒体传播。电视台、新闻机构与视频平台的字幕纠错与批量视频质检,规避重大舆情风险。
教育培训。教育机构与培训平台的作文批改、课件审核与教材校对,为教师与学生提供准确的语法依据。
企业办公。合同、报告与邮件等文档的自动审核,检测语法与格式问题,提升文档交付质量。

言澜大模型现已全面上线

全模态中文纠错系统现已全面上线。误报率 0.5%,单机处理速度 30,000 字/秒,部署成本 20 万,年度可用性 99.9%。已服务政务、新闻出版、教育培训与企业办公等高标准内容场景。欢迎政企客户联系试用。

开始使用 → 联系业务团队