Research · 研究

推动推理、代码与中文 AI 的边界。

我们围绕智能编程、多模态评测、推理训练、低资源 NLP 与模型审计展开研究,并把每项成果写成兼顾研究者与普通读者的双语解读。


推理 · 代码 · 中文 AI更新于 2026 年 6 月
重点研究 · AI 安全

SafeGEO 测量推荐智能体如何被操纵,以及如何建立防线。

在真实推荐场景中系统评估搜索优化攻击与缓解方案,给出可复核的风险边界。

阅读研究解读
600推荐案例 22攻击变体 2026研究发布
Research trajectory · 研究轨迹

里程碑

从模型解释与跨模态评测,到推理、智能编程与 AI 安全;研究方向沿着可验证、可复现的路径持续展开。

  1. 01解释与评测

    Report Cards 获 NeurIPS SoLaR Spotlight

    建立可读、可比较的模型能力报告,为后续评测研究奠定方法基础。

    查看研究
  2. 02跨模态一致性

    SEAM 被 COLM 2025 接收

    以 9,600 次评测量化文本与图像输入之间的模型一致性。

    查看研究
  3. 03研究线扩展 · 进行中

    五条研究线形成系统布局

    覆盖智能编程、RLVR、多语言 NLP、推荐智能体安全与可解释推理。

    查看 2026 研究