LIA · 留学情报局

AI 使用说明

为什么用 AI,AI 做什么

本站覆盖两百多所学校、上万条随时会变的事实,靠人工逐条盯是不现实的;靠不核对的转载是不诚实的。我们的选择是把核对这件重复劳动交给 AI 流水线,把判断权留给人。

边界从一开始就定死:AI 从来不是事实的来源——事实的来源是院校与官方机构的公开页面,AI 只负责去核对它们。每条经流水线核验的事实都带原始来源链接与「核对于」日期,您随时可以点过去自己验证。

核验流程如何运转

流程分五步:礼貌抓取院校官方页面(遵守 robots 协议、控制频率、不绕过任何访问限制);保存页面的不可变快照并记录校验和;AI 从快照中抽取字段,每个字段带置信度与原文引句;抽取结果过一遍校验规则(日期合理性、口径一致性、与既有数据的交叉比对);置信度达标且规则通过的自动发布并标注核对日期,达不到的进入人工审核队列。

整套流程可审计:每次运行记录所用模型、提示词版本与快照编号;提示词、阈值与规则都在版本控制之下。

AI 与编辑内容

院校解读等编辑文字由 AI 检索公开来源起草,随后数据与事实逐条对照全站数据核,人工审定后才发布。AI 起草的是初稿,发布的决定永远是人的。

错误率:诚实的说法

自动化核验有错误率,这一点我们直说。系统的设计目标是:需要人工复核的比例控制在一成以内;运营者每周随机抽查已发布事实的百分之五,抽查发现问题就收紧规则并重新核对受影响的记录。

两类错误值得单独说明。一是来源页面本身排版异常导致的误读——对此系统在置信度之外另设文本形态检查,命中即送人工;二是任何阈值都拦不住的小概率错误——对此的答案是每个数字旁的报错入口与《更正政策》的公开时限。发现错误的读者是这套体系的一部分,而不是体系之外的意外。

AI 的禁区

用户的个人数据从不进入任何外部 AI 模型——核验流水线处理的只是院校公开页面。图片文字识别(OCR)的输出从不直接成为数据——识别错一个数字会生成一个带完整出处的错误数字,这正是本站要防的事。AI 不生成录取概率(永久规则,见免责声明),不生成图片描述,不代替任何一处人工批准。

报错

每个指标旁的报错入口已自动带上学校、指标、统计期与来源,提交只需几秒。处理时限见《更正政策》:一个工作日内(北京时间·工作时段)确认,五个工作日内给出结果。