DeepInsight 系列 05:性能看板需要说明指标来源
性能看板是 DeepInsight 最容易被误读的页面。推荐系统指标看起来都是数字,但每个数字都需要说明来源、数据范围和适用条件。否则页面越完整,结论越不可信。

模块定位
性能看板用于展示推荐系统评估结果,包括 HR@10、NDCG@10、Recall@10、MRR、RMSE、MAE 等指标。它回答的是“已有评估记录显示了什么”,而不是“系统临时生成了什么”。
这个页面连接模型总览和可视分析工作台。模型总览提供资产和摘要,性能看板展示指标对比,可视分析工作台再把模型、数据、请求和分析说明整合起来。
指标分类
推荐系统指标需要分组解释。HR、NDCG、Recall、MRR 这类指标通常用于衡量推荐命中和排序质量,数值越高越好。RMSE、MAE 这类误差指标用于衡量预测偏差,数值越低越好。
如果页面不解释方向,用户很容易把所有指标都理解成越大越好。看板中需要通过分组、标签和说明文字降低误读风险。
数据来源
后端只返回已有日志、metrics 文件或数据库评估记录中的指标。没有记录的字段不使用 0 填充,也不使用随机数补齐。缺失就是缺失,页面要清楚显示。
这个原则和最终报告中的边界控制一致。课程项目中常见的问题是为了页面好看而补假数据,但 DeepInsight 更需要保留真实状态,因为指标可信度比页面完整度更重要。
页面结构
看板上方适合展示模型总数、评估记录状态、总交互数和关键摘要。中部展示模型指标卡片,帮助用户快速找到当前模型的主要表现。下方再用柱状图、雷达图、热力图或趋势图呈现多模型对比。
这种布局对应用户阅读顺序:先看有没有数据,再看单个模型,再看横向对比。不要一进入页面就堆满图表,否则用户不知道应该先读哪一层。
缺失状态
缺失状态要和异常状态区分。缺失表示当前没有该指标记录,异常表示读取或计算过程失败。两者不能混用,因为它们代表不同的处理方式。
缺失记录可以通过补充评估任务解决,异常状态需要排查日志、接口或数据解析。页面只有把状态写清楚,后续维护才有依据。
与数据集页面的关系
数据集页面负责查看上传文件结构,性能看板负责展示评估指标。上传一份数据不意味着立刻产生深度模型评估结果。只有完成对应评估并入库或生成日志后,看板才应该展示新指标。
这种边界让系统流程更稳:数据入口、评估过程和指标展示分开,每一步都有自己的证据。
阶段结论
性能看板的重点不是把所有数字做得醒目,而是把指标来源、方向和缺失状态讲清楚。DeepInsight 在这一页体现的是结果复核能力:哪些指标存在,来自哪里,如何比较,哪些结论暂时不能下。