数据表格 (Table)
📋 这是什么?
它是所有图表里最"朴素"的一个,但也是最不可替代的一个:把模型正在使用的数据集,以表格形式原样呈现出来。
当图表告诉你"这个点异常"时,表格告诉你"这个点具体是哪一行、每个变量分别是多少"。
🧐 怎么看?
行标识
每行右侧有一个小标签,标明这一行属于哪个数据集:
| 标签 | 含义 |
|---|---|
| TR | 训练集 (Train) |
| TE | 测试集 (Test) |
💡 如果某个样本的预测表现很差,先看它是 TR 还是 TE——测试集上的失败才是真正值得关注的。
数值高亮
- 图表中被套索选中的行会以红色 / 蓝色底色标记
- 当「显示预测值」打开时,预测列会以特殊样式区分
🛠️ 怎么用?
顶部工具栏提供五组控制:
1. 数据集筛选
| 选项 | 显示内容 |
|---|---|
| 全部数据 | 训练集 + 测试集 |
| 仅训练集 | 只看 TR 行 |
| 仅测试集 | 只看 TE 行 |
2. 选中行筛选
配合套索或 Shift / Ctrl + 点击使用:
| 选项 | 显示内容 |
|---|---|
| 红色选中行 | 你在图表里圈的红组 |
| 蓝色选中行 | 你在图表里圈的蓝组 |
💡 这是核对圈选是否准确的最佳方式:圈完之后切到「红色选中行」,逐行检查有没有圈错。
3. 表头显示切换
| 开关 | 效果 |
|---|---|
| 显示别名 | 表头显示变量的中文名称 |
| 显示全名 | 表头显示变量的英文点位名 |
4. 预测值开关
- 显示预测值 —— 在原始 Y 列旁边展示模型预测值,可直接对比
- 隐藏预测值 —— 只看原始数据
5. 搜索样本 ID
右上角提供搜索框,输入样本 ID 即可快速定位到某一行。
💡 实战用法:AI 清洗报告里点名了"样本 3394 异常",直接在搜索框输入
3394就能跳到那一行,查看它的全部变量取值。
🎯 典型用法
- 核对异常样本:从 AI 报告拿到样本 ID → 搜索定位 → 逐列检查
- 核对圈选结果:切到「红色选中行」确认分组是否正确
- 检查数据质量:肉眼扫一遍原始值,发现单位错误、录入手误
- 对比预测与真实:打开「显示预测值」,找偏差最大的行
⚠️ 表格展示的数据量受当前模型的数据集范围限制;若需完整原始数据,请到 实例列表 → 下载 导出 CSV。