工序刻度 / 01 — 12

12 道工序,把一场比赛变成可对照的条目

爱体育看台的资料库里,每场比赛都以同一种结构存放:先列首发与轮换,再列射门、传球与控球指标, 最后给出同联赛与跨联赛的对照位次。这种一致性不是自然形成的,它来自一套固定执行的工序—— 三个阶段、12 道工序,每一道都有明确的输入、交付物和确认方式。下面把整条链路逐条摊开, 方便你判断一条记录在什么条件下可以被引用、被比较。

12 道工序 / 全部可追溯
3 个阶段 / 采集 · 校验 · 发布
24h 首轮归档窗口
  1. 01 赛前名单入库
  2. 02 基础事件采集
  3. 03 指标首轮录入
  4. 04 轮换结构标注
  5. 05 字段完整性核对
  6. 06 关键指标复算
  7. 07 赛季区间挂接
  8. 08 对照位次生成
  9. 09 首轮归档发布
  10. 10 赛季区间维护
  11. 11 修订版本留痕
  12. 12 长期一致性巡检
阶段一 · 采集

把赛场上的东西先收进来,不急着下判断

工序 01 — 04 · 开赛前 90 分钟至赛后 24 小时 · 4 道工序

这个阶段处理的是原始输入:联赛公布的名单、比赛过程中产生的事件、赛后公报里的统计数字。 采集的动作只有一件事——把能拿到的东西照着统一的字段位放好。缺的项不猜测、不推算, 只在对应位置标注缺在哪里、为什么缺。四道工序按时间先后咬合,前一道没确认,后一道不启动。

多个资料节点汇入同一归档通道的抽象图形
名单来源 · 事件流来源 · 公报来源 三路输入汇入同一份单场条目
  1. 01

    赛前名单入库

    开赛前 90 分钟收齐两队首发与替补名单,按联赛官方发布口径录入姓名、位置、号码与出场状态。 两队先后公布时以最终版为准,早先的版本留在草稿层备查,不覆盖、不删除。

    交付物
    首发名单草稿,含出场名单与替补席共 22 项基础字段
    确认方式
    两名整理员分别独立录入,逐项比对差异后再合并成一份
  2. 02

    赛后基础事件采集

    终场哨响后 30 分钟内,按时间轴录入门球、射门、射正、角球、越位、黄牌与红牌等基础事件。 每个事件绑定发生的分钟数与涉及球员的位置编号,事件顺序以分钟为准,不以公报列举顺序为准。

    交付物
    单场事件流表,按分钟排序,含事件类型与位置编号
    确认方式
    事件总数与联赛公报逐类核对,对不上的项回看录像判断
  3. 03

    指标字段首轮录入

    赛后 24 小时内完成首轮归档,录入射门次数、射正率、传球成功率、控球率与换人节点等主要指标。 每项指标连同它的样本量一起写入,样本量不足的项标明原因,不用估算值填空。

    交付物
    首轮归档条目,32 项字段中的主要指标已完成录入
    确认方式
    按指标工程给出的取值区间过滤异常值,越界项进入二次复核
  4. 04

    轮换结构标注

    把换人节点与阵型变化对应起来,标出首发与轮换的关系:哪些位置属于常规轮换、 哪些是因为伤停或红牌造成的被动调整。这层标注直接决定后续复盘条目怎么写。

    交付物
    轮换标注表,含换人分钟、下场位置与阵型前后对比
    确认方式
    与首发名单、换人节点做时序交叉复核,顺序矛盾即刻退回重标
阶段二 · 校验与标注

让字段能被互相对照,而不是各说各话

工序 05 — 08 · 赛后 24 至 72 小时 · 4 道工序

两列数值与字段并排比对的高亮差异抽象图

能对照的前提是口径一致。这个阶段做三件事:把 32 项字段一项不落地过一遍、对关键指标做独立复算、 把条目挂到正确的赛季区间与轮次上。工序 08 结束之后,一条记录才真正具备横向比较的资格—— 在那之前它只是素材。

  1. 05

    字段完整性核对

    32 项字段逐项检查,记录缺口、缺口持续时间与可能来源。缺失不等于错误, 但要写清楚为什么缺——是联赛没有公布,还是采集窗口内确实没拿到。

    交付物
    字段缺口清单,逐项标注缺口原因与影响范围
    确认方式
    清单中每一行都要写明补录来源与预计补录窗口,写不出来不通过
  2. 06

    关键指标复算

    射正、传球成功率与跑动分布三类指标,由第二个人独立复算一遍,与首轮数值并列摆放看差多少。 重点不是谁对谁错,而是差值有没有超出允许范围。

    交付物
    复算差值表,含首轮值、复算值与差值三列
    确认方式
    差值越过阈值即进入偏差评审,评审结论写进条目备注备查
  3. 07

    轮次与赛季区间挂接

    把每场条目挂到所属联赛的赛季区间与具体轮次上,保证同一支球队在一个赛季里的条目顺序 与真实赛程顺序一致。这一步做错,后面生成的位次会整片错位。

    交付物
    赛季区间索引,按联赛—赛季—轮次三级排列
    确认方式
    检查轮次连续性与前后场次的时间顺序,出现倒挂立即退回重挂
  4. 08

    对照位次生成

    同联赛位次按联赛内部统计口径排出;跨联赛位次额外标注口径差异,比如不同联赛对射正的判定松紧、 对控球率的统计方式是否一致。跨联赛数字只作参考线索,不作结论。

    交付物
    对照位次表,分同联赛与跨联赛两栏并列
    确认方式
    同联赛位次与联赛内部口径核对一致;跨联赛位次必须附带口径差异说明
阶段三 · 发布与维护

条目上线之后,还要在赛季里站得住

工序 09 — 12 · 赛后 72 小时内至整个赛季 · 4 道工序

发布不是终点。条目上线之后要随着赛季推进接受维护:新赛季要接得上、口径调整要留痕、 跨赛季的同名字段要保证说的是同一件事。这四道工序决定资料库能不能被长期信任, 也决定你去年存下的对照记录今年还能不能继续用。

按赛季区间分段的归档刻度抽象图形
2021 赛季 — 2025 赛季 五个赛季区间按同一套字段骨架排列
  1. 09

    首轮归档发布

    赛后 72 小时内补齐全部 32 项字段,把条目正式发布,同时写入所属赛季区间、轮次与路径编号, 并打上口径标签,标明这条记录用的是哪一版统计定义。

    交付物
    上线条目,字段齐全,带赛季区间、轮次与口径标签
    确认方式
    发布前跑一遍字段数与口径标签检测,任一不通过即暂停发布
  2. 10

    赛季区间维护

    新赛季开赛前先把区间骨架搭好:哪些字段沿用、哪些字段新增、哪些字段停用, 都在骨架里写明理由。骨架落地之后再往里填条目,避免赛季进行到一半再动结构。

    交付物
    新赛季区间框架与字段对照说明
    确认方式
    与上一赛季区间逐字段对照,新增项与停用项都要写明依据
  3. 11

    修订与版本留痕

    出现口径调整或数据更正时,改的是新值,留的是旧值。修订记录写明改了什么、依据是什么、 影响哪些场次,读者可以对照前后两版看到差异,而不是只看到最后的结果。

    交付物
    修订记录,含原值、新值、修订依据与受影响的条目编号
    确认方式
    修订记录可在动态中心查到,并能反查回具体场次
  4. 12

    长期一致性巡检

    每个赛季结束前做一次全库巡检,重点看跨赛季同名字段的定义是否仍然一致、 有没有在几次小修订中被悄悄改变了含义。巡检结果直接决定下一赛季的字段骨架怎么定。

    交付物
    巡检报告与下一赛季的字段调整建议
    确认方式
    巡检覆盖全部 32 项字段,跨赛季定义不一致的项必须给出处理结论

异常与返工

出了偏差,流程往哪里走

工序再固定,也会遇到对不上的情况。下面三类是最常出现的,每一类都有约定的判断依据和处理路径, 处理结果一律写回条目,不做无声修补。

  • A 指标缺失 处理路径

    判断依据:该项指标在联赛公开公报中未发布,或在采集窗口内未能取得可靠来源。

    处理路径:先标记为缺项并写明原因;若存在口径接近的替代统计,仅登记为参考值并与本站口径并列显示,不做换算、不做推算。

    影响范围:通常只落在单场条目的个别字段上,不影响该场的其余指标与位次。

  • B 轮次错位 处理路径

    判断依据:条目被挂到了错误的轮次或错误的赛季区间,导致该队条目顺序与赛程顺序不一致。

    处理路径:由校对方发起重挂,重挂完成后重新生成受影响的对照位次;已发布的位次同步更新,并留下一条修订记录。

    影响范围:涉及该轮相关球队的位次,以及引用这些位次的跨赛季对照。

  • C 口径调整 处理路径

    判断依据:某项统计的定义发生变化,或同一名称在不同赛季的实际算法并不相同。

    处理路径:新旧口径并行一段时间,条目同时展示两版数值并标注版本号;在赛季结束前完成取舍,统一后的结论写入下一赛季的字段骨架。

    影响范围:可能覆盖多个赛季的多条记录,调整期间位次表会显示双版本。

由主线与分支组成的抽象流程路径图
主线继续推进,分支进入返工与复核