用 VLM 对 通用 cricket 图逐张打「动作质量 / highlight 价值」分 — 融合 batting + bowling/fielding 两套 rubric 的统一版。数据源 = vcricket_lei_v3(9.2 万张全场景 cricket)。模型先自判角色(batting/bowling/fielding/wicketkeeping/other),再按该角色的决定性瞬间评分。
scene = 采集时的场景标签(match/training/street/other);action_class = VLM 实读角色。