父议题
#58 结构优先分层识别内核(L1–L5)
背景
PDF 版谱行识别整体可用后,发现页末短行易被漏检。
现象
最后一行若小节数较少(短行 / 不满行 / 残句),L2 往往不识别为谱行,导致:
- 末行音符整体缺失
- 双谱对照末段空白
- 结构叠图 L2 在页底没有对应 system
可能原因
- 水平投影:短行 ink 总量低于
thr(相对 max 或页宽比例)
- 聚类:与上一行 gap 异常,或末簇被当成 noise
- 绑定:aux/pitch 分类后 pitchness / digit 数量不够被丢弃
- L3:即使 L2 有框,小节过少时下游也可能被滤掉(需一并核对)
期望
- 页末短旋律行仍输出为
StaffSystem(允许 confidence 略低)
- 不因「小节数少」在 L2 阶段丢行;小节数应由 L3 反映,而不是消灭 system
建议方向
- 降低页底 band 的 ink 阈值 / 使用局部自适应阈值
- 对 score ROI 底部单独做一轮弱峰值检测
- 合成单测:多行满行 + 最后一行仅 1–2 小节 ink → 仍检出 N+1 个 system
验收
相关
父议题
#58 结构优先分层识别内核(L1–L5)
背景
PDF 版谱行识别整体可用后,发现页末短行易被漏检。
现象
最后一行若小节数较少(短行 / 不满行 / 残句),L2 往往不识别为谱行,导致:
可能原因
thr(相对 max 或页宽比例)期望
StaffSystem(允许 confidence 略低)建议方向
验收
len(systems)含末行相关
core/app/pipeline/structure/l2_systems.py