做行为编码时,一个动作可能有多种解释。人是在犹豫、与旁人说话,还是等待设备?编码表有了,情境判断仍然存在。
设计 BehaviorLens 时,我把处理拆成扫描候选片段、细看候选段、结合编码表整理结果三遍,希望每一步都能被检查。
拆开以后,新的问题也显露出来
第一遍漏掉的事件,后两遍如果只看候选段,就没有机会发现。不能因为流程有三遍,就认为它自然更可靠。
因此验证要同时看已生成的标签和原始视频中被遗漏的部分。需要比较漏检、误检、编码一致性,以及人工复核总共花了多少时间。
现在能说到哪里
目前完成的是概念、架构和原型准备。20 分钟处理仍是设计目标,真实研究数据上的速度和质量没有完成验证。
我选择分三遍,是为了保留定位和修正问题的位置。它是否比其他方式更好,要等对照结果出来;能解释设计理由,还不足以证明设计有效。