C4.05.3Guessability versus recognition reliability设计研究

易学不等于可靠:语义直观的动作仍可能被误判

别名: 直观手势误识别 · intuitive but confusable · 语义好猜

概念解释

用户一眼能猜到“挥手表示下一页”,只说明隐喻对上了,不说明识别器能把这挥手从告别、赶虫、指向别人里分开。易学量的是人能不能想到并做出约定动作;可靠量的是系统能不能在噪声、视角和近邻词条里稳定找回它。语义直观的动作往往正是生活里高频出现的动作,猜得越准,和生活运动的重叠越大,误判风险越高。把引发实验里的高共识直接写成“所以这条手势能上线”,跳过了识别这一维。

机制

引发研究让人给功能配动作,共识高的候选通常来自文化里已经有的符号:挥手、点头、竖拇指、滑动。这些符号在传感器面前的形状距离很近,也和无关运动近。分类器没有“语义”通道,只看轨迹和姿态;两段对用户意义完全不同的运动,在关节角序列上可以几乎一样。教得越好,用户越敢做小、做快、做生活化,模板与真实分布的距离越大,识别更脆。反过来,故意造作的、生活里很少见的动作(先握拳再画星)难猜,但形状距离大,识别可以很稳。易学把词条往生活分布的中心推,可靠要求词条待在分布的空地上,方向相反。

怎么研究

同一条候选先做猜测/引发,得到共识或可猜率;再把它放进连续识别,得到与近邻、与生活运动的混淆。画出“可猜率 vs 混淆”散点,高可猜高混淆的点就是本维要抓住的失败。对照条件:把高共识动作稍微改形(加上一个生活里少见的前缀姿态),看可猜率掉多少、混淆掉多少。不要只用孤立片段上的分类准确率,那会把生活重叠藏起来。报告时分开写“人猜对了功能”和“系统认对了实例”。

边界

封闭、有教学、词表只有两三条时,直观动作的混淆来得及用教学压住。公共场合无教学、词表一扩,结构会回来。用户自定义词表会提高易学,同时把冲突的责任推给用户,系统侧的近邻问题并不消失。眼动或语音若用来做离合器,直观手势的生活重叠被切断,识别压力下降,那是多通道,不是手势自己变可靠了。设计师觉得直观但目标文化里另有含义的动作,会同时打击易学和社交,不只是识别问题。

怎么落地

  • 引发或猜测通过,只能进入候选名单,不能进入发布名单;发布前必须有与生活运动对打的混淆数据。
  • 对高共识候选,优先加一个与命令无关的、可观察的前缀或离合器,而不是指望模型“学会区分挥手告别和挥手翻页”。
  • 产品文案不要写“很自然所以很准”;自然说明好猜,准要另证。

延伸

  • 同组C4.05.1 易学性、识别可靠性、身体舒适度是三类独立证据 · C4.05.2 三者不可用单一「好用」评分合并 · C4.05.4 省力不等于舒适:动作幅度小仍可能姿势负担重
  • 相邻C4.02 迈达斯之触问题 · C4.14 手势词汇表的规模上限
  • 站内检索guessability · gesture confusion · elicitation agreement

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/C4.05.3