指南图片点击热点测试可用性测试创意测试

图片点击热图能回答什么?从坐标热点到可验证任务

点击题测量特定任务下的选择位置,不等于眼动注意或完整可用性;用预定义目标区域、归一化坐标、错误去向和A/B置信区间形成发布证据。

最近更新 2026年9月2日 13 分钟 阅读

一张结算页热图显示,订单金额旁边有最大、最红的点击团。设计师说“价格区最吸引注意”,产品经理却把它理解成“用户知道优惠码在这里”。两句话都越过了数据:参与者只是根据某条任务指令,在静态图上表达了一个点击位置;热图既没有记录目光,也没有证明后续能找到输入框、理解规则并成功使用优惠。

图片点击题最适合回答空间明确的问题,例如“为了输入优惠码,你第一步会点哪里”“哪一处最像可操作入口”“请指出让这条成分声明难以理解的位置”。它不单独回答喜欢、理解、购买意愿、视觉注视或端到端任务成功。要把热点变成决策,必须预先定义任务和目标区域,保留原始坐标与无点击,再用交互任务和解释性追问验证原因。

先判断问题是否真的需要坐标

研究问题图片点击是否合适更完整的方法
用户认为优惠入口在哪里适合首次点击随后用交互原型验证是否能完成
包装上哪处信息令人困惑适合多点标记逐点追问困惑内容,并做认知访谈
海报是否让人喜欢坐标不是主要结果整体评价、取舍题和开放原因
消费者第一眼看到了什么点击不能等同目光按问题采用眼动、限时回忆或观察研究
按钮在真实流程中是否可用只能做早期静态筛查可操作原型或真实服务任务

“请点击你最喜欢的地方”允许受访者用颜色、人物、文案、品牌或个人记忆等不同标准判断,热点难以解释。若确实要探索喜欢位置,应明确允许多个点,并在每点后询问理由;若要比较整体概念,普通评分和选择任务往往更直接。

任务句必须有目标,又不能泄露界面答案

GOV.UK 的主持式可用性测试指南建议任务目标清楚、与参与者真实相关、足以揭示问题,同时不能暗示完成路径。把这个原则用于静态点击:

  • 差:“请点击右侧订单摘要下的优惠按钮”——位置和控件名已经给出;
  • 差:“哪里看起来最好?”——成功没有共同定义;
  • 好:“你有一张优惠码,希望在付款前使用。你第一步会点击哪里?”

给所有版本使用同一任务句、展示时机和图片上下文。参与者若本就不知道“优惠码”是什么,应记录为目标人群或语言问题,不能用更多界面提示把任务教会后再计算成功。

首次点击和多点标记测量的是不同反应

首次点击在第一次选择后结束,适合导航入口和可发现性;主要结果是目标区命中、错误区域、无点击和点击前时间。多点标记允许指出所有相关位置,适合包装问题、视觉风险或信息审阅;主要结果还包括每人点击数、被标记区域组合和逐点原因。

不要让参与者随意点五次,再把所有点画在同一张热图后称“首次注意”。重复点击会让犹豫者贡献更多颜色,也使一个人影响总热点数超过另一个人。数据必须带参与者标识、点击序号和任务类型,分析时决定按人还是按点计数。

目标区域要在看数据之前画好

以优惠任务为例,产品规格把优惠码入口的可操作按钮和文字标签定义为正确目标区(area of interest,AOI)。订单总额、顶部促销横幅、返回按钮是预先定义的错误区,其余位置归为“其他”;超时或主动选择找不到则为无点击。

事后围着最大热点画一个大圈,会把结论变成自我实现。区域边界应依据可交互控件或明确设计元素,在数据开放前冻结。相邻元素重叠时规定优先级;落在边缘的点可以同时报告严格规则和预先设定的触控容差敏感性,但不能为了提高命中率临时扩大正确区。

区域面积也会影响机会。一个占画面30%的大卡片,即使语义错误也可能比占2%的正确图标收到更多随机点击。除命中率外,报告目标大小、位置和设备;探索性热点可帮助提出新假设,不能替代预注册的主要区域比较。

响应式图片必须保存归一化坐标

同一原图在桌面可能以1000×700像素显示,在手机上缩成360×252。如果只保存屏幕像素 (180,126),两种设备无法叠加。设图像实际显示边界左上角为 (L,T),宽高为 W、H,可保存:

x_norm = (x_click − L) ÷ W;y_norm = (y_click − T) ÷ H

归一化后坐标位于0到1之间,再映射到同一原图或 AOI。每次点击还应保留:

  • 素材稳定标识和版本哈希,而不是“结算页最终版.png”;
  • 原图宽高、实际显示宽高、裁切/留白方式、缩放和旋转;
  • 视口、设备类型、输入方式、设备像素比和页面滚动位置;
  • 点击序号、相对展示的时间、AOI 分类与分类规则版本;
  • 未加载、未点击、超时、跳过和技术失败等非坐标终态。

若 A 版使用完整截图,B 版却在手机自动裁掉顶部,归一化坐标也救不了实验可比性。应使用相同画布、缩放规则和上下文,或明确把裁切方式作为被研究因素。

结算页 A/B 案例:比较命中率,不比较红色深浅

下面是说明性数据。800名符合条件的参与者被随机分到 A、B 两个静态结算页,每版400人,任务均为“使用一张优惠码,你第一步会点哪里?”每人只能点击一次:

首次结果A版B版
正确优惠入口236(59%)292(73%)
订单金额区域8248
顶部促销横幅3622
返回按钮1812
其他/无点击2826
合计400400

B 的首次命中率比 A 高14个百分点。用两个独立比例的常规大样本近似:

SE = √[0.59×0.41÷400 + 0.73×0.27÷400] ≈ 3.31%

14% ± 1.96×3.31% ≈ 7.5% 到 20.5%

若收数前规定“95% 区间下限需高于5个百分点才进入交互验证”,本例达到下一阶段门槛。它仍不等于 B 可以直接上线:静态图没有证明入口可点击、输入框展开正确、错误码可理解或优惠最终生效。区间也只反映这个随机比较下的抽样波动,不覆盖便利样本的代表性偏差、AOI 边界错误和素材加载差异。

错误去向比总命中更有行动价值。A 版有82人点订单金额区,说明用户可能预期优惠与价格汇总放在一起;这是一条待验证解释,而不是点击本身已经证明的原因。随后抽样追问“你希望点击后发生什么”,并在主持式任务中观察语言、布局还是交互反馈导致误判。

热图是可视化,不是统计量

热图颜色取决于点数、核半径、平滑算法、透明度、色阶和图像尺寸。同一批坐标改一个半径,就可能从多个小热点变成一大片红区;两张样本量不同的图使用各自最大值,也会看起来同样“热”。

报告先给参与人数、点击规则、命中与无点击、错误 AOI、时间分布和不确定性,再把热图作为空间辅助。跨版本使用相同坐标、参数和颜色上限,或者明确标准化方式。低频但高风险的错误,例如把“删除订单”当优惠入口,不能因为颜色浅就忽略。

点击位置不是眼动、理解或满意度

参与者可能先看到了正确入口,却因不信任而点击别处;也可能没仔细看,只在大按钮上猜中。点击前时间包含阅读、犹豫和设备操作,不能直接转换成注视时长。若研究问题是视觉注意,应该采用适当的眼动或受控曝光方法;若问题是理解,加入复述或认知访谈;若问题是偏好,单独测整体选择和原因。

NIST 的可用性测试说明强调让代表性用户执行代表性任务,同时结合任务完成、错误、时间和评论等量化与质性数据。GOV.UK 的可用性基准方法也建议同时测成功、用时、放弃和“误以为已经完成”。图片点击覆盖的是可能路径的第一步,不能承担整套可用性结论。

包装和海报热点要防止“元素面积”偷换为“信息有效”

包装研究可以要求“指出最能说明产品用途的位置”或“指出让你担心成分的位置”,但应分别提问。先记录点,再让参与者用自己的话解释看到了什么;最后可问整体可信度、理解或选择。一个大面积人物图最热,只说明更多人选择了该位置,不能说明品牌、卖点或合规信息已被理解。

比较包装版本时保持画布、展示时长、缩放和任务一致,并随机分配素材或平衡顺序。若每人看多个版本,前一版本会教会参与者去找同一位置;应记录展示顺序并按问卷随机化方法控制位置与学习效应。

触控精度和无障碍不是清洗掉的噪声

W3C 对触控目标尺寸的说明强调,手指输入精度较粗,小目标和相邻目标会增加误触,行动受限者影响更明显。因此手机端应按真实视觉尺寸分析目标,不把相邻几个像素的差异解释成完全不同意图;同时记录鼠标、触控笔和触摸输入。

图片承载功能时,W3C 的图片无障碍指南要求替代文本表达相应信息或功能。研究设计还要区分:如果目标就是检验纯视觉发现,无法看图属于研究构念边界,结果不能外推给所有用户;如果点击只是收集意见的界面,则应提供区域列表、键盘选择或文字描述等替代路径,并把作答模式分开记录。不能把辅助技术无法操作产生的空白解释为“没有注意到”。

在问卷派里收坐标后,仍要回到真实任务

使用问卷派的图片点击题时,可按任务决定首次单点或多点标记,并把素材版本、展示顺序、设备与后续追问一起设计。发布前在手机和桌面用四角、边缘和 AOI 边界测试坐标映射,导出后用已知测试点复算归一化位置。

一项图片热点研究完成时,应能交付原始点击表、AOI 规则、命中与错误去向、不确定性、解释性原话,以及下一轮交互原型的验证任务。真正的结论不是“这里最红”,而是“在这个任务、这批人和这版素材中,有多少人把第一步放在预定目标,最常见的错误预期是什么,我们还需要哪项真实操作来证明改版有效”。

点击任务、可用性与无障碍依据