“别看镜头”法则:如何真正进行眼神交流
想象你正在参加视频通话,想要让自己看起来像是在直视朋友的灵魂。你的本能会告诉你,要盯着那个小小的黑色摄像头镜头。你会想:“如果我看着镜头,他们就会觉得我在看他们。”
论文指出:你错了。
根据这项研究,如果你直接看着摄像头镜头,你的朋友实际上会觉得你是在略微向上看他们。要让他们感觉你正在完美地进行眼神交流,你需要将视线稍微低于摄像头。
以下是研究人员如何运用简单类比来阐明这一发现的解析。
1. “甜蜜点”类比
不要把摄像头镜头看作一个需要正中靶心的目标,而要把它想象成飞镖靶的靶心,而“获胜”的那支飞镖实际上位于中心点的正下方。
研究人员发现,完美的注视点位于摄像头镜头下方约2 度的位置。
- 直观理解 2 度:如果你将拇指伸直举在手臂前方,那个角度大约就是 2 度。因此,你需要将视线略微低于镜头,大致对准你自己鼻梁的根部(或者屏幕上对方鼻子的顶部)。
2. 他们是如何测试的(“演员”游戏)
研究人员并非凭空猜测,而是进行了一项严格的实验。
- 设置:他们雇佣了四名“演员”,让他们坐在网络摄像头前。他们使用高科技眼动追踪眼镜,确保演员们确实按照指示看向特定位置。
- 技巧:演员们被要求看向屏幕上的不同点:有些在高处,有些在镜头正前方,有些在较低处。
- 控制:为了确保演员不会通过移动头部来作弊,他们使用了类似牙科椅使用的下巴托架,以保持头部完全静止。
- 测试:他们拍摄了演员们注视所有这些不同位置的照片。随后,他们向 17 名普通人展示这些照片,并询问:“这个人是在看着你吗?”以及“他们是在向上看还是向下看?”
3. 令人惊讶的结果
当演员们直接看着摄像头镜头时,观看照片的人表示:“不,他们是在略微向上看。”
然而,当演员们看着镜头下方 2 度的位置(即鼻梁根部)时,观看者则表示:“是的!他们正在直视我。”
事实证明,直接注视镜头会产生一种视觉错觉,让你的眼睛看起来像是在向上看。为了抵消这种错觉,你必须瞄准稍低的位置。
4. 为什么会发生这种情况?
该论文提出了几个关于我们大脑为何如此构建的原因:
- 眼睑效应:当你向上看时,你的上眼睑会向下移动以覆盖更多的眼球,这很明显地表明你在向上看。而当你向下看时,你的下眼睑移动幅度较小,因此你的眼睛看起来更加“中性”。
- “社交安全网”:在现实生活中,当我们与某人交谈时,我们通常会注视他们面部的中间(鼻梁根部),以捕捉他们的情绪和嘴部动作。我们的大脑习惯于将注视鼻子的目光解读为“眼神交流”。
- “宁可错杀,不可放过”理论:如果我们不能 100% 确定某人是否在看着我们,我们的大脑倾向于假设他们正在看着我们。由于向下看不像向上看那样会显著改变眼睛的形状,我们的大脑更有可能说:“是的,他们在看着我”,即使他们稍微偏离了一点。
5. 这对你的意义(根据论文)
该论文明确提到了两种利用这一发现的方法:
- 拍照:如果你想要一张自拍或肖像照,让自己看起来像是在与观看者建立联系,请不要看镜头。看着你的鼻梁根部,或者镜头正下方的一个点。
- 视频会议:未来的软件可以构建为自动调整你的视线。如果你正看着屏幕(那里显示着对方的脸),软件可以在视频流中将你的眼睛略微向下偏移,从而使对方感觉你正在与他们进行眼神交流。
核心结论:停止盯着摄像头的“眼睛”看。要进行眼神交流,请看着它的下方。这是一个微小的调整,但它会让你与另一端的人感觉到的连接感产生巨大的差异。
以下是论文《不要看摄像头:实现感知眼神交流》的详细技术总结。
1. 问题陈述
在视频中介通信(如电话会议、远程会议)和摄影中,实现眼神交流的感知是一个关键的社会线索。传统智慧认为,要在二维显示屏上看起来像是在与观看者进行眼神交流,主体必须直视摄像头镜头。
然而,作者假设这种直觉是错误的,因为三维交互与二维渲染之间存在几何和感知差异。核心研究问题是:主体应相对于摄像头镜头将视线投向何处,以最大化观看者对眼神交流的感知?
2. 方法论
作者进行了一项严格控制的用户研究,以量化最佳视线偏移量。
刺激获取:
- 参与者: 拍摄了 4 名演员(3 男 1 女)。
- 设备: 使用与演员眼睛水平对齐的 Logitech C920x HD Pro 网络摄像头。
- 视线控制: 与以往研究不同,本实验使用**眼动追踪系统(Vpixx Trackpixx)**来验证演员在拍摄图像前是否固定在特定点上。
- 注视点: 演员被指示固定在相对于摄像头镜头(0°)的 11 个垂直点上,范围从**-7°到 +7°**(视角度数)。负值表示看向镜头上方;正值表示看向镜头下方。
- 约束条件: 为消除噪声,演员使用下巴托以防止头部移动。仅当演员的视线偏差在目标值的**0.5°**以内时才捕获图像。
- 观看距离: 图像在两个距离(20 英寸和 24 英寸)下捕获,以模拟典型的台式机/笔记本电脑设置。
感知实验:
- 参与者: 17 名人类受试者(平均年龄 22.3 岁)观看了收集的 88 张图像(4 名演员 × 11 个视线偏移 × 2 个距离)。
- 程序: 受试者坐在距离显示器 23 英寸处。他们以随机顺序观看每张图像两次。
- 任务: 对于每张图像,受试者回答两个问题:
- “你是否感知到演员正直视你?”(是/否)
- “你是否感知到演员在看上或看下?”(上/下)
- 置信度: 受试者为每个回答提供置信度评级(1–5 分制)。
数据分析:
- “是”回答: 将高斯分布拟合到不同视线偏移下“是”回答的比例,以找到峰值(最佳眼神交流)。
- “下”回答: 将心理测量函数拟合到“下”回答,以确定主观相等点(PSE)。
3. 关键结果
该研究得出了反直觉但具有统计显著性的结果:
- 最佳视线偏移: 当演员看向摄像头镜头下方约 2°时(具体而言,基于高斯峰值为1.76°),眼神交流的感知达到最大化。
- 统计显著性:
- 从零(直视镜头)的偏移对于“是”回答具有显著性(t(16)=4.45,p<0.0001)。
- 对于“上/下”感知,偏移也具有显著性(t(16)=6.19,p<0.0001)。
- 容忍范围: 虽然峰值位于镜头下方约 2°,但在**0°到镜头下方 3°*之间的视线偏移范围内,眼神交流的感知仍然很高。直视镜头(0°)会导致观看者感知到主体正略微向上*看。
4. 主要贡献
- 对传统智慧的实证修正: 该论文提供了定量证据,证明直视镜头并不能产生最佳的眼神交流;略微看向镜头下方更优。
- 方法论的严谨性: 与 prior 研究不同,本研究采用了:
- 实时眼动追踪以确保图像捕获期间的精确固定。
- 头部/下巴约束以消除头部移动伪影。
- 受控对齐,使演员的眼睛水平与摄像头对齐,观看者的眼睛水平与显示的图像对齐。
- “最佳点”的量化: 作者确定了一个特定的角度偏移(约 2°视角),以优化感知到的相互关注的“视线锥”。
5. 讨论与理论解释
作者提出了几种解释,说明为什么略微向下看能产生更好的眼神交流:
- 解剖学因素: 当向上看时,上眼睑会显著移动,改变可见的巩膜(眼白)。当向下看时,下眼睑保持相对固定,使得虹膜位置的变化不太明显,这可能会使观察者倾向于感知为眼神交流。
- ** snap to contact 理论(接触锁定理论):** 观察者可能有一种偏见,即除非确定视线已避开,否则假设存在眼神交流。由于向下看产生的巩膜变化不太明显,观察者默认认为是“眼神交流”。
- 进化/社会线索: 在面对面互动中,看向鼻子的一半位置允许一个人同时感知来自眼睛、鼻子和嘴巴的线索。作者认为,人类已进化为将这种特定的向下视线归类为“投入”或“进行眼神交流”。
6. 意义与应用
- 摄影: 摄影师和自拍者可以通过指示主体看向鼻梁或镜头下方的一点,来改善肖像中的感知连接。
- 视频会议系统: 这一发现使得开发视线校正算法成为可能。未来的软件可以自动调整用户在垂直轴上的渲染视线(将其略微向下重定向),以补偿摄像头的位置,从而创造更自然、更具吸引力的远程通信体验。
- 人机交互(HCI): 该研究强调了数字环境中非语言线索的复杂性,并强调需要设计系统来考虑感知偏见,而不仅仅是几何准确性。
7. 局限性与未来工作
- 静态与动态: 本研究使用了静态图像。未来的工作应调查动态实时视频对话中的视线感知。
- 可变条件: 本研究未充分考虑显示器尺寸、坐姿距离或相对于用户眼睛的网络摄像头位置的变化。
- 持续时间: 本研究未测量用户在对话中偏好维持相互注视的时间长度。
每周获取最佳 computer science 论文。
受到斯坦福、剑桥和法国科学院研究人员的信赖。
请查收邮箱确认订阅。
出了点问题,再试一次?
无垃圾邮件,随时退订。