循环视差是双眼视觉和立体视觉中的一个概念,指投射到两只视网膜上的图像在旋转方向上的差异。与由眼睛横向分离产生并提供主要深度线索的水平视差不同,循环视差涉及一只眼睛的图像相对于另一只眼睛围绕视线方向的旋转。这种旋转差异在自然观看中通常很小,往往小于几度,但在感知三维空间中表面的倾斜和俯仰方面起着重要作用。
人类视觉系统通过视觉皮层中的专门机制处理循环视差,特别是在V1和MT等对方向和运动敏感的区域。这些机制帮助将循环视差与其他深度线索(如单眼线索和运动视差)整合,以产生对环境的连贯感知。研究表明,大脑能够检测到小至几个弧分的循环视差,这证明了其在精细深度辨别中的敏感性和重要性。
历史背景
对循环视差的研究可追溯至19世纪,当时查尔斯·惠斯通和赫尔曼·冯·亥姆霍兹等早期视觉科学家探索了双眼视觉的几何学。惠斯通在1838年发明的立体镜证明,向每只眼睛呈现略有不同的图像可以产生强烈的深度感,为理解视差奠定了基础。然而,循环视差直到20世纪中叶才被系统研究,当时贝拉·尤勒兹等研究人员使用随机点立体图来将视差处理与其他线索分离。尤勒兹在20世纪60年代的工作揭示,视觉系统可以从纯粹的独眼刺激中提取深度,突出了循环视差在整体立体视觉中的作用。
计算模型
在计算机视觉和人工智能领域,循环视差被建模为立体视觉算法中基础矩阵或本质矩阵的一个组成部分。这些模型估计两个相机视图之间的相对旋转和平移,其中循环视差对应于围绕光轴的旋转分量。立体匹配算法通常纳入循环视差校正以提高深度估计精度,尤其是在自动驾驶和机器人技术等应用中。例如,Waymo和特斯拉自动驾驶使用的立体相机系统必须考虑循环视差,以准确感知道路几何和障碍物。深度学习的进展催生了神经网络架构,这些网络能够从大型数据集中隐式学习估计循环视差,从而提高在现实场景中的鲁棒性。
在深度感知中的应用
循环视差对于感知倾斜表面的方向至关重要,例如倾斜的桌面或弯曲的道路。当观察者观看一个不垂直于视线的表面时,视网膜上的图像会发生相对旋转,大脑将其解释为倾斜。这一线索在虚拟现实和增强现实系统中尤为重要,因为准确的深度渲染对用户沉浸感至关重要。索尼AI和谷歌DeepMind等公司已探索利用循环视差开发更逼真的3D显示器和用于场景重建的生成式AI模型。此外,循环视差在医学成像中也发挥作用,其中解剖结构的立体可视化依赖于精确的视差处理。
测量与心理物理学
心理物理学研究使用旋转随机点模式等刺激量化了人类对循环视差的敏感性。这些实验通常呈现一个中央注视点和具有受控旋转偏移的外周刺激,测量观察者能够检测到旋转的阈值。结果表明,敏感性随偏心度和刺激大小而变化,较大且更外周的刺激需要更小的阈值。循环视差与水平视差的整合也受到研究,因为这两种线索相互作用以产生统一的深度感知。视差能量模型等模型已被扩展以解释循环视差,为理解早期视觉区域的神经反应提供了框架。
相关概念
循环视差与其他双眼线索密切相关,包括水平视差、垂直视差和辐辏眼动。水平视差沿水平轴编码深度,而垂直视差提供关于观看距离和头部方向的信息。循环视差专门捕捉旋转差异,这对表面倾斜感知至关重要。在机器学习中,循环视差类似于图像配准和光流估计中的旋转不变性问题,其中算法必须对齐具有不同方向的图像。数据增强和批归一化等技术常用于提高模型对此类变化的鲁棒性。
未来方向
神经科学和人工智能领域的持续研究继续探索循环视差的神经基础及其计算实现。脑机接口和神经形态计算可能受益于对大脑如何编码旋转视差的更深入理解。在自主系统中,将循环视差与LiDAR和雷达等其他传感器模态整合,可以增强在雾天或低光等挑战性条件下的深度感知。随着大型语言模型和Transformer (architecture)架构的进步,它们也可能应用于立体视觉任务,从而可能改善复杂场景中循环视差的解释。