逆整合性は、2つの空間(例えば2つの画像や座標系)の間の変換または写像に関する数学的性質である。ある写像が、順方向変換とその逆変換を合成したときに恒等変換を生成する場合、その写像は逆整合的であると言われる。実際的には、変換が点Aを点Bに写す場合、逆変換は点Bを正確に点Aに戻さなければならない。この性質は、異なるソースからのデータを整列または比較するタスクにおいて、対称性と信頼性を確保するために不可欠である。
この概念は、医療画像レジストレーションにおいて最も顕著に応用されており、ソース画像をターゲット画像に整列するための変換が計算される。逆整合性がない場合、画像Xを画像Yにレジストレーションした結果は、画像Yを画像Xにレジストレーションした結果と異なる可能性があり、一貫性のない解剖学的対応関係を引き起こす。逆整合性は、レジストレーション結果が画像の順序に依存しないことを保証し、これは縦断研究、マルチモーダル融合、アトラス構築にとって重要である。
画像レジストレーションにおける役割
画像レジストレーションでは、通常、ソース画像とターゲット画像間の類似度メトリックを最適化することによって変換モデルが推定される。U-Netアーキテクチャや残差ネットワークに基づく標準的なアプローチは、しばしば互いに正確な逆変換ではない順方向および逆方向変換を生成する。この非対称性は、特に大きな変形を持つ画像をレジストレーションする場合や、非対称な最適化基準を使用する場合に、バイアスを導入する可能性がある。
逆整合性は、順方向変換と逆方向変換の合成と恒等写像との差をペナルティとして課す正則化項を損失関数に追加することで強化される。この項は、モデルが互いに整合的な変換のペアを生成することを促す。このアプローチは、変換が滑らかで可逆であることが要求される微分同相レジストレーション法や、深層学習技術を活用する深層学習ベースのレジストレーションフレームワークで広く使用されている。
数学的定式化
\( f: X \rightarrow Y \) を順方向変換、\( g: Y \rightarrow X \) を逆方向変換とする。このペアは、\( g \circ f = \text{id}_X \) かつ \( f \circ g = \text{id}_Y \) を満たす場合に逆整合的である。ここで、\( \text{id} \) は恒等写像を表す。実際には、離散化や補間誤差のために完全な等号はめったに達成できないため、条件は緩和され、\( g(f(x)) \) と \( x \) の間、および \( f(g(y)) \) と \( y \) の間の平均二乗誤差などの整合性損失を最小化する。
この定式化は、類似度項や滑らかさ項も含む損失関数に統合されることが多い。例えば、典型的なレジストレーションネットワークでは、総損失は、非類似度項、滑らかさのための正則化項、逆整合性項の重み付き和である。重みは、各目的の重要性のバランスを取るハイパーパラメータである。
医療画像以外の応用
逆整合性は医療画像の文脈で最も一般的に議論されるが、この性質は双方向写像を含む他の分野でも関連する。コンピュータビジョン(提供されたスラッグリストにはないが、この概念はオプティカルフロー推定に適用される)では、逆整合性は、連続するフレーム間で推定された動き場が対称であることを保証するために使用される。自然言語処理(これもスラッグリストにはない)では、言語間翻訳時のシーケンス間モデルに同様のアイデアが現れ、優れた翻訳モデルは理想的には元の入力に近い往復翻訳を生成するべきである。
機械学習より広くでは、逆整合性は、ネットワークが構築によって正確に可逆であるように設計される可逆ニューラルネットワークや正規化フローのアイデアに関連する。しかし、ソフト制約としての逆整合性はより柔軟であり、任意の微分可能な変換モデルに適用できる。
深層学習における実装
現代の深層学習ベースのレジストレーション法は、入力画像ペアから変換パラメータを直接予測するためにニューラルネットワークを採用することが多い。ネットワークは、教師ありおよび教師なし損失の組み合わせを使用して訓練される。逆整合性は通常、逆方向変換を予測する追加の出力ヘッドとして実装され、整合性損失は2つのヘッド間で計算される。このアプローチは、神経画像研究で広く使用されているVoxelMorphやその変種など、いくつかの一般的なフレームワークで採用されている。
訓練プロセスは、確率的勾配降下法またはその変種(Adamなど)を使用してネットワークの重みを最適化することを含む。逆整合性項は正則化子として機能し、訓練データへの過適合のリスクを減らし、未見の画像ペアへのモデルの一般化を改善する。また、異なる初期化にわたる推定変換の分散を減らすのにも役立つ。
利点と限界
逆整合性を強化する主な利点は、レジストレーション結果における系統的バイアスの低減である。また、順方向および逆方向の写像が一貫していることが保証されるため、変換の解釈可能性も向上する。これは、変換が手術計画や放射線治療に使用され、非対称性が誤った線量投与や解剖学的位置ずれを引き起こす可能性がある臨床応用で特に重要である。
しかし、逆整合性を強化すると、訓練中に順方向および逆方向の変換の両方を計算する必要があるため、計算コストが増加する可能性がある。また、モデルが相互に整合的な変換のペアを生成するように制約されるため、順方向変換単独の精度がわずかに低下する可能性もある。実際には、トレードオフはしばしば許容可能であり、堅牢性と対称性の利点が、生の精度のわずかな損失を上回る。
関連概念
逆整合性は、変換モデルにおける対称性の概念と密接に関連している。また、ペアのない画像間変換で使用されるサイクル整合性のアイデアとも接続されており、生成器とその逆変換が元の入力を再構築するように訓練される。数学的基礎は、バークレーAIリサーチや他の学術機関で研究されている微分同相写像と群作用の理論にある。
MIT CSAILやスタンフォードAIラボなどの機関の研究者は、逆整合的レジストレーションアルゴリズムの開発に貢献してきた。この概念は、変換が訓練データに適用されるデータ拡張の文脈でも関連しており、逆整合性は、拡張されたサンプルが曖昧さなく元の空間にマッピングできることを保証する。