arXiv (CV)AI
最先端のAI画像編集モデルから画像を保護する技術「VETO」の開発
VETO: Towards Protecting Images From Frontier AI Editing
この記事についてAIに質問する →
日本語要約青い用語にマウスを合わせると解説が表示されます
画像編集AI技術の急速な進化に伴い、新たなセキュリティ課題が浮上している。FLUX.2をはじめとする高性能な画像編集モデルが広く利用可能になったことで、単なる局所的な編集にとどまらず、物体や人物のアイデンティティを全く新しいシーンに抽出・再配置するといった複雑な操作が可能になった。これらのモデルがプロンプトと生成トークンを参照画像トークンに直接アテンション(注視)させることで、従来の編集と文章から画像を生成するテキスト・ツー・イメージ合成の境界が曖昧になっている。この拡張された生成能力は、悪意のある画像変換の空間を大幅に広げ、有害な用途の可能性を増加させている。
既存の反編集防御技術は、従来の拡散型パイプラインにおける参照画像エンコーディングのセマンティックボトルネック(情報の絞り込み部分)を破壊することに設計されていた。しかし、最新の編集モデルはジョイント・アテンションブロックを通じて参照情報を抽出するため、これらの既存防御をしばしば回避してしまう。
こうした状況に対応するため、研究チームはVETOと呼ばれる微妙な反編集クローク技術を開発した。この技術は、モダンなモデルが元の画像を読み込むための内部メカニズムを破壊することで機能する。同時に、既存の編集ベンチマークが包括的な再文脈化をほぼ検証していないという課題に対応するため、VetoBenchと呼ばれる新しい評価ベンチマークも導入された。VetoBenchは従来の局所的な編集だけでなく、より広範な文脈的シフトも含めて防御技術を評価する。2つの最新編集モデルと3つのベンチマークでの評価結果から、VETOは既存の防御技術を一貫して上回る性能を発揮し、保護性能と画像品質のトレードオフでもより優れたバランスを実現している。