按关键词检索

微信服务号

微信订阅号

2025年3月26日 21:47 星期三

查询高级检索+

共找到相关记录1条

全选

显示方式：|

预训练驱动的多模态边界感知视觉Transformer
石泽男，陈海鹏，张冬，申铉京
2023, 34(5):2051-2067.DOI: 10.13328/j.cnki.jos.006768
关键词：模型预训练; 多模态; 视觉Transformer; 边界感知; 图像篡改检测
摘要 (1607)HTML (3080)PDF 9.96 M (5126)收藏
摘要:卷积神经网络（convolutional neural network，CNN）在图像篡改检测任务中不断取得性能突破，但在面向真实场景下篡改手段未知的情况时，现有方法仍然无法有效地捕获输入图像的长远依赖关系以缓解识别偏差问题，从而影响检测精度.此外，由于标注困难，图像篡改检测任务通常缺乏精准的像素级图像标注信息.针对以上问题，提出一种预训练驱动的多模态边界感知视觉Transformer.首先，为捕获在RGB域中不可见的细微伪造痕迹，引入图像的频域模态并将其与RGB空间域结合作为多模态嵌入形式.其次利用ImageNet对主干网络的编码器进行训练以缓解当前训练样本不足的问题.然后，Transformer模块被整合到该编码器的尾部，以达到同时捕获低级空间细节信息和全局上下文的目的，从而提升模型的整体表征能力.最后，为有效地缓解因伪造区域边界模糊导致的定位难问题，构建边界感知模块，其可以通过Scharr卷积层获得的噪声分布以更多地关注噪声信息而不是语义内容，并利用边界残差块锐化边界信息，从而提升模型的边界分割性能.大量实验结果表明，所提方法在识别精度上优于现有的图像篡改检测方法，并对不同的篡改手段具有较好的泛化性和鲁棒性.

共1页1条记录跳转到页GO

出版年份

2023年1