当前位置: 首页 > article >正文

ICLR 2026 Oral | 让大模型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测

生成式AI的狂飙突进让“眼见为实”成为了过去式。从高度逼真的AI换脸到一键生成的超清虚假人像深度伪造技术带来的安全隐患正日益引起社会的广泛关注。然而面对层出不穷的新型伪造技术现有的检测器往往在“跨域”和“未知伪造类型”面前败下阵来。论文Veritas: Generalizable Deepfake Detection via Pattern-Aware Reasoning链接https://arxiv.org/pdf/2508.21048代码https://github.com/EricTan7/Veritas数据https://www.modelscope.cn/datasets/EricTanh/HydraFake模型https://www.modelscope.cn/models/EricTanh/Veritas在这一背景下中国科学院自动化研究所联合蚂蚁集团提出了一种基于模式推理的多模态大语言模型深度伪造检测框架创造性地赋予了大模型类似人类法医专家的“模式感知推理”Pattern-aware Reasoning能力不仅“准”而且决策“透明”。背景现有的深伪检测器总在“实战”中表现不佳目前Deepfake检测研究通常遵循“在单一数据集上训练在多个数据集上测试”的评估协议与实际场景存在严重脱节在实际应用中往往拥有海量的训练样本但测试时则会遭遇前所未见的伪造手法和高质量合成图像的挑战。另一方面虽然多模态大模型在图像理解上展现了惊人的能力但在直接用于深度伪造检测时依然非常吃力。其倾向于根据高层语义线索如光影、环境来判断图像的真实性缺乏对于细微线索的感知和推理能力。破局点一HydraFake —— 更贴近实战的深伪检测基准研究团队精心构建了HydraFake数据集核心特点包括数据来源高度多样化收集了来自经典伪造数据集以及10种先进伪造技术自行生成的攻击10万张图像。真图涵盖8个公共数据集的高清、低清图像假图整合经典换脸、社交媒体商用平台GPT-4o、即梦生成内容还包含人脸重打光、修复、定制化生成等最新伪造手法的样本。全新的训练-评估协议训练数据包含丰富的伪造样本而评估则包含极具挑战性的分布外测试。为了模拟实际场景中的未知挑战评估被划分为“域内”、“跨生成式模型”、“跨伪造方式”、“跨数据域”四个测试层级。实验表明现有SOTA检测器虽然在“跨生成式模型”场景表现良好但在更具挑战性的“跨伪造方式”和“跨数据域”场景中性能急剧下降凸显了现有检测器的关键泛化瓶颈。破局点二Veritas —— 让大模型学会“像法医一样思考”| 模式感知推理Pattern-Aware Reasoning为了激发MLLM在Deepfake检测上的潜力研究团队没有采用传统的思维链CoT或事后解释机制而是提出了一种结构化的“模式感知推理”框架提取了五种关键的思维模式快速判断Fast Judgement基于第一印象做出快速判断。规划Planning面对具有挑战性的样本时进行分层分析和结构化规划。取证分析Reasoning从结构、纹理、物理规律、语境合理性等多个维度寻找证据。反思Self-reflection在推理过程中进行批判性思考以支持或推翻最初的判断。总结Conclusion综合所有证据得出最终的判断。上图清晰地展示了Veritas与其他模型包括GPT-4o在输出上的差异。Veritas不仅给出了正确答案其推理过程如反思“等一下还有一个细节要考虑...”也更透明、更接近人类思维从而更具说服力。| 两阶段训练流程为了将这些侦探般的能力无缝内化到多模态大模型中团队设计了一个两阶段训练流程阶段一模式引导的冷启动。首先通过监督微调SFT注入思维模式。然而SFT极易带来过拟合问题模型倾向于产生死记硬背、模板化的推理过程如“皮肤纹理过于光滑”等。为此团队引入了混合偏好优化MiPO策略利用混合的非偏好数据和人类标注的偏好数据引导模型进行忠实且细粒度的推理有效缓解了死记硬背的行为大幅提升了推理质量。阶段二模式感知探索。冷启动后模型具备了基础推理能力但在面对更棘手的伪造样本时其自主反思和深入推理能力仍然不足。为此团队提出P-GRPO算法通过模式感知奖励机制和GRPO在线采样在模式粒度上激励模型产生自适应的“规划”和“自我反思”行为提升了在困难样本上的能力上限。实验效果超越现有检测器不仅准而且“透明”研究团队在HydraFake数据集上将Veritas与16款主流深度伪造检测模型以及6款通用多模态大模型进行全面对比。全场景领先高难度场景优势突出Veritas在域内、跨模型、跨伪造方式、跨数据四大测试场景均取得SOTA性能尤其在最具挑战性的跨伪造方式、跨数据域场景相较传统模型优势明显平均检测准确率超90%远超同类可解释检测大模型相较FakeShield、FakeVLM等领域内大模型Veritas泛化优势显著相较基础模型InternVL3-8BVeritas平均准确率提升32.4%即使是GPT-4o、Gemini-2.5-Pro等高性能闭源大模型Veritas也实现了11.8%的准确率领先。“白盒”般的透明决策除了极高的检测准确率Veritas最亮眼的一点是它能够端到端地输出透明、符合人类逻辑的决策过程。如上图它可以像法医一样精准分析伪造瑕疵让最终的“Real”或“Fake”判定有理有据。此外消融实验验证了模式感知推理、两阶段训练的有效性其中模式感知推理让跨伪造手法、跨域场景的检测准确率分别提升6.2%和3.3%。未来方向研究团队已将训练数据、Veritas模型、冷启动模型全部开源为社区提供了良好的扩展性随着深伪手段不断进步未来的防御工作方向可以是大小模型协同统一“高层语义理解”与“底层伪影感知”现有多模态大模型虽然在全局语义理解和复杂逻辑推演上展现出显著优势但其底层伪影感知能力仍不足如Veritas在低分辨率图像上仍有提升空间而小模型则擅长以“黑盒”方式拟合底层数据分布因此是否能够综合两者的能力通过“显微镜”与“最强大脑”的协同以实现更全面的泛化。更细粒度的多模态奖励信号现有P-GRPO算法仍是文本级别的奖励信号未来可以设计更细粒度的跨模态监督信号从视觉特征和文本逻辑双重维度去约束模型的探索轨迹从而更有效地抑制多模态大模型在深伪检测中的“幻觉”。统一图像与视频深伪检测能力随着Seedance 2.0等视频生成模型的出现深伪视频的隐患日益加剧。未来的防御框架必将突破单图检测的桎梏构建跨越图像与视频模态的统一认知架构在动态的视频流中精准锚定深伪技术的“致命破绽”。总结针对深伪检测泛化难题研究团队构建了深伪检测基准HydraFake并提出多模态大模型检测框架Veritas通过创新的“模式感知推理”机制大幅提升了模型应对未知伪造手段的泛化与可解释能力为深度伪造检测技术提供了全新思路。

相关文章:

ICLR 2026 Oral | 让大模型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测

生成式AI的狂飙突进,让“眼见为实”成为了过去式。从高度逼真的AI换脸,到一键生成的超清虚假人像,深度伪造技术带来的安全隐患正日益引起社会的广泛关注。然而,面对层出不穷的新型伪造技术,现有的检测器往往在“跨域”…...

ChatGPT文献阅读:技术原理与高效实践指南

面对海量的学术文献,科研人员常常感到力不从心。信息过载导致难以抓住重点,复杂的专业术语构成理解壁垒,而不同文献之间的知识关联更是难以手动梳理和建立。传统的阅读方式,如逐字精读或依赖简单的关键词搜索,在效率和…...

AI绘画模型优化:低配置设备的显存优化技巧与部署方案

AI绘画模型优化:低配置设备的显存优化技巧与部署方案 【免费下载链接】flux1-dev 项目地址: https://ai.gitcode.com/hf_mirrors/Comfy-Org/flux1-dev 轻量级AI绘画技术正在改变创意工作的门槛,特别是FLUX.1-dev FP8量化模型的出现,让…...

【QT】——QChartView与QChart实战:从零构建动态数据可视化界面

1. 为什么选择QChartView与QChart? 在开发需要数据可视化的桌面应用时,QT的QChartView和QChart组件绝对是首选方案。我做过不少工业监控项目,从早期的QWT到现在的QChart,最大的感受就是这套组件既保留了专业图表库的灵活性&#x…...

SAP Smartforms中QUAN字段的完整配置指南:避免SSFCOMPOSER 601错误的5个关键步骤

SAP Smartforms中QUAN字段的完整配置指南:避免SSFCOMPOSER 601错误的5个关键步骤 在SAP Smartforms开发过程中,处理货币和数字字段时经常会遇到SSFCOMPOSER 601错误。这个看似简单的错误背后,实际上隐藏着SAP系统对QUAN类型字段的特殊处理机制…...

MATLAB实战:5分钟搞定AM调制解调(附完整代码+避坑指南)

MATLAB实战:5分钟搞定AM调制解调(附完整代码避坑指南) 在通信工程领域,幅度调制(AM)是最基础的模拟调制技术之一。无论是广播电台的信号传输,还是无线通信系统的原型验证,AM调制解调…...

SuperMap iClient for OpenLayers保姆级教程:从零配置到多坐标系地图加载

SuperMap iClient for OpenLayers实战指南:多坐标系地图加载全解析 当你第一次接触SuperMap iClient for OpenLayers时,可能会被各种坐标系和配置选项搞得晕头转向。作为地理信息系统(GIS)开发中的重要工具,OpenLayers与SuperMap的结合为开发…...

5大核心优势打造个性化摄影体验:给创意实践者的开源解决方案

5大核心优势打造个性化摄影体验:给创意实践者的开源解决方案 【免费下载链接】photobooth A flexible photobooth software 项目地址: https://gitcode.com/gh_mirrors/pho/photobooth 项目价值:解锁摄影棚的无限可能 如何用开源方案降低专业摄影…...

STM32F407串口乱码终极解决方案:正点原子与野火开发版时钟配置差异详解

STM32F407串口乱码终极解决方案:正点原子与野火开发版时钟配置差异详解 当你同时使用正点原子和野火的STM32F407开发板时,是否遇到过这样的困扰:同样的代码在一个板子上运行正常,换到另一个板子却出现串口乱码?这背后隐…...

OpenCV图像透视变换:自动矫正倾斜的发票

1. 引言 在日常生活中,用手机拍摄的文档照片往往因为拍摄角度而产生透视畸变——原本方正的纸张变成了不规则的四边形,导致文字歪斜,影响阅读和OCR识别。透视变换技术可以将图像中任意四边形区域“拉正”为矩形,完美解决这一问题…...

安装程序本地化完全指南:从基础配置到深度定制

安装程序本地化完全指南:从基础配置到深度定制 【免费下载链接】Inno-Setup-Chinese-Simplified-Translation :earth_asia: Inno Setup Chinese Simplified Translation 项目地址: https://gitcode.com/gh_mirrors/in/Inno-Setup-Chinese-Simplified-Translation …...

比PS更好用!用ComfyUI+LaMa模型智能抹除照片杂物(保姆级教程)

比PS更好用!用ComfyUILaMa模型智能抹除照片杂物(保姆级教程) 在数字图像处理领域,去除照片中的干扰元素一直是摄影师和设计师的刚需。传统工具如Photoshop的仿制图章和内容识别填充虽然有效,但面对复杂场景时往往需要…...

老版本Quartus如何生成JIC文件?EPCQ32A烧录避坑指南

老版本Quartus生成JIC文件实战:EPCQ32A烧录全流程解析 在FPGA开发领域,Altera(现Intel PSG)的老型号芯片如EP2C、EP3C系列至今仍广泛应用于工业控制、通信设备等场景。这些经典器件通常搭配Quartus II 11.0等早期开发环境&#xf…...

开箱即用的PyTorch环境有多香?Universal-Dev-v1.0实际使用体验分享

开箱即用的PyTorch环境有多香?Universal-Dev-v1.0实际使用体验分享 1. 为什么选择预配置的PyTorch环境 深度学习开发环境的搭建一直是让开发者头疼的问题。从CUDA驱动安装到各种Python依赖包的版本冲突,一个完整的PyTorch开发环境往往需要花费数小时甚…...

GME-Qwen2-VL-2B-Instruct创意应用:辅助Typora等Markdown编辑器进行图文内容创作

GME-Qwen2-VL-2B-Instruct创意应用:辅助Typora等Markdown编辑器进行图文内容创作 如果你经常用Typora这类Markdown编辑器写东西,不管是技术博客、学习笔记还是项目文档,肯定遇到过这个场景:文章里插了张图,然后光标停…...

颠覆式文本转3D建模:Zoo Text-to-CAD UI如何重构设计行业工作流

颠覆式文本转3D建模:Zoo Text-to-CAD UI如何重构设计行业工作流 【免费下载链接】text-to-cad-ui A lightweight UI for interfacing with the Zoo text-to-cad API, built with SvelteKit. 项目地址: https://gitcode.com/gh_mirrors/te/text-to-cad-ui 在现…...

PHPStudy环境下部署Snort IDS的5个关键步骤与避坑指南

PHPStudy环境下部署Snort IDS的5个关键步骤与避坑指南 在Windows开发环境中,PHPStudy因其便捷的一键部署特性成为许多开发者的首选工具。但当我们需要在本地搭建网络安全实验环境时,传统Linux教程往往难以直接套用。本文将针对PHPStudy集成环境特点&…...

Silvaco TCAD新手必看:DeckBuild从安装到跑通第一个例子的完整指南

Silvaco TCAD新手实战:从零开始掌握DeckBuild的完整路径 第一次打开DeckBuild时,那个充满专业术语的界面可能会让你感到不知所措——这正是三年前我刚接触TCAD仿真时的真实感受。作为半导体器件仿真领域的工业标准工具,Silvaco TCAD确实存在一…...

QQ群活跃度分析指南:用Python绘制聊天时间热力图和词云

QQ群活跃度分析指南:用Python绘制聊天时间热力图和词云 在社群运营和数据分析领域,了解群成员的活跃规律和讨论热点是优化运营策略的关键。本文将带你用Python实现三种专业级可视化:聊天时间热力图、成员活跃雷达图和话题词云,直接…...

Matlab R2021b窗口编程避坑指南:解决uitextarea的Value属性问题

Matlab R2021b窗口编程避坑指南:解决uitextarea的Value属性问题 在Matlab GUI开发中,窗口与子窗口的交互设计是常见需求。R2021b版本对App Designer组件进行了多项优化,但部分旧版特性仍存在兼容性问题。本文将深入剖析uitextarea组件的Value…...

智能文献处理:用Zotero PDF2zh插件提升学术效率的完整指南

智能文献处理:用Zotero PDF2zh插件提升学术效率的完整指南 【免费下载链接】zotero-pdf2zh PDF2zh for Zotero | Zotero PDF中文翻译插件 项目地址: https://gitcode.com/gh_mirrors/zo/zotero-pdf2zh 学术研究中,英文文献阅读往往成为科研人员的…...

深入解析SysTick定时器:从基础原理到高效延时实现

1. SysTick定时器基础解析 SysTick定时器是Cortex-M系列处理器内置的一个24位倒计时定时器,它就像嵌入式系统里的"心跳计数器"。我第一次接触STM32开发板时,发现所有例程的延时函数都基于这个不起眼的定时器,当时就很好奇为什么不用…...

OpenClaw到底是啥?能做什么?怎样部署?一文讲透!

2026年初,一只“小龙虾”席卷了科技圈,它不是夜宵摊上的美味,而是一款名为OpenClaw的开源AI智能体。本文将带大家从零开始,一文讲透OpenClaw到底是啥?能做什么?怎样部署?助力大家轻松有拥有专属…...

Mathtype公式编辑:在SUNFLOWER MATCH LAB技术文档中插入数学公式

Mathtype公式编辑:在SUNFLOWER MATCH LAB技术文档中插入数学公式 写技术文档,尤其是像SUNFLOWER MATCH LAB这类涉及算法、模型的项目文档时,最头疼的事情之一,可能就是如何优雅地插入那些复杂的数学公式。你肯定不想用一堆混乱的…...

若依代码生成的隐藏技巧:如何自定义生成模板实现个性化CRUD页面

若依代码生成器深度定制:从模板修改到个性化CRUD实战 在快速迭代的企业级应用开发中,若依框架的代码生成器无疑是提升效率的利器。但大多数开发者仅停留在基础使用层面,未能充分挖掘其定制化潜力。本文将揭示如何通过修改Velocity模板实现高度…...

Fiddler Everywhere在M1/M2芯片Mac上的性能优化指南(2024最新版)

Fiddler Everywhere在M1/M2芯片Mac上的性能优化指南(2024最新版) 当你在M1 Pro芯片的MacBook Pro上第一次启动Fiddler Everywhere时,是否注意到那个转圈的小彩虹图标?这背后是Rosetta 2在默默进行指令转译。作为一款尚未完全适配A…...

Fish Speech 1.5真实应用:远程医疗问诊语音记录转患者可听版

Fish Speech 1.5真实应用:远程医疗问诊语音记录转患者可听版 想象一下这个场景:一位医生刚刚结束一场远程视频问诊,他需要将整个问诊过程的录音整理成一份清晰、易懂的文字记录,然后发给患者。传统的做法是,医生或助理…...

告别杂乱文本!用BERT中文分割模型,3步搞定会议记录智能分段

告别杂乱文本!用BERT中文分割模型,3步搞定会议记录智能分段 1. 引言:从“文字墙”到清晰段落 想象一下这个场景:你刚开完一场两小时的线上会议,录音转文字工具很给力,生成了上万字的记录。但当你打开文档…...

LVGL_V8.3进阶一:圆形表盘UI的动效与数据可视化设计

1. 圆形表盘UI的动效设计基础 在智能穿戴设备的界面设计中,动效不仅仅是视觉点缀,更是提升用户体验的关键要素。LVGL_V8.3的动画系统基于关键帧和缓动函数,我们可以通过lv_anim_t结构体实现指针旋转、数据变化等效果。比如要让秒针实现平滑转…...

打造专属数字人助手:lite-avatar形象库多职业角色应用案例

打造专属数字人助手:lite-avatar形象库多职业角色应用案例 1. 从想法到现实:为什么你需要一个数字人助手 想象一下,你的在线教育平台需要一位能24小时答疑的虚拟老师,你的电商直播间需要一位不知疲倦的带货主播,或者…...