在ICML 2026会议上,一支研究团队提出了一项突破性探索:多模态大型模型能否在**不依赖任何外部工具**的前提下,仅凭内部表征与自主推理能力完成损坏图像的语义一致修复。该工作首次系统验证了纯端到端多模态模型在无工具学习范式下的图像修复潜力,挑战了当前主流依赖扩散模型或专用修复模块的技术路径。实验表明,经强化跨模态对齐训练的模型可在复杂遮挡与噪声干扰下实现结构合理、细节连贯的重建,为轻量化、可解释的视觉生成开辟新方向。
多模态模型图像修复自主推理ICML2026无工具学习
2026-06-15