← 最新论文
💻 computer science

Learning Structural Illumination for Unsupervised Low-light Enhancement

本文提出了 RISE,一种无监督低照度增强框架,该框架通过从可靠的高亮区域推断相对照度结构,将其与绝对曝光解耦,并采用双计量参考进行场景自适应曝光调整,从而实现了具有自然视觉效果的最先进性能。

原作者: Tianle Du, Peiyuan He, Hainuo Wang, Tianxiu Yu, Xiaojie Guo

发布于 2026-08-11
📖 1 分钟阅读☕ 轻松阅读

原作者: Tianle Du, Peiyuan He, Hainuo Wang, Tianxiu Yu, Xiaojie Guo

原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明

想象一下你是一名数字照片侦探,你的任务不是侦破犯罪,而是试图修复那些在黑暗中拍摄的照片。这个领域被称为低照度图像增强(Low-Light Image Enhancement, LLIE)。把一张在夜间拍摄的照片想象成一声低语;相机试图去倾听,但它听到的主要是噪声(static)而非实际的故事。多年来,科学家们一直试图教会计算机如何“调高音量”,让这些低语重新变得清晰。

棘手之处在于,并非所有的暗部照片都是一样的。有些只是稍微昏暗,而有些则是漆黑一片,仅有一丝微弱的光亮。旧的方法试图用同样的“主音量旋钮”来修复每一张照片,将所有东西都调到完全相同的亮度。但这就像试图用同一个音量设置来修复一声低语和一声呐喊——要么会让低语显得太小声,要么会让呐喊变得失真。此外,当照片非常暗时,相机的传感器会被噪声干扰,导致很难分辨什么是真实的阴影,什么是数字噪点。研究人员面临的一个大问题是:如何教会计算机在不需要完美的“前后对比”照片进行学习的情况下,理解场景中的光影形状

于是,RISE 出现了,这是由天津大学和敦煌研究院的杜天乐及其团队提出的一种新方法。RISE 并不试图一次性猜测整张图片的亮度,而是像一位聪明的探险家,只信任黑暗房间里最明亮、最清晰的几个点,以此来推断其余的部分。

论文指出,以往的方法犯了一个关键错误:它们试图同时估算整个照明模式和整体亮度水平,这往往会导致被图像中嘈ole的暗部干扰。RISE 通过将这两个任务分离,扭转了局面。首先,它识别出一些“关键照明线索”(Key Illumination Cues, KICs)——这些是暗部图像中微小且可靠的亮点,比如烛火或路灯的反射。计算机将这些点视为值得信赖的锚点。然后,它会询问:“光线是如何从这些亮点向外扩散的?”通过研究这些亮点与暗部区域之间的关系,RISE 构建了一张相对照明结构图。这就像是通过观察山峰来了解山的形状,而不是试图一次性测量整座大山。

一旦理解了光的形状,RISE 就会单独处理绝对曝光(即最终照片应该有多亮)。为此,它使用了一个巧妙的工具——双测光曝光参考(Dual-Metering Exposure Reference, DMER)。想象一位摄影师正在使用两个不同的测光表:一个检查整个房间的整体亮度,另一个检查特定的照明模式。RISE 结合了这两项读数,以决定究竟要提升多少亮度,从而确保它能适应特定的场景,而不是遵循死板的“一刀切”规则。

结果令人印象深刻。研究人员在七个基准测试和五个真实世界数据集上对 RISE 进行了测试。他们发现,RISE 在无监督方法中达到了最先进的性能(state-of-the-art performance),这意味着它超越了所有不使用配对训练数据的技术。具体而言,它在 LOLv2-Real 数据集上达到了 21.33 的 PSNR,在 UHD-LL 数据集上达到了 22.22,同时使用的是一个非常轻量级的模型,仅有 0.35 M(百万)参数1.43 GFLOPs 的计算能力。这意味着它不仅是最聪明的,也是最高效的之一。

至关重要的是,论文表明 RISE 不仅仅是在记忆训练数据;它在面对未见过的场景时具有良好的泛化能力,包括在真实低照度条件下使用 iPhone 16 Pro 拍摄的照片。作者证明,通过将光的结构与整体亮度解耦,该方法避免了过度曝光高光或让暗部留下过多噪声的常见陷阱。然而,作者也谨慎地指出,这种方法并非魔法;如果图像的一部分过于黑暗,以至于相机传感器捕捉到的全是噪声(低于传感器噪声底限),那么 RISE 无法凭空创造不存在的细节。在这些极端情况下,单纯依靠曝光校正无法恢复缺失的内容。

简而言之,RISE 表明,修复一张暗部照片的最佳方式不是去猜测整张图片,而是找到那几个可靠的明亮线索,理解光是如何从它们出发传播的,然后为特定场景精准地调节音量。这是一种从粗暴的亮度提升向更智能、更具结构性理解光的转变。

您所在领域的论文太多了?

获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。

试用 Digest →