A Blind Stereoscopic Image Quality Evaluator With Segmented Stacked Autoencoders
摘要该论文模拟了人类视觉感知的全过程从人眼到额叶特别是针对视网膜神经细胞RGCs和外侧膝状体核(LGNs)中的边缘和颜色的信号处理。除此之外为了模拟视觉皮层的复杂的和深度的结构采用了分段堆放自编码器S-SAE这在之前的3DIQA中是没有应用过的。S-SAE的应用弥补了基于深度学习的IQA训练需要十分长的训练时间的问题。介绍人们都是用双眼看世界的并且视网膜上的图像略有不同。两个视角通过RGCs压缩保留了边缘信息同时颜色信息也通过RGCs传递。这些信息之后被传递给LGNs之后在初级视觉皮层进行融合每一部分的视觉皮层看似都有各自的功能但是无法将它们分离出来经过复杂的处理过程后传递给额叶得出预测的质量分数。该算法的贡献可分为以下部分整个路线被分为两个字路线分别处理边缘信号和颜色信号之后两部分会各自产生一个分数即边缘分数和颜色分数。具体如下左右视图的轮廓信息被提取来模拟RGCs的边缘提取这部分将被用于计算中间过程的合成图如和、差、独眼视图。颜色信息不是发生在IQA的全过程中的这里对发生在LGNs中的对手编码进行了建模。S-SAE被用来模拟视觉皮层中的深层和复杂的结构其不仅解决了SAE的训练花费大量时间的缺点而且有高的准确率。三个S-SAE被用于边缘信息中一个SAE被用于颜色信息中最终被用于SVR中得出各自的质量分数。两个动态权重系统和一个静态权重系统被用于将局部感知分数组合得出最终的分数。背景视网膜神经细胞和外侧膝状体核视觉系统具有将复杂众多的视觉信息压缩的功能这部分是在RGCs中实现的。它们有单细胞P、近细胞(K)和巨细胞(M)。P和P携带颜色信息M携带运动和边缘信息。总的来说只有边缘和变化被提取出来并通过LGNs传递到V1。除了边缘信息RGCs也参与了颜色信息的提取和LGN的P、K细胞共同作用实现了对抗编码。这些锥细胞可分为三类L- M-和S-分别对长波长红光、中波长绿光和短波长蓝光。这里存在三个编码通道红绿、蓝黄和明暗P是对红绿方面的颜色敏感K是对蓝黄的颜色敏感。因此计算这三个部分的成分并最终传递给V1。实验发现在V1区域不仅存在sum、cyclopean还存在diff。S-SAE因为人脑的视觉处理过程是比较复杂的从V1区到IT区域这里使用S-SAE来模拟更深层和复杂的特征提取过程在该过程提取后的特征输入到SVR中进行训练得出感知分数。算法实施生理建模首先视觉神经细胞接收到外界的刺激R,G,B成分之后这些视觉刺激被传递到RGCs并且边缘信息由RGCs提取接下来R G B图像和边缘信息被传入LGNs并且对手编码发生在这里之后RG、BY、和Lum信号以及边缘信息以P、K、M流的形式传输到视觉皮层V1区域。在该区域左右视图合成为S、D和C图像。到目前为止产生了6个不同类型的映射图紧接着边缘和颜色特征提取将会在之后发生最后提取的特征会经过30多个视觉处理区域从而生成更加复杂和抽象的特征这些特征最终会传输到额叶并获得感知质量。算法建模总体分为两个子部分边缘质量索引和颜色质量索引。边缘提取使用LoG滤波器模拟RGCs的特征提取过程采取三个不同的参数进行提取n为滤波器的大小另一个参数为标准差高斯低通滤波器这模拟了在V1区域中不同的边缘检测算子结果三个左三个右LoG映射图被提取出来之后这三种边缘映射图被融合成S D C图每个图会有三种融合过程如下之后分别对融合图进行特征提取这些特征进一步会经过S-SAE训练以得到更加深层和抽象的特征最终所得到的特征输入SVR得到局部质量分数这些质量分数之后经过池化操作得到边缘特征的质量分数。颜色图使用以下公式模拟对手编码之后对这些映射图进行特征提取将提取到的特征输入到SAE网络中以得到更加深层和抽象的特征最后输入到SVR中得到颜色质量分数结合颜色质量分数和边缘质量分数可以得到最终的质量分数。特征提取对边缘图融合得到的图进行MSCN变换观察到其直方图的峰值和方差随着DMOS变化除了白噪声失真。当DMOS变大时其直方图的峰值和方差会变小乘积对的变化也和以上相似。对MSCN图进行广义高斯分布和非对称广义高斯分布拟合分别得到2个、16个拟合参数除此之外计算MSCN图的幅值、方差和熵特征最后再加上对比度特征最终每张图得到22个特征值三张图产生66个特征这些特征之后会用于S-SAE训练来得到边缘信息特征。对于颜色映射图使用AGGD拟合得到形状、左方差和右方差三个拟合参数同时映射图的峰值和偏离度也作为特征进行了提取5x3x230最终得到30个特征使用这些特征进行之后的SAE训练来得到颜色信号处理。池化系统研究发现弱相关的两眼图像对的和差通道的权重相似。但是一般情况下这些图像具有很强的相关性并且给差值通道分配了较大的权重。因此这里采用了动态权重系统这里的L和R不是图像本身而是之前提取的22个特征值C10.6 , C25以此来达到当图像弱相关时差通道仍然能得到更大的权重结果同样池化Qc质量分数时当图像弱相关时应赋予Qc更大的权重当处于弱相关时赋予两者相似的权重其权重为其中C30.55C40.8最终按照加权和得到边缘感知分数由于边缘特征质量分数比颜色特征质量分数更加重要因此前者所占比重为0.7后者为0.3且采用静态权重的方式最终得到全局质量分数。其整体流程图如下个人感想总的来说这篇文章使用的神经网络部分还是比较少的大部分的特征提取还是传统的方法不过还是有以下几点可供参考使用了多个融合图使用了颜色信息特征特征提取部分还是使用了MSCN再得到相关统计信息使用S-SAE进行深层次的特征提取分别计算局部质量分数再将质量分数进行加权融合得到最终的分数个人感觉在特征提取时先进行边缘特征提取再进行深层的特征提取有些限制了特征提取的范围之后的提取相当于都是在边缘信息之上提取的有了边缘信息的限制。在特征提取时不妨不指定提取的何种特征而是直接交给神经网络进行特征提取提取所需要的特征可采用类似于DenseNet的连接方式来提取特征这样及考虑到了深层特征也考虑到了浅层特征也许对双眼视觉的特征提取有所帮助。然后是图像融合时这里采用的是加减cyc方法不妨尝试一下采用一个学习到的权重网络进行图像的融合这样也许能学习到更适合融合的权重和方法。再之后在S-SAE部分这种方法确实能够减少训练时间但是这有些限制了特征之间的交流和组合这里不妨尝试以下ShuffleMoblieNet的组合方法随机打乱分配以下特征网络的连接方式后面的加权局部质量的方法值得借鉴通过多个局部质量分数的融合也许能够得到更更好的质量分数。

相关新闻

OpenCV的应用:九宫格小人识别

OpenCV的应用:九宫格小人识别

1、实验内容:自动是被下列九宫格图像中小人的位置,并将小人分割出来 2、思路分析: 本实验的难点首先在于如何在一幅图像中把九幅图片分离出来,其次如何能够从分离出来的九幅图片中识别出小人图像。本人的具体思路是这样的&#x…

2026/7/28 17:52:02阅读更多 →
ClosedXML深度解析:.NET Excel处理库的架构设计与企业级应用实践

ClosedXML深度解析:.NET Excel处理库的架构设计与企业级应用实践

ClosedXML深度解析:.NET Excel处理库的架构设计与企业级应用实践 【免费下载链接】ClosedXML ClosedXML is a .NET library for reading, manipulating and writing Excel 2007 (.xlsx, .xlsm) files. It aims to provide an intuitive and user-friendly interface…

2026/7/28 17:52:02阅读更多 →
Snipe-IT 资产管理本地部署:电脑和设备台账跑通后,用 cpolar 给行政同事临时验收

Snipe-IT 资产管理本地部署:电脑和设备台账跑通后,用 cpolar 给行政同事临时验收

Snipe-IT 资产管理本地部署:电脑和设备台账跑通后,用 cpolar 给行政同事临时验收 Excel 管电脑台账,最怕的不是少一列,而是借出去之后没人知道它在哪。电脑、显示器、打印机、投影仪、备用手机,这些东西一多&#xff…

2026/7/28 17:52:02阅读更多 →
摆脱环境配置难题!OpenClaw 小龙虾 Windows 系统搭建全流程(含安装包)

摆脱环境配置难题!OpenClaw 小龙虾 Windows 系统搭建全流程(含安装包)

📘OpenClaw v2.7.9 Windows 一键部署指南|本地 AI 智能体零基础搭建教程 前言✨ 当下各类 AI 工具层出不穷,但多数产品仅支持文字对话,很难直接操控电脑完成各类重复工作。OpenClaw,爱好者俗称小龙虾,作为…

2026/7/28 19:00:13阅读更多 →
AI 办公自动化实践:Windows 平台部署 OpenClaw,打造桌面自动化助手(含安装包)

AI 办公自动化实践:Windows 平台部署 OpenClaw,打造桌面自动化助手(含安装包)

Windows 本地 AI 智能体 OpenClaw 部署教程|零代码搭建自动化办公助手,新手也能一次成功 ✨核心亮点:全程可视化操作|无需手动配置环境|内置全套运行依赖|支持本地离线运行|配备 28 万 Tokens …

2026/7/28 19:00:13阅读更多 →
外卖CPS管理系统排名,卡券到期自动退款逻辑开发

外卖CPS管理系统排名,卡券到期自动退款逻辑开发

外卖CPS管理系统排名,卡券到期自动退款逻辑开发外卖CPS管理系统的核心资产是各类付费折扣卡、会员券、专属补贴券,用户付费购买的卡券存在固定使用有效期。在实际运营场景中,大量用户购买折扣卡后未及时核销使用,卡券到期后会产生…

2026/7/28 19:00:13阅读更多 →
资本积累的负反馈循环与文明再生产的结构性危机

资本积累的负反馈循环与文明再生产的结构性危机

资本积累的负反馈循环与文明再生产的结构性危机 ——基于马克思主义政治经济学与系统动力学的综合性研究 摘要 本文以马克思主义政治经济学为方法论基础,整合列宁帝国主义理论、系统动力学负反馈循环理论、历史社会学制度分析方法及卡尔波兰尼的“双重运动”理论框架…

2026/7/28 19:00:13阅读更多 →
5分钟快速上手:基于深度学习AI的中国象棋智能辅助工具完整指南

5分钟快速上手:基于深度学习AI的中国象棋智能辅助工具完整指南

5分钟快速上手:基于深度学习AI的中国象棋智能辅助工具完整指南 【免费下载链接】VinXiangQi Xiangqi syncing tool based on Yolov5 / 基于Yolov5的中国象棋连线工具 项目地址: https://gitcode.com/gh_mirrors/vi/VinXiangQi 还在为在线下棋时无法获得专业分…

2026/7/28 19:00:13阅读更多 →
[具身智能-674]:ROSMASTER-M1(亚博智能 Yahboom)完整解析

[具身智能-674]:ROSMASTER-M1(亚博智能 Yahboom)完整解析

基础定位ROSMASTER-M1 是麦克纳姆轮全向移动 ROS2 模块化开发机器人,主打室内 SLAM 建图导航、机器视觉、具身智能、大模型语音交互,兼容多类边缘 AI 主控,适合高校科研、机器人教学、算法验证。一、硬件架构分层(对应爆炸图&…

2026/7/28 18:58:12阅读更多 →
覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

🔹 工具基础介绍 OpenClaw 是开源生态中一款实用性较强的本地智能工具,凭借本地离线运行、可视化图形操作和任务自动化三大核心特性,赢得了众多用户的青睐。与普通在线对话AI工具不同,它属于能够直接操控本机软硬件的智能数字员工…

2026/7/28 4:06:39阅读更多 →
伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

所谓液压伺服阀体的精密激光焊接,是用激光束对阀座壳体(通常为不锈钢或铝合金)进行密封焊接,使阀体在21-35MPa的高压液压油或压缩气体中长期运行而不发生介质泄漏。液压伺服阀是高端液压系统的"大脑"。从航空航天飞行控…

2026/7/28 2:08:06阅读更多 →
D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南 【免费下载链接】d2dx D2DX is a complete solution to make Diablo II run well on modern PCs, with high fps and better resolutions. 项目地址: https://gitcode.com/gh_mirrors/d2/d2dx 你是否还在…

2026/7/28 1:38:28阅读更多 →
告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生 【免费下载链接】OmenSuperHub Control Omen laptop performance, fan speeds, and keyboard lighting, and unlock power limits. 项目地址: https://gitcode.com/gh_mirrors/om/OmenSuperHub 你是否也曾为官方Om…

2026/7/28 0:00:29阅读更多 →
RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

做 RAG 的人应该都踩过这个致命的坑:把几百页的财报、法规、技术手册扔给向量库,问一个具体问题,搜出来的全是沾边但没用的内容 —— 关键信息要么被硬切块拆碎了,要么藏在几十条结果的最下面。语义相似≠真正相关,这个…

2026/7/28 0:00:29阅读更多 →
抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

2026年做短视频运营,从抖音上扒文案早就不是偷偷抄笔记的事了。我刚开始做内容的时候,每天刷半小时抖音,手动把爆款视频的口播敲进备忘录,一条2分钟的视频得花十来分钟,碰到语速快的还要反复回听。后来试了一圈工具&am…

2026/7/28 0:00:29阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/27 16:57:54阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/28 3:17:03阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/28 2:35:58阅读更多 →