异常检测(Out-of-distribution detection\ anomaly detection)相关论文阅读

Out-of-distribution Detection系列专栏(二) OOD Detection系列专栏(二):Max-Softmax baseline 阅读详情

Learning Confidence for Out-of-Distribution detection in Neural Network

作者 Terrance DeVries 、Graham W. Taylor
论文原地址:https://arxiv.org/abs/1802.04865

OOD : where a network must determine whether or not an input is outside of the set on which it is expected to safely perform

提到任何事物都有认知局限性,认识到这种局限性才可以最小化潜在风险

proposed:

1 train NN classifiers to output confidence estimates for input, and differeniate the in and out-of distribution examples.

2 misclassified in-distribution examples can be used as a proxy when calibrating ood detectors

motivation:

​以学生回答问题作为motivation。当学生回答问题时,对于不太确定的问题,可以申请hints,但是会受到penalty。对于high confidence的问题,不需要hints,对于low confidence的问题,需要hints,当所有问题回答完之后,根据一共申请了多少hints(或者是受到多生penalty),确定这个模型的置信度程度

model:

在这里插入图片描述
​ 在倒数第二层之后添加一个 confidence estimation branch,original模型有prediction branch and confidence branch.分别输出prediction probabilities p和confidence estimate c
p , c = f ( x , Θ ) p i , c ∈ [ 0 , 1 ] , ∑ i = 1 M p i = 1. p, c = f(x, Θ) p_i, c ∈ [0, 1],\sum_{i=1}^Mpi = 1. p,c=f(x,Θ)pi,c[0,1],i=1Mpi=1.
上述motivation中提到的hints,通过interpolate between original predictions and target probability
p i ′ = c ∗ p i + ( 1 − c ) ∗ y i p_i^{'} = c * p_i + (1-c)*y_i pi=cpi+(1c)yi
​ 这个式子还是蛮有意思的,通过置信度C,如果模型对该输入的预测置信度为1,则预测就是模型的预测,如果模型对该输入的预测置信度为零,就是模型完全不可信,则预测就是真实的标签,通过c的大小,来决定调整预测值有多少来自hints。

​ 像传统的softmax loss一样,不过是adjusted prediction propability. 但是只用这样的loss会有一个问题就是模型会把c学的特别低,这样输出都是真实的标签,loss也就越来越小,所以必须要对c有一个限制,添加一个log penalty,confidence loss
L s = − ∑ i = 1 M l o g ( p i ′ ) y i L_s = -\sum_{i=1}^Mlog(p_i^{'})y_i Ls=i=1Mlog(pi)yi
L C = − l o g ( c ) L_C = -log(c) LC=log(c)
L o s s = L s + λ L c Loss = L_s + \lambda Lc Loss=Ls+λLc

具体训练

三个关键点:

1 对于模型超参数lambda的选择

​ 在训练过程中,很容易所有的样本的c都会收敛到1,这样子就不会考虑hints了,也就和普通的softmax没有区别了,而理想应该是预测正确的样本 c -> 1,预测错误的样本 c-> 0.

​ 提出一个beta,作为预置参数,表示置信度惩罚项的最大值,具体实施:当Lc > beta, 就增加lambda,将Lc降下来;当Lc < beta,就减小lambda,总之就是让Lc维持在一个目标beta附近。

2 避免过度正则化

​ confidence learning可以看作一个很强的正则化,这在某些任务中可以看作是很强的抗过拟合方法,但是也有风险导致欠拟合(就是模型不去学复杂的decision boundry),因此该模型选择每个batch中一半的数据用之前的loss,另一半的数据还是只用传统softmax(也就是只有部分数据可以得到hints)

3 保留错误分类的training example

​ 当多参数模型遇到小量数据集时,会将训练集过拟合,也就是在训练过程中所有样本都被判断正确,但是在该模型中,判断错误的样本同样重要,因为他们会很大程度影响c。因此在训练过程中用了一些数据增强的方法。

一些操作

1 数据预处理

​作者希望数据在输入前就可以增加 in-distribution 和 out-distribution之间的差异性。论文中参考Fast Gradient Sign Method FGSM(GAN)通过对输入数据增加一些pertubation,使得模型更有几率进行错误分类。对图像进行干扰,使得模型能对in-distribution data输出更大置信度。

we observe that in-distribution examples increase in confidence more than out-of-distribution examples using this procedure, resulting in an easier separation of the two distributions

实验数据

in-distribution-dataset: SVHN, CIFAR-10

out-distribution-dataset: TinyImageNet, LSUN, iSUN, Uniform Noise, Gaussian Noise



Enhancing The Reliability of Out-of-distribution Image Detection in Neural Networks(2018 ICLR)

问题提出:

1 开篇同样是介绍OOD, However, when deploying neural networks in real-world
applications, there is often very little control over the testing data distribution. Recent works have shown that neural networks tend to make high confidence predictions even for completely unrecognizable or irrelevant inputs(对很能识别的或者完全无关的类输入也会产生高置信度。 这里给予的还是最基础的OOD方法,根据置信度判断)

在这里插入图片描述

看到论文提到的这一点,联想到之前看李宏毅老师讲OOD的时候一个例子(不得不说李老师讲课真的好),他在做一个关于辛普森家族的分类任务时,输入一个其他动漫的角色,最大softmax输出达到了0.99,也就是模型对于这个样本的置信度很高,但其实这个数据应该是一个Out of distribution的,这就是上述提到问题的一个鲜明的例子。

2 2018年之前的工作training set都还需要包含一些ood data(很难获得),同时也提到如果想同时保证id data的效果和ood data的效果,那么需要一个大的网络框架。

方法基础:

1 论文“ A baseline for detecting misclassified and out-of-distribution examples in neural networks” 中提出 不需要重新训练模型,一个well-trained neural networks tends to assign higher softmax score to id examples

2 使用temperature scaling 和 small controlled perturbations可以提升id 和 ood之间的 softmax score gap

3 只需要用pretrain模型 + 上面两个手段就可以提升效果

方法核心:

1 temperature scaling

具体参考:

Calibration of Modern Neural Networks

首先学习一下temperature scaling的作用,在这之前需要了解一下knowledge distillation and calibrated(校准)。论文提出temperature scaling可以区分ID和OOD的最大softmax分数。那么什么是模型校准呢?

通常模型的输出是一个对应最大softmax的索引,也就是输出预测类,但是如果我们希望模型可以输出预测的置信度(confidence)是多少,那么这个confidence就是calibrated的。譬如:进行一个分类任务,将模型预测判断为某一类A且confidence score为90%的所有样本统计在一起,总数为N;并对着N个样本进行真实类别统计,如果有90%的样本都为A类,则说明该模型是calibrated的。

在这里插入图片描述

​ 如上图所示,横纵坐标分别是confidence和acc,蓝色图代表的模型输出,灰色线代表calibration。那么该模型就是较自信的(输出的confidence大于实际acc)譬如在confidence为0.8的这些输出中,期望的是有80%的应该分类正确,但实际只有60%分类正确,那么也就是“网络过于自信了”,输出的置信度具体式子如下:
y ^ = e x p ( z i / T ) ∑ e x p ( z j / T ) \hat{y} = \frac{exp(z_i/T)}{\sum exp(z_j/T)} y^=exp(zj/

CVPR anomaly detection异常检测 论文汇总 CVPR anomaly detection异常检测 论文汇总1.1 2019CVPR1.2 2018CVPR1.3 2017CVPR1.3 2016CVPR 关键词为"anomaly detection" 1.1 2019CVPR [2019CVPR paperlist] Graph Convolutional Label Noise Cleaner: Train a Plug-And-Play Action Classifier for Anomaly Detection [paper] MVTec 阅读详情

相关推荐

【信息科学与工程学】计算机科学与自动化——第三百零五篇 数据中心 Scale-Up、Scale-Out、Scale-Across 20

GPU 训练中的各种算子融合技巧、梯度压缩与稀疏通信的高级变体、混合专家模型的负载均衡与通信优化、长序列模型的注意力机制优化、模型量化与蒸馏的联合优化、分布式训练中的容错与恢复、以及一些新兴硬件特性的建模(如 HBM3、GDDR7、CXL 3.0 内存语义、PCIe Gen6 PAM4 信令等)。每条仍然包含四个方程式子节。

weixin_49199313的博客 241

无监督异常检测论文

无监督异常检测论文集,可用于未来智能工厂预测性分析。

【信息科学与工程学】计算机科学与自动化——第十八篇 存储系统设计——6 存储算法(1)分布式存储相关算法

存储内容

weixin_49199313的博客 1161

7篇异常检测最新论文解析(附20+篇高引经典)

异常检测作为机器学习中的一个非常重要的子分支,目前已经广泛应用于计算机视觉、数据挖掘、NLP等方向。近年来,随着大数据的不断发展,我们对数据处理效率的要求越来越高,人工早已比不上机器,这时候,及时检测数据中的异常问题并加以解决,就成为了不可忽视的重点。这也是为什么异常检测仍是热门研究方向的原因之一。老规矩下载打包好了,看文末直接领取。

学姐带你玩AI的博客 6534

[转载]Out-of-distribution Detection

算是第一次正经的调研吧,之前就做过论文复现和 “不成功” 的调研。至于为什么不成功呢?主要因为我是0基础的科研小白,所以对调研目的的认知错误。其实在年前做过一次关于 Out-of-distribution 的调研了,但是为什么现在又花了差不多一周的时间重新做了一次呢?因为我一开始调研的目的是了解一下这个领域,看看有没有可以用于我当前方向的方法(我当前的方向比较新,只能从类似的任务中借鉴)。所以,我第一次调研的时候,就直接把OOD的方法和我当前的方向做比较,如果没有什么关联就跳过。实际上这是错误的一种调研。

wuling129的专栏 903

【抗疫不出门】李宏毅教授机器学习课程笔记二——异常检测Anomaly Detection

异常检测视频课程地址:https://www.bilibili.com/video/av46561029?p=2 课件不要太卡哇伊啦~~~~ 文章目录1 什么是异常检测2 问题描述3 现实应用4 和Binary Classification的关系5 异常检测的分类5.1 with classifier信心分数如何估计信心分数估计的一些其他研究门限如何获得如何评估可能的问题5.2 without c...

weixin_39389001的博客 781

AI推介-大语言模型LLMs论文速览(arXiv方向):2024.09.01-2024.09.05

自 ChatGPT 问世以来,大型语言模型(LLM)在各种任务中表现出色,但在很大程度上仍是黑盒系统。因此,它们的开发在很大程度上依赖于数据驱动方法,限制了通过改变内部架构和推理途径来提高性能。因此,许多研究人员开始探索 LLMs 的潜在内部机制,旨在找出其推理瓶颈的本质,而大多数研究都集中在注意力方面。我们的调查旨在通过集中研究注意头的可解释性和内在机制来揭示 LLMs 的内部推理过程。我们首先将人类的思维过程提炼为一个四阶段框架:知识回顾、上下文识别、潜在推理和表达准备。

小小帅 1640

AI驱动的软件测试革命:从自动化框架到智能优化的全栈实践

本文探讨AI技术在软件测试领域的三大核心应用:自动化测试框架、智能缺陷检测和A/B测试优化。通过深度学习、强化学习等AI技术,可显著提升测试效率和质量。AI赋能的自动化测试框架通过计算机视觉识别UI元素,实现智能定位与自愈机制;智能缺陷检测利用CodeBERT模型分析代码语义,准确率达83.5%;A/B测试优化采用贝叶斯方法动态调整样本量,可减少35-45%的样本需求。文章还提出了AI测试实施路线图,并强调需关注数据偏见、算法公平性等伦理问题。

zzywxc787的博客 680

【信息科学与工程学】【通信工程】【云骨干网】第一百三十三篇 智算中心互联之云骨干网01

传统网络方向(如硬件防火墙、交换机)和安全产品方向(如传统防病毒软件)并未“完全”进入衰退期,但已处于深度转型阶段。市场对基础能力的需求仍在,但技术形态、价值重心和竞争逻辑已发生根本变化。

weixin_49199313的博客 1102

【信息科学与工程学】【通信工程】第七十六篇 网络解决方案设计03

继续围绕智算中心相关的组网设计、光路设计、波分设计、OTN设备、交换机设备、组网拓扑、网络操作系统、业务区/管理区/存储区、光设计、租户设计、电磁设计、队列设计、QoS设计、调度设计、组合设计等领域。: 若Tpxe​=2min,Tos_install​=5min,Tagent​=0.5min,Tconfig​=0.5min,则Tready​=8min。: 若N=2000,Ms​=2,Nstorage​=128,Mss​=2,则Nip​=2000×2+128×2=4256,需要/20子网。

weixin_49199313的博客 158

【信息科学与工程学】【数据中心】【智算中心】 第二十六篇 计费系统篇03-智算业务计费

动态批价与规则引擎的协同本质是 ​​“策略与执行解耦”+“实时上下文驱动”​​技术协同​:规则引擎定义业务逻辑(What),批价引擎执行计算(How),通过缓存、事件总线和动态注入实现高效联动;​架构演进​:从单体规则中心 → 微服务化 → 事件驱动分层,核心目标是提升扩展性、降低时延;​关键突破​:​实时性​:电信OCS通过规则引擎实现秒级信用控制;​灵活性​:电商将促销规则拆分为独立AO服务,避免单点故障;​精准性​:物流动态权重模型量化距离、燃油等因子,误差率<5%。

weixin_49199313的博客 1193

【信息科学与工程学】【数据中心】 第十五篇 智算中心DaaS数据消费场景02

智算中心DaaS数据共享场景的分级分类是一个复杂的系统工程,需要从技术、安全、合规、治理、运营等多个维度进行综合考虑。本分级分类体系为不同场景下的数据共享提供了详细的指导,包括安全分级、共享模式、技术架构、合规治理等方面。在实施数据共享平台时,应结合自身业务需求、技术能力和资源情况,选择适合的共享模式和实施路径。同时,要高度重视数据安全和隐私保护,采用先进的技术和管理手段,确保数据共享的安全可控。

weixin_49199313的博客 1万+

【信息科学与工程学】【数据中心】第三十二篇 云数据中心网络拓扑参数全息模型

多维度集成:物理、二维、三维、几何、连接拓扑的有机统一强约束网络:空间、承重、散热、供电、布线等多重物理约束复杂关系网络:互斥、相似、联动、依赖关系交织多目标优化:成本、性能、可靠性、可扩展性的权衡自动化设计:参数化建模,自动化验证,智能化优化实际工程应用中,建议:建立参数化设计模板库实现多约束自动化验证采用分层协同优化策略构建数字化孪生验证环境持续迭代优化设计规则通过系统化的参数管理,可以实现数据中心网络拓扑的科学设计、高效部署和智能运维。多维度参数:地理、物理、拓扑、性能、成本等千余参数。

weixin_49199313的博客 1349

【信息科学与工程学】【通信工程】第一百五十五篇 SRv6/SDN网络中的算法01

1 确定性路由算法 SRv6 控制平面 显式路径计算 SRv6段列表优化算法 1. 输入:源节点S,目标节点D,约束条件集合C={c₁,...,cₘ}<br>2. 构建有向图G(V,E),V为节点集

weixin_49199313的博客 238

【信息科学与工程学】【通信工程】第一百五十五篇 网络拓扑学10

编号类型领域问题问题的数学分析(拓扑学+其他)参数列表及参数的数值范围关联知识A401图论/拓扑量子纠缠计算+存储+网络融合(全域共享内存)如何用GHZ纠缠态优化全域共享内存的原子广播?​1. 拓扑学分析(详细): - 拓扑纠缠视角:全域共享内存(如CXL.mem)需要原子广播以保证一致性。GHZ纠缠态GHZ⟩ = (0...0⟩+A402图论/拓扑序计算+存储融合(近存储计算)如何用拓扑序的长程纠缠优化近存储计算的数据一致性?​1. 拓扑学分析(详细): - 拓扑序视角:近存储计算(Near-

weixin_49199313的博客 298

【信息科学与工程学】【通信工程】第一百五十五篇 网络拓扑学09

聚焦云数据中心(多region多AZ+多边缘DC)与城域网5G/6G网络一体化的拓扑学编号类型领域问题问题的数学分析(拓扑学+其他)参数列表及参数的数值范围关联知识A166图论/组合优化云原生数据湖如何用Apache Hudi的Timeline拓扑优化增量查询?​1. 拓扑学分析(详细): - 拓扑结构:Apache Hudi使用Timeline管理表的历史变更,Timeline是一个时间轴上的DAG。每个Instant(提交、 compaction、 cleaning等)是一个节点,节点之间按时间顺

weixin_49199313的博客 189

【信息科学与工程学】计算机科学与自动化 第二百三十三篇 凤凰架构01

编号类型领域系统软件/硬件或系统集成方案及系统架构模块子模块函数名称/算法名称算法的数学分析及计算机体系架构及数据结构与算法详细设计及参数列表及数值范围设计关联知识1共识算法分布式基石状态机复制架构:Proposer/Acceptor/Learner 多节点角色模型,基于操作转移(Operation Transfer)分布式共识PaxosPaxos 协议(Prepare/Promise/Accept/Accepted 两阶段)数学基础:多数派(Quorum)投票,基于鸽巢原理保证 W+R>N 时读写集合必有

weixin_49199313的博客 177

人工智能世界观(认知篇)

本文系统梳理了人工智能(AI)的基础知识体系,重点解析了大模型(LLM)的核心原理、技术演进及应用边界。主要内容包括: AI基础认知:从规则驱动到数据驱动的范式转变,强调AI=数据+算法+算力的技术本质,区分了弱AI与通用AI(AGI)的能力差异。 技术发展史:回顾AI七十年发展,从符号主义、专家系统到深度学习的五次技术浪潮,重点分析Transformer架构如何推动大模型革命。 大模型原理:详解LLM的三大支柱(参数量/数据量/算力),揭示自回归生成和注意力机制的工作逻辑,对比GPT与BERT的技术路线差

轻舟已过万重山 411
上一篇: 长尾分布相关论文阅读
下一篇: Elsevier旗下期刊利用latex模板撰写论文记录
supergxt
博客等级 码龄8年 16粉丝 27原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值