相关文章
用于评估各类时间序列异常检测(Time Series Anomaly Detection) 算法的框架源码+项目说明.zip
2024-12-20 00:49
# TSAD_evaluator TSAD_evaluator是一个用于评估各类时间序列异常检测(Time Series Anomaly Detection) 算法的框架,主要目的是能让研究人员专心于实现算法,而无需关心其他例如数据集处理、评估、可视化等流程,将算法之外的流程标准化、简易化、可配置化,其特性主要有以下几点: - **可扩展**:内置对多种数据集的支持,将多种数据集处理成统一格式 - **可视化**:将数据和结果持久化存储到influxdb,用grafana进行可视化 - **通用性**:适配各类算法以及应用场景,只需实现相应的接口即可 - **简易性**:支持一键脚本化运行,快速评估单个算法/多个算法在一个数据集/多个数据集上的结果 - **全面性**:提供通用评价指标、针对时序数据设计的评价指标、自研指标、性能指标对算法进行全方位评估 ## 目录 - [系统介绍](#系统介绍) - [数据集支持](#数据集支持) - [可视化支持](#可视化支持) - [算法抽象](#算法抽象) - [检测流程标准化](#检测流程标准化) - [效果评估](#效果评估) - [如何使用](#如何使用) - [安装所需依赖](#安装所需依赖) - [导入数据集](#导入数据集) - [实现算法](#实现算法) - [评估算法](#评估算法) - [拓展实现](#拓展实现) - [对聚合函数的扩展](#对聚合函数的扩展) - [对自动确立阈值方法的扩展](#对自动确立阈值方法的扩展) - [对评价指标的扩展](#对评价指标的扩展) - [联系方式](#联系方式) - [参考文献](#参考文献) ## 系统介绍 <!-- 这边是不是应该有一张overview,整个系统的模块图 --> ### 数据集支持 在TSAD_evaluator中,Dataset代表一个数据集,而一个数据集下会有多个时间序列数据TimeSeries,我们把TimeSeries处理成统一的格式: ``` timestamp col1 col2 ... colN ``` - 其中N是时间序列的维度,对于单维度的时间序列数据N=1 - 如果原来的数据集中有timestamp,则会沿用;否则会从2022-01-01 00:00:00开始认为每一分钟一个点的方式填充时间戳 目前已经支持的数据集 <!-- 之后可以显示下这些数据集的维度信息、点数、异常率等等,搞个表格--> | 数据集 | 维度| 时间序列数| 总采样点数 | 总异常点数 | 异常比例| |-----------------------------------------------------------------------------------------------------|----|-------|---------|--------|----------| | [Yahoo](https://webscope.sandbox.yahoo.com/catalog.php?datatype=s&did=70) | 1 | 367 | 572966 | 3915 | 0.68% | | [KPI](https://github.com/NetManAIOps/KPI-Anomaly-Detection) | 1 | 29 | 5922913 | 134114 | 2.26% | | [Industry](https://github.com/OpsPAI/ADSketch) | 1 | 70 | 695293 | 7614 | 1.10% | | [UCR](https://wu.renjie.im/research/anomaly-benchmarks-are-flawed/#ucr-time-series-anomaly-archive) | 1 | 250 | 19353766 | 49363 | 2.55% | | [SMD](https://github.com/NetManAIOps/OmniAnomaly) | 38 | 28 | 1416825 | 29444 | 2.08% | | [JumpStarter](https://github.com/NetManAIOps/JumpStarter) | 19 | 60 | 777600 | 55101 | 7.09% | | [SKAB](https://github.com/waico/SKAB) | 9 | 34 | 37401 | 13067 | 34.94% | | [PSM](https://github.com/eBay/RANSynCoders) | 26 | 1 | 220322 | 24381 | 11.07% | > 打算但是暂未支持的数据集:NAB,SMAP,MSL,SWaT、WADI ### 可视化支持 我们提供对数据、检测结果包括中间结果的一些可视化支持,主要原因是: - 研究算法前:可以了解数据集的特点(是否是周期性、为什么是异常、异常的密度如何等信息),也能启发研究者想出针对的解决方案 - 研究算法中:观察算法的中间输出(例如预测类算法可以输出每个点的预测值),从而对算法拟合的效果有所了解(可能欠拟合or过拟合),可以进一步调优 - 研究算法后:直观了解算法对一个序列的检测结果(一般是检测分数)是否契合异常标注(而不仅仅是依赖评估指标的数字),并且可以与其他算法的结果进行对比 但为了减少依赖,避免该框架过于冗余,我们选择将数据和结果全部持久化到[Influxdb](https://github.com/influxdata/influxdb) ,然后用[Granfana](https://github.com/grafana/grafana) 来展示其中的数据,目前我们新建了5个Dashboard来展示特定的界面: - 原数据查看:查看「选定数据集」的「选定时间序列」的统计信息、时间序列信息、标签 ![](doc/1.png) - 检测结果查看:查看「选定算法」在「选定数据集」的「选定序列」上的异常分数、中间结果、检测耗时和指标 ![](doc/2.png) ![](doc/3.png) - 检测结果对比:查看「多个选定算法」在「选定数据集」的「选定序列」上的异常分数、检测耗时和指标对比 ![](doc/4.png) - 数据集结果查看:查看「选定算法」在「选定数据集」下的整体检测指标和「各个序列」的检测指标 ![](doc/5.png) - 数据集结果对比:查看「多个选定算法」在「选定数据集」下的整体检测指标的对比 ![](doc/6.png) ### 算法抽象 我们根据输入的数据维度、训练是否需要有标注数据、应用场景将一个检测算法解耦,拆成三个可灵活组合的模块: - 输入的数据维度:单维度/多维度 - 训练是否有标注:有监督/无监督/无需训练 - 应用场景:离线/流式/触发式 > 关于触发式 > - 定义:主要是对于某些时间序列数据,我们只对它在**特定时间范围**内有没有发生异常感兴趣,而不需要算法在每个时间点给出它是否异常或者异常分数,这在某些故障定位场景(而不是故障发现)中是比较常见的 > - 实现:需要输入窗口大小和正负样本比例,我们对于测试集中的每一个(段)异常,都挑选其开头前后共计窗口大小的数据作为正例,然后再按照正负样本比例采样若干完全正常的数据作为负例组成触发异常检测的**时间范围**,在前端会用蓝色区域标识我们选择的区间 实现算法时,需根据每一模块所属的具体类别继承特定的类,实现其中的接口即可 ### 检测流程标准化 除了基本的算法外,我们也提供将单维度检测算法应用于多维度数据集以及多个算法集成的功能,思路比较简单,具体来讲就是通过提供一个聚合函数,可以把单个算法在不同维度的检测结果 / 不同算法在同一数据集上的检测结果聚合成一个最终的检测结果,该聚合函数可以自定义(内置了取max和取mean)并且配置 因此总体来讲,对于一个「特定算法」在「特定时间序列数据」上的检测,我们有以下几步: 1. 训练:根据算法所需数据喂给算法 2. 对于触发式,要根据配置生成正负例 3. 预测:根据算法应用场景进行预测 1. 离线:把测试数据全部喂给算法,得到检测的异常分数 2. 流式:每次喂一个时间点的数据给算法,拼接起来得到检测的异常分数 3. 触发式:将第2步中生成的**时间范围**以及一个获取历史数据的接口(具体获取多少依赖于算法内部调用)逐个喂给算法,得到一个检测的异常分数
    以上就是本篇文章【用于评估各类时间序列异常检测(Time Series Anomaly Detection) 算法的框架源码+项目说明.zip】的全部内容了,欢迎阅览 ! 文章地址:http://sjzytwl.xhstdz.com/news/11864.html 
     栏目首页      相关文章      动态      同类文章      热门文章      网站地图      返回首页 物流园资讯移动站 http://sjzytwl.xhstdz.com/mobile/ , 查看更多   
最新文章
3防手机(3防手机8849)
  关于《三防手机》的文章  随着科技的不断发展,智能手机已经成为我们日常生活中不可或缺的一部分。然而,我们的手机在使用
华为手机有放大镜望远镜的功能吗 华为手机放大镜望远镜功能介绍【详解】手机望远镜「华为手机有放大镜望远镜的功能吗 华为手机放大镜望远镜功能介绍【详解】」
  有放大镜望远镜的功能吗,很多朋友都遇到了这样的问题。这个问题该如何解决呢?下面小编就带来华为放大镜望远镜的功能介绍,
4glte是什么手机(4g lte+)
  关于《4GLTE是什么手机》的文章  在现代社会,移动通信技术日新月异,其中,4GLTE技术已成为众多智能手机所广泛采用的一种
工行短信银行工商银行手机银行app下载「工行短信银行」
工行短信银行app是一款工行移动金融创新产品的手机客户端。工行短信银行客户端为你提供实时查询、业务办理等等,方便快捷,快来I
怎么办理手机银行手机银行「怎么办理手机银行」
随着移动互联网的飞速发展,手机银行已成为我们日常生活中不可或缺的一部分,它提供了便捷、高效的金融服务。那么,如何办理手机
手机管家手机管家「手机管家」
手机管家是一款综合性的手机管理软件,旨在为用户提供一站式的手机优化服务。通过智能清理、加速、安全保护等功能,帮助用户轻松
品牌手机排行榜前十名手机品牌排行榜前十名「品牌手机排行榜前十名」
华为创立于1987年,是全球领先的信息与通信技术(ICT)解决方案供应商,在电信运营商、企业、终端和云计算等领域构筑了端到端的解
手机CPU天梯图2023年2月最新版,你的手机排名如何?手机cpu天梯图「手机CPU天梯图2023年2月最新版,你的手机排名如何?」
2月已经过去,我们迎来了3月,冬日的寒冷逐渐消散,春天的日子已经触手可及。今天是我们3月份的第一天,芝麻科技讯更新了2023年2
6g运行手机(6g运行手机什么牌子好)
  关于《6G运行手机》的文章  随着科技的飞速发展,手机已经成为了我们日常生活中不可或缺的一部分。近日,各大手机品牌纷纷
手机控必看!大屏手机用出“手机手” 严重的要动手术手机手「手机控必看!大屏手机用出“手机手” 严重的要动手术」
你的手还好吗?鼠标手、键盘手、近视眼、肩周炎……难道这些伤害还不够吗?这不,最近又爆出新科技病——“手机手”!没有买卖,
相关文章