华为的网络AI领域10大公开数据集是哪些

在华为开发者大会hdc.cloud 3月20号直播间,华为网络人工智能数据湖专家周尧,向开发者们正式发布了网络ai领域10大公开数据集,解决了网络ai开发缺乏工业级数据的难题。
这10大数据集是华为从外场仿真数据和实验室模拟数据,经过解析治理、探索标注之后的,可以直接应用于网络领域ai应用开发的数据集。分为“异常检测类”、“控制优化类”、和“故障定界类”三大类:
异常检测类
1)性能指标异常检测数据集:时间序列数据集,包括正样本和负样本,可应用于时序序列预测等算法的训练和验证;样本量100w条,特征维度7维
2)性能指标变更监控测数据集:覆盖4种网络业务变更场景,包括变更成功场景和失败场景,失败场景数据有对应标签;样本量100w条,特征维度40维
3)硬盘故障检测数据集:覆盖日立,希捷共计16款硬盘型号,累积标注坏盘数量超2300块,应用于硬盘故障预测类问题分析与研究;样本量超230w条,特征维度超100维(覆盖厂商公开smart指标)
控制优化类
4)数据中心群控数据集:包含冷塔、冷机、泵等设备的供回水温度、压力、it机房、冷站设备能耗100+维特征,可应用于数据中心水冷冷冻水场景制冷系统优化模型训练;样本量2w条,特征维度100维
5)数据中心pue优化数据集:覆盖3种制冷场景、4种末端空调、冷站群控、it机房等设备能耗数据,基于冷却系统完成关联,应用于pue优化、网络领域控制类模型开发与研究;样本量2w条,特征维度110维
故障定界类
6)无线接入故障数据集:覆盖20种无线接入故障类型,告警数据与工单数据相关关联,业务专家团队准确标注,可用于告警压缩和根因定位类模型开发,样本量65w条,特征维度7维
7)无线&ipran故障数据集:告警数据基于无线接入和ipran的设备拓扑进行关联,利用工单数据完成根因告警标注,覆盖37种故障类型,可用于告警压缩和故障定位,样本量700w+条,特征维度24维
8)无线&ptn故障数据集:告警数据基于无线基站、动力环境、ptn等设备拓扑进行关联,利用工单数据完成根因告警标注,覆盖48种故障类型,可用于告警压缩和故障定位,样本量100w+条,特征维度61维
9)无线&微波故障数据集:告警数据基于无线基站、动力环境、微波等设备拓扑进行关联,利用工单数据完成根因告警标注,覆盖29种故障类型,可用于告警压缩和故障定位,样本量100w+条,特征维度46维
10)pon光路故障数据集:pon光路故障场景数据,包含光纤弯曲、连接器松动等故障场景,覆盖光模块的电压,电流,接收光功率,发送光功率等特征,样本量4w条,特征维度11维
数据和特征决定了机器学习的上限,华为发布网络领域10大数据集,不但可以帮助网络ai开发者减少90%的数据集准备时间,更重要的是将会极大提高ai模型精度。目前已验证数据中心数据集助力ai模型达准确率达到89.77%,无线&ipran故障数据集提高高级聚合率到95.4%,查准率到90%。
现在使用华为云账号登录华为云,选择naie服务(路径:ei企业智能—智能体—网络智能体 naie),再从ai服务目录选择数据集服务,即可进入数据集服务页面选择所需公开数据集。

LCD版新iPhone最详细的爆料
铝电解电容器 耐波纹电流性能更强且高度更低
数字化时代,企业终端安全防护该“上新”了!
集成电路行业和企业的特点对金融政策制定的影响
基于MAX7456视频字幕模块的单色OSD系统的实现过程
华为的网络AI领域10大公开数据集是哪些
联想创投贺志强:以CVC模式,助力行业智能转型
Linux input 子系统范例和基本函数解析
pcb如何生产出来的呢? PCB的生产完整过程解析
电动汽车的电池续航问题有何解决出路
2020年的物联网时代:以巨头为中心,物联网业绩难以成规模
PicoG24K体验 设计简洁大气机身轻便佩戴舒适
浅谈雨量监测系统的组成部分
康普RUCKUS观点:共享频谱和融合网络打造2023年企业连接新亮点
C/C++中的内存区域划分
最新资讯|意法半导体TouchGFX Stock简化并加快在STM32 MCU上用户界面设计
安捷伦推出EDA平台最新版本ADS 2012软件
车规芯片与消费电子芯片有何不同?
共创智慧矿山新蓝海
ARM与联华电子达成最新的28HPC POP工艺合作,扩大28纳米IP领先地位