AI实践哪家强?来 AICon, 解锁技术前沿,探寻产业新机! 了解详情
写点什么

BAT 都有哪些 AIOps 的经典案例?

  • 2018-09-29
  • 本文字数:1852 字

    阅读完需:约 6 分钟

首先,我们一起划重点:不提供干货的案例,都不能算好案例。

AIOps 的概念从 2016 年被提出以来,热度一直在增加,都是混运维这个圈的,我相信你听过或看过不少关于 AIOps 的报道。所以,是时候提供一些落地案例,增加一下你对 AIOps 的信心了。

11 月 16-17 日,CNUTCon 全球运维技术大会将在上海举行,我们邀请了 BAT 的专家来分享他们在 AIOps 领域的实践经验,知道你爱听“踩坑”教训和“排雷”经验,请相信,你想要的,我们都有!小编也是用尽毕生力气摁住了 Molly 和 Joy 的小手手,为大家争取来一次“剧透”的机会,提前带大家探究下他们要讲的内容!

聊起百度,想必大家的记忆都是从“百度一下”开始的,但很显然,百度并不想被大家定义为一个“搜索引擎”,于是他们涉足了各种领域,有了“百度文库”“百度知道”“百度学术”“百度地图”“百度网盘”“百度外卖”等产品。

互联网产品迭代速度非常之快,因此,百度每年都有数以万计的程序变更。但变化都伴随着风险,据统计超过 50% 的服务故障来源于发布。为了减少变更发布故障带来的损失,更好地管理海量规模的发布变更过程,百度智能变更(BID)产品应运而生。BID 提供了包含自动化部署、分级发布和变更检查的完整解决方案。

我们请来了百度智能云事业部的高级研发工程师陈云,为你重点讲述百度变更发布检查从人工到智能进阶。

「她说」

随着模块监控逐渐完善,很多模块都有数以十万计的监控数据,依靠配置规则或人工来检查发布效果是不可完成的任务。为了应对海量指标检查的需求,我们利用 AIOps 相关技术,设计出了一套可根据历史变更及对照组情况自动判断指标状态的智能检测算法。该算法不需要人工配置参数,通过自动训练参数并准确地判断异常,并且具备较好的普适性。最后,我们将展示智能发布检查在百度的具体实践效果。

本次演讲的主要内容如下:

  1. 故障来源及分布;
  2. 分级发布机制;
  3. 智能发布检查算法(异常定义、算法流程、基于 T 检验的指标变化度量、基于历史变更的异常变化检测、基于对照组的异常变化检测);
  4. 百度变更发布智能检查实践。

你能从中学到:

  1. 学习尽可能限制变更过程中异常影响范围的机制;
  2. 理解变更检查在变更过程中的重要地位和作用;
  3. 学习如果利用 AIOps 相关技术对变更过程中指标状态进行智能判断的方法。

提到阿里巴巴,你最先想到的是哪个词呢?移动支付?还是双十一?阿里系在产品种类上,也不甘落后。听说今年优酷直播世界杯,也是阿里云的小伙伴们在保驾护航。世界杯看得怎么样?是不是很清晰,又不卡顿呢?

我们请来了阿里云的视频云运维专家不畏,为你分享:智能的大脑——谈阿里视频云智能调度系统的演进。

「他说」

调度系统作为 CDN 的核心模块,对业务的质量、成本和稳定性等各方面起决定性作用。随着业务类型的快速变化,从传统的图片等小文件,到点播流媒体、直播、动态加速,调度系统也随之在不停的迭代更新以更加适应业务形态的调度模型,在业务和系统快速变化之下的稳定性、效率、智能运营是摆在运维面前的难题。希望这次可以深入浅出地介绍多次负责护航阿里“双十一”和 2018 俄罗斯世界杯的视频云智能调度系统,以及智能化运维在业务发展中的演进及其背后的思考。

本次演讲的主要内容如下:

  1. 阿里云视频云调度系统的演进之路;
  2. 在调度演进中的智能化运维思考和实践;
  3. 调度系统全盘智能化之下的运维价值。

你能从中学到:

  1. 阿里视频云调度系统在业务变化下是如何演进实践的;
  2. 在系统快速变化下的智能化运维思考模式。

去年王者荣耀,今年一起吃鸡。这是不是很多人在手游界的常态。小编虽然是个女孩子,但也经常混迹于“王者峡谷”。但我也是今天第一次去思考,游戏里的故障,腾讯是怎么定位的呢?

我们邀请到了腾讯技术运营部的高级工程师刘伟,为你深入浅出地介绍:智能运维助力游戏故障定位。

「他说」

随着游戏业务监控建设不断完善,海量业务故障时产生成百上千条告警,如何智能进行告警收敛、定位故障根源、实时统计业务影响是现阶段游戏运营面临的一个难题。本次分享以覆盖上百款游戏的智能故障定位平台出发,介绍腾讯游戏在智能异常检测、故障关联分析、故障知识图谱等方面的技术探索。

本次演讲内容如下:

  1. 利用动态阈值方法进行 KPI 曲线异常检测;
  2. 基于自然语音处理的实时舆情检测; 
  3. 故障定位领域关联分析及知识图谱技术。

你能从中学到:

  1. 学习智能监控全流程系统架构设计;
  2. 学习腾讯游戏在故障定位领域探索的经验;
  3. 掌握海量数据下动态阈值监控方法、实时舆情检测模型;
  4. 掌握构建专业知识图谱方法及知识图谱在故障领域应用。
2018-09-29 19:472570

评论

发布
暂无评论
发现更多内容

从 Java 到 Go:面向对象的巨人与云原生的轻骑兵

京东科技开发者

Autodesk AutoCAD 2021(cad 2021)自带中文许可证

Rose

烟草行业信创迁移-企业综合管理平台上线运行

中烟创新

哈尔滨等保应用安全测评

黑龙江陆陆信息测评部

Aloudata Agent :基于 NoETL 明细语义层的分析决策智能体

Aloudata

数据分析 大模型 智能问数 智能归因 智能报告

用知识图谱重构电商测试用例:精准覆盖业务场景的实践

测试人

人工智能

桌面日历工具有哪些?3个常用的任务管理软件盘点!

职场工具箱

项目管理 任务管理 在线白板 办公软件 日历应用程序

如何检测 Sliver C2 框架活动

天翼云开发者社区

sliver

对比2款国产远控软件,贝锐向日葵更优

科技热闻

八大年度奖项揭晓!2024 BSRC年度盛典沙龙圆满举办

百度安全

「产品功能授权」和「外部开发者授权」的差异

柯杰

授权

使用 gt-checksum 分析迁移对象

GreatSQL

淘宝/天猫订单同步实战:用API打通电商“任督二脉”

代码忍者

淘宝API接口

白鲸开源与亚马逊云科技携手推动AI-Ready数据架构创新

白鲸开源

AWS 亚马逊 白鲸开源 WhaleStudio

「Boli-职业发展助手」:技术人必备的智能职业规划与求职利器

安全乐谷

找工作 简历 实习 校招 失业

AI重构鞋服品牌「增长基因」:数据驱动的商品力革命已至

第七在线

秒送LBS场景下的C端SOA服务容灾建设之-数据备份篇

京东科技开发者

CST软件如何计算半导体的光电生成速率_达索官方授权

思茂信息

cst CST软件 CST Studio Suite

免费教程!【20小时通关工业级RAG】变现千万的RAG优化经验!

商汤万象开发者

人工智能 大模型 LLM rag 免费课程

苹果电脑一键深度清理工具App Cleaner & Uninstaller

Rose

IntelliJ IDEA 2025永久密钥最新版 Java语言开发

Rose

人工智能与气候模拟:如何用AI模拟和预测气候变化影响?

天津汇柏科技有限公司

人工智能 AI

Mac SVN客户端 SnailSVN Pro专业版

Rose

基于 Amazon Nova 和 TEN 框架的实时音视频交互解决方案

亚马逊云科技 (Amazon Web Services)

构建多智能体安全信任体系:业内首个智能体可信互连技术ASL来了

科技热闻

五一出行看科技,高速巡检无人机 AI 算法开启智慧新篇

极小新

人工智能 目标检测算法 视觉智能 智能巡检

开源鸿蒙,给机器人带来了什么?

脑极体

AI 操作系统

AI算法 | 睡岗识别冠军方案解读(姿态估计)

极小新

人工智能 计算机视觉 算法竞赛 目标检测算法 人体姿态估计

python 实现消费者优先级队列

天翼云开发者社区

rython 堆队列算法

从 Java 到 Go:面向对象的巨人与云原生的轻骑兵

京东科技开发者

《Operating System Concepts》阅读笔记:p778-p793

codists

操作系统

BAT都有哪些AIOps的经典案例?_DevOps & 平台工程_辛未・李_InfoQ精选文章