写点什么

DigitalOcean 添加监控和告警特性

  • 2017-05-14
  • 本文字数:1453 字

    阅读完需:约 5 分钟

云基础设施提供商 DigitalOcean 最近释放了监控服务器和发送告警的功能。尽管这不是什么新奇的功能,但是这个免费的特性带有一定的象征性,代表了行业越来越关注服务器和应用内部的运行情况。

DigitalOcean 的监控服务是基于 agent 的。它能用于新的和已有的虚拟机(被称为“droplets”)。开发人员可以在供应基于 Linux 的 droplets 时安装这个 agent ,也可以在事后运行一个构建脚本。agent 会捕获各种指标,包括:CPU、内存使用、磁盘 I/O、磁盘使用率、输入带宽和输出带宽。这些指标只能通过仪表盘来查看,无法通过 API 访问。因为这些指标是通过内置(on-box)的 agent 来收集的,像“top 进程”这样的信息也是可以获取到的。开发人员能够创建告警策略,当达到一定的性能阈值就会产生警报。这些策略可以用于单个 droplet,也可以用于一组 droplet。报警能够通过 Email 地址或 Slack channel 来进行发送。DigitalOcean 最多会将指标信息存储 30 天。但是,如果用户销毁某个 droplet 的话,指标信息也会立即消除。

在提供监控服务之前,DigitalOcean依赖于合作伙伴来弥补这块缺失的功能。DigitalOcean 的联合创始人 Mitch Wainer对记者 Ben Kepes 说,他们的核心合作伙伴并没有对这些功能感到惊讶。

当然,对于 Wainer 来说,一个明显的问题在于如何处理与 DigitalOcean 已有的合作伙伴的关系。Wainer 非常开放和坦诚,他承认这会影响到合作伙伴。但是他很快补充说,DigitalOcean 一直对它的发展意图非常开放,给了这些供应商很长的时间来准备这种变更。

其他主要的 IaaS 厂商也支持范围广泛的合作伙伴,但是多年来一直都会提供内置的监控功能。 Amazon CloudWatch 有一个用于服务器监控的免费层级(free tier),能够存储性能数据超过一年的时间。另外,AWS 还提供了可视化、告警、API 访问、更高级的层级(需要收取一定费用)、自定义指标和日志监控的功能。微软为 Azure 虚拟机也提供了综合的监控功能。用户可以创建告警,将指标归档到长期存储中,然后通过API 来消费和查询数据。 Google Stackdriver 监控支持 Google Compute Engine 和 AWS 服务器。它有一个免费层级,同时还有一个更高层级的服务。与其他的 IaaS 供应商类似,Google 提供了自定义指标、告警策略、丰富的提醒方案、API 访问等功能。

用户对服务器和应用监控的期望在发生着变化。The New Stack 的一份报告指出了容器化对监控需求会带来什么样的影响。临时性服务(Ephemeral service)、要跟踪的“东西”呈现多样化、关注“服务”而不是“服务器”以及新类型的终端用户,上述的这些变化都导致传统的监控方式力不从心。临时性服务意味着厂商需要有新的方式来定价,因为服务实例会随时加入或销毁。为了应对更复杂的应用拓扑架构所带来的挑战, AWS 在 2016 年引入了 X-Ray 。在帮助现代团队监控服务和解决问题方面,工具和服务出现了爆炸性地增长。已有的厂商,比如 New Relic Dynatrace Datadog 在不断演化其产品,以满足新的需求。新出现的解决方案也都引起了业界的关注,比如 Prometheus Pivotal Cloud Foundry Metrics Honeycomb Zipkin

DigitalOcean 的监控是免费使用的,在全球范围内的八个机房都可以访问。在宣布该项服务的博客文章的结尾,DigitalOcean 给出了这项服务的未来规划。

监控服务的第一个迭代成果已经和大家见面了,我们已经致力于下一个迭代的工作。很快将会推出的特性包括:

  • 对告警策略的 API 支持
  • 告警的可视化增强
  • 监控块存储(Block Storage)
  • 将告警通知外部服务的 Webhooks

查看英文原文 DigitalOcean Adds Monitoring and Alerting Features

2017-05-14 19:001564

评论

发布
暂无评论
发现更多内容

Spring系列篇:Spring容器基本使用及原理

简爱W

架构师训练营 -- 第11周作业

stardust20

Apache 软件基金会顶级项目 Pulsar 达成新里程碑:全球贡献者超 300 位!

Apache Pulsar

Apache Apache Pulsar 消息系统 消息中间件

薪水真的不是工作的全部

escray

学习 面试

云算力挖矿平台APP,一站式云算力挖矿系统开发

13530558032

有益思考一则:框架性思维

石君

学习 方法论

一起学MySQL性能优化

xcbeyond

MySQL 性能优化 MySQL性能优化

微服务编程范式

看山

微服务 范式 签约计划第二季

微服务的基建工作

看山

微服务 基础设施 签约计划第二季

游戏夜读 | 什么才值得纪念?

game1night

银行热衷拿区块链专利 背后有何意图

CECBC

区块链 银行

一次开零售店的经历(2)

石云升

零售店

第11周学习总结

赵龙

架构师训练营第11周作业

Bruce Xiong

开源流数据公司 StreamNative 推出 Pulsar 云服务,推进企业“流优先”进程

Apache Pulsar

Apache Pulsar 消息系统 消息中间件

区块链数字钱包定制开发,数字货币钱包开发费用

13530558032

沟通是一门艺术

石云升

情绪控制 沟通艺术

架构师第十一周作业及总结

傻傻的帅

ArCall 升级丨新增多项功能,可支持多人在线语音

anyRTC开发者

音视频 WebRTC 直播 RTC

第二周学习总结

Vincent

极客时间 极客大学 作业

论商品促销代码的优雅性

架构师修行之路

架构师训练营第十一周总结

张明森

智能化转型将加速数字经济变革

CECBC

人工智能 数字经济

跨过语言银河,构筑智能鹊桥:百度NLP的十年、今夕与未来

脑极体

安全系列之——主流Hash散列算法介绍和使用

诸葛小猿

hash 散列函数 md5 sha1 murmurhash

悬挂引用是如何被Rust消灭的?

袁承兴

rust 内存模型 指针 引用 泛型

第11周作业

赵龙

第二周作业

Vincent

极客时间 作业

week11 作业

Geek_196d0f

一次开零售店的经历(1)

石云升

零售店

架构师训练营第十一周作业

张明森

DigitalOcean添加监控和告警特性_DevOps & 平台工程_Richard Seroter_InfoQ精选文章