写点什么
创作场景
- 记录自己日常工作的实践、心得
- 发表对生活和职场的感悟
- 针对感兴趣的事件发表随笔或者杂谈
- 从 0 到 1 详细介绍你掌握的一门语言、一个技术,或者一个兴趣、爱好
- 或者,就直接把你的个人博客、公众号直接搬到这里
登录/注册
收录了 团队监控 频道下的 50 篇内容

随着互联网业务的迅速发展,用户对系统的要求也越来越高,而做好监控为系统保驾护航,能有效提高系统的可靠性、可用性及用户体验。
Uber工程师团队发布了开源项目Chaperone,这是一个Kafka监控工具。在Uber,它被用于监控并检测多个数据中心及大容量Kafka集群中数据丢失、延迟以及重复的问题。
“没有度量就没有提升”,度量是改进优化的基础,是做好一个系统的前置条件。业务应用是个黑盒子,通过数据埋点来收集应用的实时状态,然后展示在大屏或看板上。它是报警系统和数字化管理的基础,还可以结合集中式日志来快速定位和查找问题。我们的业务监控系统使用 Metrics.NET+InfluxDB+Grafana。
Robinhood服务器运营团队发表了一系列的文章,详细阐述了公司所采用的度量采集、监控和报警的架构。根据文章介绍,OpenTSDB、Grafana、Kafka和Riemann构成了其技术栈的核心。其中Kafka作为代理层,实现将度量流数据推送给Riemann处理,并推送到OpenTSDB存储。

2 月 7 日,由极客邦科技旗下 InfoQ 中国举办的 GMTC 全球大前端技术大会在北京·四季酒店顺利落下帷幕。

本文介绍携程框架团队对于应用监控系统的探索与思考
NewRelic宣布与Rails核心团队合作,以改进Rails的性能。通过可选特性,可以将性能数据提供给Rails核心团队,用以指出Rails在真实应用中的瓶颈所在。另外:FiveRuns的TuneUp性能监控工具现在已经支持Merb。

如今的软件开发⽣命周期⽐以往任何时候都快,多个开发和测试阶段同时发⽣。这催⽣了DevOps,使之前执⾏开发测试与运营管理彼此孤⽴的团队转化为了要执⾏所有功能并接受“⾃⼰构建,⾃⼰运营”(YBIYRI)的联合团队。

过去两年多作者本人关于可观测性相关工作的反思与回顾。

在 GMTC 深圳 2019 大会上,刘恒兵(河伯)讲师做了《由体验驱动的全链路监控》主题演讲。

腾讯 NOW 直播相比其他直播平台虽然起步较晚,但是成立三年以来, IVWEB 团队在对业务进行优化的同时,在实践中不断沉淀,沉淀出了一套比较完善监控方案。

随着互联网行业的不断发展,各种监控工具多得不可胜数,如何利用这些工具构建一个完整好用的监控平台呢?
在现代企业中,性能是系统稳定性和用户体验的关键指标,尤其是在面对复杂的 IT 架构和日益增长的用户需求时。性能监控系统是确保系统高效运行、及时发现潜在问题并快速响应的核心工具。无论是 Web 应用、数据库系统,还是分布式架构,性能监控系统都能够为 I

在 GMTC 深圳 2019 大会上,何方舟讲师做了《NOW 直播在大前端时代下的监控体系建设》主题演讲。

本文介绍了Netflix的系统监控实践:自研Telltale,它成功运行并监控着Netflix 100多个生产应用程序的运行状况。
持续交付是指团队能够快速、安全、可持续地按需发布各类变更。对于希望提升 CI/CD 能力、优化软件交付流程、降低发布风险的团队来说,持续交付不是简单地“更频繁发布”,而是让软件始终保持可部署状态。实践持续交付的团队,可以随时以低风险方式发布软件,

开源可观测性项目OpenTelemetry最近发布了一份名为“揭秘OpenTelemetry”的全面指南,旨在帮助组织理解、采用和扩展使用OpenTelemetry标准的可观测性。

在系统架构设计中非常重要的一环是要做数据监控和数据最终一致性,关于一致性的补偿,已经由算法部的大佬总结过就不再赘述。这里主要讲如何去补偿?补偿的方案哪些?这就引出来数据监控系统了。有小伙伴会问了,为什么业务状态监控系统可以做补偿?别急,往下

这是华夏银行基础技术研究团队完全自主研发、采用 Java 开发、全面采集 openGauss 数据库监控指标的一个开源项目。