通过使用火山引擎MARS-APM Plus的memory graph功能,飞书研发团队有效分析定位问题线上case多达30例,线上OOM率降低到了0.8‰,降幅达到60%。大幅提升了用户体验,为飞书的性能品质保驾护航。

应用程序稳定性是影响用户体验及留存的关键因素

对于移动App的开发者来说,最基础也是最关注的问题就是应用程序的稳定性。而崩溃问题是影响稳定性的重要因素, 包括NSException、Signal、卡死、OOM(Out Of Memory)等问题类型。其中,OOM问题是随着业务的迭代,慢慢进入了开发者视野。

OOM问题往往潜伏在复杂的业务背景下,复现困难且缺少有效的问题排查手段。目前在 iOS 端排查内存问题的工具主要包括 Xcode 提供的 Memory Graph 和 Instruments 相关的工具集,它们能够提供相对完备的内存信息,但是应用场景仅限于开发环境,无法在生产环境使用。由于内存问题往往发生在一些极端的使用场景,线下开发测试一般无法覆盖对应的问题,Xcode 提供的工具无法分析处理大多数偶现的疑难问题。

飞书是字节跳动旗下先进企业协作与管理平台,不仅包含一站式整合及时沟通、智能日历、音视频会议、飞书文档、云盘等办公协作套件,更提供飞书OKR、飞书招聘、飞书绩效等组织管理产品。作为一款企业协作与管理平台,业务复杂度非常高,稍有不注意就会触发OOM,导致程序崩溃。

那么飞书的业务有多复杂呢?举例来说:

  • 飞书消息列表页的消息类型多达十余种,包括文档预览,视频、复杂的富文本等;
  • 飞书会议在千人视频中可以对视频做各种特效渲染,视频过程能共享文档,千人在线编辑文档;
  • 飞书文档本身支持插入各种类型信息,比如复杂计算公式、脑图、UML图、同时也支持外部扩展;

飞书把内存的使用运用到了极限,稍不留意就会导致OOM。试想一下,千人视频会议的时候,突然间因为内存问题导致崩溃,会议方是什么感受?给客户发送一条复杂的消息,因为内存问题,客户的手机崩溃了,客户是什么感受?基于此,解决内存问题、分析定位线上 OOM 原因,是飞书的首要目标

火山引擎MARS-APM Plus为飞书性能保驾护航

APM Plus是字节跳动应用开发套件MARS下的性能监控产品,通过先进的数据采集与监控技术,为企业提供全链路的应用性能监控服务,解决企业对各端监控的需求。具备非侵入式监控、丰富的异常现场还原能力,助力企业提升异常问题排查与解决的效率、优化应用品质,以降低成本提高收入。

MARS-APM Plus-功能介绍

飞书通过火山引擎MARS-APM Plus memory graph 提供的类聚合列表,能清晰的发现内存占用排名靠前的类,每一个类还可以向下钻取到内存节点单元,通过内存节点单元可以查询到节点的引用关系,顺藤摸瓜,找到最开始的父节点,同时还可以逆向去看其他内存节点单元是否也是同样的引用关系,以此来佐证该内存问题。通过这种分析思路,我们发现了超大图问题、超多帧gif问题、资源预加载问题等等。

火山引擎MARS-APM Plus的内存优化分「OOM趋势」、「泄露分析」、「大对象」和「单设备查询」。

  1. OOM 趋势:提供了内存泄露的指标分析。 除了4个核心指标(OOM次数、OOM率、影响用户数、影响用户比例)外,还提供进一步分析OOM的扩展指标,如:App占用内存大小、App占用内存比例。
  2. 泄露分析:提供了导致泄漏的对象类型列表和详情分析。 在这里可以逐一分析那些严重导致内存泄露的对象。
  3. 对象列表中:提供了占用内存过大的大对象以及数量众多聚合而成的小对象。 以帮助研发更准确地了解内存被哪些对象占用。
  4. 单设备查询中:可直接分析单台设备的内存问题。 iOS提供了直接精准分析单台设备的内存引用树、支配树、实例等,Android可下载查询其原始数据。

在使用memory graph前,飞书线上分析手段单一,也不能给出明确的理论依据,一度线上OOM用户影响率达到2‰,通过使用memory graph,我们有效分析定位问题线上case多达30例,线上 OOM 率降低到了0.8‰,降幅达到60% 。大幅提升了用户体验,为飞书的性能品质保驾护航。

助力企业提升IT异常问题排查与解决的效率、优化应用品质

APM Plus为企业提供针对应用服务的品质、性能以及自定义 埋点 APM 服务。基于海量数据的聚合分析,平台可帮助客户发现多类异常问题,并及时报警,做分配处理,同时平台提供了丰富的归因能力,包括且不限于异常分析、多维分析、自定义上报、单点日志查询等,结合灵活的报表能力可了解各类指标的趋势变化。除飞书外,APM Plus已服务了抖音、今日头条、Tik Tok等多个超大规模用户量级移动App。

火山引擎MARS-APM Plus的内存监控可定位到到因内存占用导致的异常,并提供多种排查内存异常的指标、维度与手段:

  1. 无死角地发现已出现的内存异常问题,有完备的归因链路。 不仅提供了丰富的指标可分析内存问题并确定影响范围,并能够给出导致内存异常的对象列表,还能够分析单台设备上具体异常节点。提供从大盘到代码的层层递进的归因分析能力,极大提高研发的排查效率
  2. 提供预防内存异常的能力。 可给出有导致内存异常风险的对象列表,可提前针对性地优化,降低事故发生率,在影响用户前就解决掉潜在风险。

目前,火山引擎MARS-APM Plus面向新用户提供试用30 天的限时免费服务。其中包含 App 监控、Web 监控、Server 监控、小程序监控,App 监控和 Web 监控各500 万条事件量, Server 与小程序监控限时不限量。

相关文章: https://mp.weixin.qq.com/s/hQRN5s60AeIj-WoTXRLlPg


MARS TALK | 02

今日头条极速版插件化实践分享

10月28日(周四)晚八点,我们邀请火山引擎MARS-APM Plus的火山引擎MARS-APM Plus开发工程师党鹏飞和飞书iOS开发工程师蔡亮,做客 MARS TALK 第二期,分享飞书基于MARS-APM Plus的性能优化实践之路。

本次活动采用线上直播的模式,更多产品及活动信息,欢迎大家扫码了解

火山引擎MARS-APM Plus x 飞书 |降低线上OOM,提高App性能稳定性相关推荐

  1. 如何用飞书高效线上教学?

    题图:Photo by  Sergey Zolkin on  Unsplash 需求 这学期,我们这儿从头到尾上网课,有些让人始料未及. 其实从 2020 年开始,上网课已经不新鲜了.但是一门课完全线 ...

  2. 最新功能 | 飞书推出“线上办公室”功能,助力企业开启无压力远程实时高效协作

    为解决企业节后远程协作办公痛点,飞书"线上办公室"功能应运而生,"线上办公室"通过实时语音频道的方式,高度还原办公室工作.沟通场景,帮助企业和团队之间提升远程协 ...

  3. 飞书推出“线上办公室” 通过实时语音频道还原办公场景

    为解决企业远程协作办公痛点,2月2日,字节跳动旗下办公套件飞书宣布推出"线上办公室"功能,通过实时语音频道的方式,高度还原办公室工作.沟通场景,帮助企业和团队之间提升远程协作效率, ...

  4. 明明白白炸鸡--APM固件LOG日志全解析线上视频讨论会

    经常有人在各大QQ群求分析LOG日志,分析炸鸡原因.我们作为开发者角度以为,不管是航模爱好者和学习研究APM固件的飞控人员,对于LOG日志的分析都是很有必要的. 其实LOG日志里面已经可以分析出绝大多 ...

  5. 智能汽车竞赛线上答疑|灵动微电子联合逐飞科技的线上答疑会来啦~

    第十七届大赛是灵动微电子赞助大赛的第二年,今年有两个组别限定使用灵动的微控制器作为主控,分别是平衡信标组和极速越野组,另外还规定了极速越野组的无刷驱动方案需要使用灵动的MCU作为主控,平衡信标组的国赛 ...

  6. 飞书与IAI国际广告奖,协同实现国内营销史上的创新“云终审”

    防疫时期,线下营销活动暂停或无限延期,转型线上迫在眉睫.而想要高效地进行线上远程办公,一套实用而全面的线上协同工具不可或缺. 今天的主角,IAI国际广告奖--是由中国传媒大学广告学院与IAI国际广告研 ...

  7. 生态伙伴 | 摹客入驻飞书,体验高效产品协作设计!

    产业数字化是未来的重要趋势,而企业要想数字化,必须拥有自己的协作平台和软件产品,因此,产品设计的重要程度越发凸显出来. 如何更高效地完成产品设计与协同?飞书携手本期生态伙伴「摹客」为企业产品团队提供全 ...

  8. Feishu(飞书) 聊天机器人应用(2/3)- 定制对话,实现知识库、信息查询、意图识别、多轮对话

    目录 Chatopera 飞书 Custom App 开源项目 快速开始 创建 Feishu Bot 应用 创建 Chatopera Bot 应用 编辑描述文件 安装依赖 启动服务 配置 Feishu ...

  9. 钉钉、企业微信、飞书的掘金逻辑

    互联网进程已经从上半场的消费互联网,转为下半场的产业互联网.TO B,成为互联网巨头挖掘产业增量的另一赛道. 各家企业进入赛道的方式都不同.目前,钉钉.企业微信.飞书三家远程办公平台,成为阿里.腾讯. ...

最新文章

  1. Android媒体相关开发应用程序接口
  2. Maven中使用tomcat:run出现错误org.eclipse.jdt.internal.compiler.classfmt.ClassFormatException
  3. 关于c++静态成员函数
  4. 前端学习(3284):立即执行函数三
  5. VUE 入坑系列 一 双向绑定
  6. Linux下安装配置Nexus
  7. linux wget安装mysql_linux安装mysql
  8. web和python哪个好_用python开发app和web哪个比较容易?
  9. synchronized 线程同步
  10. 翻译:PropertyWrapper swift 5 aop特性
  11. 计算机二级c语言考试的步骤,计算机二级C语言考试技巧
  12. fatal: unable to access 'https://github.com:***' 或者本机ping不通github.com解决方法
  13. 【CDAS峰会】吴喜之:数据科学的未来发展
  14. 让优秀成为一种习惯——笔录
  15. 微信小程序周记(第一周 7.19-7.25)
  16. 实战 逆向最新黄鸟抓包软件
  17. java微信支付 需要证书吗_java引用微信支付的p12证书文件
  18. php微信公众号开发之网页授权
  19. 在oracle中要谨慎使用when others then(二)
  20. 15款JQuery图片展示效果插件

热门文章

  1. 两台计算机直连怎么写ip,两台电脑如何直连?
  2. RabbitMQ入门指南:初学者也能读懂的教程
  3. vue 实现前端模糊搜索
  4. [算法]什么算法?怎么衡量算法的好坏?
  5. MyBatis框架知识
  6. 目标检测标签文件txt转成xml
  7. opencv之图像采样
  8. php防火墙源码,科威PHP防火墙 v1.1 BETA UTF8
  9. Python案例分析:中美汇率转换(2)
  10. 飞睿科技乐鑫代理商,新型多媒体开发板方案,支持人机交互应用