大前端监控

会议室:四季厅 1 时间:02月06日 14:55
出品人:何定旭

互联网人口红利逐渐消失,用户运营成为重中之重,线上问题如何被更快地发现、定位与解... 展开 >

专题出品人:何定旭

美团App 效能工具负责人

先后负责移动端持续集成平台、智能化发布系统与监控运维体系,目前主要致力于美团监控体系建设,为美团 200 多个业务品类提供千亿级数据实时计算、异常智能归因分析与个案日志联动查询等一条龙服务,在智能监控、用户体验与工程化等方向有较为丰富的经验。

时间:02月06日 14:55
地点:四季厅 1

专题:大前端监控

互联网人口红利逐渐消失,用户运营成为重中之重,线上问题如何被更快地发现、定位与解决,对业务而言至关重要,大前端监控作为观测业务的窗口承担了业务雷达的作用。本次主要聚焦线上问题从发现到解决的业界优秀实践。

by 黄建波

阿里巴巴
前端技术专家

过去一年,淘系对业务做了监控的统一接入和覆盖,但是前端整体的故障发现率和问题发现率仍处于较低水位,如何提升线上问题发现率是监控核心要解决的问题。

本次分享主要通过前端监控的演进,调整监控策略,从传统的技术指标监控转为体验指标监控,通过升级异常检测、业务监控以及报警监控能力,帮助业务实现从不确性问题到确认性问题的监控策略转化。

演讲提纲:

1. 背景概述

  • 淘系过去录入的前端问题以及问题分布情况
  • 对未监控的问题进行问题归类以及典型问题做案例分析

2. 问题分析

  • 链路分析
    • 分析页面在不同节点出现的异常场景
    • 分析页面异常和体验的关系
  • 指标分析
    • 技术指标(JSError、资源异常等)现状
    • 技术指标和体验指标的差异
  • 前端监控演进策略

3. 技术方案

  • 异常检测
    • 页面信息结构特征采集
    • 基于大数据检测页面异常渲染
    • 案例分析
  • 业务监控
    • 业务监控定义
    • 业务监控模型设计
    • 业务监控最佳实践
  • 数据治理
    • 核心指标对监控的影响分析
    • 治理思路和方案以及治理成果
    • 案例分析
  • 报警监控
    • 监控场景分析
    • 报警策略、报警方案以及报警监控细粒的维度分析
    • 实践案例

4. 总结规划

  • 方案总结
  • 成果总结
  • 后续规划

你将获得:

  • 了解淘系监控遇到的问题和解决思路
  • 了解前端监控能力建设方案与实践
  • 了解如何通过前端监控能力提高问题发现率

by 江保贵

去哪儿网
客户端架构师

App 涉及多技术栈、多种维度数据统计监控,多系统之间使用的页面及 View 名称长度不一、全称简称复杂多变,为 App 治理用户体验提升带来诸多不便,从而需要制定统一的 ID 标准,为 App 运行时质量监控、端上管控、用户体验优化等数字量化平台提供最基础能力支撑。

演讲提纲:

1. 精细化治理的背景与价值

  • 去哪儿网大前端业务及框架现状:大前端复杂臃肿,监控系统散乱,优化治理没有统一量化标准
  • 治理熵增的价值:建立组件 ID 机制,统一生产和使用规则,关联大前端各种日志采集、性能监控等,实现精细化治理,结合数字化平台实现治理效果可追溯追踪

2. 标准建立与多端实现

  • 组件 ID 机制整体架构体系
  • 双端无侵入技术实现关键点
  • 组件 ID 的管理与维护
  • 数据的采集及处理流程

3. 实践及应用场景

  • 线上问题快速定位处理
  • 用户体验评分模型的搭建
  • 模型数据验证流程
  • 用户体验评分平台效果展示

4. 未来规划

  • 预警与诊断
  • 端上管控
  • 精准风控
  • 数据支撑 App 瘦身

你将获得:

  • 了解技术架构设计与方案实施
  • 了解 App 及业务组件数字量化、精细化端上管控治理等基础能力建设

by 李祎

58同城
用户价值增长前端技术部负责人

曾几何时,大前端多技术栈混合开发、多端开发还是非常新兴技术,如今已变成了各大互联网公司的基本架构,伴随而来的是更加复杂的逻辑实现和更加难以定位、解决的线上异常,提供覆盖多技术栈、多端的前端监控系统成为一种必选项。

本次分享主要介绍 58 同城北斗大前端监控系统的在多技术栈监控的建设与实践,包括如何在多技术栈监控场景下保证实时体验、可控的维护成本和多场景灵活定制,以及如何提供更为方便的多端技术团队的会诊能力等内容。


演讲提纲:
1. 多端监控系统架构设计

  • 基于业务发展的关注点-整体架构
  • 多技术栈高可控-前端SDK设计
  • 保障日志协议的可扩展-两级传输协议
  • 双数据引擎架构
  • 日志采样静动分级
  • 日志集群隔离策略
  • 低成本多阶段-分布式实时告警

2. 多端监控异常定位思路

  • 前端异常定位体系
  • 自动生成复现上下文-智能维度分析
  • 全场景高精度日志-前端执行链路日志
  • 像游戏一样重现-异常场景模拟还原
  • 客户端异常定位体系
  • 客户端执行链路日志
  • 技术优化推动业务-启动性能和启动折损

3. 多端场景下的串联演进

  • 案例1:前端主导客户端会诊
  • 案例2:客户端对齐前端日志时机
  • 案例3:前端后端监控系统级对接

4. 思考与规划


你将获得:

  • 了解如何以集团级平台视角去设计前端监控系统
  • 了解如何保证多技术栈、多端监控系统的实时体验、可维护性、可扩展性和维护成本
  • 了解如何实现多技术栈混合开发过程中的异常关联和异常定位
  • 了解如何思考前端监控系统未来的演进方向

by 李振

腾讯云
前端性能监控 RUM 负责人

随着互联网业务稳步发展,整个前端体系也逐渐走向精细化运营和质量开发,用户体验问题也越来越受到开发者重视,前端监控变得尤为重要。前端监控首先要解决数据采集问题,一个高效且跨平台的 SDK 是我们首先要解决的问题,错误数据如何采集?数据上报时机如何设置?流量异常的时候如何进行熔断?这些基础问题解决好以后,高并发接入层是整个产品稳定运行的关键,面对每天千亿的上报数据,峰值百万 QPS 上报流量,如何通过无状态且可自动扩缩容的服务保障系统鲁棒性?

本次分享将着重介绍前端监控平台的技术思考、具体实践和优化细节,以及整体方案解决过程中遇到的实际问题等。

演讲提纲:

1. 背景介绍

  • 腾讯大前端监控体系介绍
  • 问题与挑战
    • 腾讯内部前端基础建设复杂,多种平台共存,内部多个跨端框架
    • 因网络和环境导致的接口异常问题难以定位和复现

2. 多平台监控 SDK 设计与实现

  • 微内核与插件化方案
    • 基于 Pipeline 管道进行数据上报
    • 不同平台监控关注点分离如何实现
    • 案例分享
  • 基于插件组合的最小包优化模式
    • TCP 首包 14k 原则
    • 监控 SDK 如何实现按需加载
    • 案例分享
  • 数据上报方式与延迟设计
    • 多种上报方式对比:xhr/img/beacon,孰优孰劣
    • 指标采集后上报时机,实时上报和延迟上报如何选择
    • 上报带宽损耗与上报数据完整度如何设计与选择
    • 案例分享

3. 百万 QPS 上报接入层设计与实现

  • 服务性能机制优化之路
  • Node.js 微服务改造与性能优化
  • 高性能异步网关设计
  • 高维数据降维
  • 实践案例分析

你将获得:

  • 建立前端监控整体知识架构体系,了解 Web 和小程序相关主流监控卖点
  • 了解腾讯前端监控成熟的解决方案和技术选型
  • 了解对海量数据处理和超高并发流量处理经验
  • 从网关到接入层到数据存储的全方位优化,学习流量激增、高维数据处理经验
在报名过程中如有任何问题,欢迎微信扫描二维码联系我们的票务经理