如何进行用户的路径分析?

 
 

397c479876b90a21d1bdb0013cef5405.gif

 
 
公众号后台回复“图书“,了解更多号主新书内容

     作者:NK冬至

     来源:首席数据科学家

 路径分析,对于理解用户的流量行为特点,是最直观、高效的分析方式之一。

很久之前分享过《用户归因分析》,今天和大家聊聊流量分析中常用的用户的路径分析,以及如何在BI系统中产品化。

01

什么是路径分析

首先,什么是用户路径分析呢?

似乎这个从表述上来讲,就很容易理解了。其实就是用户在站内或者App内的不同页面、不同模块、不同操作事件之间,流转来及流转去的分析。

通过路径分析,我们可以很好地发现用户的流转特点,发现用户是从哪些环节、哪些页面流失、或者发生了阻碍,从而有针对性地优化产品,提升业绩。

比如,我们发现很多用户在加购后没有进行支付,我们就可以通过路径分析,看看用户加购后,都去哪里了、发生了什么操作。如此,有可能找到支付率低的原因所在。

02


路径分析的可视化呈现

关于用户的路径分析,比较常见的可视化呈现,就是桑基图。

桑基图,这里可以简单说两句。其实是因1898年Matthew Henry Phineas Riall Sankey绘制的“蒸汽机的能源效率图”而闻名,此后便以其名字命名为“桑基图”。

桑基图主要是用来显示流向和数量。最大的特点,就是开始与结束是保持总量守恒的。

比如下面的这个例子,就是桑基图:

19fac9c3741fdb97e7074d09d90a6619.png

从这个图里,我们能清晰看出全体用户是从哪个地方来,经过一步一步的环节后,到了哪里去。

另外一种和桑基图比较相似的图,是和弦图。如下示例:

3cd923684bbd6a1c8c47b6fe956017f2.png

和弦图主要是呈现从一个内容转移到另外所有内容的情况,呈现不了桑基图多层环节的内容,仅仅是一个环节。

03


路径分析的产品设计

上面讲到了路径分析主要的可视化呈现是桑基图。其实对于做分析报告而言,有一张恰当的桑基图就可以呈现很多信息了。

但产品化和做分析报告不一样。产品化要满足的是更丰富的应用场景,实现灵活的交互式分析。这是BI系统中路径分析的基本要求。

那么关于BI分析系统中的路径分析模块,该如何进行产品设计呢?我们看看行业的产品设计。

(1)谷歌分析的路径分析

下图是GA的路径分析模块:

f2ae8c2f228d63efb3cd172d5eff2afa.png

首先,GA支持节点类型的选择。用户可以选择事件、也可以选择页面,并且针对详细程度、聚合程度进行自定义调整。

其次,点击某个节点,可以进行更深入的分析。

  • 突出显示途经此处的流量:突出显示该部分流量在整个流程中产生的所有连接

  • 仅查看此细分(仅限维度节点):仅显示来自该维度/细分的流量

  • 查看通过此处的流量:显示来到该节点或出自该节点的所有连接。在此模式中,可以在路径中的该节点之前或之后添加其他步骤。

  • 群组详细信息:显示该节点中组合到一起的元素,如各个网页或事件。此选项用于查看以下详细信息:

顶级细分:当前指标

出站流量:接收来自该节点的流量的网页数

排名靠前的网页:流量进入频率最高的网页。例如,如果节点表示 Wearables 目录中的网页集合,那么您可以看到与该目录中具有最大流量的网页相关的信息。

流量细分:无法用于目标流

入站流量:将流量发送到节点的网页的数

出站流量:接收来自节点的流量的网页数

渠道进入次数:您的网站上用户从中进入渠道的网页数

渠道退出次数:您的渠道中用户从中退出渠道的网页数

(2)神策数据的路径分析

下图是神策数据的路径分析模块:

de2fc67b06c8c741c59bd630fec06720.png

其实大的逻辑,和GA的桑基图没有本质的区别,细节上,比GA还是会有一些减少。但从体验上,不得不说还是挺不错的。起码比较容易上手。GA可能还是翻译或者文化不同吧,总需要一个适应的过程。

神策的路径分析中,支持了多种方式的筛选操作。

8402a0ba595bf5657a22255b57e22d56.png

这里包括以下:

  • 事件范围的筛选

  • 起始事件的确定

  • 用户细分的筛选

  • session的时长设置

这些筛选其实能满足正常分析人员绝大部分的分析诉求了。尤其是session的间隔设置,这个我觉得还是挺惊艳的。回头仔细调研一下技术的实现。毕竟session间隔的随意设置,个人觉得对计算的要求还是很高的。

04


路径分析的数据逻辑

上面讲了很多产品设计侧面的内容。很便捷的交互式操作背后,是大量的数据处理逻辑,这里可以简述一二。

(1)需要有良好的序列数据及会话切割

想象一下,要实现路径分析,数据该如何处理?

首先,要对所有的行为日志进行会话(session)的划分。划分的目的是为了实现区分一次次独立的行为。通常的划分方式是,30分钟或者多久没有操作,本次会话就结束了。

其次,基于划分成一段段的会话,进行数据处理和汇总分析。

以作者之前的经验,在每个session中的事件记录,会按照时间顺序标记序列号。如此可以实现序列的分析。但对于神策分析中的自由设置session间隔是如何实现的,我确实也没想到。因为正常情况下,session的划分逻辑是固定的。

难道是预先按照不同的间隔进行了计算?

我反正觉得如果是实时计算不同间隔划分session,然后按照划分后的session统计流入流出,是很困难的。有了解的朋友欢迎私信指教~

(2)数据计算量的要求比较高

通过刚才的示例我们也看到了,在分析过程中,有可能进行各种条件的筛选、各种人群的细分、各种逻辑的设置,这对于计算的要求无疑是很高的。

具体背后的技术架构层的设计,是很重要的内容。

◆ ◆ ◆  ◆ ◆
麟哥新书已经在当当上架了,我写了本书:《拿下Offer-数据分析师求职面试指南》,目前当当正在举行活动,大家可以用相当于原价5折的预购价格购买,还是非常划算的:
 
 
数据森麟公众号的交流群已经建立,许多小伙伴已经加入其中,感谢大家的支持。大家可以在群里交流关于数据分析&数据挖掘的相关内容,还没有加入的小伙伴可以扫描下方管理员二维码,进群前一定要关注公众号奥,关注后让管理员帮忙拉进群,期待大家的加入。

管理员二维码:


猜你喜欢

● 卧槽!原来爬取B站弹幕这么简单
● 厉害了!麟哥新书登顶京东销量排行榜!
● 笑死人不偿命的知乎沙雕问题排行榜

● 用Python扒出B站那些“惊为天人”的阿婆主!
● 你相信逛B站也能学编程吗
  • 0
    点赞
  • 8
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值