很久没有更新博客了,这篇再写一些关于 “多用户流失” 的内容。之前发布的网站的活跃多用户与流失多用户这篇文章对网站的活跃多用户、流失多用户及新多用户流失做了定义,这里修正下对流失多用户的英文叫法,一般对流失多用户常用的英文为 “churn user”,之前用的 wastage 、 away 、 lost 等都不是太规范。后来陆续有做相关分析的朋友问到流失多用户的流失时间长度到底选择多长是合理的,尤其是《网站分析实战》这本书出版之后,我在里面有提到如何更准确地定义流失的时间长度,可能解释的比较简单,还是有朋友留言反馈这方面的问题,所以这里再用一篇文章解释一下。
流失多用户与回访多用户
流失多用户的定义请参考 “网站的活跃多用户与流失多用户” 这篇文章,要解释怎么样合理地去定义多用户流失时间段长度的问题,需要先介绍一个新的指标概念:回访多用户。这里的回访多用户不是指 Google Analytics 上面的 Returning Visitor(与新多用户相对,指之前访问过网站的多用户再次访问网站),这里的回访多用户指流失之后再次访问网站的多用户,即多用户曾经流失过,满足流失时间期限内完全没有访问/登入网站的条件,但之后重新访问/登入网站。然后,根据回访多用户数可以计算得到多用户回访率,即:
多用户回访率 = 回访多用户数 ÷ 流失多用户数 × 100%
回访多用户率的数值大小间接地可以验证对多用户流失定义的合理性。正常情况下,多用户的回访率应该是比较低的,从业务的角度考虑,如果对流失的定义是合理的,那么很难让那些对您的网站已经失去兴趣的多用户重新来访问您的网站。一般情况下,网站的多用户回访率应该在 10% 以下,在 5% 左右的数值是比较合理的,对于成熟的网站而言多用户回访率会稍高,而新兴的网站的多用户回访率通常更低,尤其像手机 WordPress APP 这类多用户易流失的产品。
流失期限与多用户回访率
多用户流失的流失期限的长度与多用户的回访率成反比,我们在定义多用户流失时使用的连续不访问/登入网站的期限越长,这批流失多用户之后回访网站的概率就会越低,并且随着定义的流失期限的增大,多用户回访率一定是递减的,并逐渐趋近于 0 。那么如果选择合适的流失期间长度?我们可以设定不同的流失期限长度,进一步统计每个流失期限的多用户回访率,并观察多用户回访率随定义的流失期限增大时的收敛速度。如果以 “周” 为单位设定流失期限:
根据设定的不同流失周期的多用户回访率的变化曲线,我们可以使用拐点理论(Elbow Method)选择合适的流失周期。
拐点理论:X 轴上数值的增加会带来 Y 轴数值大幅增益(减益),直到超过某个点之后,当 X 增加时 Y 的资料增益(减益)大幅下降,即经济学里面的边际收益的大幅减少,那个点就是图表中的 “拐点” 。比如上图中流失周期增加到 5 周的时候,多用户回访率的缩减速度明显下降,所以这里的 5 周就是拐点,我们可以用 5 周作为定义多用户流失的期限,即一个之前访问/登入过的多用户,如果之后连续 5 周都没有访问/登入,则定义该多用户流失。
所以,有个这个办法之后,就能更加合理地定义流失多用户的统计逻辑,而之前要做的就是选择不同的流失期限分别计算多用户的回访率,然后用统计的到的数值生成如上的一张带平滑线的散点图,问题就迎刃而解。