怎样合理地定义用户流失

user_churn  很久没有更新博客了,这篇再写一些关于“用户流失”的内容。之前发布的网站的活跃用户与流失用户这篇文章对网站的活跃用户流失用户新用户流失做了定义,这里修正下对流失用户的英文叫法,一般对流失用户常用的英文为“churn user”,之前用的wastage、away、lost等都不是太规范。后来陆续有做相关分析的朋友问到流失用户的流失时间长度到底选择多长是合理的,尤其是《网站分析实战》这本书出版之后,我在里面有提到如何更准确地定义流失的时间长度,可能解释的比较简单,还是有朋友留言反馈这方面的问题,所以这里再用一篇文章解释一下。

流失用户与回访用户

  流失用户的定义请参考“网站的活跃用户与流失用户”这篇文章,要解释怎么样合理地去定义用户流失时间段长度的问题,需要先介绍一个新的指标概念:回访用户。这里的回访用户不是指Google Analytics上面的Returning Visitor(与新用户相对,指之前访问过网站的用户再次访问网站),这里的回访用户指流失之后再次访问网站的用户,即用户曾经流失过,满足流失时间期限内完全没有访问/登录网站的条件,但之后重新访问/登录网站。然后,根据回访用户数可以计算得到用户回访率,即:

  用户回访率 = 回访用户数 ÷ 流失用户数 × 100%

  回访用户率的数值大小间接地可以验证对用户流失定义的合理性。正常情况下,用户的回访率应该是比较低的,从业务的角度考虑,如果对流失的定义是合理的,那么很难让那些对你的网站已经失去兴趣的用户重新来访问你的网站。一般情况下,网站的用户回访率应该在10%以下,在5%左右的数值是比较合理的,对于成熟的网站而言用户回访率会稍高,而新兴的网站的用户回访率通常更低,尤其像手机APP这类用户易流失的产品。

流失期限与用户回访率

  用户流失的流失期限的长度与用户的回访率成反比,我们在定义用户流失时使用的连续不访问/登录网站的期限越长,这批流失用户之后回访网站的概率就会越低,并且随着定义的流失期限的增大,用户回访率一定是递减的,并逐渐趋近于0。那么如果选择合适的流失期间长度?我们可以设定不同的流失期限长度,进一步统计每个流失期限的用户回访率,并观察用户回访率随定义的流失期限增大时的收敛速度。如果以“周”为单位设定流失期限:

user_returning_rate

  根据设定的不同流失周期的用户回访率的变化曲线,我们可以使用拐点理论(Elbow Method)选择最合适的流失周期。

  拐点理论:X轴上数值的增加会带来Y轴数值大幅增益(减益),直到超过某个点之后,当X增加时Y的数据增益(减益)大幅下降,即经济学里面的边际收益的大幅减少,那个点就是图表中的“拐点”。比如上图中流失周期增加到5周的时候,用户回访率的缩减速度明显下降,所以这里的5周就是拐点,我们可以用5周作为定义用户流失的期限,即一个之前访问/登录过的用户,如果之后连续5周都没有访问/登录,则定义该用户流失。

  所以,有个这个办法之后,就能更加合理地定义流失用户的统计逻辑,而之前要做的就是选择不同的流失期限分别计算用户的回访率,然后用统计的到的数值生成如上的一张带平滑线的散点图,问题就迎刃而解。 :)

怎样合理地定义用户流失》上有 19 条评论

  1. niki陈陈

    终于看到博主的更新了,弱弱地问一句:一般情况下,网站的用户回访率应该在10%以下,在5%左右的数值是比较合理的,这里的5%和10%是所有行业都适用么?还是只是针对某类行业的经验值?另外,也许实际测算时,流失期限的曲线并不会这么平滑,这个时候又该考虑哪些噪点的影响?

    回复
  2. joegh 文章作者

    @niki陈陈: 很赞的评论。
    这里的10%和5%都是我的经验值,不同的网站和不同的产品肯定会有差异,其实这个值同样可以用文章中那个图表的用户回访率曲线来确定个大概的阈值,大概就是拐点之后慢速收敛的起始点。
    实测数据会受各种外界因素的影响,文章中图表的曲线是比较理想的状况,需要考虑的噪点也基本是受网站业务特征和运营策略的影响,比如间歇性的推广、运营和产品的调整等。

    回复
  3. wx

    博主,你好,取拐点作为用户流失期限的意义是什么?是由于取了拐点后,回访率不会剧烈波动吗?

    回复
  4. joegh 文章作者

    @wx: 因为用户回访率随着流失期限增大是不断减小的,也就是我们取不到用户回访率最小的那个点,所以就只能要求流失期限每增大一个点的时候能让回访率有明显的下降,当这个下降幅度不明显的时候也就没有继续增大流失期限的必要了,类似经济学上利润最大化的原则是边际收益等于边际成本。

    回复
  5. Victor

    GA最新升级的高级细分中可以按用户的层级进行细分了,可以把某一段时间第一次访问的用户细分出来,根据用户的回访数据计算用户的流失率。不过GA根据用户细分可以应用的时间段限于90天以内。

    回复
  6. jenny

    文中是为了定义用户流失,所以使用回访率这个概念,找定义用户流失的合理的期限。但是回访本身就是针对流失用户来说的,那么在取回访的样本时,怎么定义这个流失用户样本呢?拍脑袋?然后迭代?

    回复
  7. mike

    请问流失用户数怎么定义呢?超过流失期限未登陆的用户数以及登陆的用户,未登录的用户数应该怎么定义?

    回复
  8. joegh 文章作者

    @mike: 流失用户在之前肯定是登录过的,不然无法统计到。而且流失用户数的统计也是基于统计周期的,不在这个统计周期内并且之前登录过的用户会被统计进入之前的统计周期内。

    回复
  9. Pingback 引用通告: 怎样合理地定义用户流失_读懂_钛媒体网

  10. Pingback 引用通告: 怎样合理地定义用户流失

  11. Pingback 引用通告: 怎样合理地定义用户流失 | 极客互联|关注极客事业

  12. luozi

    流失用户与网站跳出率相关吗?
    我的香烟网跳出率一直在60%以上,是否与内容有关呢?

    回复
  13. 麦兜

    回访用户中的,之后重新回访的时间段是多久呢?我们网站是付费才可以登录的,那么按不同时长付费的用户,有必要细化流失时长吗?菜鸟提问,多多包涵!谢谢

    回复
    1. joegh 文章作者

      流失时间段的长短可以自己定义,主要跟网站的业务特征相关,如果付费网站有相对固定的付费周期,那么可以取比这个付费周期稍长的一个时间长度会比较合适。

      回复
  14. joegh 文章作者

    @pang_zm: 流失用户的统计出来后,回访用户的统计自然就出来了。“时间段是变化的”不太理解具体指什么,如果是文章里面的不同时间段,这里是通过统计不同时间段的回访率来确定流失时间段的长度多长合适,最终确定的流失时间段是一个固定值。

    回复
  15. shenhc

    与pang_zm的问题有点像?
    按照我的理解,你说的意思是:
    如果以现在的时间点为准的话,可以统计最近一次访问距今天在7天/14天/21天….问的用户量(相当于不同的流失长度),之后一段时间跟踪这些不同用户的回访情况~
    我想问的是,这“之后一段时间”是指多久?—难道从今往后1年也算回访?

    回复
  16. Pingback 引用通告: 怎样合理地定义用户流失 | 内容采集

麦兜 进行回复 取消回复

电子邮件地址不会被公开。 必填项已用 * 标注

您可以使用这些 HTML 标签和属性: <a href="" title=""> <abbr title=""> <acronym title=""> <b> <blockquote cite=""> <cite> <code> <del datetime=""> <em> <i> <q cite=""> <strike> <strong>