先给结论:不要试图把每条来源都归到唯一渠道,而是按“可核实程度”分三层记录——有链接参数的记为可归因,只有对话线索的记为口碑,无法判断的记为未知。这三层不能互相折算成同一口径,但可以同时保留,用来判断下一步该做什么。缺少后台数据或权限时,这个动作仍然可以从一张手工表开始。
可归因渠道的典型特征是:来源自带可追踪的标识,比如带参数的链接、表单里的来源字段、广告平台回传的点击标识。它的价值在于能对应到一次具体访问或提交,但对应不上“为什么来”。
口碑传播的典型特征是:来源发生在你无法观测的对话里,读者从别人口中、群聊、转发截图或线下交流中知道你的博客。你能拿到的往往只是事后线索,比如对方在留言里提到“朋友推荐”,或者咨询时顺口说出从哪听来的。这类来源无法被参数捕获,只能被记录。
把两者混在一起统计,最容易出现的错误是:把口碑带来的访问算进“直接访问”,然后得出“直接访问质量高”的结论。这个结论站不住,因为“直接访问”里同时装着真正直接输入网址的人、从私密渠道点进来的人、以及参数丢失的访问。
假设你手上只有一份导出表:每行是一条访问或一条留言,字段可能只有时间、页面、一句备注。不需要权限,也不需要埋点,按下面的顺序把它转成可执行记录。
做完这四步,你会得到三列而不是一个总数。这个结果本身不能告诉你哪个渠道更好,但能告诉你:可归因部分是否覆盖了主要入口,口碑线索是否集中出现在某类内容上,未知部分是否大到让任何比较都失去意义。
假设某月导出表里有 100 行记录:40 行带参数,25 行备注提到“朋友推荐”,35 行没有任何来源信息。此时可以做的判断是:可归因部分占 40%,口碑线索占 25%,未知占 35%。不能做的判断是:口碑贡献了 25% 的流量,因为口碑线索可能只是被记录下来的那一小部分,真实口碑传播可能更多也可能更少。
如果下一步动作是“针对备注里反复出现的推荐语,写一篇回应式文章”,那么结果如何影响下一步?若新文章发布后,备注里同类推荐语的行数没有变化,只能说明这个动作在当前样本里没有产生可观察差异,不能证明口碑传播无效,因为口碑本身就在你观测范围之外。
如果你拿不到后台数据,只能看到公开页面和读者留言,最小动作是:选最近 20 条留言或咨询,逐条标注“可核实”“口碑线索”“未知”,并把口碑线索的原话单独抄出来。这个动作不需要任何工具权限,结果是一份 20 行的手工记录。
这份记录能支持的决定很有限:你可以据此判断是否值得继续追问口碑来源,是否需要在留言区加一句“如果是从朋友那里知道的,欢迎说一声”。它不能支持“哪个渠道该加预算”这类决定,因为样本量和观测范围都不够。把能做的和不能做的分开,比强行得出一个渠道排名更有用。
记录来源的目的不是把口碑变成可归因,而是让你知道哪些结论有依据、哪些只是猜测,并据此选择下一个可验证的动作。