【大数据之网站用户行为分析】
网站数据分析历史,从“您是第***位来访用户”到现在百家齐放的专业工具提供商,网站分析已经逐渐发展衍化成一门科学。但面对形态各异的分析数据,很多人仍然困惑于数据的来源,了解数据的收集原理,也许对你解决这些困惑有所帮助。
网站用户行为,就是访客在进入网站后所有的操作,分析网站用户行为,有利于满足网站的用户需求,提升网站信任度。
专业术语
1、用户群
用户者主要所在区域,24小时之内有多少回访。
2、访问者
访问主要来源哪个区域,如国家、省份、城市。
3、访问量
分析网站月访问,日访问,时访问,来确定网站的高峰是在是何月何日何时。
4、浏览量
访客在一定时间内所浏览内容,日最大浏览量多少,日最小浏览量多少。
5、流量来源
分析网站是从哪方便来的流量。
6、流量页面
哪些页面主要引来的流量。
7、访问者分析
在24小时的回访次数,访客浏览多少页面,在网站中逗留多长时间。
8、访客访问分析
用户电脑所采用的系统语言,所使用的浏览器,屏幕尺寸,屏幕颜色位数。
9、搜索引擎
搜索引擎是提供信息查询的工具,通过分析网站来源关键词,来确定搜索引擎用户主要关注网站哪些方面。
眼下网站分析数据主要有三种收集方式:Web日志、JavaScript标记和包嗅探器。
1. 以Web日志的方式
网站服务器接收到请求后会在自己的Log文件中追加一条记录,记录内容包括:远程主机名(或者是IP地址)、登录名、登录全名、发请求的日期、发请求的时间、请求的详细(包括请求的方法、地址、协议)、请求返回的状态、请求文档的大小。随后网站服务器将页面返回到访问者的浏览器内得以展现。
2.以JavaScript标记的方式-又称“埋码技术”
JavaScript标记同Web日志收集数据一样,从网站访问者发出http请求开始。不同的是,JavaScript标记返回给访问者的网页代码中会包含一段特殊的JavaScript代码,当页面展示的同时这段代码也得以执行。这段代码会从访问者的Cookie中取得详细信息(访问时间、浏览器信息、工具厂商赋予当前访问者的userID等)并发送到工具商的数据收集服务器。数据收集服务器对收集到的数据处理后存入数据库中。网站经营人员通过访问分析报表系统查看这些数据。
3. 包嗅探器的方式
网站访问者发出的请求到达网站服务器之前,会先经过包嗅探器,然后包嗅探器才会将请求发送到网站服务器。包嗅探器收集到的数据经过工具厂商的处理服务器后存入数据库。随后网站经营人员就可以通过分析报表系统看到这些数据。
数据收集方式的优劣比较
没有一种数据收集方式是完美无缺的,不同数据收集方式也决定了各自的特性,了解不同收集方式的优劣所在,会对工具的选择也有一定的指导作用。
下表是三种数据收集方式的优劣比较详细:
决定选择采用哪种数据收集方式之前,你需要先了解自己的需求。如果你不想自己网站的流量数据被任何第三方获取,那么Web日志无疑是你的最佳选择了。但想得到更贴近网站访问者行为的精确数据,还是需要采用JavaScript标记收集数据。这种数据收集方式不仅可以对缓存访问、代理访问正确记录,而且可以通过Cookie对独立访问者进行更为精确的定位。
当然也有一些网站为了获得多方面的数据而同时采取多种数据收集方式。例如采用JavaScript标记收集精确数据的同时,为了搜索引擎优化对Web日志中的搜索引擎爬虫记录也进行分析。也有已经采用包嗅探器收集数据,但为获取缓存访问而同时进行JavaScript标记。