
地 址:北京市顺义区66号
电 话:15338521262
网址:dsesh.com
邮 箱:20780227@qq.com
在(zai)本篇文章中,我们将介绍什么是可少可行日志文件,它们为(wei)何如此重要,法用方法要寻找的好网内容(rong)以及(ji)使用哪些工具。最后(hou),可少可行我将提供8种可行的法用方法方法来分析。

服务器日志是由服务器(qi)自动创建和维护的日志文(wen)件(或多个文件),由它执行的可少可(ke)行(xing)活动列(lie)表组成。

出于SEO的法用方法目的,我们关(guan)注一个(ge)Web服务器日志(zhi),好网其中包含来自人类和机器人的(de)可少可行网站页面请求的历史记录。有(you)时也称为访问日志,法用(yong)方法原始数据如下所(suo)示:

是好网的,起初数据看上去(qu)有点令人不知所措,可少可行令人困惑,法用方法所以(yi)让我们分解一下(xia),更仔细地看一下“命中”。
每个服务器在记录命中方面都(dou)有本质上的不同,但是它们通(tong)常会提供类似的信息,这些(xie)信息被组(zu)织成字段。
对于每次匹配,我们都会获得关键信息,例如日期和时间,请求的URI的响应代码(在本例中为404)以及(ji)请求来自的用(yong)户代理(在本例中为Googlebot) )。您可以想象,日(ri)志文(wen)件每天由成千上万的点击数组成,每当用(yong)户或漫游器到达(da)您的网站时,就会为请求的每个页面记录许多点击数-包括图像(xiang),CSS和呈现(xian)该文件所需的任何其(qi)他文件。
所以您知道什么是日志文件,但是为什么值得花(hua)时间分析它们?
好吧,事实是,只有一个真实的(de)记录可以说明搜索引擎(例如Googlebot)如何处理您的网站。那就是通过查看(kan)网站的服务器日志文件。
站长工具,第三方爬虫和搜索操作员不会全面(mian)了(le)解(jie)搜索引擎如何与(yu)网站互动。只有访问日(ri)志文(wen)件可以为我们提供此信息。
日志文件(jian)分析为我们提(ti)供了大量有用的见解,包括使我(wo)们能够:
对于这(zhe)种(zhong)类型的分析,您需要来自(zi)您域的所有Web服务器的原始访问日志,而没有应用任(ren)何过(guo)滤或修改。理想情况下,您需要大量数据(ju)才能使分析有价值。值得多少天(tian)/周取决于(yu)站点的大小和权限以及所产生的流量。对于(yu)某些站点,一周可能就足够了,对于某些站点,您可能需要一个月或(huo)更长时间的数据。
您的Web开发人员应该能够为您发送这些(xie)文件(jian)。值得一问,在它们发送给您之前(qian),日志是(shi)否包含来自多个(ge)域和协议的请求,以及(ji)这些请求是否包含在此日志中。因为否则,将阻止您正确识别请求。您将无法分辨对(dui)http://www.example.com/和://example.com/的请求之间的区别。在这种情况下,您应该要求开发人员更新日志配置,以在将来包含此信息。
首先,什么是抓取预算?综合(he)爬网率和爬网需求,我们将爬网预算(suan)定义为搜索引擎蜘蛛或机器人可以并且想要爬网的数量。
本质上,它是搜索引擎每次访问您的网站时将爬网的(de)页面数,并关联到域的权重,并与通过网站的链接资源成比例。
对于日志文件分析而言,至(zhi)关重(zhong)要的是,有时爬网预算可能会浪费(fei)在无关的页面上(shang)。如果(guo)您有新内容要编制索引,但没有预算,那么搜索引擎将不会为新内容编制索引。这就是为什么要通(tong)过日志文件分析来监视爬网预算的支出原因。
有许多低附加值(zhi)的URL会对网站的爬网和索引产生负面影响。低附加值URL可以属于以下类别:
浪费诸如此类页面上的服务(wu)器资源会浪费实际具有价值的页面的爬网活动,这可能会导致在站点上发现(xian)良好(hao)内容的时间大大延迟。
例如,查看这些日志文件,我们发现一个不正确的主题被非常频繁地访问,这个问题很明显!
在查看每个(ge)页面获得的事件数(shu)量时,请问自己搜索引擎是否应该爬网这些URL –您通常会找到答案是否定的。因此(ci),优化(hua)您的抓取预算将有助于搜索引擎抓取您的网站上最重要的页面并将其编入(ru)索引。您可以通过多种方式来执行此操作,例如通过(guo)文件阻止包含某些模式(shi)的URL,从而避免对URL进行爬网。
我们已经介绍了为什么对搜索引擎来说重要的是不(bu)要在低价值网页上浪费抓取预算。硬币的另一面是检查您对高价值网页的(de)重视程度。如果按事件(jian)数排序日(ri)志文件并按HTML过滤,则可以看到访问量(liang)最大(da)的页面。
如果说最重要的URL应该进行最大程度的爬网,可能(neng)有点过分简单了-但是,如果(guo)您是潜在客户网站,则希望您的主页,关键(jian)服务页面和文章内容出现在其中。
作为电子商务网站,您希望您的主页,类别页面和关键产品页面显示在其中。如果您看到不再销售的旧产品页面并且这(zhe)些结果中最重要(yao)的类别页面为零,则说明存在问题。
坚持使用日(ri)志分析工具,这很容易执行。我们知道对外贸易中Google是主要的搜索引擎,因此确保Googlebot Smartphone和Googlebot定期访问您的网站是您的首要任务。
我们可以通(tong)过搜索引擎bot过滤日(ri)志文件数据。
过(guo)滤后(hou),您可以查看每个所需的搜索引擎机器人正在记录的事件数。希望您会看(kan)到Googlebot Smartphone或Googlebot最常访问您的网站。
使用Screaming Frog日(ri)志文件分析器(qi),您可以快速发现错误状态码,并且由于它们是按爬网频率排序的,因此您还可以查看哪些是最(zui)可能要修复的URL。
要查看(kan)此数据,您可以在“响应代码”标签下过滤此信息
查找具有3xx,4xx和5xx HTTP状态的页面
在一个项目中,命中率最高的(de)前15个(ge)页面中有重定向,不正确的302(临时)重定向,页面上没有内容的页面以及一些404和软404。
通过日志文件分析,一旦发现问(wen)题,就可以通过更新不正确的(de)重定向和软404来开始解(jie)决该问题。
尽管分(fen)析搜索引擎将遇到的最后一个(ge)响应代码很重要,但突出显示不一致的响应代(dai)码也可以使您获得更(geng)深刻(ke)的见解。
如果(guo)您只看最后的响应代码,而没有发现异常错误或4xxs和5xxs中的任何尖峰,则可以在那里进行技术检查。但是,您可以在日志文(wen)件分析器中使用过滤器来仅详细查看“不一致”的(de)响应。
原因很多,您的URL可能会遇到不一致的响应代码。例如:
一旦掌握了(le)日志文件分析中的这些(xie)信息,就可(ke)以创建行动计划(hua)来修复这些错误。
我们知道到第一个字节的时间(TTFB),到最后(hou)一个(ge)字节的时间(TTLB)以及到整个页面(mian)加(jia)载的时间(jian)都会影响您的网站的(de)爬网方式。尤其是TTFB,这是使您的网站快速有效地爬网的(de)关键。页面速度也是(shi)排名因素,我们可以看(kan)到快速网站对您的性能至关重要(yao)。
使用日志文件,我们可以(yi)快速查看您网站上最大的页面,而最慢的页面。
要查看最大的页面,请对“平均字节数”列进行排序。
在这里,我们可以看到PDF构成了网站上最大的页面。优化它们并减小它们的大小是一个很(hen)好的起点。如果您看到此处显示特(te)定页面,则可(ke)能需要单独查看它们。
尽管页面(mian)的大小可以很(hen)好地指示页面(mian)变慢,但这并不是全(quan)部。您可以有一个很(hen)大的页面,但是它仍然可以(yi)快速加载。排序“平均响(xiang)应时间”列(lie),您可以看到响应时间最慢的网址。
也许您的目标(biao)是减少(shao)网站对JavaScript的(de)依赖,并希望找出(chu)最大的罪魁祸首。或(huo)者您知道CSS可以简化,并且需要数据来备份它。您的网站可能会以蜗牛的速度加载(zai),并且按图像进行过滤向您表明,提(ti)供下一代格式应该是优先事项。
该日志文件分(fen)析器的另一个重要功能是能够导入网站的(de)爬网。这确实很容易实现(xian),并为您提供了(le)更(geng)多(duo)从(cong)日志文件中进行分析的灵活性。只需(xu)将爬网拖放到如下所示的“导入的URL数据”中即可。
完成后,您可以进行进一步的分析。
确保在(zai)下拉菜单“与URL数据匹配”中进行选择,然后将相(xiang)关列拖动到视图中。在这里,我们可以(yi)对爬网深度和链接对您网站的爬网频率的影响进行批量分析。
例如,如果您的“重要(yao)”页面不经常被抓取,并且发现它们的链接很(hen)少,并(bing)且抓取深度大于3,这很可能就是为什么您的页面没有被抓取太多的原因(yin)。相反,如果您有一个页面被大量爬网,并且不确定为什么,请查看页面在您网站中的位置。链接在哪里?距根有多远?对此进行(xing)分析可以向您表明搜索引擎喜欢您的。最终,该技术可(ke)以帮助您确定层次结构和站点结构中的任何问题。
选择下拉菜单“不(bu)在URL数据中”将显示日志中存在的URL,而不是您的抓取数据中存在的URL 。因此(ci),此处显示的URL将是搜索引擎机器人仍然认为具有价值的页面,但不再出现在网站上(shang)。出现孤立URL的原因有很多,其中包括:
最终,您需要查看找到的孤立URL,并作(zuo)出判断来处理(li)它们。
这(zhe)就是我们对日志文件分析和8个可操作任务的简短介绍,您可以立(li)即使用Screaming Frog日志文件分析器开始。在Excel和上述其他工具(以及其他工具)中,您还可以(yi)做更多的工作。
您如何进行日志文件(jian)分析?您认为哪种工具最有效?我们的SEO团队很想知道,在下面发表评论吧!
搜索引擎优化(SEO)是提高网站排名并在搜索引擎中编入索引的过程。涉及(ji)错误本地化和可以持续对排名进行改进(jin)。以(yi)下是您可以在(zai)网站上实施的一些SEO策略:
1.监控网站速度
当您的网站加载时(shi)间越长时,那么(me)潜在客户就越有可能(neng)转移到另一个(ge)网站中。若是(shi)要提高此速度,就得需要使(shi)用精益编码和移动优化的内容(rong)布局。加载缓慢的网站可以将潜在合法客户提高38%。
2.使(shi)用相(xiang)关(guan)关键字
相关关键字可以增加获得更(geng)多流量的机会(hui)。高质量的标题和描述将(jiang)吸引用户,并使(shi)您的网站在(zai)搜索结果中看(kan)起来更(geng)好。如果网页标题和(he)说明优化不(bu)当,抓取工具会努力抓取您的网站。标题和标签也是一站式SEO的重要组成部分(fen)。网站的每个页面都应包含多个标题标签,其中最重要的是H1标签。
1.产品和服务的结构化数据
通过向产品和服务页面添加架构标记,您可以为客户提供与其需求相关的结构化数据,它(ta)还可以提高品牌认知度和点击率。给网站添加架构有两种方法:1.使用免费工具;2.聘请SEO公司。
2.专注于正确的关键字
在产品页面上使用架构可以帮助百度了解其价格和库存状况。除此之(zhi)外它还可以提高您网站的内容质量。向百度提供结构化数据可以为您的产品带来更(geng)多的 SERP 空间。
1.与(yu)类似的产业/企业交换链接。
2.增加指(zhi)向(xiang)反向链接的数量。
链接对于(yu)实现(xian)更高的SEO排名非常重要。此外拥有更多(duo)来自优质网站的反向链接将提高您网站的声誉和排名。因此投资您的链接(jie)建(jian)设策略对于您的(de)在线营销策略至关重要。
1.相关关键字:
关键字支(zhi)持您的(de)主要关键字并将语境化。例如,如果您的(de)企业销售SEO服务,您可能还(hai)希望成为SEO咨询公司或代理商。相关关键字的含义应该相同,但可(ke)能会使用不(bu)同的(de)词语。
2.锚文本:
1.确保您的页面(mian)相互链接(jie)。
通过创建支柱页面和中心页面,增加您的网站在众多(duo)拥有竞争性质的关键字中排名靠前的可能性。这使得SEO更容易抓取你的网站并找到新页面。这很(hen)重要,因为百度很难将整(zheng)个网站编入索引。
2.使用(yong)相关的内部链接。
首先确保内部链接与网站的内容相关,并且传入链接上的锚文本也能被百度使(shi)用;其次确保内部链接一致并包含相关关键字。
1.网站适合移动设备,这是提高SEO排名的有效方法。
2.使用搜索控制台来测试(shi)移动友好性(xing)。
如果有严重问题,此工具会通知您。并(bing)且还会列出可能损害您的移动友好性的因素。