﻿

<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"
	xmlns:content="http://purl.org/rss/1.0/modules/content/"
	xmlns:wfw="http://wellformedweb.org/CommentAPI/"
	xmlns:dc="http://purl.org/dc/elements/1.1/"
	xmlns:atom="http://www.w3.org/2005/Atom"
	xmlns:sy="http://purl.org/rss/1.0/modules/syndication/"
	xmlns:slash="http://purl.org/rss/1.0/modules/slash/"
	>

<channel>
	<title>SEO_网站优化_网络推广公司 &#187; robots.txt</title>
	<atom:link href="http://seo.heiku8.com/tag/robots-txt/feed" rel="self" type="application/rss+xml" />
	<link>http://seo.heiku8.com</link>
	<description>【黑酷哥】</description>
	<lastBuildDate>Sat, 09 Nov 2024 19:09:08 +0000</lastBuildDate>
	<language>zh-CN</language>
		<sy:updatePeriod>hourly</sy:updatePeriod>
		<sy:updateFrequency>1</sy:updateFrequency>
	<generator>http://wordpress.org/?v=4.0.18</generator>
	<item>
		<title>超快排快速排名-正确使用Robot.txt</title>
		<link>http://seo.heiku8.com/4547.html</link>
		<comments>http://seo.heiku8.com/4547.html#comments</comments>
		<pubDate>Sat, 06 Mar 2021 10:40:12 +0000</pubDate>
		<dc:creator><![CDATA[黑酷SEO]]></dc:creator>
				<category><![CDATA[网站优化]]></category>
		<category><![CDATA[robots.txt]]></category>

		<guid isPermaLink="false">http://seo.heiku8.com/?p=4547</guid>
		<description><![CDATA[做网站优化的人应该都知道Robots.txt吧，我们可以通过它直接与搜索引擎蜘蛛对话，告诉蜘蛛哪些内容可以抓取，哪些内容不能抓取。这和我们今天要说的文件优化相关。 一、站内优化 Robot.txt用法详解及robot.txt问题汇总 (1)为什么设置Robots.txt? 在进行 [&#8230;]]]></description>
				<content:encoded><![CDATA[<p>做网站优化的人应该都知道Robots.txt吧，我们可以通过它直接与搜索引擎蜘蛛对话，告诉蜘蛛哪些内容可以抓取，哪些内容不能抓取。这和我们今天要说的文件优化相关。</p>
<p>一、站内优化</p>
<p>Robot.txt用法详解及robot.txt问题汇总</p>
<p>(1)为什么设置Robots.txt?</p>
<p>在进行SEO操作的时候，我们需要告诉搜索引擎哪些页面重要哪些页面不重要，重要的页面让蜘蛛进行抓取，不重要的页面进行屏蔽可以减少网站服务器的负担。</p>
<p>(2)一些常见的问题和知识点</p>
<p>蜘蛛在发现一个网站的时候，是抓取网站的Robots.txt文件(当然官方上是这么说的，有时候也会出现不遵守的情况);</p>
<p>建议所有的网站都要设置Robots.txt文件，如果你认为网站上所有内容都是重要的，你可以建立一个空的<a href="http://seo.heiku8.com/tag/robots-txt" title="【查看含有[robots.txt]标签的文章】" target="_blank">robots.txt</a>文件;</p>
<p>(3)在<a href="http://seo.heiku8.com/tag/robots-txt" title="【查看含有[robots.txt]标签的文章】" target="_blank">robots.txt</a>文件中设置网站地图</p>
<p>你可以在robots.txt中添加网站的地图，告诉蜘蛛网站地图所在的地址。</p>
<p>(4)Robots.txt的顺序</p>
<p>在蜘蛛协议中，Disallow与Allow是有顺序的，这是一个非常重要的问题，如果设置错误可能会导致抓取错误。</p>
<p>引擎蜘蛛程序会根据个匹配成功的Allow或Disallow行确定是否访问某个URL，一个例子可以让你更清楚明白：</p>
<p>User-agent:*2.Allow:/seojc/bbs3.Disallow:/seojc/这个情况下，蜘蛛/seojc/bbs目录可以正常抓取，但/seojc/目录的文件无法抓取。通过这种方式可以允许蜘蛛访问特定目录中的部分url。</p>
<p>我们对调下位置观察一下。</p>
<p>User-agent:*2.Disallow:/根目录下的文件夹/3.Allow:/seojc/bbs/seojc/目录出现在行，禁止抓取目录下的所有文件，那么第二行的Allow就无效，因为行中已经禁止抓取seojc目录下的所有文件，而bbs目录正好位于seowhy目录下。因此匹配不成功。</p>
<p>(5)Robots.txt路径问题</p>
<p>在蜘蛛协议中，Allow和Disallow后面可以跟两种路径形式，即链接、相对链接。链接就是完整的URL形式，而相对链接只针对根目录。这是记住。</p>
<p>(6)斜杠问题</p>
<p>Disallow:/seojc表示禁止抓取seoic这个目录下的所有文件，如:seojc.1.html、seojc/rmjc.php都不允许抓取;</p>
<p>Disallow:/seojc/表示禁止抓取seojc这个目录下的文件，即允许抓取seojc.1.html，但是不允许抓取seojc/rmjc.php。</p>
]]></content:encoded>
			<wfw:commentRss>http://seo.heiku8.com/4547.html/feed</wfw:commentRss>
		<slash:comments>0</slash:comments>
		</item>
	</channel>
</rss>
