robots.txt使用技巧

月飞春秋 @ April 2, 2009 2:24 pm | No Comments | Comments Feed | Trackback

Tags:

    1. 每当用户试图访问某个不存在的URL时,服务器都会在日志中记录404错误(无法找到文件)。

每当搜索蜘蛛来寻找并不存在的robots.txt文件时,服务器也将在日志中记录一条404错误,所以你应该在网站中添加一个robots.txt。

    2. 网站管理员必须使蜘蛛程序远离某些服务器上的目录——保证服务器性能。

比如:大多数网站服务器都有程序储存在“cgi-bin”目录下,因此在 robots.txt文件中加入“Disallow: /cgi-bin”是个好主意,这样能够避免将所有程序文件被蜘蛛索引,可以节省服务器资源。一般网站中不需要蜘蛛抓取的文件有:后台管理文件、程序脚本、附件、数据库文件、编码文件、样式表文件、模板文件、导航图片和背景图片等等。
  下面是VeryCMS里的robots.txt文件:
  User-agent: *
  Disallow: /admin/ 后台管理文件
  Disallow: /require/ 程序文件
  Disallow: /attachment/ 附件
  Disallow: /images/ 图片
  Disallow: /data/ 数据库文件
  Disallow: /template/ 模板文件
  Disallow: /css/ 样式表文件
  Disallow: /lang/ 编码文件
  Disallow: /script/ 脚本文件

  3. 如果你的网站是动态网页,并且你为这些动态网页创建了静态副本,以供搜索蜘蛛更容易抓取。

那么你需要在robots.txt文件里设置避免动态网页被蜘蛛索引,以保证这些网页不会被视为含重复内容。

  4. robots.txt文件里还可以直接包括在sitemap文件的链接。

就像这样:
  Sitemap: http://www.***.com/sitemap.xml
  目前对此表示支持的搜索引擎公司有Google, Yahoo, Ask and MSN。而中文搜索引擎公司,显然不在这个圈子内。这样做的好处就是,站长不用到每个搜索引擎的站长工具或者相似的站长部分,去提交自己的sitemap 文件,搜索引擎的蜘蛛自己就会抓取robots.txt文件,读取其中的sitemap路径,接着抓取其中相链接的网页。

  5. 合理使用robots.txt文件还能避免访问时出错。

比如,不能让搜索者直接进入购物车页面。因为没有理由使购物车被收录,所以你可以在robots.txt文件里设置来阻止搜索者直接进入购物车页面。

相关文章:

  1. robots.txt的语法格式
  2. robots.txt介绍
  3. 友情链接的欺骗 你被骗了吗
  4. Google AdSense巧妙地处理内容重复
  5. 网站优化之不可忽略的源标签

Font: Large   Normal   Small

Leave a comment

Log in to leave a comment or comment anonymously.


Name (required)

E-mail (required)

Website

Spam Protection by WP-SpamFree

RSS WordPress资讯
  • 让不同文章显示不同Header
    一种相对简单的方法。 首先需要激活新的post_thumbnail函数(如果该函数尚未激活)。打开functions.php文件,在右上方(开始php标签后)加入以下代码: // add post_thumbnail support if ( function_exists('add_theme_support') ) add_theme_support('post-thumbnails');保存functions.php,然后打开header.php文件。在art-header-jpg DIV里加入一段代码,改写默认的header图片。 原始art-header-jpg DIV是这样的: 我们要把它替换成下面这样: 阅读全文 […]
  • 漫谈网赚方式(下)
    14. 出售或出租网站内页 这种方式很久前就已经存在,只是一直没有得到推广。把网站上的某个页面出租或出售给别人,也可以从中得到一定收入。不过买家通常会选择PR较高或者流量较大的网站,所以小型网站采用这种方式效果并不理想。值得推荐的是这种概念,如果多加研究,说不定可以看到其它希望。 15. 高亮显示赞助商发布的文章 有赞助商或者其它内容购买者的网站可以选择这种方法。 这种方式在国内也不多见,不过BAIDU可以说是这方面的老手了。 16. 请求捐赠 国内直接在网站上摆出“捐赠”字样的网站也不多。但这在国外也是相当普遍的网赚方式, 小到个人博客,大到维基百科,都可以选择这种方式获取收入。只要站长觉得读者可以从自己的网站内容受益,就可以在网站上挂出“给我们捐赠”的招牌。 阅读全文 […]