免费观看又色又爽又黄的小说免费_美女福利视频国产片_亚洲欧美精品_美国一级大黄大色毛片

robots.txt是什么?怎么運用

2015-01-01    分類: 網站建設

作為一個網站建設加優化的公司,是必須要回的就是robots.txt文件,所以我們就來看看這個文件的意思

robots.txt是一個純文本文件,用于聲明該網站中不想被蜘蛛訪問的部分,或者指定蜘蛛抓取的部分。不是規定,而是一種約定,需要蜘蛛自覺遵守的一種習俗

當蜘蛛訪問一個站點時,它會首先檢查該站點是否存在robots.txt

如果找到,蜘蛛就會按照該文件中的內容來確定抓取的范圍

如果該文件不存在,那么蜘蛛就沿著鏈接直接抓取

網站建設

robots.txt的作用

1、防止私密或重要內容被搜索引擎抓取

2、節省服務器資源,從而提高服務質量

3、減少重復抓取,提高網站質量

4、指定sitemap文件位置

robots.txt是什么

User-agent: *

針對哪個搜索引擎蜘蛛

這里的*代表搜索引擎種類,*是通配符

Allow

定義的是允許蜘蛛抓取某個欄目或文件

Allow: /cgi-bin/

這里定義是允許訪問cgi-bin目錄

Allow:/* .htm$

允許訪問以".htm"為后綴的URL

$指的是匹配行結束符

*指的是匹配任何字符

網站建設

Disallow

定義的是禁止蜘蛛抓取某個欄目或文件

Disallow: /admin/

這里定義是禁止抓取admin目錄

Disallow: /cgi-bin/*.htm

禁止抓取/cgi-bin/目錄下的所有以".htm"為后綴的URL

Disallow: /*?*

禁止抓取網站中所有包含問號 “?”的網址robots.txt是什么

用法:sitemap: http://www.google.com/sitemap.xml

sitemap:URL全稱(包含http://部分)

告訴搜索引擎蜘蛛這個頁面是網站地圖

robots.txt文件主要是限制整個站點或者目錄的蜘蛛訪問情況,而robots meta標簽則主要是針對某個具體的頁面

本文名稱:robots.txt是什么?怎么運用
文章URL:http://m.newbst.com/news21/14321.html

成都網站建設公司_創新互聯,為您提供微信小程序全網營銷推廣服務器托管響應式網站企業建站網站收錄

廣告

聲明:本網站發布的內容(圖片、視頻和文字)以用戶投稿、用戶轉載內容為主,如果涉及侵權請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網站立場,如需處理請聯系客服。電話:028-86922220;郵箱:631063699@qq.com。內容未經允許不得轉載,或轉載時需注明來源: 創新互聯

搜索引擎優化