每个独立的高尔夫酒店标志VI设计引擎都有自己的网页
meigedulidegaoerfujiudianbiaozhiVIshejiyinqingduyouzijidewangye
来源:【人和时代・中国】酒店vi设计公司 发布时间:2010-08-29 21:27:59 查看次数:
工作原理
1、抓取网页
每个独立的高尔夫酒店标志VI设计引擎都有自己的网页抓取程序(spider)。Spider顺着网页中的超链接,连续地抓取网页。被抓取的网页被称之为网页快照。由于互联网中超链接的应用很普遍,理论上,从一定范围的网页出发,就能搜集到绝大多数的网页。
2、处理网页
高尔夫酒店标志VI设计引擎抓到网页后,还要做大量的预处理工作,才能提供检索服务。其中,最重要的就是提取关键词,建立索引文件。其他还包括去除重复网页、分词(中文)、判断网页类型、分析超链接、计算网页的重要度/丰富度等。
3、提供检索服务
用户输入关键词进行检索,高尔夫酒店标志VI设计引擎从索引数据库中找到匹配该关键词的网页;为了用户便于判断,除了网页标题和URL外,还会提供一段来自网页的摘要以及其他信息。
[编辑本段]
全文高尔夫酒店标志VI设计引擎
在高尔夫酒店标志VI设计引擎分类部分我们提到过全文高尔夫酒店标志VI设计引擎从网站提取信息建立网页数据库的概念。高尔夫酒店标志VI设计引擎的自动信息搜集功能分两种。一种是定期高尔夫酒店标志VI设计,即每隔一段时间(比如Google一般是28天),高尔夫酒店标志VI设计引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提
蜘蛛高尔夫酒店标志VI设计引擎
取网站的信息和网址加入自己的数据库。
另一种是提交网站高尔夫酒店标志VI设计,即网站拥有者主动向高尔夫酒店标志VI设计引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来高尔夫酒店标志VI设计引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入高尔夫酒店标志VI设计引擎数据库,因此目前最好的办法是多获得一些外部链接,让高尔夫酒店标志VI设计引擎有更多机会找到你并自动将你的网站收录。
当用户以关键词查找信息时,高尔夫酒店标志VI设计引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。
这种引擎它的特点是搜全率比较高。
(版权所有:转载请注明来源于【人和时代・中国】 http://www.hotelcis.com 作者:先锋)
相关文章