搜索引擎的排名原理
搜索引擎的排名原理大致上分为四个步骤?1、爬行和抓取
这个顺序通常被称为蜘蛛(spider或者机器人(robot搜索引擎蜘蛛从数据库中已经知道的网页开始动身,搜索引擎 派出一个能够在网上发现新网页并抓取文件的顺序。就好比正常用户的浏览器一样访问这些网页并抓取网上的内容。并且搜索引擎蜘蛛会跟踪网页上的链接从而访问跟多的网页,这个过程就是爬行了
2、索引
并以巨大的表格形式存入数据库中。索引数据库,搜索引擎索引顺序把蜘蛛抓取的网页进行分解、分析。网页文字内容,关键字出现的位置、字体、颜色、加粗、斜体等相关信息都有相应的记录。
3、搜索词处理
单击“搜索”按钮后,用户在搜索引擎界面输入关键词。搜索引擎顺序即对输入的搜索词进行处理,如中文特有的分词处理,对关键词词序的分类,去除停止词,判断重复度,判断是否需要启动整合搜索,判断是否有拼写错误或错别字等情况。搜索词的处置必需十分快速。
4、排序
搜索引擎排序顺序开始工作,对搜索词进行处置后。从索引数据库中找出所有包括搜索词的网页,并且根据排名计算法计算出哪些网页应该排在前面,然后按一定格式返回“搜索”页面。
刚好遇到类似问题,看完这个帖子心里有底了 蹲了这么久,终于看到有价值的讨论,支持一下!
页:
[1]