军队文职考试

您当前位置:山东人事考试网 > 军队文职考试 > 试题资料 > [面试模拟]2023军队文职计算机岗:百度搜索引擎原理

[面试模拟]2023军队文职计算机岗:百度搜索引擎原理

2023-04-07 13:51:12 文章来源:未知

点击订阅
山东华图
公务员招录,事业单位考试,教师招聘信息

[面试模拟]2023军队文职计算机岗:百度搜索引擎原理

  【题目】

  简述百度搜索引擎的原理。

  【解题思路】

  组织流程题,可按照事前、事中、事后三部分开展。

  【参考答案】

  大概分为三个阶段:

  第一,爬行和抓取。为了抓取网上尽量多的页面,搜索引擎蜘蛛会跟踪页面上的超链接,从一个页面爬到下一个页面。整个互联网是由相互链接的网站及页面组成的。从理论上说,蜘蛛从任何一个页面出发,顺着超链接都可以爬行到网上的所有页面。

  第二,预处理。“预处理”也被简称为“索引”。搜索引擎蜘蛛抓取的原始页面,还要做大量的预处理工作,为最后的查询排名做好准备。其中,最重要的就是提取关键词,建立索引文件。其他还包括内容过滤去除重复网页、一些明显的欺骗用户的网页,死链接,空白内容页面(这些网页对用户和百度来说,都是没有价值的);分词(中文)、判断网页类型、分析超链接、计算网页的重要度、丰富度等。

  第三,排名结果输出。用户输入关键词后,排名程序调用索引库数据,会对其进行一系列复杂的分析,并根据分析的结论在索引库中寻找与之最为匹配的一系列网页,按照用户输入的关键词所体现的需求强弱和网页的优劣进行打分,并按照最终的分数进行排列,展现给用户该关键词最匹配最有价值的网页。

图书

更多>
(编辑:华图小土豆)

图书

更多>
有报考疑惑?在线客服随时解惑

公告啥时候出?

报考问题解惑?报考条件?

报考岗位解惑   怎么备考?

冲刺资料领取?

立即咨询
山东华图微信

军队文职