重生之我真没想当大佬啊: 第七十三章:搜索引擎(2/3)
也搞竞价排名,不过我们是采用竞价排名的方式进行广告拍卖。
之后一方面通过旗下高用户、以及后续开发的高流量产品出售广告位,另一方面是通过做广告联盟匹配广告主和流量主,占据广告长尾市场,从中赚取佣金。”
神秀不会只做一个搜索引擎,我们用搜索引擎消耗用户的信任,其实是会直接影响到未来的产品。”
苏炎坚定的说道。
搜索引擎这个东西,需要用到网络爬虫技术、检索排序技术、网页处理技术、大数据处理技术、自然语言处理技术等,在零一年的这个时候,还用不上自然语言处理技术,大数据处理也更后世的概念不太一样。
但是说白了,所有的搜索引擎核心点其实就是一个东西,算法。
然后不断的重复计算每个页面的pr。假设给每个页面一个随机pr值,那么经过不断的重复计算,这些页面的pr值会趋向于稳定,也就是收敛的状态。
这样也就意味着用户用谷歌的搜索引擎可以比百度更为有效的获取到自己所需要的信息。至于我说为什么不将百度放在眼里,完全是因为百度在前不久推出了竞价业务。”
关键在于百度当前的过于简单的基于在某次搜索的所有结果中被其他网页用超链接指向的越多的网页就价值越高这种基础排序方式。
第二天,苏炎直接来到了教学楼,今天是他和陆渊亭约好的日子。
因为每一个东西都是围绕着算法进行的。
“各位都是计算机方面的专家了,对于搜索引擎可能都有自己的看法,所以在一会的讲解中我希望可以按照我的节奏来,要是有异议的话可以提出来,我会进行详细的解答。”
通过抓去网页信息,然后用算法机制对这些网页进行排序当用户输入关键词进行搜索时,根据关键词匹配出按照机制进行排列的网页。
这种基础排序方式导致有些正确的网页反而被一些劣质网页所覆盖,最终劣币驱逐良币,使用户很难找到自己需要的东西。
而谷歌的pagerank就多了两件很重要的事情,第一件事情是,把a页面到b页面的链接解释为a给b的投票行为,谷歌在这里会同时考评a和b的等级从而形成新的等级。
也就是每一个页面都有pr值,同时你的pr值会成为其他页面pr值的参考。
“在展示我的算法核心之前,我们先来看看当下的三大主流算法,的hits算法。
而在着三种算法里几乎所有人都觉得百度的超链分析是三个算法中最落后的,但有些事情我们还是要多角度的看一看,百度的超链分析在某种程度上可以算得上是奠定了搜索引擎的发展基础。
苏炎平静的看着众人。
“确实是一个很好的盈利手段,对商家来说可以算的上是一个相对精准的推广。如果是想要登上搜索首页得到话,那么支付给百度的费用将是一笔巨资。如果没有太大的变故的话,这将是百度除了传统广告之外的又一大重要盈利手段。”
当前三大主流算法,其实不管是哪一家的算法,算法基础其实都是一样的。都是按照上面的步骤来进行的。
甚至有一种说法,谷歌的算法其实是剽窃了百度的超链算法,对此我们不去做过多的研究。那么同样是搜索引擎为什么百度在国外市场竞争不过谷歌呢?
说完苏炎便开始准备进入正题。
本章还未完,点击下一页继续阅读>>>