搜索引擎及工作原理

推荐 科技 2019-02-03 21:59:21 308

本文收集整理关于搜索引擎及工作原理的相关议题,使用内容导航快速到达。

内容导航:

  • Q1:搜索引擎的分类及其工作原理
  • Q2:淘宝搜索引擎展现流程即工作原理是怎样的?
  • Q3:百度搜索引擎的工作原理
  • Q1:搜索引擎的分类及其工作原理

    搜索引擎按其工作方式主要可分为三种,分别是全文搜索引擎(Full Text Search Engine)、目录索引类搜索引擎(Search Index/Directory)和元搜索引擎(Meta Search Engine)。
    l 全文搜索引擎
    全文搜索引擎是名副其实的搜索引擎,国外具代表性的有Google、Fast/AllTheWeb、AltaVista、Inktomi、Teoma、WiseNut等,国内著名的有百度(Baidu)。它们都是通过从互联网上提取的各个网站的信息(以网页文字为主)而建立的数据库中,检索与用户查询条件匹配的相关记录,然后按一定的排列顺序将结果返回给用户,因此他们是真正的搜索引擎。
    从搜索结果来源的角度,全文搜索引擎又可细分为两种,一种是拥有自己的检索程序(Indexer),俗称“蜘蛛”(Spider)程序或“机器人”(Robot)程序,并自建网页数据库,搜索结果直接从自身的数据库中调用,如上面提到的7家引擎;另一种则是租用其他引擎的数据库,并按自定的格式排列搜索结果,如Lycos引擎。
    l 目录索引
    目录索引虽然有搜索功能,但在严格意义上算不上是真正的搜索引擎,仅仅是按目录分类的网站链接列表而已。用户完全可以不用进行关键词(Keywords)查询,仅靠分类目录也可找到需要的信息。目录索引中最具代表性的莫过于大名鼎鼎的Yahoo雅虎。其他著名的还有Open Directory Project(DMOZ)、LookSmart、About等。国内的搜狐、新浪、网易搜索也都属于这一类。
    l 元搜索引擎(META Search Engine)
    元搜索引擎在接受用户查询请求时,同时在其他多个引擎上进行搜索,并将结果返回给用户。著名的元搜索引擎有InfoSpace、Dogpile、Vivisimo等(元搜索引擎列表),中文元搜索引擎中具代表性的有搜星搜索引擎。在搜索结果排列方面,有的直接按来源引擎排列搜索结果,如Dogpile,有的则按自定的规则将结果重新排列组合,如Vivisimo。
    l 除上述三大类引擎外,还有以下几种非主流形式:
    集合式搜索引擎:如HotBot在2002年底推出的引擎。该引擎类似META搜索引擎,但区别在于不是同时调用多个引擎进行搜索,而是由用户从提供的4个引擎当中选择,因此叫它“集合式”搜索引擎更确切些。
    门户搜索引擎:如AOL Search、MSN Search等虽然提供搜索服务,但自身即没有分类目录也没有网页数据库,其搜索结果完全来自其他引擎。
    免费链接列表(Free For All Links,简称FFA):这类网站一般只简单地滚动排列链接条目,少部分有简单的分类目录,不过规模比起Yahoo等目录索引来要小得多。
    由于上述网站都为用户提供搜索查询服务,为方便起见,我们通常将其统称为搜索引擎。
    l 搜索引擎基本工作原理
    了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。
    全文搜索引擎
    在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。
    另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。
    当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。
    目录索引
    与全文搜索引擎相比,目录索引有许多不同之处。
    首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。
    其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录Yahoo雅虎的技巧)
    此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。
    最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。
    目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。
    目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。

    Q2:淘宝搜索引擎展现流程即工作原理是怎样的?

    根据淘宝官方的说法,搜素引擎的排名规则为四大类,只要你的四大类就属于中上,那你的产品就很有可能能够出现再首页。

    除此之外i。当然也可以烧钱。但建议小卖家以及新手卖家还是好好研究研究这四大类基础把。

    这四项都是做淘宝必研究做好的一项,如果连这些都不想做,也可以不用做淘宝了。

    一:店铺的各项数据,

    店铺的各项数据是什么?我相信不仅大多数新手卖家不知道,就连好几年的老买家有的都不是很清楚。

    其实一般来说,店铺的数据分为:(注意,是整个店铺的数据,不是宝贝的数据)

    动态评分(描述、服务、物流)、退款纠纷率、投诉维权处罚等。

    做淘宝一定要做好店铺数据,要不然的其他各项评分再好,淘宝很有可能也不会给你排名的。新手买家该刷就刷!

    二:商品质量

    千万不要说淘宝又不知道宝贝的质量。这个产品质量指着是你产品的各项数据!

    里面包含你产品的标题,关键词,主图,详情图片 ,价格,属性等

    如果你是做一件代发的,建议你不要和商家的各项属性都一样的,因为分销商很多,产品的属性一样的太多的话,是没有权重的,自然也不会给你展示!

    当然,有条件的最好自己拍图,没有条件的就累一点,要商家要原图重新自己做。

    独一份的话,商品权重会很高的,排名也会优先。

    三:商品数据

    商品数据大概分为:销量、人气、收藏、转化率,客单价,橱窗推荐、下架时间等

    这一项是最关键也是最难做的一项,仅靠刷的话是很难有那么大的量能跟别人拼的,所以说必须要打造爆款,爆款可以不挣钱,等把流量吸引进来,做好详情、推荐,让客户能够连带下单!

    当然,新开店的卖家对这个一定要多研究,就算不是精通也要最起码知道数据是什么意思、怎么来的,这样再开店初期你才能针对性的去刷,去做。

    四:处罚类

    处罚类的数据一般分为 店铺违规、虚假交易、处罚、低价交易、假货、历史违规等

    这些一般的新店都是没有的,做的久了自然而然会出现这些处罚,这些没有什么技巧,只能奉劝各位熟读淘宝规则,不要进入雷区,否则清者屏蔽店铺,重则关店!

    对了,新手卖家刷单的时候一定不要为了节约成本就把价钱改低,这样会影响商品数据的!

    影响淘宝搜索引擎的差不多就是这四大分类,其中无数的小分类就要靠大家一点一点去做了。

    最后祝愿大家都能够挣钱。

    生意红红火火。

    Q3:百度搜索引擎的工作原理

    搜索引擎基本工作原理
    了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。
    ........................................................................................
    ■ 全文搜索引擎
    在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。
    另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。
    当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。
    ........................................................................................
    ■ 目录索引
    与全文搜索引擎相比,目录索引有许多不同之处。
    首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。
    其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象 Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录 Yahoo雅虎的技巧)
    此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。
    最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。
    目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。
    目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Directory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围(注)。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。

    相关文章
    如何更改safari默认搜索引擎2019-02-03
    搜索引擎如何搜集信息2019-02-11
    手机如何设置搜索引擎2019-02-19
    搜索引擎关键词可分为2019-02-21
    浏览器的搜索引擎怎么删除2019-04-09
    谷歌浏览器管理搜索引擎不能设置2019-04-21
    推荐几个百度网盘搜索引擎2019-05-14
    搜索引擎用百度还是谷歌还是搜狗好2019-05-22
    搜索引擎工作原理分析2019-06-24
    手机浏览器搜索引擎2019-06-30