ImageVerifierCode 换一换
格式:DOCX , 页数:26 ,大小:34.56KB ,
资源ID:10784577      下载积分:3 金币
快捷下载
登录下载
邮箱/手机:
温馨提示:
快捷下载时,用户名和密码都是您填写的邮箱或者手机号,方便查询和重复下载(系统自动生成)。 如填写123,账号就是123,密码也是123。
特别说明:
请自助下载,系统不会自动发送文件的哦; 如果您已付费,想二次下载,请登录后访问:我的下载记录
支付方式: 支付宝    微信支付   
验证码:   换一换

加入VIP,免费下载
 

温馨提示:由于个人手机设置不同,如果发现不能下载,请复制以下地址【https://www.bdocx.com/down/10784577.html】到电脑端继续下载(重复下载不扣费)。

已注册用户请登录:
账号:
密码:
验证码:   换一换
  忘记密码?
三方登录: 微信登录   QQ登录  

下载须知

1: 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。
2: 试题试卷类文档,如果标题没有明确说明有答案则都视为没有答案,请知晓。
3: 文件的所有权益归上传用户所有。
4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
5. 本站仅提供交流平台,并不能对任何下载内容负责。
6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

版权提示 | 免责声明

本文(搜索引擎分类.docx)为本站会员(b****7)主动上传,冰豆网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对上载内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知冰豆网(发送邮件至service@bdocx.com或直接QQ联系客服),我们立即给予删除!

搜索引擎分类.docx

1、搜索引擎分类搜索引擎分类搜索引擎按其工作方式主要可分为三种,分别是全文搜索引擎(Full Text Search Engine)、目录索引类搜索引擎(Search Index/Directory)和元搜索引擎(Meta Search Engine)。 全文搜索引擎 全文搜索引擎是名副其实的搜索引擎,国外具代表性的有Google、Fast/AllTheWeb、AltaVista、Inktomi、Teoma、WiseNut等,国内著名的有XX(Baidu)。它们都是通过从互联网上提取的各个网站的信息(以网页文字为主)而建立的数据库中,检索与用户查询条件匹配的相关记录,然后按一定的排列顺序将结果返回

2、给用户,因此他们是真正的搜索引擎。 从搜索结果来源的角度,全文搜索引擎又可细分为两种,一种是拥有自己的检索程序(Indexer),俗称“蜘蛛”(Spider)程序或“机器人”(Robot)程序,并自建网页数据库,搜索结果直接从自身的数据库中调用,如上面提到的7家引擎;另一种则是租用其他引擎的数据库,并按自定的格式排列搜索结果,如Lycos引擎。 目录索引 目录索引虽然有搜索功能,但在严格意义上算不上是真正的搜索引擎,仅仅是按目录分类的网站链接列表而已。用户完全可以不用进行关键词(Keywords)查询,仅靠分类目录也可找到需要的信息。目录索引中最具代表性的莫过于大名鼎鼎的Yahoo雅虎。其他著

3、名的还有Open Directory Project(DMOZ)、LookSmart、About等。国内的搜狐、新浪、网易搜索也都属于这一类。 元搜索引擎(META Search Engine) 元搜索引擎在接受用户查询请求时,同时在其他多个引擎上进行搜索,并将结果返回给用户。著名的元搜索引擎有InfoSpace、Dogpile、Vivisimo等(元搜索引擎列表),中文元搜索引擎中具代表性的有搜星搜索引擎。在搜索结果排列方面,有的直接按来源引擎排列搜索结果,如Dogpile,有的则按自定的规则将结果重新排列组合,如Vivisimo。 除上述三大类引擎外,还有以下几种非主流形式: 集合式搜索引

4、擎:如HotBot在2002年底推出的引擎。该引擎类似META搜索引擎,但区别在于不是同时调用多个引擎进行搜索,而是由用户从提供的4个引擎当中选择,因此叫它“集合式”搜索引擎更确切些。 门户搜索引擎:如AOL Search、MSN Search等虽然提供搜索服务,但自身即没有分类目录也没有网页数据库,其搜索结果完全来自其他引擎。 免费链接列表(Free For All Links,简称FFA):这类网站一般只简单地滚动排列链接条目,少部分有简单的分类目录,不过规模比起Yahoo等目录索引来要小得多。 由于上述网站都为用户提供搜索查询服务,为方便起见,我们通常将其统称为搜索引擎。 搜索引擎基本工

5、作原理 了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。 全文搜索引擎 在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。搜索引擎的自动信息搜集功能分两种。一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。 另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。由于近年来搜索引擎索引规

6、则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。 当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。 目录索引 与全文搜索引擎相比,目录索引有许多不同之处。 首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标

7、准甚至编辑人员的主观印象,决定是否接纳你的网站。 其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。尤其象Yahoo!这样的超级索引,登录更是困难。(由于登录Yahoo!的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录Yahoo雅虎的技巧) 此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。 最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引

8、则要求必须手工另外填写网站信息,而且还有各种各样的限制。更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。 目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。 目前,搜索引擎与目录索引有相互融合渗透的趋势。原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用Open Di

9、rectory目录提供分类查询。而象 Yahoo! 这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围。在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。 搜索引擎的第三定律 搜索引擎走到今天,已经是一个结束过去,开辟未来的时候了。为了说清楚我所讲的第三定律,我们先来回顾一下第一和第二定律。 第一定律 相关性定律 听起来象是一篇学术论文,的确,就连第一,第二定律的提法以前也没有过,但是第一,第二定律的内容确早已在业界和学术界得到了公认。其实这第一定律是早在互联网出现之前就被学术界广泛研究过的,

10、那就是所谓的相关性定律。这个领域那时叫情报检索,或信息检索,也有叫全文检索的。 那时的相关性都是基于词频统计的,也就是说,当用户输入检索词时,搜索引擎去找那些检索词在文章(网页)中出现频率较高的,位置较重要的,再加上一些对检索词本身常用程度的加权,最后排出一个结果来(检索结果页面) 。早期的搜索引擎结果排序都是基于本文的第一定律的,如Infoseek,Excite,Lycos等,它们基本上是沿用了网络时代之前学术界的研究成果,工业界的主要精力放在处理大访问量和大数据量上,对相关性排序没有突破。 词频统计其实根本没有利用任何跟网络有关的特性,是前网络时代的技术。然而,网络时代的主要文献是以网页的

11、形式存在的,而几乎每个人都可以随心所欲地在网上发表各种内容,词频相同的两个网页,质量相差可以很远,可是按照搜索引擎的第一定律,对这两个网页的排序应该是一样的。为了能够派在某些检索结果的前几位,许多网页内容的制作者绞尽脑汁,在其页面上堆砌关键词,搜索引擎对此防不胜防,苦不堪言。这种情况到了 1996年开始有了改变。 第二定律 人气质量定律 1996年4月,我到赌城拉斯维加斯开一个有关信息检索方面的学术会议,会议的内容就象拉斯维加斯的天气一样,照例比较枯燥乏味。但远离公司的我,却难得有一个静下心来认真思考问题的机会。就在听一个毫不相干的论文演讲的时候,我突然把科学引文索引的机制跟Web上的超级链接

12、联系起来了 - 感谢北大,她在我上大三的时候就教授了我科学引文索引的机制,美国恐怕没有一所大学会在你本科的时候教这玩艺儿。 科学引文索引的机制,说白了就是谁的论文被引用次数多,谁就被认为是权威,论文就是好论文。这个思路移植到网上就是谁的网页被链接次数多,那个网页就被认为是质量高,人气旺。在加上相应的链接文字分析,就可以用在搜索结果的排序上了。这就引出了搜索引擎的第二定律:人气质量定律。根据这一定律,搜索结果的相关性排序,并不完全依赖于词频统计,而是更多地依赖于超链分析。 我意识到这是一个突破性的东西,回去以后就很快总结了思路,于96年6月申请了这一方面的美国专利。1999年 7月6号,美国专利

13、和商标局批准了专利号为5,920,859的,以我为唯一发明人的专利。大约在96年底,斯坦福大学计算机系的两位研究生也想到了同样的解决方法,他们后来创立了一个叫Google的搜索引擎,Google的网站上至今仍然说他们的这项技术是Patent-pending (专利申请中) ,不知道美国专利局是不是还会再批这样的专利。Anyway, 超链分析的方法98年以后逐渐被各大搜索引擎所接受,由于链接是网络内容的一个根本特性,这时候的搜索引擎才开始真正利用网络时代的检索技术。 世事难料,2000年起网络泡沫迅速破灭,各大搜索引擎要么遭人收购,要么推迟上市,所有使用人气质量定律的搜索引擎公司都未能幸免。那么

14、,搜索引擎的出路到底在哪儿? 第三定律 自信心定律 人气质量定律解决的还是一个技术层面的问题,然而搜索引擎从诞生的那一天起,从来就不是一个纯技术现像,它融合了技术,文化,市场等各个层面的因素。解决搜索引擎公司的生存和发展问题需要搜索引擎的第三定律-自信心定律。 1998年的时候,没有太多的人拿一家远在硅谷500英里以外,刚刚成立的,叫作GoT(现已更名为Overture)的公司当回事儿。它不过是买了一个搜索引擎的技术服务,然后再向那些网站的拥有者们拍卖他们网站在GoTo检索结果中的排名,谁付的钱多,谁的网站就排在前面,而且付费是根据网民点击该网站的情况来计算的,仅仅在搜索结果中出现并不需要付费

15、。这就是自信心定律的最早实践者!根据这一定律,搜索结果的相关性排序,除了词频统计和超链分析之外,更注重的是竞价拍卖。谁对自己的网站有信心,谁就排在前面。有信心的表现就是愿意为这个排名付钱。需要声明的是,自信心定律也是我自己给这一模式起的名字,以前的文献中并没有人这样总结过。 今天,在网络业一片萧条,那斯达克风声鹤唳的时候,GoTo却如日中天,市值高达13亿美金,收入高达雅虎总收入的35%。反观门户网站,有哪一个能从它们的搜索引擎服务中赚出总收入的三分之一呢?究其原因,就是因为GoTo最早实践了搜索引擎的自信心定律。以前的搜索引擎都是靠CPM来收费的,而CPM是从传统广告业借鉴过来的,没有考虑网

16、络媒体即时性,交互性,易竞价的特点,而竞价排名,点击收费则是为网站拥有者直接提供销售线索,而不是传统意义上的广告宣传。自信心定律一改过去搜索引擎靠CPM收钱的尴尬局面,开创了真正属于互联网的收费模式。各类搜索网站1、google 如果你的网站是新发布的,或是访问量较低的网站在内容更新时,很有必要主动提交到Google,这样会使网站资料迅速更新倒Google搜索资料库,让用户能及时搜索到你的最新资料。 登录地址: 2、baidu baidu基本跟google差不多 登录地址: 3、ODP(开放式目录) Open Directory Project(ODP) 是仅次于Yahoo的人工操作目录索引类

17、搜索引擎。与Yahoo不同的是,Open Directory Project (ODP)的编辑人员均为志愿者,而非其雇员。目前其志愿编辑人数已达数万人。(Alexa、Google就使用的是此目录) 中国用户登录地址:http:/ch.dmoz.org/ 4、yahoo 在雅虎主站登录和在雅虎中国登录网站都有免费的,操作步骤类似。 登录步骤: (1)进入雅虎中国, (2)在其左下角的网站分类模块中选择适合你网站的目录。 (3)点击登录网站,按照提示填写信息即可。 5、sohu 搜狐只对非商业型网站,如政府机构,慈善机构,学校等,提供免费网站登录服务。如果你的网站属于非商业型网站,那么赶快到搜狐免

18、费登录。商业网站(如:商场、公司、电子商务等)就要花钱来登录了。 登录地址: 6、yisou 一搜是雅虎新推出的挑战google的搜索服务。 登录地址: 7、天网搜索 北大的搜索引擎,高校学生用得比较多。 登录地址: 8、搜狗 (1)进入搜狗网站分类目录, (2)在其网站分类中选择适合你网站的目录 (3)点击搜索框右边网站登录,按照提示填写信息即可著名目录类搜索引擎著名目录类搜索引擎(18)Yahoo!英文 Yahoo!中文 Yahoo!繁体中文 Google 英文 Google 中文 Google 繁体中文 Alexa 新浪 网易 搜狐 新浪台北 Altavista AOL Hotbot L

19、ycos Netscape TEOMA all the web Northern Night 中国大陆地区搜索引擎(263)1. 北极星2. 我是野虎3. 尤里卡中文智能搜索引擎4. FM3655. 天下游6. 搜友搜索7. 搜鲸8. 1608搜网9. 海天搜索10. 香港之最搜索11. 新加坡世界华商网络12. 中国船业网13. 中华美食网14. 赛迪IT罗盘15. 绿色搜索引擎16. 可美特商务专员网搜索17. 千龙搜索引擎18. hi中国强力搜索19. 999健康网搜索20. 出国在线搜索引擎21. 中华生物信息搜索引擎22. 山阳搜索引擎23. 金海网络搜索引擎24. 中国人口搜索引擎

20、25. 金农企业搜索引擎26. 中国教育科研网搜索引擎27. 国信搜索引擎28. 精网盟29. 中华商埠30. 千禧搜索引擎31. 广州信息网网络导航32. 搜星搜索引擎33. 中国经济网站大全34. 政网搜索35. CMP3商业网络36. 中国展区37. 雅格网络38. 中华特产搜索引擎39. 中国行业搜索引擎40. 商情网搜索引擎41. 163搜索42. BEST FREE引擎43. 五行搜索引擎44. 中国黄页在线45. 中国搜易引擎46. 中文信息网47. 秀佳之窗搜索引擎48. 热点精选搜索49. 21在线信息咨询50. 中国电力搜索引擎51. 杭州联盟52. 数字永嘉53. 搜豹5

21、4. 秀佳搜索引擎55. 搜鼠中文搜索引擎56. 中华网-外经贸搜索引擎57. 印度asiaco搜索引擎58. 菲律宾yehey搜索引擎59. 台湾小蕃薯搜寻引擎60. 香港绿世界搜索引擎61. 中国市县区信息网62. 滔滔品网63. 中国国情网64. 瑞星搜索65. 云南信息港66. 顶尖珠宝网67. 浩瀚搜索68. 耍网搜索69. 宽网空间70. 中国化学化工网搜索引擎71. 惠州搜索引擎72. 八闽农网搜索73. 中国漳州商业网搜索74. 问蝶网探搜索引擎75. 女士网76. 台中全球咨询网搜索引擎77. 中国国际贸易发展网搜索78. 无忧电子集成网搜索79. 豫思网络搜索80. 江苏阜

22、宁人搜索引擎81. 我要搜索82. 金意软件搜索83. 香港建材搜索引擎84. 九能搜索引擎85. 阳江网站搜索86. 导医网搜索87. cy频道搜索88. 商务地带搜索89. 猎网90. 教育部网上合作研究中心搜索91. 中国鞋业资源网92. 长安游侠搜索93. companybtob搜索94. 电梯商务信息网95. 中兴高中搜索96. 成都市金牛区搜索97. 数码2000搜索98. 育星搜索99. 中国啤酒网上行搜索100. 迈博搜索101. 中国医药网站搜索引擎102. Yiuwa搜索103. 中国宠物网搜索104. TV俱乐部搜索105. 振中搜索2000106. 工程造价信息搜索10

23、7. 月饼中文资讯网搜索108. 厦门永兴搜索109. 南京教育信息网搜索110. 闽南艺术网111. FM365 XX 263 21CN TOM 搜狐112. 7758搜索引擎113. 马坡岭农业搜索引擎114. 龙虎家居搜索115. 蓝帆搜索116. 中国产权交易网117. 中国农大搜索118. 逸星搜索119. 海宁信息港120. 珠海工程搜索121. 眼镜信息搜索引擎122. 福建导航123. 河北省总商会海湾信息网124. 314旅游网搜索125. 中国厦门网站搜索126. 中国用户搜索引擎127. 中国设计网搜索引擎128. 特殊教育网搜索引擎129. 齐隆搜索130. 高手网络1

24、31. 汉都搜索引擎132. 时空引擎-中国贵州省133. 高密外经贸信息网134. 亚洲在线135. 湖北教育136. 网上律师137. 台州新干线138. 大台湾网搜寻139. 襄阳风日140. 新疆网络141. 企业搜索引擎142. 袋鼠超市网搜索143. 音乐共和搜索144. 中国经济学人搜索引擎145. 风网搜索146. 浙江法律咨询网搜索147. 足彩世界-足球网址收藏148. 搜趣网149. 中国168信息网150. 超市网搜索引擎151. 信仰搜索152. 蓝芒搜索153. 南京财经大学搜索引擎154. 荣华水产搜索155. 法网搜索引擎156. 易想网157. 中央音乐学院搜

25、索引擎158. 徐州指南搜索引擎159. 北京在线搜索引擎160. 冀南热线搜索引擎161. 方圆网162. 夏氏礼品搜索163. 电影网搜索引擎164. 无限资讯搜索引擎165. 音响世界企业信息网166. 榆林网搜索167. 1972s搜索引擎168. 中国药学会医药导航169. 视点在线搜索170. 神州网盟171. 新西兰全方位资讯网172. 杰科搜索173. 君临人力资源搜索174. 厦门信息导航中心175. 6917搜索176. 圣火暖通网搜索177. 袋鼠超市网178. 人力资源引擎179. 纸业资讯网搜索引擎180. 中国集藏在线搜索181. 中国网腾公众信息网182. 浙江法

26、律咨询网183. 青浦企业信息网搜索引擎184. 中华企业信息网搜索引擎185. 千度搜索引擎186. 易润搜索187. 透明的心搜索188. 一路签搜索引擎189. 浙江玉环商务网搜索190. 绿色资讯网191. 中国考研情报中心搜索引擎192. 中国好运河搜索193. 广告人搜索引擎194. 51555搜索195. 朝日网搜索196. 微远商业网197. 东方电子商务网198. 中世商务网搜索199. 中业网搜索200. 连州在线搜索201. 5m5m搜索202. 胶州搜索203. 天网信息港204. 慈溪企业网205. 以太搜索206. 中国包装在线搜索引擎207. 东方商贸网208.

27、碧云DJ行搜索引擎209. 搜索引擎210. 万达企业网211. 城市在线搜索212. 人大学生网213. 中国纸业网搜索引擎214. 深圳超市网215. 安庆信息网搜索引擎216. 扬州导航217. 徐州金网218. 爱之源网络219. 商业企业网搜索220. 白垩纪搜索引擎221. 江苏人搜索222. 中国编程网搜索引擎223. 泰达搜索引擎224. 甘肃省计算中心225. 热讯网搜索226. 6A6A6.COM227. 数字鞍山228. 人到中年搜索引擎229. 上海科技网搜索引擎230. 亮亮电子搜索231. 衢州信息港232. 怡海电脑搜索233. 极限科技234. 中原信息网235

28、. HH521.COM236. 遨空搜索237. 大自在网络238. 浙江热线239. 闽南信息网240. 网镜搜索241. 龙港都市频道242. 慈溪工商网243. 微网搜索244. 巢湖信息港搜索引擎245. 日月咨询网246. CMT搜索引擎247. 长城热线248. FLASH动感音符搜索引擎249. 中国学生网250. VIDEO搜索251. 丝绸之路旅游网搜索引擎252. 中国SMT信息网253. 吕梁之窗254. 锡林郭勒经济技术开发区255. 晨曦热线256. 中国假日搜索引擎257. 蔡进视窗258. 陆丰公众信息网259. 佳人互动资源网260. 动态网站制作指南搜索引擎2

29、61. 三门峡搜索引擎262. 中国柳市网263. 揭阳商业网 香港、台湾、澳门地区搜索引擎(56)1. 巴辣香港搜索器2. 香港网中网3. 香港之最搜索4. PCHOME搜索5. MIT国际网络咨询中心6. 香港搜索器7. 香港Y28网站导航8. WEBINHK搜索引擎9. GAIS搜索器10. 台湾COO索引11. HINET搜索12. openfind搜索引擎13. 台湾小蕃薯搜寻引擎14. 香港绿世界搜索引擎15. 育德全球咨询网搜索16. CC-NET中文网站搜索引擎17. 艺术笔记网搜索引擎18. SppHome搜索引擎19. 25H.COM.TW20. 哈玛星球搜索21. 琦景优质生活网22. 台湾电动车搜索23. 香港建材搜索引擎24. 台湾商业广场25. 香港邹几教育网艘26. 台湾Commerce搜索引擎27. 井利搜索28. 台北医学资讯搜7D22完整29. 天空搜索30. 城市之星搜索31. 台湾龙山搜索32. 光堡高尔夫旅游网33. 极易搜34. 国立中正大学搜索引擎35. 光堡冷冻空调技术网搜索引擎36. 我们的网站搜索引擎37. CNSLOT搜索引擎38. 数位管理导航中心39. 香港双子公园

copyright@ 2008-2022 冰豆网网站版权所有

经营许可证编号:鄂ICP备2022015515号-1