搜索引擎分类.docx

上传人:b****3 文档编号:4928301 上传时间:2022-12-11 格式:DOCX 页数:23 大小:29.43KB
下载 相关 举报
搜索引擎分类.docx_第1页
第1页 / 共23页
搜索引擎分类.docx_第2页
第2页 / 共23页
搜索引擎分类.docx_第3页
第3页 / 共23页
搜索引擎分类.docx_第4页
第4页 / 共23页
搜索引擎分类.docx_第5页
第5页 / 共23页
点击查看更多>>
下载资源
资源描述

搜索引擎分类.docx

《搜索引擎分类.docx》由会员分享,可在线阅读,更多相关《搜索引擎分类.docx(23页珍藏版)》请在冰豆网上搜索。

搜索引擎分类.docx

搜索引擎分类

搜索引擎分类

搜索引擎按其工作方式主要可分为三种,分别是全文搜索引擎(FullTextSearchEngine)、目录索引类搜索引擎(SearchIndex/Directory)和元搜索引擎(MetaSearchEngine)。

●全文搜索引擎

全文搜索引擎是名副其实的搜索引擎,国外具代表性的有Google、Fast/AllTheWeb、AltaVista、Inktomi、Teoma、WiseNut等,国内著名的有XX(Baidu)。

它们都是通过从互联网上提取的各个网站的信息(以网页文字为主)而建立的数据库中,检索与用户查询条件匹配的相关记录,然后按一定的排列顺序将结果返回给用户,因此他们是真正的搜索引擎。

从搜索结果来源的角度,全文搜索引擎又可细分为两种,一种是拥有自己的检索程序(Indexer),俗称“蜘蛛”(Spider)程序或“机器人”(Robot)程序,并自建网页数据库,搜索结果直接从自身的数据库中调用,如上面提到的7家引擎;另一种则是租用其他引擎的数据库,并按自定的格式排列搜索结果,如Lycos引擎。

●目录索引

目录索引虽然有搜索功能,但在严格意义上算不上是真正的搜索引擎,仅仅是按目录分类的网站链接列表而已。

用户完全可以不用进行关键词(Keywords)查询,仅靠分类目录也可找到需要的信息。

目录索引中最具代表性的莫过于大名鼎鼎的Yahoo雅虎。

其他著名的还有OpenDirectoryProject(DMOZ)、LookSmart、About等。

国内的搜狐、新浪、网易搜索也都属于这一类。

●元搜索引擎(METASearchEngine)

元搜索引擎在接受用户查询请求时,同时在其他多个引擎上进行搜索,并将结果返回给用户。

著名的元搜索引擎有InfoSpace、Dogpile、Vivisimo等(元搜索引擎列表),中文元搜索引擎中具代表性的有搜星搜索引擎。

在搜索结果排列方面,有的直接按来源引擎排列搜索结果,如Dogpile,有的则按自定的规则将结果重新排列组合,如Vivisimo。

●除上述三大类引擎外,还有以下几种非主流形式:

集合式搜索引擎:

如HotBot在2002年底推出的引擎。

该引擎类似META搜索引擎,但区别在于不是同时调用多个引擎进行搜索,而是由用户从提供的4个引擎当中选择,因此叫它“集合式”搜索引擎更确切些。

门户搜索引擎:

如AOLSearch、MSNSearch等虽然提供搜索服务,但自身即没有分类目录也没有网页数据库,其搜索结果完全来自其他引擎。

免费链接列表(FreeForAllLinks,简称FFA):

这类网站一般只简单地滚动排列链接条目,少部分有简单的分类目录,不过规模比起Yahoo等目录索引来要小得多。

由于上述网站都为用户提供搜索查询服务,为方便起见,我们通常将其统称为搜索引擎。

●搜索引擎基本工作原理

了解搜索引擎的工作原理对我们日常搜索应用和网站提交推广都会有很大帮助。

全文搜索引擎

在搜索引擎分类部分我们提到过全文搜索引擎从网站提取信息建立网页数据库的概念。

搜索引擎的自动信息搜集功能分两种。

一种是定期搜索,即每隔一段时间(比如Google一般是28天),搜索引擎主动派出“蜘蛛”程序,对一定IP地址范围内的互联网站进行检索,一旦发现新的网站,它会自动提取网站的信息和网址加入自己的数据库。

另一种是提交网站搜索,即网站拥有者主动向搜索引擎提交网址,它在一定时间内(2天到数月不等)定向向你的网站派出“蜘蛛”程序,扫描你的网站并将有关信息存入数据库,以备用户查询。

由于近年来搜索引擎索引规则发生了很大变化,主动提交网址并不保证你的网站能进入搜索引擎数据库,因此目前最好的办法是多获得一些外部链接,让搜索引擎有更多机会找到你并自动将你的网站收录。

当用户以关键词查找信息时,搜索引擎会在数据库中进行搜寻,如果找到与用户要求内容相符的网站,便采用特殊的算法——通常根据网页中关键词的匹配程度,出现的位置/频次,链接质量等——计算出各网页的相关度及排名等级,然后根据关联度高低,按顺序将这些网页链接返回给用户。

目录索引

与全文搜索引擎相比,目录索引有许多不同之处。

首先,搜索引擎属于自动网站检索,而目录索引则完全依赖手工操作。

用户提交网站后,目录编辑人员会亲自浏览你的网站,然后根据一套自定的评判标准甚至编辑人员的主观印象,决定是否接纳你的网站。

其次,搜索引擎收录网站时,只要网站本身没有违反有关的规则,一般都能登录成功。

而目录索引对网站的要求则高得多,有时即使登录多次也不一定成功。

尤其象Yahoo!

这样的超级索引,登录更是困难。

(由于登录Yahoo!

的难度最大,而它又是商家网络营销必争之地,所以我们会在后面用专门的篇幅介绍登录Yahoo雅虎的技巧)

此外,在登录搜索引擎时,我们一般不用考虑网站的分类问题,而登录目录索引时则必须将网站放在一个最合适的目录(Directory)。

最后,搜索引擎中各网站的有关信息都是从用户网页中自动提取的,所以用户的角度看,我们拥有更多的自主权;而目录索引则要求必须手工另外填写网站信息,而且还有各种各样的限制。

更有甚者,如果工作人员认为你提交网站的目录、网站信息不合适,他可以随时对其进行调整,当然事先是不会和你商量的。

目录索引,顾名思义就是将网站分门别类地存放在相应的目录中,因此用户在查询信息时,可选择关键词搜索,也可按分类目录逐层查找。

如以关键词搜索,返回的结果跟搜索引擎一样,也是根据信息关联程度排列网站,只不过其中人为因素要多一些。

如果按分层目录查找,某一目录中网站的排名则是由标题字母的先后顺序决定(也有例外)。

目前,搜索引擎与目录索引有相互融合渗透的趋势。

原来一些纯粹的全文搜索引擎现在也提供目录搜索,如Google就借用OpenDirectory目录提供分类查询。

而象Yahoo!

这些老牌目录索引则通过与Google等搜索引擎合作扩大搜索范围。

在默认搜索模式下,一些目录类搜索引擎首先返回的是自己目录中匹配的网站,如国内搜狐、新浪、网易等;而另外一些则默认的是网页搜索,如Yahoo。

●搜索引擎的第三定律

搜索引擎走到今天,已经是一个结束过去,开辟未来的时候了。

为了说清楚我所讲的第三定律,我们先来回顾一下第一和第二定律。

第一定律相关性定律

听起来象是一篇学术论文,的确,就连第一,第二定律的提法以前也没有过,但是第一,第二定律的内容确早已在业界和学术界得到了公认。

其实这第一定律是早在互联网出现之前就被学术界广泛研究过的,那就是所谓的相关性定律。

这个领域那时叫情报检索,或信息检索,也有叫全文检索的。

那时的相关性都是基于词频统计的,也就是说,当用户输入检索词时,搜索引擎去找那些检索词在文章(网页)中出现频率较高的,位置较重要的,再加上一些对检索词本身常用程度的加权,最后排出一个结果来(检索结果页面)。

早期的搜索引擎结果排序都是基于本文的第一定律的,如Infoseek,Excite,Lycos等,它们基本上是沿用了网络时代之前学术界的研究成果,工业界的主要精力放在处理大访问量和大数据量上,对相关性排序没有突破。

词频统计其实根本没有利用任何跟网络有关的特性,是前网络时代的技术。

然而,网络时代的主要文献是以网页的形式存在的,而几乎每个人都可以随心所欲地在网上发表各种内容,词频相同的两个网页,质量相差可以很远,可是按照搜索引擎的第一定律,对这两个网页的排序应该是一样的。

为了能够派在某些检索结果的前几位,许多网页内容的制作者绞尽脑汁,在其页面上堆砌关键词,搜索引擎对此防不胜防,苦不堪言。

这种情况到了1996年开始有了改变。

第二定律人气质量定律

1996年4月,我到赌城拉斯维加斯开一个有关信息检索方面的学术会议,会议的内容就象拉斯维加斯的天气一样,照例比较枯燥乏味。

但远离公司的我,却难得有一个静下心来认真思考问题的机会。

就在听一个毫不相干的论文演讲的时候,我突然把科学引文索引的机制跟Web上的超级链接联系起来了-感谢北大,她在我上大三的时候就教授了我科学引文索引的机制,美国恐怕没有一所大学会在你本科的时候教这玩艺儿。

科学引文索引的机制,说白了就是谁的论文被引用次数多,谁就被认为是权威,论文就是好论文。

这个思路移植到网上就是谁的网页被链接次数多,那个网页就被认为是质量高,人气旺。

在加上相应的链接文字分析,就可以用在搜索结果的排序上了。

这就引出了搜索引擎的第二定律:

人气质量定律。

根据这一定律,搜索结果的相关性排序,并不完全依赖于词频统计,而是更多地依赖于超链分析。

我意识到这是一个突破性的东西,回去以后就很快总结了思路,于96年6月申请了这一方面的美国专利。

1999年7月6号,美国专利和商标局批准了专利号为5,920,859的,以我为唯一发明人的专利。

大约在96年底,斯坦福大学计算机系的两位研究生也想到了同样的解决方法,他们后来创立了一个叫Google的搜索引擎,Google的网站上至今仍然说他们的这项技术是Patent-pending(专利申请中),不知道美国专利局是不是还会再批这样的专利。

Anyway,超链分析的方法98年以后逐渐被各大搜索引擎所接受,由于链接是网络内容的一个根本特性,这时候的搜索引擎才开始真正利用网络时代的检索技术。

世事难料,2000年起网络泡沫迅速破灭,各大搜索引擎要么遭人收购,要么推迟上市,所有使用人气质量定律的搜索引擎公司都未能幸免。

那么,搜索引擎的出路到底在哪儿?

第三定律自信心定律

人气质量定律解决的还是一个技术层面的问题,然而搜索引擎从诞生的那一天起,从来就不是一个纯技术现像,它融合了技术,文化,市场等各个层面的因素。

解决搜索引擎公司的生存和发展问题需要搜索引擎的第三定律--自信心定律。

1998年的时候,没有太多的人拿一家远在硅谷500英里以外,刚刚成立的,叫作GoT(现已更名为Overture)的公司当回事儿。

它不过是买了一个搜索引擎的技术服务,然后再向那些网站的拥有者们拍卖他们网站在GoTo检索结果中的排名,谁付的钱多,谁的网站就排在前面,而且付费是根据网民点击该网站的情况来计算的,仅仅在搜索结果中出现并不需要付费。

这就是自信心定律的最早实践者!

根据这一定律,搜索结果的相关性排序,除了词频统计和超链分析之外,更注重的是竞价拍卖。

谁对自己的网站有信心,谁就排在前面。

有信心的表现就是愿意为这个排名付钱。

需要声明的是,自信心定律也是我自己给这一模式起的名字,以前的文献中并没有人这样总结过。

今天,在网络业一片萧条,那斯达克风声鹤唳的时候,GoTo却如日中天,市值高达13亿美金,收入高达雅虎总收入的35%。

反观门户网站,有哪一个能从它们的搜索引擎服务中赚出总收入的三分之一呢?

究其原因,就是因为GoTo最早实践了搜索引擎的自信心定律。

以前的搜索引擎都是靠CPM来收费的,而CPM是从传统广告业借鉴过来的,没有考虑网络媒体即时性,交互性,易竞价的特点,而竞价排名,点击收费则是为网站拥有者直接提供销售线索,而不是传统意义上的广告宣传。

自信心定律一改过去搜索引擎靠CPM收钱的尴尬局面,开创了真正属于互联网的收费模式。

 

各类搜索网站

1、google

如果你的网站是新发布的,或是访问量较低的网站在内容更新时,很有必要主动提交到Google,这样会使网站资料迅速更新倒Google搜索资料库,让用户能及时搜索到你的最新资料。

登录地址:

2、baidu

baidu基本跟google差不多

登录地址:

3、ODP(开放式目录)

OpenDirectoryProject(ODP)是仅次于Yahoo的人工操作目录索引类搜索引擎。

与Yahoo不同的是,OpenDirectoryProject(ODP)的编辑人员均为志愿者,而非其雇员。

目前其志愿编辑人数已达数万人。

(Alexa、Google就使用的是此目录)

中国用户登录地址:

http:

//ch.dmoz.org/

4、yahoo

在雅虎主站登录和在雅虎中国登录网站都有免费的,操作步骤类似。

登录步骤:

(1)进入雅虎中国,

(2)在其左下角的"网站分类"模块中选择适合你网站的目录。

(3)点击"登录网站",按照提示填写信息即可。

5、sohu

搜狐只对非商业型网站,如政府机构,慈善机构,学校等,提供免费网站登录服务。

如果你的网站属于非商业型网站,那么赶快到搜狐免费登录。

商业网站(如:

商场、公司、电子商务等)就要花钱来登录了。

登录地址:

6、yisou

一搜是雅虎新推出的挑战google的搜索服务。

登录地址:

7、天网搜索

北大的搜索引擎,高校学生用得比较多。

登录地址:

8、搜狗

(1)进入搜狗网站分类目录,

(2)在其网站分类中选择适合你网站的目录

(3)点击搜索框右边"网站登录",按照提示填写信息即可

 

著名目录类搜索引擎

著名目录类搜索引擎(18)

Yahoo!

英文

Yahoo!

中文

Yahoo!

繁体中文

Google英文

Google中文

Google繁体中文

Alexa

新浪

网易

搜狐

新浪台北

Altavista

AOL

Hotbot

Lycos

Netscape

TEOMA

alltheweb

NorthernNight

中国大陆地区搜索引擎(263)

1.北极星

2.我是野虎

3.尤里卡中文智能搜索引擎

4.FM365

5.天下游

6.搜友搜索

7.搜鲸

8.1608搜网

9.海天搜索

10.香港之最搜索

11.新加坡世界华商网络

12.中国船业网

13.中华美食网

14.赛迪IT罗盘

15.绿色搜索引擎

16.可美特商务专员网搜索

17.千龙搜索引擎

18.hi中国强力搜索

19.999健康网搜索

20.出国在线搜索引擎

21.中华生物信息搜索引擎

22.山阳搜索引擎

23.金海网络搜索引擎

24.中国人口搜索引擎

25.金农企业搜索引擎

26.中国教育科研网搜索引擎

27.国信搜索引擎

28.精网盟

29.中华商埠

30.千禧搜索引擎

31.广州信息网网络导航

32.搜星搜索引擎

33.中国经济网站大全

34.政网搜索

35.CMP3商业网络

36.中国展区

37.雅格网络

38.中华特产搜索引擎

39.中国行业搜索引擎

40.商情网搜索引擎

41.163搜索

42.BESTFREE引擎

43.五行搜索引擎

44.中国黄页在线

45.中国搜易引擎

46.中文信息网

47.秀佳之窗搜索引擎

48.热点精选搜索

49.21在线信息咨询

50.中国电力搜索引擎

51.杭州联盟

52.数字永嘉

53.搜豹

54.秀佳搜索引擎

55.搜鼠中文搜索引擎

56.中华网-外经贸搜索引擎

57.印度asiaco搜索引擎

58.菲律宾yehey搜索引擎

59.台湾小蕃薯搜寻引擎

60.香港绿世界搜索引擎

61.中国市县区信息网

62.滔滔品网

63.中国国情网

64.瑞星搜索

65.云南信息港

66.顶尖珠宝网

67.浩瀚搜索

68.耍网搜索

69.宽网空间

70.中国化学化工网搜索引擎

71.惠州搜索引擎

72.八闽农网搜索

73.中国漳州商业网搜索

74.问蝶网探搜索引擎

75.女士网

76.台中全球咨询网搜索引擎

77.中国国际贸易发展网搜索

78.无忧电子集成网搜索

79.豫思网络搜索

80.江苏阜宁人搜索引擎

81.我要搜索

82.金意软件搜索

83.香港建材搜索引擎

84.九能搜索引擎

85.阳江网站搜索

86.导医网搜索

87.cy频道搜索

88.商务地带搜索

89.猎网

90.教育部网上合作研究中心搜索

91.中国鞋业资源网

92.长安游侠搜索

93.companybtob搜索

94.电梯商务信息网

95.中兴高中搜索

96.成都市金牛区搜索

97.数码2000搜索

98.育星搜索

99.中国啤酒网上行搜索

100.迈博搜索

101.中国医药网站搜索引擎

102.Yiuwa搜索

103.中国宠物网搜索

104.TV俱乐部搜索

105.振中搜索2000

106.工程造价信息搜索

107.月饼中文资讯网搜索

108.厦门永兴搜索

109.南京教育信息网搜索

110.闽南艺术网

111.FM365XX26321CNTOM搜狐

112.7758搜索引擎

113.马坡岭农业搜索引擎

114.龙虎家居搜索

115.蓝帆搜索

116.中国产权交易网

117.中国农大搜索

118.逸星搜索

119.海宁信息港

120.珠海工程搜索

121.眼镜信息搜索引擎

122.福建导航

123.河北省总商会海湾信息网

124.314旅游网搜索

125.中国厦门网站搜索

126.中国用户搜索引擎

127.中国设计网搜索引擎

128.特殊教育网搜索引擎

129.齐隆搜索

130.高手网络

131.汉都搜索引擎

132.时空引擎-中国贵州省

133.高密外经贸信息网

134.亚洲在线

135.湖北教育

136.网上律师

137.台州新干线

138.大台湾网搜寻

139.襄阳风日

140.新疆网络

141.企业搜索引擎

142.袋鼠超市网搜索

143.音乐共和搜索

144.中国经济学人搜索引擎

145.风网搜索

146.浙江法律咨询网搜索

147.足彩世界-足球网址收藏

148.搜趣网

149.中国168信息网

150.超市网搜索引擎

151.信仰搜索

152.蓝芒搜索

153.南京财经大学搜索引擎

154.荣华水产搜索

155.法网搜索引擎

156.易想网

157.中央音乐学院搜索引擎

158.徐州指南搜索引擎

159.北京在线搜索引擎

160.冀南热线搜索引擎

161.方圆网

162.夏氏礼品搜索

163.电影网搜索引擎

164.无限资讯搜索引擎

165.音响世界企业信息网

166.榆林网搜索

167.1972s搜索引擎

168.中国药学会医药导航

169.视点在线搜索

170.神州网盟

171.新西兰全方位资讯网

172.杰科搜索

173.君临人力资源搜索

174.厦门信息导航中心

175.6917搜索

176.圣火暖通网搜索

177.袋鼠超市网

178.人力资源引擎

179.纸业资讯网搜索引擎

180.中国集藏在线搜索

181.中国网腾公众信息网

182.浙江法律咨询网

183.青浦企业信息网搜索引擎

184.中华企业信息网搜索引擎

185.千度搜索引擎

186.易润搜索

187.透明的心搜索

188.一路签搜索引擎

189.浙江玉环商务网搜索

190.绿色资讯网

191.中国考研情报中心搜索引擎

192.中国好运河搜索

193.广告人搜索引擎

194.51555搜索

195.朝日网搜索

196.微远商业网

197.东方电子商务网

198.中世商务网搜索

199.中业网搜索

200.连州在线搜索

201.5m5m搜索

202.胶州搜索

203.天网信息港

204.慈溪企业网

205.以太搜索

206.中国包装在线搜索引擎

207.东方商贸网

208.碧云DJ行搜索引擎

209.TBO搜索引擎

210.万达企业网

211.城市在线搜索

212.人大学生网

213.中国纸业网搜索引擎

214.深圳超市网

215.安庆信息网搜索引擎

216.扬州导航

217.徐州金网

218.爱之源网络

219.商业企业网搜索

220.白垩纪搜索引擎

221.江苏人搜索

222.中国编程网搜索引擎

223.泰达搜索引擎

224.甘肃省计算中心

225.热讯网搜索

226.6A6A6.COM

227.数字鞍山

228.人到中年搜索引擎

229.上海科技网搜索引擎

230.亮亮电子搜索

231.衢州信息港

232.怡海电脑搜索

233.极限科技

234.中原信息网

235.HH521.COM

236.遨空搜索

237.大自在网络

238.浙江热线

239.闽南信息网

240.网镜搜索

241.龙港都市频道

242.慈溪工商网

243.微网搜索

244.巢湖信息港搜索引擎

245.日月咨询网

246.CMT搜索引擎

247.长城热线

248.FLASH动感音符搜索引擎

249.中国学生网

250.VIDEO搜索

251.丝绸之路旅游网搜索引擎

252.中国SMT信息网

253.吕梁之窗

254.锡林郭勒经济技术开发区

255.晨曦热线

256.中国假日搜索引擎

257.蔡进视窗

258.陆丰公众信息网

259.佳人互动资源网

260.动态网站制作指南搜索引擎

261.三门峡搜索引擎

262.中国柳市网

263.揭阳商业网

香港、台湾、澳门地区搜索引擎(56)

1.巴辣香港搜索器

2.香港网中网

3.香港之最搜索

4.PCHOME搜索

5.MIT国际网络咨询中心

6.香港搜索器

7.香港Y28网站导航

8.WEBINHK搜索引擎

9.GAIS搜索器

10.台湾COO索引

11.HINET搜索

12.openfind搜索引擎

13.台湾小蕃薯搜寻引擎

14.香港绿世界搜索引擎

15.育德全球咨询网搜索

16.CC-NET中文网站搜索引擎

17.艺术笔记网搜索引擎

18.SppHome搜索引擎

19.25H.COM.TW

20.哈玛星球搜索

21.琦景优质生活网

22.台湾电动车搜索

23.香港建材搜索引擎

24.台湾商业广场

25.香港邹几教育网艘

26.台湾Commerce搜索引擎

27.井利搜索

28.台北医学资讯搜7D22完整

29.天空搜索

30.城市之星搜索

31.台湾龙山搜索

32.光堡高尔夫旅游网

33.极易搜

34.国立中正大学搜索引擎

35.光堡冷冻空调技术网搜索引擎

36.我们的网站搜索引擎

37.CNSLOT搜索引擎

38.数位管理导航中心

39.香港双子公园

展开阅读全文
相关资源
猜你喜欢
相关搜索

当前位置:首页 > 法律文书 > 调解书

copyright@ 2008-2022 冰豆网网站版权所有

经营许可证编号:鄂ICP备2022015515号-1