1882 字
5 分钟
网络信息资源与信息组织
网络信息资源
- 网络信息资源(或虚拟信息资源):以数字化形式记录、多媒体形式表达,存储在介质上,并通过计算机网络通讯方式传递的信息内容集合。简言之,即通过网络可利用的信息资源总和。
- 类型:
- 按信息来源:政府、公共、商用信息资源。
- 按信息内容:网络资源指南和搜索引擎、联机馆藏目录、网络数据库、电子出版物、网上参考工具书等。
- 按网络传输协议:WWW、Telnet、FTP 等。
为了更好地利用海量的网络信息资源,必须对其进行有效的组织与管理。
网络信息组织
- 含义:对网络信息资源进行有序化,使其有利于信息用户利用的过程。
- 组织方式:
- 超文本(
Hypertext):非线性文本。以节点为基本单位,节点间通过链接点相连,将信息组织为网状结构。 - Web2.0:注重用户的交互作用,用户既是内容的浏览者,也是制造者。常见形式包括博客(
Blog)、维基(Wiki)、标签(Tag)、社会性网络服务(SNS)、简易信息集合(RSS)、对等网(P2P)等。
- 超文本(
随着网络资源的爆炸式增长,依靠有效的检索工具来获取信息变得尤为重要。
7.2 网络信息检索工具与检索方法
网络信息检索工具
- 定义:在因特网上提供信息检索服务的计算机系统,检索对象是各种类型的网络信息资源。
- 类型:
- 检索机制:分类目录型、搜索引擎型、混合型。
- 检索范围:综合型、专题型、特殊型。
- 功能:精确构造检索提问、按相关度排列结果、关键词检索与分类浏览结合、多语种翻译等。
掌握了检索工具的基本分类和功能后,我们还需要了解常见的检索方法。
网络信息检索方法
- 基于超文本的信息浏览
- 基于网络资源目录的信息查询
- 基于搜索引擎的信息检索
在所有的检索方法中,搜索引擎无疑是应用最为广泛的一种工具。
7.3 网络搜索引擎的应用
网络搜索引擎的工作原理
- 搜索引擎(
Search Engine)一般由采集器、分析器、索引器、检索器和用户接口组成。 - 工作机制:通过网上机器人(
Spider或Robot)自动采集网页数据并建立索引数据库。当用户通过接口输入查询时,检索器在索引库中查找并按相关度反馈结果。
网络搜索引擎的类型
- 按检索语言:关键词型、分类型、混合型。
- 按检索功能:目录型、全文型。
- 按搜索方式:独立搜索引擎、元搜索引擎(
Meta Search Engine)。 - 按运营方式:综合搜索引擎、门户搜索引擎、垂直搜索引擎。
常见的搜索引擎包括 Google、Yahoo!、Bing 及国内的百度。熟练使用百度的特色搜索语法(如 intitle:、site:、filetype: 等)能够大幅提高检索效率。而在学术研究中,我们往往还需要获取专业的学术资源。
7.4 免费学术信息资源的分布与获取
学术资源的分布广泛,集中在教育机构、科研院所、出版机构、图书馆、数据库开发商网站以及学术论坛等。 获取的内容涵盖免费工具书、图书、期刊、报纸、政府出版物、学位论文、专利及标准信息。
在免费学术资源中,开放存取(OA)资源占据着举足轻重的地位。
开放存取信息资源
- 含义:开放存取(
Open Access,OA)指用户可以通过 Internet 免费阅读、下载、复制、传播数字化学术资源,不受经济限制。 - 核心区别:传统模式为读者付费模式,而开放存取通常采用作者付费模式,向读者无偿提供。
- 发布形式与获取途径:涵盖开放存取期刊(如
DOAJ)、开放存取知识库、门户网站(如Google Scholar)以及个人博客等。
除了上述能够被轻易搜寻的资源外,互联网底层还潜藏着大量难以直接触达的深层信息。
7.5 看不见的网络及其检索利用
看不见的网络及其成因
- 定义:看不见的网络(
Deep Web,深网、暗资源),指在互联网上可获得,但未能被通用搜索引擎建立索引的高质量、权威性信息资源。 - 成因:
- 技术障碍:搜索引擎无法处理非文本文件、动态网页,或无法检索无外部链接的页面。
- 访问限制:存在
Spider陷阱,或受到网站协议、索引深度的限制。 - 用户局限:用户的检索期望过高或检索技能不足。
- 特点:数量巨大、主题精深、信息权威精准且往往免费。
为了挖掘这些深网资源,我们需要掌握特定的检索手段。
看不见的网络的利用
- 利用一般搜索引擎进行“间接”查找。
- 增加专业的数据库检索软件或附件。
- 利用专业主题目录指南(如
Librarians’Index to the Internet)。 - 利用专业搜索引擎(如
Scirus)。 - 利用针对深网的导航网站。
通过对网络资源和检索工具的系统学习,我们可以结合具体实例来进行综合应用与实战。
7.6 综合检索实例及分析
以**“国内外微型飞行器的研究机构和项目”**为例:
- 分析检索课题:明确微型飞行器(
Micro Air Vehicle,MAV)的概念,提炼核心概念。 - 制定检索策略与选择系统:拟定检索词(如微型飞行器、
MAV、flying insect robots等),选用百度、Google Scholar、Yahoo! 等中英文平台。 - 实施检索与整理结果:筛选出核心结果。例如,提取出南京航空航天大学的“仿鸟微型扑翼飞行器”、加州理工大学的“微船”等具体的机构与研究项目。
复习卡片
- 什么是网络信息资源?在网络信息组织中,
Web2.0相较于传统组织方式有什么本质特征? - 简述搜索引擎(
Search Engine)的五大核心组成部分及其基本工作原理。 - 什么是开放存取(
Open Access)?它与传统的学术信息获取模式最大的区别在哪里? - 什么是看不见的网络(
Deep Web)?请列举至少两种利用此类深层网络资源的方法。
分享
如果这篇文章对你有帮助,欢迎分享给更多人!
部分信息可能已经过时
相关文章 猜你想看
1
信息检索与Web数据挖掘 - 课程大纲与总结
信息检索与Web数据挖掘 信息检索与Web数据挖掘课程的完整大纲与核心知识点总结,涵盖信息资源、检索策略、各类数据库及网络爬虫等内容。
2
网络爬虫
信息检索与Web数据挖掘 网络爬虫是数据获取的重要手段。本节从基本原理、实战应用到法律道德问题,全面梳理网络爬虫的知识体系。
3
信息的综合利用
信息检索与Web数据挖掘 本章主要涵盖了科研信息处理的全流程,从信息的搜集、整理与分析,到学术论文、文献综述及开题报告的撰写,并强调了学术规范与文献管理工具的使用。
4
检索步骤与检索策略
信息检索与Web数据挖掘 在完成了信息检索的基础理论学习后,我们需要进一步探讨具体的检索步骤和馆藏资源的实际应用。
5
外文数据库与专利检索
信息检索与Web数据挖掘 在掌握了基础的文献检索后,我们还可以利用专门的数据库获取学位论文和专利信息。

