mobile wallpaper 1
1882 字
5 分钟
网络信息资源与信息组织
2026-06-28

网络信息资源#

  • 网络信息资源(或虚拟信息资源):以数字化形式记录、多媒体形式表达,存储在介质上,并通过计算机网络通讯方式传递的信息内容集合。简言之,即通过网络可利用的信息资源总和。
  • 类型
    • 按信息来源:政府、公共、商用信息资源。
    • 按信息内容:网络资源指南和搜索引擎、联机馆藏目录、网络数据库、电子出版物、网上参考工具书等。
    • 按网络传输协议:WWW、Telnet、FTP 等。

为了更好地利用海量的网络信息资源,必须对其进行有效的组织与管理。

网络信息组织#

  • 含义:对网络信息资源进行有序化,使其有利于信息用户利用的过程。
  • 组织方式
    • 超文本Hypertext):非线性文本。以节点为基本单位,节点间通过链接点相连,将信息组织为网状结构。
    • Web2.0:注重用户的交互作用,用户既是内容的浏览者,也是制造者。常见形式包括博客(Blog)、维基(Wiki)、标签(Tag)、社会性网络服务(SNS)、简易信息集合(RSS)、对等网(P2P)等。

随着网络资源的爆炸式增长,依靠有效的检索工具来获取信息变得尤为重要。

7.2 网络信息检索工具与检索方法#

网络信息检索工具#

  • 定义:在因特网上提供信息检索服务的计算机系统,检索对象是各种类型的网络信息资源。
  • 类型
    • 检索机制:分类目录型、搜索引擎型、混合型。
    • 检索范围:综合型、专题型、特殊型。
  • 功能:精确构造检索提问、按相关度排列结果、关键词检索与分类浏览结合、多语种翻译等。

掌握了检索工具的基本分类和功能后,我们还需要了解常见的检索方法。

网络信息检索方法#

  • 基于超文本的信息浏览
  • 基于网络资源目录的信息查询
  • 基于搜索引擎的信息检索

在所有的检索方法中,搜索引擎无疑是应用最为广泛的一种工具。

7.3 网络搜索引擎的应用#

网络搜索引擎的工作原理#

  • 搜索引擎Search Engine)一般由采集器分析器索引器检索器用户接口组成。
  • 工作机制:通过网上机器人(SpiderRobot)自动采集网页数据并建立索引数据库。当用户通过接口输入查询时,检索器在索引库中查找并按相关度反馈结果。

网络搜索引擎的类型#

  • 按检索语言:关键词型、分类型、混合型。
  • 按检索功能:目录型、全文型。
  • 按搜索方式:独立搜索引擎、元搜索引擎(Meta Search Engine)。
  • 按运营方式:综合搜索引擎、门户搜索引擎、垂直搜索引擎。

常见的搜索引擎包括 Google、Yahoo!、Bing 及国内的百度。熟练使用百度的特色搜索语法(如 intitle:site:filetype: 等)能够大幅提高检索效率。而在学术研究中,我们往往还需要获取专业的学术资源。

7.4 免费学术信息资源的分布与获取#

学术资源的分布广泛,集中在教育机构、科研院所、出版机构、图书馆、数据库开发商网站以及学术论坛等。 获取的内容涵盖免费工具书、图书、期刊、报纸、政府出版物、学位论文、专利及标准信息。

在免费学术资源中,开放存取(OA)资源占据着举足轻重的地位。

开放存取信息资源#

  • 含义开放存取Open Access, OA)指用户可以通过 Internet 免费阅读、下载、复制、传播数字化学术资源,不受经济限制。
  • 核心区别:传统模式为读者付费模式,而开放存取通常采用作者付费模式,向读者无偿提供。
  • 发布形式与获取途径:涵盖开放存取期刊(如 DOAJ )、开放存取知识库、门户网站(如 Google Scholar )以及个人博客等。

除了上述能够被轻易搜寻的资源外,互联网底层还潜藏着大量难以直接触达的深层信息。

7.5 看不见的网络及其检索利用#

看不见的网络及其成因#

  • 定义看不见的网络Deep Web,深网、暗资源),指在互联网上可获得,但未能被通用搜索引擎建立索引的高质量、权威性信息资源。
  • 成因
    1. 技术障碍:搜索引擎无法处理非文本文件、动态网页,或无法检索无外部链接的页面。
    2. 访问限制:存在 Spider 陷阱,或受到网站协议、索引深度的限制。
    3. 用户局限:用户的检索期望过高或检索技能不足。
  • 特点:数量巨大、主题精深、信息权威精准且往往免费。

为了挖掘这些深网资源,我们需要掌握特定的检索手段。

看不见的网络的利用#

  • 利用一般搜索引擎进行“间接”查找。
  • 增加专业的数据库检索软件或附件。
  • 利用专业主题目录指南(如 Librarians’Index to the Internet )。
  • 利用专业搜索引擎(如 Scirus )。
  • 利用针对深网的导航网站。

通过对网络资源和检索工具的系统学习,我们可以结合具体实例来进行综合应用与实战。

7.6 综合检索实例及分析#

以**“国内外微型飞行器的研究机构和项目”**为例:

  1. 分析检索课题:明确微型飞行器(Micro Air Vehicle, MAV)的概念,提炼核心概念。
  2. 制定检索策略与选择系统:拟定检索词(如微型飞行器、MAVflying insect robots 等),选用百度、Google Scholar、Yahoo! 等中英文平台。
  3. 实施检索与整理结果:筛选出核心结果。例如,提取出南京航空航天大学的“仿鸟微型扑翼飞行器”、加州理工大学的“微船”等具体的机构与研究项目。

复习卡片#

  1. 什么是网络信息资源?在网络信息组织中,Web2.0 相较于传统组织方式有什么本质特征?
  2. 简述搜索引擎Search Engine)的五大核心组成部分及其基本工作原理。
  3. 什么是开放存取Open Access)?它与传统的学术信息获取模式最大的区别在哪里?
  4. 什么是看不见的网络Deep Web)?请列举至少两种利用此类深层网络资源的方法。
分享

如果这篇文章对你有帮助,欢迎分享给更多人!

网络信息资源与信息组织
https://blog.sopak.space/posts/study/computer-science/ir-wdm/7/
作者
Xxxhite
发布于
2026-06-28
许可协议
CC BY-NC-SA 4.0

部分信息可能已经过时

目录