高等教育 > 专著
数字人文导论
书号:9787113323387 套系名称:无
作者:刘忠宝 赵文娟 出版日期:2025-08-01
定价:58.00 页码 / 开本:无 /16
策划编辑:王春霞 责任编辑:王春霞 许璐
适用专业:专著 适用层次:高等教育
最新印刷时间:2025-09-01
资源下载
内容简介
前言
目录
作者介绍
图书特色
-
近年来, 数字人文作为人文科学、 社会科学与计算机科学交叉的新兴领域备受关注。 本书全面论述其理论方法与实践路径, 内容包括数字人文理论 (基本概念、 研究进展、 数据来 源等)、 数字人文方法 (数据组织、 文本挖掘、 GIS 与可视化、 社交网络等) 与数字人文实践(数据采集、 文本挖掘、 可视化分析、 社交网络等)。 本书可作为高等院校人文社科专业、 计算机科学与技术等专业本科生及研究生的教材或参考书, 也适合对数字人文感兴趣的跨学科研究人员、 图书馆与文博机构专业人员阅读参考。
-
数字人文作为人文科学、 社会科学与计算机科学等领域深度交叉融合而形成的新兴研究领域, 正以前所未有的广度和深度改变着传统人文学术的研究范式、 知识生产与传播方式。 它不仅为经典的人文问题提供了新的研究视角和分析工具, 也催生了诸多全新的研究议题。 面对这一充满活力与挑战的领域, 越来越多的学生、 学者以及文化机构从业者渴望系统地了解其理论基础, 掌握其核心方法, 并投身于相关的研究与实践。 然而, 数字人文知识体系庞杂, 技术方法更新迅速, 目前能够兼顾理论深度、 方法广度与实践操作的系统性著作和教材仍相对缺乏。 许多有志于进入该领域的人员, 常常在浩瀚的概念、 工具和案例面前感到无所适从。 为满足广大人文社科及相关专业师生、 研究人员以及图书馆、 博物馆、 档案馆等机构从业人员系统了解数字人文知识、 掌握基本研究技能的需求, 我们著述了本著作。 本书内容力求全面系统、 循序渐进, 共分为三篇:第一篇 “数字人文理论” (第 1~3 章), 旨在奠定数字人文理论基础。 内容涵盖人文与人文科学、 人文计算等基本概念的辨析, 数字人文概念、 发展阶段、理论与技术方法研究现状。 第二篇 “数字人文方法” (第 4~7 章), 聚焦于数字人文核心方法。 详细论述了面向数字人文的知识组织方法 (含开源语料库、 开放知识库、 专题数据库及网络资源等), 面向数字人文的文本挖掘技术 (含文本分类、 聚类、 信息抽取、 情感分析与观点挖掘等), 地理信息系统 (GIS) 的关键技术与数据可视化方法 (含文本可视化、 社会网络可视化), 以及社交网络分析的主要理论与度量指标 (如凝聚子群分析、 中心性分析、 核心-边缘结构分析等)。 第三篇 “数字人文实践” (第 8~11 章), 侧重于数字人文实践应用。 通过一系列精心设计的实验案例, 引导读者学习使用 Python 爬虫、 Protégé、 NLTK、spaCy、 Gensim、 GuwenBERT、 QGIS、 ArcGIS、 Neo4j、 Gephi、 NetworkX 等工具,亲身实践数据采集、 本体构建、 古诗情感分析、 命名实体识别、 GIS 数据处理与可视化、 社交网络构建与分析等典型任务。 本书主要具有以下特点: 体系完整, 结构清晰: 本书遵循 “理论基础—核心方法—实践应用” 的逻辑结构, 由浅入深, 层次分明, 以帮助读者构建完整的数字人文知识框架。 内容全面, 覆盖核心: 本书既包含对数字人文基本概念和理论发展脉络的梳理, 也深入介绍了文本挖掘、 GIS 与可视化、 社交网络分析等当前数字人文研究的核心方法论。 实践导向, 注重应用: 本书特设 “数字人文实践” 篇, 提供详尽的实验步骤和代码示例 (涉及工具和具体操作), 强调学以致用, 着力培养读者的实际操作能力, 这是本书的重要亮点。 案例丰富, 工具前沿: 本书结合具体研究问题设计实验案例, 如历史人物数据处理、 古诗情感分析等, 并介绍了多种在学术界和业界广泛使用的数据处理、 分析及可视化工具。 本书由刘忠宝、 赵文娟著, 张博文、 万广文参与著述, 具体分工如下: 刘忠宝著述第一篇和全书统稿, 赵文娟著述第二篇, 张博文、 万广文负责第三篇的实验设计与著述等。 本成果受北京语言大学中央高校基本科研业务费专项资金资助 (项目批准号: 24HQ02)。 同时, 张习文教授对本书的框架设计和内容撰写给予了悉心指导; 著者参考和借鉴了国内外数字人文领域众多学者的研究成果。 在此一并表示衷心的感谢。 感谢中国铁道出版社有限公司王春霞副编审在本书出版过程中付出的辛勤劳动和提出的宝贵意见。 此外, 还要感谢参与本书部分内容调研和实验测试的王起扬、 任东海两位同学。 数字人文领域发展日新月异, 知识与技术不断更新。 限于著者的学识水平和经验, 书中难免存在疏漏和不足之处, 恳请广大读者批评指正, 以便我们在后续修订中不断完善。 我们衷心希望本书能为读者开启数字人文探索之门, 激发研究兴趣, 为其学习和研究工作提供切实的帮助。 著 者 2025 年 5 月
-
第一篇 数字人文理论 第 1 章 数字人文基本概念 2 1. 1 人文与人文科学 2 1. 2 人文计算 5 1. 3 数字人文 6 1. 4 人文计算与数字人文 11 第 2 章 数字人文研究进展 14 2. 1 数字人文发展阶段 14 2. 2 数字人文理论研究 18 2. 3 数字人文技术与方法研究 19 2. 4 数字人文服务研究 21 2. 4. 1 服务模式 21 2. 4. 2 资源导航 22 2. 4. 3 工具应用 22 2. 4. 4 数字保存 23 2. 4. 5 元数据管理 23 2. 4. 6 学术评价 23 2. 4. 7 数字人文教育 24 2. 5 数字人文实践研究 25 2. 5. 1 数字人文基础设施建设 25 2. 5. 2 数字人文专题库建设 25 第 3 章 数字人文数据来源 27 3. 1 开源语料库 27 3. 1. 1 语料库的概念 27 3. 1. 2 语料库的特点 28 3. 1. 3 代表性语料库 28 3. 2 开放知识库 29 3. 2. 1 知识库的概念 29 3. 2. 2 知识库的特点 30 3. 2. 3 代表性知识库 30 3. 3 专题数据库 32 3. 3. 1 专题数据库的概念 32 3. 3. 2 代表性专题数据库 33 3. 4 网络资源 34 3. 4. 1 网络爬虫的概念与分类 34 3. 4. 2 网络爬虫框架 35 3. 4. 3 网络爬虫工作流程 35 第二篇 数字人文方法 第 4 章 面向数字人文的数据组织 37 4. 1 本体 37 4. 1. 1 本体概念 37 4. 1. 2 本体理论 39 4. 1. 3 本体构建 41 4. 2 关联数据 43 4. 2. 1 关联数据概念 43 4. 2. 2 资源描述框架 44 4. 2. 3 关联数据创建与发布 45 4. 2. 4 关联数据应用机制 46 4. 2. 5 关联数据在数字人文中的应用 47 4. 3 语义网 48 4. 3. 1 语义网概念 48 4. 3. 2 语义网体系结构 48 4. 3. 3 语义网开发框架 51 4. 4 数据库 52 4. 4. 1 数据库概念 52 4. 4. 2 关系型数据库 53 4. 4. 3 非关系型数据库 54 4. 4. 4 关系型数据库和非关系型数据库的比较 55 第 5 章 面向数字人文的文本挖掘 57 5. 1 文本挖掘框架 57 5. 1. 1 文本数据获取 58 5. 1. 2 文本预处理 58 5. 1. 3 文本挖掘 58 5. 1. 4 知识模式评估 59 5. 1. 5 模式输出 59 5. 2 文本分类 59 5. 2. 1 传统分类算法 60 5. 2. 2 深度神经网络方法 62 5. 3 文本聚类 68 5. 3. 1 文本相似性度量 68 5. 3. 2 k-均值聚类 69 5. 3. 3 层次聚类 71 5. 4 文本信息抽取 72 5. 4. 1 命名实体识别 72 5. 4. 2 关系抽取 78 5. 4. 3 事件抽取 82 5. 5 情感分析与观点挖掘 86 5. 5. 1 基于情感词典的方法 86 5. 5. 2 基于机器学习的方法 88 5. 5. 3 基于深度学习的方法 88 第 6 章 面向数字人文的 GIS 与可视化 90 6. 1 相关研究 90 6. 2 GIS 92 6. 2. 1 系统组成 92 6. 2. 2 主要功能 94 6. 2. 3 关键技术 95 6. 2. 4 技术优势 98 6. 3 数据可视化 99 6. 3. 1 基本概念 99 6. 3. 2 可视化图 100 6. 3. 3 虚拟现实技术 101 6. 4 文本可视化 102 6. 4. 1 处理流程 102 6. 4. 2 可视化类型 103 6. 4. 3 实现方式 103 6. 5 社会网络可视化 106 6. 5. 1 基本概念 106 6. 5. 2 技术分类 107 6. 5. 3 可视化工具 108 第 7 章 面向数字人文的社交网络 110 7. 1 基本概念 111 7. 1. 1 社交网络 111 7. 1. 2 社交网络分析 111 7. 2 相关研究 114 7. 3 凝聚子群分析 115 7. 3. 1 凝聚子群的分类 116 7. 3. 2 凝聚子群密度 118 7. 4 中心性分析 118 7. 4. 1 点度中心性 119 7. 4. 2 中间中心性 121 7. 4. 3 接近中心性 122 7. 5 核心-边缘结构分析 123 7. 5. 1 离散的核心-边缘结构模型 124 7. 5. 2 连续的核心-边缘结构模型 124 第三篇 数字人文实践 第 8 章 面向数字人文的数据采集与数据组织实验 126 8. 1 数据采集与数据组织工具 126 8. 1. 1 数据采集工具 127 8. 1. 2 数据组织工具 132 8. 2 利用 Python 爬虫爬取历史人物数据 138 8. 2. 1 实验目的 138 8. 2. 2 实验思路 138 8. 2. 3 实验准备 138 8. 2. 4 实验步骤 139 8. 3 中国古代历史人物本体构建 143 8. 3. 1 实验目的和意义 143 8. 3. 2 实验准备 143 8. 3. 3 实验步骤 143 第 9 章 面向数字人文的文本挖掘实验 151 9. 1 面向数字人文的文本挖掘工具 151 9. 1. 1 NLTK 152 9. 1. 2 spaCy 153 9. 1. 3 Gensim 154 9. 1. 4 GuwenBERT 简介 155 9. 2 面向数字人文的古诗情感分析 157 9. 2. 1 实验目的和意义 157 9. 2. 2 实验准备 157 9. 2. 3 实验步骤 158 9. 3 面向数字人文的命名实体识别 167 9. 3. 1 实验目的和意义 167 9. 3. 2 实验准备 167 9. 3. 3 实验步骤 168 第 10 章 面向数字人文的 GIS 与可视化实验 183 10. 1 GIS 与可视化工具 183 10. 1. 1 QGIS 184 10. 1. 2 ArcGIS 187 10. 2 面向数字人文的 GIS 190 10. 2. 1 实验目的和意义 190 10. 2. 2 实验步骤 191 10. 3 面向数字人文的文本可视化 196 10. 3. 1 词云 196 10. 3. 2 文本地图 201 第 11 章 面向数字人文的社交网络实验 206 11. 1 社交网络工具 206 11. 1. 1 Neo4j 206 11. 1. 2 Gephi 209 11. 1. 3 NetworkX 211 11. 2 面向数字人文的社交网络构建 213 11. 2. 1 实验目的和意义 213 11. 2. 2 实验步骤 214 11. 3 面向数字人文的社交网络分析 223 11. 3. 1 实验目的和意义 223 11. 3. 2 人物中心性分析 223 11. 3. 3 凝聚子群分析 225 参考文献 228
-
刘忠宝,男,就职于北京语言大学信息科学学院,博士,教授,博士生导师,博士后合作导师。中国科技情报学会青年人才工作委员会委员、中国计算机学会计算机应用专委会委员,福建省语言文字专家库成员,国家社会科学基金项目、教育部人文社会科学研究项目同行评议专家,《情报工程》、《计算机应用研究》编委,《Information Processing & Management》、《Information Sciences》等多个权威期刊审稿人。国内外权威期刊发表学术论文80余篇,出版学术专著4部,授权国家发明专利6项。主持国家社科基金项目重点项目、一般项目、后期资助项目、青年项目以及教育部人文社科项目等国家级、省部级等各类项目30余项。 赵文娟,情报学硕士,就职于北京语言大学图书馆,副教授,图情专业硕士生导师;有10余年教学经历,主带课程《离散数学》、《计算机基础》、《信息系统项目管理》;主要从事信息管理、知识服务、数字人文等方面的研究工作,在数字图书馆、政府信息治理方面也做了一些探索性研究。近10年在CSSCI核心期刊上发表学术论文近20篇;主持山西省科技厅软科学项目1项、福建省社科基金1项、作为主要成员参与国家社科项目3项,参与其他各类课题10余项;编写学术专著1部,获批国家实用新型专利2项。
-
本书:体系完整, 结构清晰;内容全面, 覆盖核心;实践导向, 注重应用;案例丰富, 工具前沿。
