From f3900ae78e84e28b238387061a3feffcca9140a3 Mon Sep 17 00:00:00 2001 From: xiaopeng <1509442308@qq.com> Date: Sat, 30 May 2026 12:44:16 +0800 Subject: [PATCH] =?UTF-8?q?untrack:=20Gitea=20=E4=B8=8D=E5=86=8D=E8=BF=BD?= =?UTF-8?q?=E8=B8=AA=20latex=EF=BC=8C=E7=94=B1=20Overleaf=20=E7=8B=AC?= =?UTF-8?q?=E7=AB=8B=E7=AE=A1=E7=90=86?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- officefile/latex/.gitignore | 2 - officefile/latex/2026_KG_ICH.bib | 785 --------------------- officefile/latex/main.tex | 1106 ------------------------------ 3 files changed, 1893 deletions(-) delete mode 100644 officefile/latex/.gitignore delete mode 100644 officefile/latex/2026_KG_ICH.bib delete mode 100644 officefile/latex/main.tex diff --git a/officefile/latex/.gitignore b/officefile/latex/.gitignore deleted file mode 100644 index 034a873..0000000 --- a/officefile/latex/.gitignore +++ /dev/null @@ -1,2 +0,0 @@ -# Overleaf 同步目录(Git Bridge 独立管理) -# 此文件仅标识 latex/ 由 Overleaf 管理,忽略规则已在根 .gitignore 中配置 diff --git a/officefile/latex/2026_KG_ICH.bib b/officefile/latex/2026_KG_ICH.bib deleted file mode 100644 index 53a48da..0000000 --- a/officefile/latex/2026_KG_ICH.bib +++ /dev/null @@ -1,785 +0,0 @@ -@article{2F3PRYB4, - title = {大语言模型强化学习驱动的文化遗迹叙事文本语义组织方法研究}, - author = {{张卫} and {高鑫} and {张予歌}}, - date = {2025-12-09}, - journaltitle = {图书情报工作}, - issn = {0252-3116}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CAPJ&dbname=CAPJLAST&filename=TSQB20251208001}, - urldate = {2026-03-13}, - abstract = {[目的 /意义]文化遗迹叙事文本是我国重要的文物数据资源,利用AIGC技术挖掘与组织叙事文本内的事件语义特征,对于文化遗产数字记忆保护与开发具有重要意义。[方法 /过程]在大语言模型强化学习驱动下提出基于事件本体的文化遗迹叙事文本语义组织方法。首先,综合专家智慧与文本特征进行事件概念揭示与知识单元重组,归纳遗迹叙事文本中核心元数据形成遗迹事件本体;基于DeepSeek深度思考范式进行事件抽取冷启动以获取伪标签,引入人智协同思维对各任务问答语料进行质量优化;重点针对事件抽取的任务框架设计高效自适应的奖励函数,并通过组内相对优势计算探索事件提及抽取、事件分类、事件论元识别等大模型强化学习的有效性。[结果 /结论 ]经过群体相对策略优化的DeepSeek-R1-Distill-Qwen-32B蒸馏模型分别在事件提及抽取(BLEU_1=80.21\%、ROUGE-1-F\textsubscript{1}=84.64\%)与事件论元识别(F\textsubscript{1}=78.90\%)任务取得最佳实践,强化后的QwQ-32B在事件分类任务上更具优势(ACC=86.09\%);经过实体消歧与共指消解能够进一步优化事件知识图谱的质量,从历史情节分析、人物知识谱系、时空耦合分析方面实现文化遗迹数字叙事服务。}, - langid = {chinese}, - pubstate = {advance online publication}, - keywords = {大语言模型,强化学习,事件抽取,数字人文,文化遗迹,语义组织}, - annotation = {original-container-title: Library and Information Service\\ -foundation: 国家自然科学基金青年项目“事件情感知识关联驱动下文化遗迹数字记忆重构模式研究”(项目编号:72404131); 江苏省社会科学基金青年项目“历代经典诗作隐喻的跨语言知识组织及应用研究”(项目编号:24TQC009)的研究成果之一;\\ -album: 信息科技;经济与管理科学;哲学与人文科学\\ -CLC: K87;TP391.1;TP18\\ -dbcode: CAPJ\\ -dbname: CAPJLAST\\ -filename: TSQB20251208001\\ -publicationTag: 北大核心, JST, AMI权威, CSSCI\\ -CIF: 4.608\\ -AIF: 3.514}, - file = {F:\Zotero\storage\S65UXEN3\大语言模型强化学习驱动的文化遗迹叙事文本语义组织方法研究_张卫.pdf} -} - -@article{2LWIKRWR, - title = {基于大语言模型的唐蕃古道文物知识图谱构建研究}, - author = {雒伟群, 刘华瑞}, - date = {2026}, - journaltitle = {计算机科学与探索}, - volume = {20}, - number = {3}, - pages = {801}, - doi = {10.3778/j.issn.1673-9418.2510052}, - url = {http://fcst.ceaj.org/CN/10.3778/j.issn.1673-9418.2510052}, - urldate = {2026-03-13}, - abstract = {针对文物领域多源异构数据整合困难,以及传统知识抽取方法依赖人工标注、自动化程度低等问题,提出一种基于大语言模型的文物知识图谱构建方法。融合领域专家知识与文物行业标准,构建涵盖文物核心概念及其关系的知识本体,系统定义其时空属性、文化属性和物理特征,以及文物间的关联关系,形成多维度结构化的知识框架。设计多阶段任务分解的联合抽取策略,利用大语言模型的语义理解与生成能力,将知识抽取拆解为“实体属性提取”与“三元组抽取”两个子任务,并通过提示工程引导模型逐步完成。同时,引入多维度校验机制,从逻辑一致性、领域规范性和事实准确性等三方面对生成的三元组进行验证,确保知识图谱的专业性与可靠性。实验表明,DeepSeek-R1模型在抽取任务中F1值达86.25\%,较BERT-BiLSTM-CRF模型提升3.13个百分点;消融实验也验证了各模块的有效性。该方法为文物数字化保护与跨学科研究提供了高效、自动化的技术支撑。}, - langid = {chinese}, - file = {F:\Zotero\storage\4PSREFEE\2026-雒伟群-刘华瑞-基于大语言模型的唐蕃古道文物知识图谱构建研究.pdf} -} - -@article{49Q5D2DH, - title = {基于Neo4j的中轴线艺术价值数字化知识图谱研究}, - author = {{刘彦超} and {刘键} and {席上琳} and {晁溪蕊} and {侯娜} and {朱文莲}}, - date = {2024}, - journaltitle = {包装工程}, - volume = {45}, - number = {8}, - issn = {1001-3563}, - doi = {10.19554/j.cnki.1001-3563.2024.08.023}, - url = {https://doi.org/10.19554/j.cnki.1001-3563.2024.08.023}, - urldate = {2026-03-13}, - abstract = {目的 以数字技术推动文化遗产价值阐释,以北京中轴线为例,提出了基于人工智能知识图谱的遗产价值挖掘与阐释方法。方法 构建了人工智能阐释遗产艺术价值的知识图谱七步法:1)多源异构的艺术资料整理与数字转化;2)基于Protégé系统的本体系统;3)借助本体与图数据库的映射厘清逻辑关系;4)结合NLP大数据技术进行文本挖掘与抽取;5)基于Neo4j构建数字化资源;6)基于Cypher语言查询与图算法提炼艺术价值研究;7)知识图谱的可视化呈现。结论 跳出了传统的中轴线宫廷艺术的范畴,提出了4个审美维度,并从4维度揭示了中轴线所承载的中华传统思想精髓。}, - langid = {chinese}, - keywords = {北京中轴线,本体,艺术价值,知识图谱,Neo4j}, - annotation = {original-container-title: Packaging Engineering\\ -foundation: 国家社科基金艺术学一般项目(23BH146); 北京市宣传系统高层次人才项目;\\ -album: 工程科技Ⅱ辑\\ -CLC: TB47\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2024\\ -filename: BZGC202408023\\ -publicationTag: 北大核心, CAS, JST, WJCI, AMI扩展\\ -CIF: 2.948\\ -AIF: 1.651}, - file = {F:\Zotero\storage\8MZ39UG7\基于Neo4j的中轴线艺术价值数字化知识图谱研究_刘彦超.pdf} -} - -@article{4GYKXZJ5, - title = {基于知识图谱和大模型的文化遗产展示和查询方法研究——以大运河文化遗产为例}, - author = {{蒋金亮} and {徐云翼} and {杨晗} and {刘志超}}, - date = {2024}, - journaltitle = {中国名城}, - volume = {38}, - number = {12}, - issn = {1674-4144}, - doi = {10.19924/j.cnki.1674-4144.2024.012.001}, - url = {https://doi.org/10.19924/j.cnki.1674-4144.2024.012.001}, - urldate = {2026-03-13}, - abstract = {随着数字技术的不断发展,知识图谱、生成式大模型等技术在历史文化遗产展示、保护领域得到广泛研究和应用。本研究提出基于知识图谱和大模型的历史文化遗产展示和查询方法,以大运河文化遗产作为研究对象,采集文化遗产的管理属性和文化属性信息,通过RDF三元组方法构建文化遗产知识图谱,用于可视化展示和遗产搜索;利用生成式大模型方法,构建大运河文化遗产的自然语言生成方案,最终抽取、生成大运河历史文化遗产的具体知识。本文提出的文化遗产展示和查询方法,拓展了文化遗产数字化保护传承利用的视角,同时为其他相关文化遗产的可视化呈现、数字化管理提供参考。}, - langid = {chinese}, - keywords = {大模型,大运河,文化遗产,知识图谱}, - annotation = {original-container-title: China Ancient City\\ -foundation: 国家自然科学基金面上项目“基于复杂系统模拟的跨区域国土空间韧性耦合机制与规划方法研究——以长三角地区为例”(编号:52178043);\\ -album: 哲学与人文科学;工程科技Ⅱ辑\\ -CLC: TU984.114;K878.4\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2025\\ -filename: ZGMI202412012\\ -CIF: 1.972\\ -AIF: 1.36}, - file = {F:\Zotero\storage\HT8773S9\基于知识图谱和大模型的文化遗产展示和查询方法研究——以大运河文化遗产为例_蒋金亮.pdf} -} - -@article{5VBJ427S, - title = {基于Neo4j的湘西地区旅游知识图谱构建研究}, - author = {{彭纪扬} and {郑昂}}, - date = {2025}, - journaltitle = {科技资讯}, - volume = {23}, - number = {8}, - issn = {1672-3791}, - doi = {10.16661/j.cnki.1672-3791.2409-5042-9147}, - url = {https://doi.org/10.16661/j.cnki.1672-3791.2409-5042-9147}, - urldate = {2026-03-13}, - abstract = {人工智能大模型和知识图谱技术的应用有助于系统化地组织和展示湘西地区的旅游资源信息。首先,通过网络数据采集,获取湘西地区的旅游资源文本数据,并利用生成式人工智能模型进行关系抽取和内容标注。然后,将处理后的数据导入Neo4j数据库,构建涵盖景点、饮食、交通等多维度信息的旅游知识图谱,并通过可视化工具予以直观展示。研究结果为区域旅游资源的数字化管理和精准营销提供了科学支持,并为相关领域的知识图谱构建提供了实践参考。}, - langid = {chinese}, - keywords = {关系抽取,旅游知识图谱,湘西地区,Neo4j数据库}, - annotation = {original-container-title: Science \& Technology Information\\ -foundation: 湖南省自然与文化遗产研究基地开放基金项目“基于自然语言处理的文旅资源知识图谱构建研究”(项目编号:ZRYC2306);\\ -album: 基础科学;信息科技;经济与管理科学\\ -CLC: TP391.1;F592.7\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2025\\ -filename: ZXLJ202508020\\ -publicationTag: JST\\ -CIF: 0.376\\ -AIF: 0.206}, - file = {F:\Zotero\storage\8WM48HSY\基于Neo4j的湘西地区旅游知识图谱构建研究_彭纪扬.pdf} -} - -@article{6JYY2GXD, - title = {论地理知识图谱}, - author = {{陆锋} and {余丽} and {仇培元}}, - date = {2017}, - journaltitle = {地球信息科学学报}, - volume = {19}, - number = {6}, - pages = {723--734}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2017&filename=DQXX201706002}, - urldate = {2026-03-22}, - abstract = {网络文本蕴含大量隐式地理空间信息,为地理知识获取与知识服务提供了巨大潜能。地理知识图谱是将传统地理信息服务拓展到地理知识服务的关键,也是网络文本蕴含地理信息采集与处理的终极目标。本文系统评述了开放地理语义网、开放地理实体及关系抽取、地理语义网对齐、知识图谱存储方法等地理知识图谱相关主题的研究进展,从网络文本蕴含地理空间信息量与质量评价、地理信息语义理解、空间语义计算模型和异构地理语义网对齐等方面剖析了目前亟需解决的关键科学问题。}, - langid = {chinese}, - keywords = {地理信息抽取,语义网,知识图谱,自然语言理解}, - annotation = {Fund: 国家自然科学重点基金项目(41631177); 中国科学院重点部署项目(ZDRW-ZS-2016-6-3);} -} - -@article{72HK557Y, - title = {知识图谱在数字人文中的应用研究}, - author = {{陈涛} and {刘炜} and {单蓉蓉} and {朱庆华}}, - date = {2019}, - journaltitle = {中国图书馆学报}, - shortjournal = {中国图书馆学报}, - volume = {45}, - number = {6}, - pages = {34--49}, - doi = {10.13530/j.cnki.jlis.190046}, - url = {https://link.cnki.net/doi/10.13530/j.cnki.jlis.190046}, - urldate = {2026-03-23}, - abstract = {知识图谱是利用计算机存储、管理和呈现概念及其相互关系的一种技术,一经提出便很快成为工业界和学术界的研究热点,但目前对知识图谱的认知还比较混乱。依据存储方式不同,知识图谱可分为基于RDF存储的语义知识图谱(关联数据)和基于图数据库的广义知识图谱。语义知识图谱(关联数据)侧重于知识的发布和链接,广义知识图谱则更侧重于知识的挖掘和计算,两者之间既有共同点,又有不同之处。本文从概念层面和技术层面详细分析了两者之间的异同,指出语义知识图谱(关联数据)才是谷歌知识图谱的延续和发展。随后,提出了将知识图谱应用于数字人文研究的系统框架,并在此基础上构建了中国历代人物传记资料库的关联数据平台(CBDBLD)。该平台借助知识图谱的理念展现了人物之间丰富的亲属及社会关系,形成了特有的社会关系网络,并可通过设置推理规则来实现人物之间隐性关系的挖掘与呈现。广义知识图谱研究中丰富的图运算和关联数据的结合将会成为数字人文领域研究的下一个热点,从而开启数字人文研究的新时代。图10。表2。参考文献25。}, - langid = {chinese}, - keywords = {/unread,关联数据,数字人文,知识图谱,知识推理,中国历代人物传记资料库}, - annotation = {Fund: 国家社会科学基金项目“数字人文中图像文本资源的语义化建设与开放图谱构建研究”(编号:19BTQ024)的研究成果之一\textasciitilde\textasciitilde ;}, - file = {F:\Zotero\storage\XDFFDI6E\2019-陈涛-刘炜-单蓉蓉-朱庆华-知识图谱在数字人文中的应用研究.pdf} -} - -@article{7ZYWS5KV, - title = {中共中央办公厅 国务院办公厅印发《关于进一步加强非物质文化遗产保护工作的意见》}, - journaltitle = {中华人民共和国国务院公报}, - shortjournal = {中华人民共和国国务院公报}, - number = {24}, - issn = {1004-3438}, - url = {https://www.gov.cn/gongbao/content/2021/content_5633447.htm}, - urldate = {2026-03-23}, - abstract = {近日,中共中央办公厅、国务院办公厅印发了《关于进一步加强非物质文化遗产保护工作的意见》,并发出通知,要求各地区各部门结合实际认真贯彻落实。明确提出,加大非物质文化遗产传播普及力度, 将非物质文化遗产内容贯穿国民教育始终,构建非物质文化 遗产课程体系和教材体系,鼓励非物质文化遗产进校园}, - langid = {chinese}, - keywords = {非物质文化遗产中央办公厅意见国务院办公厅}, - file = {F:\Zotero\storage\ERF9BFWT\content_5633447.html} -} - -@article{8LEDXI3J, - title = {ChatKG:一种基于大语言模型和提示工程的非遗知识图谱构建框架——以中国非遗陶瓷制作工艺为例}, - author = {{周正达} and {王昊} and {汪琳} and {李晓敏} and {周抒} and {姚天辰}}, - date = {2025-02-24}, - journaltitle = {图书馆杂志}, - issn = {1000-4254}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CAPJ&dbname=CAPJLAST&filename=TNGZ20250221003}, - urldate = {2026-03-13}, - abstract = {本文旨在解决当前非遗知识图谱构建中存在的人工成本高、准确率不足的问题,提出利用大规模预训练模型ChatGPT开展非遗知识图谱构建的新思路。具体提出一种基于大语言模型和提示工程的非遗知识图谱构建框架ChatKG(Chat Knowledge Graph),选择复用CIDOC CRM本体模型,结合人工梳理与ChatGPT辅助,实现了非遗本体构建,并提出一种基于思维链(CoT)的提示优化方法实现准确的非遗知识抽取,为缺少可直接复用本体概念模型以及高质量标注数据的非遗领域,提供了一种快速、高效、低成本构建领域本体概念模型和进行知识抽取的方法。本文以中国非遗陶瓷制作工艺为例,引导大语言模型成功识别出了419个工艺实体及763条实体间关系,最终构建了非遗陶瓷工艺知识图谱并进行了应用场景探索,验证了本文方法的有效性。}, - langid = {chinese}, - pubstate = {advance online publication}, - keywords = {本体构建,大语言模型,提示工程,知识抽取,知识图谱}, - annotation = {original-container-title: Library Journal\\ -foundation: 国家自然科学基金面上项目“关联数据驱动下我国非遗文本的语义解析与人文计算研究”(项目编号:72074108); 南京大学“中央高校基本科研业务费专项资金资助”项目“面向人文计算的方志文本的语义分析和知识图谱研究”(项目编号:010814370113)的研究成果之一; 江苏青年社科英才和南京大学仲英青年学者等人才培养计划的支持;\\ -album: 哲学与人文科学;信息科技\\ -CLC: J527;G353.1\\ -dbcode: CAPJ\\ -dbname: CAPJLAST\\ -filename: TNGZ20250221003\\ -publicationTag: 北大核心, AMI核心, CSSCI\\ -CIF: 3.589\\ -AIF: 2.878}, - file = {F:\Zotero\storage\8SYAQFEN\ChatKG:一种基于大语言模型和提示工程的非遗知识图谱构建框架——以中国非遗陶瓷制作工艺为例_周正达.pdf} -} - -@article{B79P45VU, - title = {唐诗知识图谱的构建及其智能知识服务设计}, - author = {{周莉娜} and {洪亮} and {高子阳}}, - date = {2019}, - journaltitle = {图书情报工作}, - volume = {63}, - number = {2}, - pages = {24--33}, - doi = {10.13266/j.issn.0252-3116.2019.02.003}, - url = {https://doi.org/10.13266/j.issn.0252-3116.2019.02.003}, - urldate = {2026-03-22}, - abstract = {[目的/意义]立足于当前大数据环境下的唐诗知识服务需求,以大规模唐诗数据为基础构建唐诗知识图谱并提供智能知识服务,推动人工智能环境下唐诗知识管理和知识服务方式的创新。[方法/过程]本文在对领域知识服务需求调研的基础上,设计领域知识服务驱动的唐诗本体模型,然后利用从Web上爬取的多源异构数据,采用知识抽取、知识融合、知识推理等技术自动构建唐诗知识图谱,统一表示和组织唐诗领域数据,实现对大规模唐诗数据的语义化处理。[结果/结论]本文设计基于唐诗知识图谱的智能知识服务平台KnowPoetry,提供唐诗领域的知识探索、时空轨迹、语义查询等智能化知识服务,推动人工智能环境下唐诗数字人文研究方法的创新转型。}, - langid = {chinese}, - keywords = {数字人文,唐诗知识图谱,知识建模,智能知识服务}, - annotation = {Fund: 国家重点研发计划“科学大数据管理系统”子课题“图数据管理关键技术及系统”(项目编号:2016YFB1000603); 教育部人文社会科学重点研究基地重大项目“大数据资源的语义表示与组织研究——面向文化遗产领域”(项目编号:16JJD870002)研究成果之一;}, - file = {F:\Zotero\storage\7DMY9Q5C\2019-周莉娜-洪亮-高子阳-唐诗知识图谱的构建及其智能知识服务设计.pdf} -} - -@article{D93KE6Y2, - title = {A {{Map}} for {{Big Data Research}} in {{Digital Humanities}}}, - author = {Kaplan, Frédéric}, - date = {2015-05-06}, - journaltitle = {Frontiers in DIGITAL Humanities}, - shortjournal = {Front. DIGIT. Humanit.}, - volume = {2}, - publisher = {Frontiers}, - issn = {2297-2668}, - doi = {10.3389/fdigh.2015.00001}, - url = {https://www.frontiersin.org/journals/digital-humanities/articles/10.3389/fdigh.2015.00001/full}, - urldate = {2026-03-23}, - abstract = {AbstractThis article is an attempt to represent Big Data research in Digital Humanities as a structured research field. A division in three concentric areas of study is presented. Challenges in the first circle - focusing on the processing and interpretations of large cultural datasets - can be organized linearly following the data processing pipeline. Challenges in the second circle - concerning digital culture at large – can be structured around the different relations linking massive datasets, large communities, collective discourses, global actors and the software medium. Challenges in the third circle - dealing with the experience of big data - can be described within a continuous space of possible interfaces organized around three poles: immersion, abstraction and language. By identifying research challenges in all these domains, the article illustrates how this initial cartography could be helpful to organize the exploration of the various dimensions of Big Data Digital Humanities research. Introduction: Big Data Digital Humanities vs. Small Data Digital HumanitiesDefining the nature and the boundaries of Digital Humanities is a long-discussed and unsolved issue (Terras et al 2013), not only because there is no consensus on this question but also because Digital Humanities are currently undergoing a profound transformation that calls for a reconsideration of its fundamental concepts (Gold 2012). For years, Digital humanities have been loosely regrouping computational approaches of humanities research problems and critical reflections of the effects of digital technologies on culture and knowledge (Schreibman et al 2004). Ten years ago, they emerged as a new label, rebranding and enlarging the idea of “humanities computing” (Svensson 2009). Around this new name and under a “big tent”, a progressively larger community of practice thrived (Terras 2011). Each work at the intersection of Computer Science and the Humanities could potentially be part of this welcoming trend. Researchers gathered in national and international meetings, exchanged their views on blogs and mailing lists. If not a well bounded field, Digital Humanities were surely a lively conversation.The welcoming Digital Humanities label opened doors, connected separated academic silos, built bridges between information sciences and the various disciplines loosely forming what is called the humanities. However openness was always associated with a need for introspection, self-reflexive writings, tentative boundaries definitions, the “What are digital humanities” articles and monographs became a genre of its own structured around several narratives of exclusion and inclusion (Rockwell, 2011). Digital Humanities as a research domain define themselves dynamically in the negotiation of these tensions as discussed by several Digital Humanities scholars (Unsworth 2002, Svensson 2009, Rockwell 2011). Table 1 gives a non-exhaustive list of these structuring tensions.The starting point of this article is a relatively new particular structuring tension, opposing Big Data Digital Humanists with Small Data Digital Humanists. Research in Big Data Digital Humanities focuses on large or dense cultural datasets, that call for new processing and interpretation methods. The term Big Data itself has disputed origins (Diebold, 2012, Lohr 2013). The Oxford English Dictionary defines it as “data of a very large size, typically to the extent that its manipulation and management present significant logistical challenges.” In that sense, Big Data are “big” when “manual” analysis becomes cumbersome and new study and interpretation methods must be invented. However, massiveness of Big Data is not tightly linked to a certain number of Terabytes. Boyd and Crowford (2011) note that “Big Data is not notable because of its size, but because of its relationality to other data”. Big Data is “fundamentally networked” and challenges in processing it are linked with its interconnected nature. In comparison, the Small Data Digital Humanities regroup more focused works that do not use massive data processing methods and explore other interdisciplinary dimensions linking computer science and humanities research. In comparison with Big Data, Small Data is small in the sense that it is not only smaller-scale but also well-bounded.This article intends to draw a map for Big Data Digital Humanities showing how it can be organized as a structured field. The ambition of this map is to show that Big Data research in Digital Humanities can be characterized by common methodologies and objects of studies, therefore transcending some of the tensions that have structured Digital Humanities so far. As it focuses only on research that deals with these “large body of information” (Katz 2005), this maps does not cover the Digital Humanities domain as whole. Nevertheless, given the growing importance of massive and networked cultural datasets, it is likely that Big Data Digital Humanities become a significant part of the whole Digital Humanities field. In this context, this map may help institutionalize research and education programs with clearer focuses and objectives. This article presents Big Data research in Digital Humanities as three concentric circles (Fig 1.) The first circle corresponds to research focusing on processing and interpretation big and networked cultural data sets, the first object of study of this field. Most of the methods needed to study these datasets need still to be invented, as they are currently not mastered neither by humanists or computer scientists. However, it is important to consider that data processing and interpretation occur in a larger context of the new digital culture characterized by collective discourses, large community, ubiquitous software and global IT actors. Understanding the relation between these entities could be considered the second object of study for Big Data Digital Humanities. Eventually, the human experience of such datasets through various kinds of interfaces corresponds to a third family of challenges, differing in scope and methodology from the other two. Therefore, these three areas of studies could be represented as three concentric circles, illustrating three levels of contextualization and embodiment of cultural data. In the next sections we will briefly discuss each of the circles in more details.Big Cultural datasetsMassive cultural digital objects include large-scale corpus like the millions of books scanned by Google and the ones produced by numerous other digitization initiatives (Jacquesson 2010), the millions of photos and micro-message shared on social network services (Tushoo et al 2010), giant geographical information systems like Google Earth (Butler 2006) or the ever expanding networks of academic papers citing one another (Shibata et al 2008). These interconnected objects - either digitally born or reconstructed through digitization pipelines - are too big to be read or watched. The traditional 1:1 ratio of a single scholar confronted with one document cannot cope with such abundance. Moreover, their boundaries are sometimes fuzzy, their content partially unknown and, likely to be in continuous expansion. These characteristics make them profoundly different from corpora traditionally studied by humanities researchers, despite surface resemblances. The confrontation with these “massive” objects calls for fundamental questions. What can really be extracted from these huge datasets and what interpretations can be drawn based on these extractions? Will we learn more by analyzing 10 millions books that we cannot read individually or by reading five carefully (Moretti 2005)? What is the role of algorithms for mining, shaping and representing these large digital objects?Some of these challenges can be structured following the specific parts of data processing: digitization, transcription, pattern recognition, simulation and inferences, preservation and curation as show in figure 2 and in the table below. Each step in the data processing pipeline can be associated with questions that are both technical and epistemological. Consider the processing pipeline of mass book digitization projects. Physical books must be transformed into images (digitization step) that are then transformed into texts (transcription step), on which various pattern can be detected (pattern recognition step like text mining or n-gram approaches) or inferred (simulation step) while being preserved and curated for future research (preservation step). This way of presenting the research challenge insists on the fact that data are never given, but taken and transformed (Gitelman 2013). The technical complexity of pipelines involved clearly demonstrate that, at each step of the data processing, choices are made and biases apply. Understanding these technical choices is crucial to develop new interpretive theories.Digital CultureWe discussed the relationship between data processing pipelines and large cultural datasets. However, data processing and interpretation happen in a larger context, which we may call Digital Culture. The study of this large context can be considered to be the second object of study for Digital Humanities research. One way to structure this domain is to replace the relation between software and data (the focus of the first circle) in a network of relations between new entities including large-scale communities (MOOCs classrooms, Wikipedia contributors, etc.), collective discourses (Blogs, data journalism, wiki-style collaborative writing), ubiquitous software medium (auto-completion algorithm, search engine) and global actors (Google, Facebook, GLAM, Universities). Consider the millions of photos shared every hour on Facebook (Huang et al 2013). In this case, large-scale communities produce both the massive digital objects and the collective discourses about massive digital objects. They do so through the mediation of algorithms produced by one giant IT company of the web. Retroactively, collective discourses about the photos have a shaping role on the emergence and structuration of these communities. In addition, as collective discourses reach rapidly a critical mass (e.g. millions of messages or status update) they tend to become themselves massive digital objects, to be archived and studied through specific text and data mining approaches. Understanding photo sharing implies understanding the complexity of this network of interactions. More generally, research about digital culture can be segmented in subdomains corresponding to groups of relations between some of the entities we have been discussing. This structuration summarized in Table 3 and Figure 3, identifies five domains: the processing domain, the discursive domain, the social shaping domain, the algorithmic mediation domain and the control domain. This grouping articulates differently the relations of Big Data Digital Humanities with trad}, - langid = {english}, - keywords = {big data,Cartography.,Challenges,Digital Humanities,Mapping}, - file = {F:\Zotero\storage\FFVP5DKK\2015-kaplan-frédéric-a-map-for-big-data-research-in.pdf} -} - -@article{EC26X7PS, - title = {基于大模型技术的档案文化遗产自动问答平台构建研究}, - author = {{李根}}, - date = {2024}, - journaltitle = {山西档案}, - number = {9}, - issn = {1005-9652}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2024&filename=SXDA202409029}, - urldate = {2026-03-13}, - abstract = {大语言模型的出现为档案工作的数智化转型提供了新契机。在梳理了大模型技术特点的基础上,分析其在图情档领域的应用现状,并剖析了档案文化遗产传承弘扬面临的困境,进而提出档案文化遗产自动问答平台的整体构建框架,并围绕领域知识库构建、大模型与知识库融合的问答、档案知识可视化、问答质量评估等关键技术展开了深入探讨。旨在为档案知识服务创新提供理论视角,也为智能问答系统的实践应用提供借鉴,助力新时代档案事业的高质量发展。}, - langid = {chinese}, - keywords = {大语言模型,档案文化遗产,数字人文,知识库,智能问答}, - annotation = {original-container-title: Shanxi Archives\\ -foundation: 2023年广东省教育厅青年创新人才项目(自然科学)“基于大数据图像处理的工业瑕疵检测系统”(项目编号:2023KQNCX143);\\ -album: 信息科技\\ -CLC: TP18;TP391.1;G270.7\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2024\\ -filename: SXDA202409029\\ -publicationTag: 北大核心, AMI扩展\\ -CIF: 3.591\\ -AIF: 3.339}, - file = {F:\Zotero\storage\A4YJ4GJF\基于大模型技术的档案文化遗产自动问答平台构建研究_李根.pdf} -} - -@article{FMHA6MVH, - title = {基于大模型的非遗知识图谱与智慧问答系统构建研究}, - author = {{徐怀钰} and {赵俊伟} and {彭潇} and {黄梅荣}}, - date = {2025}, - journaltitle = {华东科技}, - number = {6}, - issn = {1006-8465}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2025&filename=HDKJ202506031}, - urldate = {2026-03-13}, - abstract = {{$<$}正{$>$}自党的二十大报告明确提出实施国家文化数字化战略以来,文化数字化已逐步成为建设社会主义文化强国、实现文化产业高质量发展的战略选择。非物质文化遗产(以下简称非遗)作为人类文明的瑰宝,在保护与传承方面仍面临诸多现实挑战。与此同时,数字化技术为非遗的保护与传承提供了创新手段,如通过智能问答技术来高效解答公众对非遗项目的疑问,有效促进中华优秀传统文化的传播。基于此,本文探讨了基于大模型的非遗知识图谱与智慧问答系统的构建路径,以期为非遗的保护与传承提供技术支持。}, - langid = {chinese}, - annotation = {original-container-title: East China Science \& Technology\\ -foundation: 湖南省大学生创新训练项目“内容生成技术赋能非物质文化遗产的知识图谱建设研究——以江永女书为例”(项目编号:S202410554092); 湖南省普通本科高校教学改革研究项目“ChatGPT赋能元宇宙教学资源数字化建设”(项目编号:202401001061);\\ -album: 基础科学;哲学与人文科学;信息科技\\ -CLC: G122;TP391.1;TP18\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2025\\ -filename: HDKJ202506031\\ -CIF: 0.324\\ -AIF: 0.157}, - file = {F:\Zotero\storage\WJJTSAGE\基于大模型的非遗知识图谱与智慧问答系统构建研究_徐怀钰.pdf} -} - -@article{FYB5RXLC, - title = {文化遗产领域知识图谱发展趋势与前沿进展研究}, - author = {{敖若瑶}}, - date = {2025}, - journaltitle = {科技与创新}, - number = {17}, - issn = {2095-6835}, - doi = {10.15913/j.cnki.kjycx.2025.17.004}, - url = {https://doi.org/10.15913/j.cnki.kjycx.2025.17.004}, - urldate = {2026-03-13}, - abstract = {知识图谱作为学界较为成熟的一项技术,为分散且多维度的文化遗产资源提供了结构化与语义化整合的解决方案。运用文献计量法和文献分析法,借助CiteSpace软件对从CNKI期刊库中获取的共计92篇相关文献进行科学知识图谱可视化分析,旨在揭示文化遗产领域知识图谱研究的演进脉络、热点主题以及前沿趋势。研究总结归纳出文化领域知识图谱研究的演进可划分为3个阶段,即萌芽期(2015—2019年)、发展期(2020—2023年)、探索期(2024—2025年),发现大模型与智能体技术显著推动了文化遗产知识图谱在知识生成、多模态交互以及动态服务方面的革新。展望未来,可以重点关注多模态知识图谱的深度整合与动态表达,以及智能体驱动的主动化知识服务系统等方向,以深化文化遗产的智慧化保护与传播。}, - langid = {chinese}, - keywords = {大模型,数字人文,文化遗产,知识图谱}, - annotation = {original-container-title: Science and Technology \& Innovation\\ -album: 工程科技Ⅱ辑;哲学与人文科学;信息科技\\ -CLC: G353.1;G122\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2025\\ -filename: KJYX202517004\\ -publicationTag: JST\\ -CIF: 0.443\\ -AIF: 0.24}, - file = {F:\Zotero\storage\YNNL99H5\文化遗产领域知识图谱发展趋势与前沿进展研究_敖若瑶.pdf} -} - -@article{GCLXKNED, - title = {融合学习扩展的非遗陶瓷工艺领域术语库构建及应用}, - author = {{汪琳} and {王昊} and {李晓敏} and {邓三鸿}}, - date = {2024}, - journaltitle = {图书馆论坛}, - shortjournal = {图书馆论坛}, - volume = {44}, - number = {2}, - pages = {66--78}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2024&filename=TSGL202402008}, - urldate = {2026-03-23}, - abstract = {文章通过学习扩展的机器学习和深度学习,提出针对非物质文化遗产项目语料的术语抽取及新词发现方法,形成领域术语库并探讨在数字人文领域的应用。首先使用自然语言处理方法对非遗陶瓷语料进行预处理,结合领域术语词表对语料进行标注;然后针对Random-CRFs模型,研究词表特征(DICT)、词性特征(POS)、部首特征(Radical)、拼音特征(Pinyin)对术语抽取效果的影响,再对比Random-CRFs、Random-BiLSTM、Random-BiLSTM-CRFs、BERT-BiLSTMCRFs等4个模型对术语抽取效果的影响;最后使用训练完成的模型对测试集语料进行新词识别,对抽取出的候选词进行人工判断,构建包含1,173个术语的非物质文化遗产陶瓷工艺领域术语库,将其应用于非遗项目画像、非遗陶瓷工艺知识图谱和非遗陶瓷工艺术语检索。}, - langid = {chinese}, - keywords = {非物质文化遗产,领域术语,数字人文,新词发现}, - annotation = {Fund: 国家自然科学基金项目“关联数据驱动下我国非遗文本的语义解析与人文计算研究”(项目编号:72074108); 中央高校基本科研业务费项目“面向人文计算的方志文本的语义分析和知识图谱研究”(项目编号:010814370113)研究成果;}, - file = {F:\Zotero\storage\UCTVN2WA\2024-汪琳-王昊-李晓敏-邓三鸿-融合学习扩展的非遗陶瓷工艺领域术语库构建及应用.pdf} -} - -@article{IBVAJNMD, - title = {价值共创视域下中国传统戏曲知识图谱模式层构建及应用研究}, - author = {{王左戎} and {邓三鸿} and {胡畔} and {翟姗姗}}, - date = {2025}, - journaltitle = {情报科学}, - shortjournal = {情报科学}, - volume = {43}, - number = {3}, - pages = {165--175}, - doi = {10.13833/j.issn.1007-7634.2025.03.020}, - url = {https://doi.org/10.13833/j.issn.1007-7634.2025.03.020}, - urldate = {2026-03-23}, - abstract = {【目的/意义】作为中华民族文化的重要组成部分,利用现代语义组织实现对于海量异构中国传统戏曲主题数字资源的组织,有利于实现中国传统戏曲文化价值的挖掘和释放。【方法/过程】本研究在梳理价值共创理论在文化遗产领域应用的基础上,围绕16项具体中国传统戏曲全面搜集了包括政府部门、企业、高校在内多类型主体提供的公开数字资源,按照七步法知识建模流程提出中国传统戏曲知识图谱模式层构建方案,同时利用Protégé和Neo4j工具进行了图谱模式层的具体应用展示。【结果/结论】本研究以充分释放中国传统戏曲文化价值为导向,在人工梳理了120篇主题文献和40项主题网站内容的基础上提出了囊括11项实体类、24项实体子类及7种主要关系类型的模式层设计方案和应用策略,以期从资源组织的角度为我国传统戏曲文化的创新性发展提供支持。【创新/局限】本研究在价值共创视域下面向中国传统戏曲信息组织场景提出领域知识图谱模式层构建方案,但在具体实践的细节层面仍有可以完善的空间,后续将会进一步考虑引入大语言模型等方式提升图谱构建的效率。}, - langid = {chinese}, - keywords = {本体,传统戏曲,价值共创,信息组织,知识图谱}, - annotation = {Fund: 国家社科基金一般项目“数字人文视域下非遗知识图谱自动构建与长期演进研究”(20BTQ071);}, - file = {F:\Zotero\storage\V6ZYTA73\2025-王左戎-邓三鸿-胡畔-翟姗姗-价值共创视域下中国传统戏曲知识图谱模式层构建及应用研究.pdf} -} - -@article{JH5C6HKD, - title = {“博古问津”:知识图谱增强的文化遗产领域多模态大模型}, - shorttitle = {“博古问津”}, - author = {{赵万青} and {徐朝阳} and {谢智伟} and {张少博} and {张晓丹} and {彭进业}}, - date = {2025}, - journaltitle = {西北大学学报(自然科学版)}, - volume = {55}, - number = {6}, - issn = {1000-274X}, - doi = {10.16152/j.cnki.xdxbzr.2025-06-006}, - url = {https://doi.org/10.16152/j.cnki.xdxbzr.2025-06-006}, - urldate = {2026-03-13}, - abstract = {近年来,大语言模型(LLMs)和多模态大模型(MLMs)在自然语言处理和多模态内容理解方面取得了显著成就,然而,这些通用模型在处理文化遗产相关任务时存在明显缺陷,如对领域专业术语的理解存在偏差、缺乏文化历史背景导致回答不够深入以及知识幻觉等问题,使得输出结果难以满足实际需求。针对这些挑战,首次提出了面向文化遗产领域的多模态大模型——“博古问津”。首先,设计半自动化策略构建大规模的多模态文化遗产数据集并形成多模态知识图谱;然后,利用构建的数据集对通用大模型进行图文对齐和指令微调两阶段训练,以适应文化遗产领域的特定需求;此外,还引入了知识图谱作为辅助知识库,通过图文检索和关系检索策略,有效提升了模型在文化遗产领域问答任务上的可信度和可解释性。实验结果表明,“博古问津”在文物图像描述、属性问题解答及关系问题理解等多个方面表现优异,相较于通用多模态大模型,对复杂文化内容的理解和回答能力提升效果显著,分别在文物图像描述、文物属性问题和文物关系问题3个不同任务的综合分值上高出次优模型21.4\%、53\%和20.6\%。}, - langid = {chinese}, - keywords = {多模态大模型,模型微调,视觉问答,文化遗产,知识图谱,知识增强}, - annotation = {original-container-title: Journal of Northwest University(Natural Science Edition)\\ -foundation: 国家重点研发计划(2024YFF0907600); 国家自然科学基金(62273275); 陕西省自然科学基础研究计划青年项目(2025JC-YBQN-847);\\ -album: 基础科学;哲学与人文科学;信息科技\\ -CLC: K85;TP18;TP391.1\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2026\\ -filename: XBDZ202506006\\ -publicationTag: 北大核心, CAS, JST, CSCD, WJCI, 卓越期刊\\ -CIF: 2.156\\ -AIF: 1.458}, - file = {F:\Zotero\storage\2USFSBL6\“博古问津”_知识图谱增强的文化遗产领域多模态大模型_赵万青.pdf} -} - -@article{LDUKQAWH, - title = {数字人文领域的知识图谱:研究进展与未来趋势}, - author = {{朱丽雅} and {张珺} and {洪亮} and {罗绍辉} and {兰度}}, - date = {2022}, - journaltitle = {知识管理论坛}, - shortjournal = {知识管理论坛}, - volume = {7}, - number = {1}, - pages = {87--100}, - doi = {10.13266/j.issn.2095-5472.2022.008}, - url = {https://doi.org/10.13266/j.issn.2095-5472.2022.008}, - urldate = {2026-03-23}, - abstract = {[目的/意义]对数字人文领域的知识图谱研究进行系统性回顾,旨在提供未来可能的研究方向和开放的研究主题。[方法/过程]以国内外会议、期刊发表的相关文献为研究对象,采用综合归纳法,系统梳理数字人文领域知识图谱的理论与实践发展。阐述数字人文领域知识图谱的相关概念,并根据当前的研究热点,从数据资源建设、关键构建技术、平台智能应用3个方面揭示其研究动向,并对未来研究趋势进行展望。[结果/结论]总结数字人文知识图谱研究的未来发展趋势,即未来将呈现出多源数据集成、多模态知识融合、多学科交叉应用的发展趋势。}, - langid = {chinese}, - keywords = {数据资源建设,数字人文,语义挖掘,知识图谱,智慧数据}, - annotation = {Fund: 2020年国家档案局科技项目“基于时空数据的智慧城市档案知识图谱构建及应用服务体系研究”(项目编号:2020-X-053); 湖北省重点研发计划项目“文旅科技大数据关键技术研发与应用示范”(项目编号:2020BAB117); 南宁市科学研究与技术开发计划项目科技重大专项“基于GIS和BIM技术的城建大数据平台研究”(项目编号:20193010)研究成果之一;}, - file = {F:\Zotero\storage\3UB3793C\2022-朱丽雅-张珺-洪亮-罗绍辉-兰度-数字人文领域的知识图谱:研究进展与未来趋势.pdf} -} - -@article{LJ5QBY4I, - title = {“大模型+知识图谱”双轮驱动的公共数字文化资源管理新范式}, - author = {{杨萌} and {张云中} and {赵程程}}, - date = {2025}, - journaltitle = {情报科学}, - volume = {43}, - number = {9}, - issn = {1007-7634}, - doi = {10.13833/j.issn.1007-7634.2025.09.009}, - url = {https://doi.org/10.13833/j.issn.1007-7634.2025.09.009}, - urldate = {2026-03-13}, - abstract = {【目的/意义】“大模型+知识图谱”的双轮驱动范式,可以创造更为强大的公共数字文化资源研究工具和应用,有助于提升公共数字文化资源的保护、研究、利用和传播水平。【方法/过程】本文在对比知识图谱和大模型作为知识库的技术特点及优劣势的基础上,提出了公共数字文化资源管理“大模型+知识图谱”双轮驱动模型,分析了该模型建构的需求与动机、基础与条件,并对资源层、数据层、技术层、应用层和行业层的运行机制进行了阐释。【结果/结论】研究发现,建构在“大模型+知识图谱”双轮驱动模型基础上的公共数字文化行业知识中台,可以更好实现人机协同,有效支撑公共数字文化领域的文化遗产保护修复、文化内涵挖掘与数字展陈、文化资产智慧化管理、文化教育与文化传播等方面的知识服务创新。【创新/局限】将大模型和知识图谱二者相结合,构建公共数字文化资源知识平台框架。}, - langid = {chinese}, - keywords = {大模型,公共数字文化资源,知识服务,知识图谱,知识中台}, - annotation = {original-container-title: Information Science\\ -foundation: 国家社会科学基金项目“智慧数据驱动的公共数字文化资源知识图谱构建与应用研究”(21BTQ105); 上海市教育发展基金会和上海市教育委员会“曙光计划”资助;\\ -album: 信息科技\\ -CLC: G250.7\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2026\\ -filename: QBKX202509009\\ -publicationTag: 北大核心, JST, WJCI, AMI核心, CSSCI\\ -CIF: 5.027\\ -AIF: 3.1}, - file = {F:\Zotero\storage\CPG5RZ24\“大模型+知识图谱”双轮驱动的公共数字文化资源管理新范式_杨萌.pdf} -} - -@article{MLPW6LLL, - title = {基于关联数据的数字人文视觉资源知识组织研究}, - author = {{曾子明} and {周知} and {蒋琳}}, - date = {2018}, - journaltitle = {情报资料工作}, - shortjournal = {情报资料工作}, - number = {6}, - pages = {6--12}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2018&filename=QBZL201806003}, - urldate = {2026-03-23}, - abstract = {文章提出一种基于关联数据的数字人文视觉资源知识组织模型,在分析用户需求的基础上,提出从数据采集到智慧服务的完整流程,构建基于关联数据的知识组织模型,并以敦煌文化遗产为具体案例进行说明,为相关问题的解决提供参考。}, - langid = {chinese}, - keywords = {关联数据,视觉资源,数字人文,知识组织}, - annotation = {Fund: 国家自然科学基金项目“云环境下智慧图书馆移动视觉搜索模型与实现研究”(编号:71673203)的研究成果之一;}, - file = {F:\Zotero\storage\D7B32DXK\2018-曾子明-周知-蒋琳-基于关联数据的数字人文视觉资源知识组织研究.pdf} -} - -@article{N9VGUZD6, - title = {大模型与古籍档案文化遗产数字化:价值、挑战与应对}, - author = {{刘文俏}}, - date = {2024}, - journaltitle = {山西档案}, - number = {1}, - issn = {1005-9652}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2024&filename=SXDA202401023}, - urldate = {2026-03-13}, - abstract = {古籍档案是中华文明重要的物质文化载体,其价值不仅在于承载了丰富的历史文化知识,而且在于彰显了民族的文化自信和价值观念。为了实现古籍档案的长期有效保护和广泛传播利用,将大模型技术应用于古籍档案数字化保护与利用中,发挥其巨大的潜力。旨在深入探讨大模型技术赋能古籍档案文化遗产数字化保护与利用的路径设计,站在理论与实践相结合的高度,充分挖掘大模型技术在传统档案文化遗产保护与传播中的变革性作用,为推动古籍档案资源保护和文化创新利用提供有力的技术支撑。}, - langid = {chinese}, - keywords = {大语言模型,古籍档案,数字化保护,文化创新利用,智慧服务}, - annotation = {original-container-title: Shanxi Archives\\ -album: 信息科技\\ -CLC: G255.1;G270.7\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2024\\ -filename: SXDA202401023\\ -publicationTag: 北大核心, AMI扩展\\ -CIF: 3.591\\ -AIF: 3.339}, - file = {F:\Zotero\storage\4DH3ZTUP\大模型与古籍档案文化遗产数字化:价值、挑战与应对_刘文俏.pdf} -} - -@article{NLCHJIZL, - title = {AIGC视角下非物质文化遗产知识图谱的构建研究}, - author = {{陈昱成} and {黎洋} and {刘江峰} and {杨帆}}, - date = {2024}, - journaltitle = {科技情报研究}, - volume = {6}, - number = {2}, - issn = {2096-7144}, - doi = {10.19809/j.cnki.kjqbyj.2024.02.010}, - url = {https://doi.org/10.19809/j.cnki.kjqbyj.2024.02.010}, - urldate = {2026-03-13}, - abstract = {[目的/意义]非遗是人类文明的重要组成部分,对于保护和弘扬民族精神,增强民族认同感和凝聚力具有重要意义。[方法/过程]文章探讨如何利用AIGC的优势,结合传统深度学习的方法,构建一个全面、高效的非遗知识图谱。[结果/结论]在非遗项目分类研究中,微调后的Baichuan-7B效果最佳,macro-F1值为0.7688,在非遗属性信息抽取中,RoBERTa的效果最好,F1值为0.7085。微调Baichuan-7B生成的结果,BLEU的2-Gram为0.2052。结合属性抽取和生成的结果,构建了高效全面的知识图谱。[创新/局限]文章利用生成式大模型辅助建立知识图谱,对国家级的非遗项目进行了研究,暂未对具有较高研究价值的省级项目进行研究。}, - langid = {chinese}, - keywords = {非物质文化遗产,知识图谱,AIGC,LLM}, - annotation = {original-container-title: Scientific Information Research\\ -album: 信息科技;哲学与人文科学\\ -CLC: TP391.1;G122;G353.1\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2024\\ -filename: QBYJ202402010\\ -publicationTag: AMI新刊入库, CSSCI\\ -CIF: 2.631\\ -AIF: 1.938}, - file = {F:\Zotero\storage\LDJPTVCU\AIGC视角下非物质文化遗产知识图谱的构建研究_陈昱成.pdf} -} - -@article{NNJSH2A9, - title = {地方非物质文化遗产知识图谱构建及其思政教育应用}, - author = {{张萌萌} and {张矛矛}}, - date = {2025}, - journaltitle = {情报科学}, - volume = {43}, - number = {9}, - issn = {1007-7634}, - doi = {10.13833/j.issn.1007-7634.2025.09.015}, - url = {https://doi.org/10.13833/j.issn.1007-7634.2025.09.015}, - urldate = {2026-03-13}, - abstract = {【目的/意义】为推动非物质文化遗产领域的知识挖掘及其在高校思政教育创新应用,助力地方特色思政教育元素的资源整合及应用,提升非遗文化在当代思政教育中的应用效果和影响力。【方法/过程】本研究先搜集建构地方非物质文化遗产数据集,运用BERTopic主题模型提取实体类别与关系标签,再使用OneKE大模型进行实体抽取与关系识别,最后运用Neo4j图数据库进行知识图谱的可视化。并以国家级非遗徐州剪纸为例实证应用,探讨其在高校思政教育中应用路径。【结果/结论】研究发现:基于OneKE大模型的知识图谱构建方法能够清晰呈现地方非物质文化遗产的知识文化背景、技艺传承及内在关联,形成结构化的知识表达体系;基于构建的知识图谱能够协助挖掘思政元素,助力思政教学资源整合,提升地方性非遗文化在思政教育中的应用效果。【创新/局限】提出了一种基于大语言模型的地方非遗知识图谱构建方法,并挖掘思政元素用于思政教育。}, - langid = {chinese}, - keywords = {非物质文化遗产,思政教育,知识图谱,BERTopic,OneKE大模型}, - annotation = {original-container-title: Information Science\\ -foundation: 国家社会科学基金后期资助项目“中国古代辞书相关体育汉字整理与研究”(22FTYB002);\\ -album: 信息科技;社会科学Ⅱ辑\\ -CLC: G641;G353.1\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2026\\ -filename: QBKX202509015\\ -publicationTag: 北大核心, JST, WJCI, AMI核心, CSSCI\\ -CIF: 5.027\\ -AIF: 3.1}, - file = {F:\Zotero\storage\SXJ5UXAF\地方非物质文化遗产知识图谱构建及其思政教育应用_张萌萌.pdf} -} - -@article{RPNDCWWB, - title = {文理融通:AGI时代的数字人文——第六届中国数字人文年会(CDH2024)会议综述}, - shorttitle = {文理融通}, - author = {{李嘉仪} and {李想} and {马小柯} and {胡浩天} and {王丽华}}, - date = {2025}, - journaltitle = {数字人文研究}, - volume = {5}, - number = {1}, - issn = {2096-9155}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2025&filename=SZYH202501002}, - urldate = {2026-03-13}, - abstract = {文章对“文理融通:AGI时代的数字人文”学术研讨会暨第六届中国数字人文年会(CDH2024)的会议内容进行梳理和总结,从主旨报告、圆桌论坛、分论坛、新闻发布会和获奖项目几部分进行介绍,回顾2024数字人文年会的主要内容,揭示数字人文的发展现状与趋势,为相关研究人员提供参考与借鉴。}, - langid = {chinese}, - keywords = {会议综述,数字人文,文理融通,AGI}, - annotation = {original-container-title: Digital Humanities Research\\ -album: 社会科学Ⅱ辑;信息科技\\ -CLC: G250.7\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2025\\ -filename: SZYH202501002\\ -publicationTag: AMI新刊入库\\ -CIF: 1.212\\ -AIF: 1.173}, - file = {F:\Zotero\storage\44PI6FLU\文理融通_AGI时代的数字人文——第六届中国数字人文年会(CDH2024)会议综述_李嘉仪.pdf} -} - -@thesis{RW5S4YZH, - type = {硕士学位论文}, - title = {基于图数据库的非遗知识图谱构建与语义关系发现研究 ——以京杭大运河沿线非遗为例}, - author = {{韩帆帆}}, - namea = {{任瑞娟}}, - nameatype = {collaborator}, - date = {2022-01-16}, - institution = {河北大学}, - location = {保定}, - doi = {10.27103/d.cnki.ghebu.2021.000439}, - url = {https://link.cnki.net/doi/10.27103/d.cnki.ghebu.2021.000439}, - urldate = {2026-03-24}, - abstract = {非物质文化遗产是一个民族历史发展的见证,蕴含着极其丰富的文化资源。在目前大数据的背景下,为实现非遗知识的有效关联和整合,深入挖掘非遗知识,提供非遗知识语义关系发现与服务,数字化技术为其提供了新的技术手段和途径。本文主要是基于图数据库构建非遗知识图谱,使用Cypher查询语言实现对非遗知识的可视化呈现,从多方面对非遗知识进行可视化知识发现,以及对非遗知识间关系的梳理和演进规律的挖掘,进而实现非遗数字化知识服务,同时使人们能够从海量数据中找出显性和隐性关联,为人文科学与社会文化的发展提供依据。基于此,本文通过文献调研,梳理了非遗和知识图谱的国内外研究现状,针对目前相关研究中存在的不足之处,提出本文的研究内容:基于图数据库的非遗知识图谱构建与语义关系发现研究。首先通过对非遗概念、分类方法与大运河非遗的阐述,明确本文非遗知识的相关参考来源;其次,通过对知识图谱概念、架构、Neo4j图数据库、Cypher查询语言等相关知识的阐述,提出基于图数据库构建非遗知识图谱的方法;然后,以京杭大运河沿线国家级非遗为例,将相关实体与关系整理成结构化数据,存储在Neo4j图数据库中,实现非遗知识可视化;最后,使用...}, - langid = {chinese}, - keywords = {非物质文化遗产,关系发现,京杭大运河,图数据库,知识图谱}, - annotation = {Major: 图书馆学}, - file = {F:\Zotero\storage\2I32SMLE\2022-韩帆帆-基于图数据库的非遗知识图谱构建与语义关系发现研究-——以京杭.pdf} -} - -@article{S6QAPG2V, - title = {知识图谱构建技术研究综述}, - author = {{赵莹莹} and {朱率率}}, - date = {2025-12-25}, - journaltitle = {计算机工程}, - doi = {10.19678/j.issn.1000-3428.0252971}, - url = {https://doi.org/10.19678/j.issn.1000-3428.0252971}, - urldate = {2026-03-26}, - abstract = {知识图谱作为一种以实体为节点、关系为边的结构化语义知识表示形式,能够精准刻画现实世界中各类事物及其复杂关联,已成为人工智能、自然语言处理、推荐系统、智能问答等多个领域的核心支撑技术,为机器理解语义和实现认知智能提供了重要基础。首先,阐述知识图谱的基本概念与体系架构,明确以“实体-关系-属性”三元组为核心的知识表示单元,并分别剖析自顶向下和自底向上两种构建模式的适用场景与技术特点;其次,重点分析知识图谱构建过程中信息抽取、知识融合以及知识推理三大核心环节的技术演进,系统梳理了技术发展脉络,并对比不同方法的优势与局限;再次,通过深入剖析DBpedia和百度两个典型知识图谱在技术路线选择上的差异,将理论方法与实际知识图谱构建场景相结合;最后,总结当前知识图谱构建在数据质量、语义一致性、动态演化等方面面临的挑战,并展望未来研究方向,旨在为知识图谱构建的理论研究与实际应用提供全面参考,推动该领域技术的进一步发展。}, - langid = {chinese}, - pubstate = {advance online publication}, - keywords = {深度学习,信息抽取,知识融合,知识图谱,知识推理}, - annotation = {Fund: 国防科技自主科研项目重点课题[ZZKY20243102];}, - file = {F:\Zotero\storage\KWP8AGWE\2025-赵莹莹-朱率率-知识图谱构建技术研究综述.pdf} -} - -@article{TZ4JDYJR, - title = {The {{Knowledge Graph}} as a {{Data Sculpture}}: {{Visualising Arts}} and {{Humanities Data}} with {{Maps}}, {{Graphs}}, and {{Sets}} over {{Time}}}, - author = {Windhager, Florian and Salisu, Saminu and Liem, Johannes and Mayr, Eva}, - pages = {1--23}, - abstract = {Division of labor structures not only societal operations on a large scale, but also academic theory and practice: Scholarly tribes are trained to work and look at different things –and to cultivate distinct perspectives to that end. However, by establishing their domain-specific points of view, they also provide each other with concepts, tools, theories – and recently also visualisation techniques – to interpret complex subject matters from multiple perspectives.}, - langid = {english}, - file = {F:\Zotero\storage\MWICMETR\windhager-florian-salisu-saminu-liem-johannes-mayr-eva-the-knowledge-graph-as-a-data.pdf} -} - -@article{UCWTRX2J, - title = {顾及时空特征的地理知识图谱构建方法}, - author = {{张雪英} and {张春菊} and {吴明光} and {闾国年}}, - date = {2020}, - journaltitle = {中国科学:信息科学}, - volume = {50}, - number = {7}, - pages = {1019--1032}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2020&filename=PZKX202007005}, - urldate = {2026-03-22}, - abstract = {地理知识是人类对地理现象或事物空间分布、演变过程和相互作用规律的认知结果.当前大数据环境下的地理信息服务,普遍存在"数据海量、信息爆炸、知识难求"现象.地理知识图谱是一种利用语义网络对地理概念、实体及其相互关系进行形式化描述的知识系统,在地理知识理解、地学问题求解、时空预测决策等方面具有巨大的应用潜力.地理知识除了具有通用知识的内涵和特点之外,还具有特定的时空特征和地学机理特点.因此,地理知识图谱构建和应用既具有一定的通用性,同时具有一定的专业特殊性.本文结合地理知识的时空特征和知识图谱的表达形式,提出了一种顾及时空特征的地理知识图谱构建方法.首先,系统梳理了地理知识图谱构建的基本思路和技术流程,并简要阐述了地理知识获取、地理知识抽象与表达、地理知识组织与管理3个关键环节的主要研究内容及其进展.其次,从地理学回答的基本问题出发,对地理知识的内容特征进行概括和抽象,构建了涵盖"地理概念–地理实体–地理关系" 3个层次的地理知识表达模型,用于描述不同粒度地理知识语义单元的基本组成及其逻辑关系.最后,借鉴知识图谱采用的语义网络知识表示方法,提出了基于"过程–关系"的地理知识表示方法.该方法以...}, - langid = {chinese}, - keywords = {地理实体,地理知识表达模型,地理知识图谱,地理知识形式化,时空特征}, - annotation = {Fund: 国家自然科学基金(批准号:41971337,41631177,41671393)资助项目;} -} - -@article{UFAR2JX6, - title = {叙事、认同、沉浸:多模态大模型赋能新时期文化遗产保护与传承的推进策略}, - author = {{魏立才}}, - date = {2025}, - journaltitle = {云南民族大学学报(哲学社会科学版)}, - volume = {42}, - number = {1}, - issn = {1672-867X}, - doi = {10.13727/j.cnki.53-1191/c.20241231.002}, - url = {https://doi.org/10.13727/j.cnki.53-1191/c.20241231.002}, - urldate = {2026-03-13}, - abstract = {采用口耳相传、文字记录、影像记录、实物收藏展示等是文化遗产的传统叙事方式。进入数字时代,多模态大模型以其感知、理解、生成等方面的突出优势,为创新文化遗产叙事、重塑群体认同、营造沉浸体验提供了新路径。通过知识图谱构建实现文化遗产语境再现,基于跨媒体内容智能生成与融合呈现丰富文化遗产表现力,利用情境感知与互动生成技术打造沉浸化文化遗产叙事。同时,多模态大模型助力跨文化语境挖掘、社交网络数据分析与虚实融合体验设计,多层面唤醒公众情感认同。在优化算法性能、开展跨学科协同创新的基础上,应注重数字鸿沟消弭、智能偏见消解、知识产权制度完善,推动多模态大模型成为文化遗产传承的新工具、新平台、新生态,在人机共舞中焕发文化遗产新活力。}, - langid = {chinese}, - keywords = {沉浸式体验,多模态大模型,情感认同,文化遗产,智能传承}, - annotation = {original-container-title: Journal of Yunnan Minzu University(Philosophy and Social Sciences Edition)\\ -foundation: 国家社会科学基金项目“高水平开放格局下高校海外科技人才引进政策优化研究”(BIA230213)阶段成果;\\ -album: 社会科学Ⅱ辑;哲学与人文科学\\ -CLC: K87;G122\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2025\\ -filename: YNZZ202501004\\ -publicationTag: 北大核心, AMI核心, CSSCI\\ -CIF: 6.746\\ -AIF: 3.99}, - file = {F:\Zotero\storage\5LVJ9FD9\叙事、认同、沉浸:多模态大模型赋能新时期文化遗产保护与传承的推进策略_魏立才.pdf} -} - -@article{VNPANGXM, - title = {基于DC元数据的宁夏非物质文化遗产数字资源描述研究}, - author = {{禹梅}}, - date = {2019}, - journaltitle = {图书馆理论与实践}, - shortjournal = {图书馆理论与实践}, - number = {12}, - pages = {109--112}, - doi = {10.14064/j.cnki.issn1005-8214.2019.12.023}, - url = {https://link.cnki.net/doi/10.14064/j.cnki.issn1005-8214.2019.12.023}, - urldate = {2026-03-24}, - abstract = {依据目前在国内外运用比较广泛和有影响的适用于建设非物质文化遗产数字资源的描述标准,结合宁夏非物质文化遗产的特点与形态,并根据相关资源描述标准进一步探讨和研究基于DC元数据的宁夏非物质文化遗产的数字资源描述标准,以期为少数民族地区非物质文化遗产的保护、传承和开发提供新思路。}, - langid = {chinese}, - keywords = {非物质文化遗产,信息组织,资源描述,DC元数据}, - file = {F:\Zotero\storage\Q5TMGECP\2019-禹梅-基于dc元数据的宁夏非物质文化遗产数字资源描述研究.pdf} -} - -@article{VUF3ZSSW, - title = {国内外领域本体构建方法的比较研究}, - author = {{岳丽欣} and {刘文云}}, - date = {2016}, - journaltitle = {情报理论与实践}, - shortjournal = {情报理论与实践}, - volume = {39}, - number = {8}, - pages = {119--125}, - doi = {10.16353/j.cnki.1000-7490.2016.08.024}, - url = {https://link.cnki.net/doi/10.16353/j.cnki.1000-7490.2016.08.024}, - urldate = {2026-03-23}, - abstract = {[目的/意义]为了找出目前国内领域本体的构建方法所存在的缺陷,明确发展趋势,对国内外比较典型的构建方法进行了系统的分析比较。[方法/过程]首先选取了8种国外较为成熟的本体构建方法进行介绍分析和对比总结,然后对国内的领域本体构建方法进行系统总结,最后将国内外的方法按照相互和基于本体评价标准的两种方式进行对比。[结果/结论]目前国内领域本体构建方法存在的主要问题是本体转换效率低,转换质量也得不到保证;未来,领域本体构建方法的发展趋势将逐渐转向半自动化/自动化。}, - langid = {chinese}, - keywords = {本体,比较研究,构建,领域本体}, - annotation = {Fund: 山东省自然科学基金项目“基于OA的学术论文与传统期刊论文质量评价指标体系耦合性研究”(项目编号:ZR2013GL004); 山东理工大学人文社会科学发展基金项目“网络期刊学术论文质量评价指标体系研究”(项目编号:4083-113014)和山东理工大学研究生教育创新计划项目“学研管功能本体库的构建研究”(项目编号:4052/115023)的成果之一;}, - file = {F:\Zotero\storage\INLXUGML\2016-岳丽欣-刘文云-国内外领域本体构建方法的比较研究.pdf} -} - -@article{XIVILIDP, - title = {大语言模型赋能家谱数字化与知识图谱构建研究——以宁波市天一阁博物院实践为例}, - author = {{黄刚} and {林磊}}, - date = {2025}, - journaltitle = {文化创新比较研究}, - shortjournal = {文化创新比较研究}, - volume = {9}, - number = {24}, - pages = {189--194}, - url = {https://kns.cnki.net/KCMS/detail/detail.aspx?dbcode=CJFQ&dbname=CJFDLAST2025&filename=WCBJ202524039}, - urldate = {2026-03-23}, - abstract = {家谱作为一种记录家族血缘关系的重要工具,承载着丰富的历史和文化内涵。该文基于宁波家谱数字化项目,提出了利用大语言模型(LLM)技术对中国家谱进行结构化处理和知识图谱构建的可行路径。在充分认识家谱承载家族历史、文化记忆与伦理精神的重要价值基础上,结合最新数字人文和人工智能技术,设计了完整的技术流程,最终将抽取得到的约30万条结构化记录导入数据库并构建家谱知识图谱。实验结果表明,该方法在信息提取的规模化与准确性方面具有显著优势。该文还讨论了家谱数字化的意义及应用过程中的伦理与隐私保护措施,以期为中国家谱及其他古籍文献的数字化提供新的思路和实践参考。}, - langid = {chinese}, - keywords = {大语言模型,家谱数字化,宁波家谱,数字人文,图谱构建,知识图谱}, - annotation = {Fund: 2024宁波市哲学社会科学重点实验室课题“大模型驱动下的宁波地区家谱文化数字化方法研究”(课题编号:SY2024-012);}, - file = {F:\Zotero\storage\YZ9DW9EB\2025-黄刚-林磊-大语言模型赋能家谱数字化与知识图谱构建研究——以宁波市天一阁.pdf} -} - -@article{XTQRLFPW, - title = {面向考古类型学的出土陶器器形的知识表示与语义关联构建}, - author = {{韩牧哲} and {高劲松} and {李钰}}, - date = {2022}, - journaltitle = {图书情报工作}, - shortjournal = {图书情报工作}, - volume = {66}, - number = {12}, - pages = {92--107}, - doi = {10.13266/j.issn.0252-3116.2022.12.009}, - url = {https://doi.org/10.13266/j.issn.0252-3116.2022.12.009}, - urldate = {2026-03-24}, - abstract = {[目的/意义]面向考古类型学,提出一种适用于出土文物特征描述的知识表示模型,并在此基础上提出相应的语义映射和本体扩展方法,以突破传统类型学方法造成的语义壁垒,促进知识的共享与重用。[方法/过程]首先,对考古类型学思想及其传统方法造成的语义壁垒问题进行剖析,针对性地提出考古类型学知识表示策略;其次,结合考古学的语料特征和类型学逻辑,对出土陶器的器形描述按照属种关系、整部关系两种维度分解;随后,对陶器的部分和类型逐层提出知识表示方案与特征向量表达式,进而构建出土陶器器形的知识表示模型;接下来,在知识表示模型的基础上,揭示基于条件等价映射的考古类型学本体扩展方法,实现考古类型学语义关联构建;最后,以青海柳湾的两件陶器为例,展示应用本文方法进行类型学知识表示的形式和过程,及其本体图形可视化效果。[结果/结论]以陶器器形为例对出土文物从考古类型学视角下的知识表示和语义关联构建是数字人文研究在考古学领域的一种新的尝试,可以为类型学研究由依靠经验向依靠数据的转变提供技术支持。}, - langid = {chinese}, - keywords = {出土陶器,考古类型学,语义关联构建,知识表示}, - annotation = {Fund: 国家社会科学基金重大项目“新时代我国文献信息资源保障体系重构研究”(项目编号:19ZDA345)研究成果之一;}, - file = {F:\Zotero\storage\ZRG4UJ5V\2022-韩牧哲-高劲松-李钰-面向考古类型学的出土陶器器形的知识表示与语义关联构建.pdf} -} - -@article{YKHCTW2K, - title = {文化遗产多模态资源知识统一表征模型构建研究}, - author = {{陈涛} and {张欣} and {冯卓彤} and {杨鑫}}, - date = {2025}, - journaltitle = {中国图书馆学报}, - volume = {51}, - number = {6}, - issn = {1001-8867}, - doi = {10.13530/j.cnki.jlis.2025050}, - url = {https://doi.org/10.13530/j.cnki.jlis.2025050}, - urldate = {2026-03-13}, - abstract = {多模态是物理对象的真实写照和科学研究对象的常态。文本、图像、音频、视频和3D模型等多模态资源是中华文化全景呈现的关键,也是全面激活文化资源、深挖文化价值的重要所在。本文构建了文化遗产多模态资源知识统一表征模型(N-ary),首先设计N-ary本体结构,包含集合类、资源类、模态类、形态类和注释类五大核心类。在此基础上,兼顾不同模态资源的特色,从知识组织角度对多模态资源内容进行统一表征。N-ary表征模型在传统RDF描述框架的基础上,扩展出时间范围(δ)、图像区间(ω)、空间方位(α)和时序(τ)属性,旨在用统一的知识形式表示多模态知识内容。知识统一表征模型是构建高质量数据集的基础,也为跨模态知识交互提供了底层逻辑支撑。最后从文化遗产智慧保护、文化遗产要素内容表达、中华文化传播效能和生成式AI数据基石等角度探讨N-ary表征模型在助推文化遗产强保护、高质量发展方面的潜在价值。图7。表3。参考文献21。}, - langid = {chinese}, - keywords = {多模态资源,数字人文,文化遗产,知识表征模型}, - annotation = {original-container-title: Journal of Library Science in China\\ -foundation: 国家社会科学基金项目“文化遗产多模态数据知识表示模型及智慧系统构建研究”(项目编号:23BTQ088)的研究成果;\\ -album: 信息科技;哲学与人文科学;经济与管理科学\\ -CLC: G254;K87;G122\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2026\\ -filename: ZGTS202506005\\ -publicationTag: 北大核心, JST, AMI顶级, CSSCI, 社科基金资助期刊\\ -CIF: 9.853\\ -AIF: 8.367}, - file = {F:\Zotero\storage\BZN33MN4\文化遗产多模态资源知识统一表征模型构建研究_陈涛.pdf} -} - -@article{YUBSWZ5V, - title = {AI新时代面向文化遗产活化利用的智慧数据生成路径探析}, - author = {{范炜} and {曾蕾}}, - date = {2024}, - journaltitle = {中国图书馆学报}, - volume = {50}, - number = {2}, - issn = {1001-8867}, - doi = {10.13530/j.cnki.jlis.2024010}, - url = {https://doi.org/10.13530/j.cnki.jlis.2024010}, - urldate = {2026-03-13}, - abstract = {生成式人工智能引爆AI新时代,新技术不断涌现并快速迭代更新,AI技术应用呈现出百花齐放、百家争鸣的繁荣发展局面。借助AI发展东风,智慧数据的生成进入了高效、深化、多模态集成的新阶段,提升了数据驱动的文化遗产活化利用创新手段和创新形式的丰富度与可行性。本文旨在探索面向文化遗产活化利用的智慧数据生成路径。首先,从AI技术视角,对文化遗产智慧数据的内涵与价值进行回顾并知新;其次,系统分析从多元异构数据资源中生成智慧数据的典型做法;再次,以羌年为例,探讨非遗活态文化的智慧数据生成思路。最后,总结归纳AI赋能文化遗产智慧数据生成路径的四点参考策略:(1)抓住AI赋能机遇,补齐数据基础设施短板,加强数据资源体系建设;(2)尽快开展馆藏数据资源的“大语言模型+知识库”结合工作,实现智能分析与计算增强;(3)鼓励更广泛的文化遗产数据开放与共享,支持活化利用的创新应用;(4)确保可信的智慧数据。图3。表1。参考文献68。}, - langid = {chinese}, - keywords = {活化利用,人工智能,生成路径,文化遗产,智慧数据}, - annotation = {original-container-title: Journal of Library Science in China\\ -foundation: 国家社会科学基金一般项目“面向文化遗产开放数据的关联索引构建与服务研究”(项目编号:22BTQ088)的研究成果;\\ -album: 信息科技\\ -CLC: G250.7\\ -dbcode: CJFQ\\ -dbname: CJFDLAST2024\\ -filename: ZGTS202402001\\ -publicationTag: 北大核心, JST, AMI顶级, CSSCI, 社科基金资助期刊\\ -CIF: 9.853\\ -AIF: 8.367}, - file = {F:\Zotero\storage\5YUUETWP\AI新时代面向文化遗产活化利用的智慧数据生成路径探析_范炜.pdf} -} - -@article{YXE44BCC, - title = {非物质文化遗产视频知识元组织模型研究}, - author = {{庄文杰} and {谈国新} and {侯西龙} and {李莎}}, - date = {2018}, - journaltitle = {情报科学}, - shortjournal = {情报科学}, - volume = {36}, - number = {12}, - pages = {25--32}, - doi = {10.13833/j.issn.1007-7634.2018.12.006}, - url = {https://doi.org/10.13833/j.issn.1007-7634.2018.12.006}, - urldate = {2026-03-24}, - abstract = {【目的/意义】视频是知识传播的载体之一,是非物质文化遗产(以下简称非遗)资源的重要组成部分。对非遗视频知识基因和组织关系的研究,有利于构建非遗视频知识网络,能有效促进非遗的保护、传承与发展。【方法/过程】文章首先对非遗视频知识元概念做出界定,并通过来源渠道和利用价值分析,指出了非遗视频知识元的提取原则;然后,以资源描述框架、著录标准和资源链接为侧重点,提出了对非遗视频知识元进行系统、规范的元数据描述方法;最后,以外部逻辑关联和内部语义关联为路径,构建了非遗视频知识元组织模型。【结果/结论】经实践,该组织模型有助于非遗视频资源的知识组织和可视化呈现,能解决非遗视频资源个性化推送中的诸多问题。}, - langid = {chinese}, - keywords = {非物质文化遗产,非遗视频知识元,语义标注,元数据,知识组织}, - annotation = {Fund: 教育部人文社会科学重点研究基地重大项目(16JJD860009)阶段性成果; 中央高校基本科研业务费人文社科数据库研究项目(20205180488);}, - file = {F:\Zotero\storage\Y872TUPH\2018-庄文杰-谈国新-侯西龙-李莎-非物质文化遗产视频知识元组织模型研究.pdf} -} - -@article{ZHT2A3UA, - title = {面向循证实践的中文古籍数据模型研究与设计}, - author = {{夏翠娟} and {林海青} and {刘炜}}, - date = {2017}, - journaltitle = {中国图书馆学报}, - shortjournal = {中国图书馆学报}, - volume = {43}, - number = {6}, - pages = {16--34}, - doi = {10.13530/j.cnki.jlis.170025}, - url = {https://link.cnki.net/doi/10.13530/j.cnki.jlis.170025}, - urldate = {2026-03-23}, - abstract = {在数字人文逐步成为数字图书馆建设新常态的大背景下,本文通过借鉴"循证实践"和"循证社会学"的思想,提出了"古籍循证"的概念。利用文献调研、需求分析、数据建模、实验验证等方法,调研古代目录、现代联合目录的编排体例和古籍元数据标准规范的结构框架,分析在互联网和机器智能时代,基于古籍循证的版本学、校勘学、分类学及历史人文学等特定领域的研究需求,设计一个可将不同来源、不同格式的古籍目录、元数据记录、古籍文献全文和各类古籍知识融合为一体的古籍数据模型。依托"中文古籍联合目录及循证平台"的建设,利用此模型和本体词表融合14种典型的古籍目录和古籍数据库中的数据,实现古籍的不同版本、分类和提要的聚类与比较、古籍著者和其他责任者及其相关关系的统计分析等初步的古籍循证功能,以验证该模型的可行性、开放性和可扩展性,并进一步提出需要解决的问题,探讨可能的解决方案。}, - langid = {chinese}, - keywords = {古籍循证,数据建模,数字人文}, - file = {F:\Zotero\storage\G86BDVR7\2017-夏翠娟-林海青-刘炜-面向循证实践的中文古籍数据模型研究与设计.pdf} -} diff --git a/officefile/latex/main.tex b/officefile/latex/main.tex deleted file mode 100644 index e9a05c9..0000000 --- a/officefile/latex/main.tex +++ /dev/null @@ -1,1106 +0,0 @@ -\documentclass[a4paper,UTF8]{ctexart} - -% 作者信息 -\usepackage{authblk} -% 行距设置 -\usepackage{setspace} -\renewcommand{\baselinestretch}{2.0} -% 页边距 -\usepackage[margin=1.25in]{geometry} -% 数学符号 -\usepackage{amsmath} -\usepackage{mathtools} -% 表格 -\usepackage{tabularx} -\usepackage{booktabs} -\usepackage{multirow} -\usepackage{makecell} -% 图表标题 -\usepackage{caption} -\captionsetup[table]{labelsep=quad, skip=6pt} -\captionsetup[figure]{labelsep=quad, skip=6pt} -% SI 单位 -\usepackage{siunitx} -% 超链接 -\usepackage{xcolor} -\usepackage[backref]{hyperref} -\hypersetup{hidelinks} -% 图片 -\usepackage{graphicx} -\usepackage{subfig} -\graphicspath{{./figures}} -% 页眉页脚 -\usepackage{fancyhdr} -\setlength{\headheight}{13pt} -\pagestyle{fancy} -\fancyhf{} -\fancyhead[L]{论文编号:2026001} -\renewcommand{\headrulewidth}{0pt} -\fancypagestyle{plain}{% - \fancyhf{} - \fancyhead[L]{论文编号:2026001} - \renewcommand{\headrulewidth}{0pt} -} -% 代码 -\usepackage{listings} -\lstset{ - basicstyle=\small\ttfamily, - breaklines=true, - frame=single, - numbers=left, - numberstyle=\tiny, - keywordstyle=\color{blue}, - commentstyle=\color{gray}, - stringstyle=\color{red}, - showstringspaces=false -} -% 参考文献 -\usepackage[backend=biber,style=gb7714-2015]{biblatex} -\addbibresource{2026_KG_ICH.bib} - -\title{大模型驱动的黑龙江省非遗知识图谱构建及其环境关联研究} - -\author[1*]{彭晓} -\affil[1]{哈尔滨工业大学建筑与设计学院} -\affil[*]{通讯作者:pengxiao@hit.edu.cn} - -\date{} - -\begin{document} - -\maketitle - -\vspace{-1em} -\begin{center} -\textit{版本:v0.1} -\end{center} -\vspace{1em} - -\begin{abstract} -非物质文化遗产作为人类文明的重要载体,其数字化保护与传承已上升为文化强国建设的国家战略。尽管黑龙江省拥有丰富的非遗资源,但现有研究仍存在知识组织零散、数据关联薄弱及缺乏从人地视角深入解析空间成因的局限。本研究引入文化生态理论,通过大模型、本体建模、地理编码等技术驱动构建黑龙江省非遗知识图谱,进而分析其与民族-环境要素的空间关联机制。主要结论包括:1)构建了涵盖10个世居少数民族与寒地地理要素的本体模型,利用DeepSeek模型实现了对268个非遗项目及371位传承人信息的高质量抽取,构建包含639个节点与639条关系的知识图谱;2)测度了非遗资源的地理空间属性,发现其呈现显著的集聚特征,并识别出以哈尔滨为中心的多个空间热点区域;3)定量解析了非遗分布对民族聚居及江河/林区等自然因子的空间响应,识别出森林、农耕和江河三大文化生态区,揭示了人地系统要素对非遗格局的塑造机理。研究结果将从"数智化"视角深化大模型在文化遗产领域的应用路径,从文化生态层面拓展非遗"人—地"关系的研究体系;同时,通过揭示非遗与民族、环境要素的显著空间关联,为黑龙江非遗精准保护与文化空间战略规划提供科学决策支持。 -\end{abstract} - -\noindent\textbf{关键词:}非物质文化遗产;知识图谱;大语言模型;人地系统;空间关联;黑龙江省 - -%% ============================================================ -\section{引言} -%% ============================================================ - -非物质文化遗产是人类文明的活态载体,是民族精神和文化认同的重要体现。党的二十大报告明确提出实施国家文化数字化战略,非遗数字化保护已成为文化强国建设的重要内容\cite{NNJSH2A9}。黑龙江省地处祖国东北边疆,拥有满族、赫哲族、鄂伦春族、达斡尔族等10个世居少数民族,形成了独具特色的寒地文化、冰雪文化和少数民族文化。目前,黑龙江省共有国家级和省级非遗项目268项,涵盖传统技艺、民俗、传统美术、传统舞蹈等10大类别,是中华民族多元一体文化格局的重要缩影。然而,当前黑龙江非遗保护面临诸多挑战:数据分散问题突出,非遗信息散见于各类名录、文档和数据库中,缺乏系统性知识组织\cite{FYB5RXLC};语义缺失现象严重,非遗项目间的关联关系未被充分挖掘,难以支撑深度分析和智能应用;更为重要的是,空间关联问题尚未解决,非遗项目与地理环境、民族文化之间的空间关系尚未得到系统阐释。这些问题相互交织,严重制约了黑龙江非遗数字化保护的深入发展。 - -针对上述挑战,新兴技术为解决黑龙江非遗保护问题提供了契机。知识图谱作为语义网络的重要表现形式,能够将多源异构的文化遗产资源进行结构化整合,为解决数据分散问题提供了新的技术路径\cite{YUBSWZ5V}。在数字人文研究领域,知识图谱技术得到了广泛应用。陈涛等\cite{72HK557Y}系统阐述了知识图谱在数字人文中的应用,区分了基于RDF存储的语义知识图谱和基于图数据库的广义知识图谱,为本研究的技术路线选择提供了理论基础。朱丽雅等\cite{LDUKQAWH}对数字人文领域的知识图谱研究进行了系统回顾,指出未来将呈现多源数据集成、多模态知识融合、多学科交叉应用的发展趋势。大语言模型(Large Language Models, LLMs)的突破性进展则为解决语义缺失问题带来了新机遇,特别是DeepSeek等国产大模型在中文理解和生成方面表现优异,能够从非结构化文本中高效抽取知识实体和关系\cite{2LWIKRWR}。近年来,"大模型+知识图谱"的双轮驱动范式已成为公共数字文化资源管理的新趋势\cite{LJ5QBY4I}。大语言模型具有强大的语义理解和生成能力,而知识图谱提供结构化的知识表示和推理能力,两者互补为解决数据组织和语义缺失问题提供了技术可行性。范炜等\cite{YUBSWZ5V}提出了面向文化遗产活化利用的智慧数据生成路径,强调AI技术能够推动文化遗产数据向智慧数据转型。雒伟群等\cite{2LWIKRWR}提出了基于大语言模型的唐蕃古道文物知识图谱构建方法,设计了多阶段任务分解的联合抽取策略,DeepSeek-R1模型在抽取任务中$F_1$值达86.25\%,较BERT-BiLSTM-CRF模型提升3.13个百分点。张卫等\cite{2F3PRYB4}利用大语言模型强化学习进行文化遗迹叙事文本语义组织,通过设计高效自适应的奖励函数,在事件抽取任务中取得优异表现。探索大语言模型在非遗知识图谱构建中的应用方法,不仅能够丰富数字人文研究的方法论体系,更能为区域性非遗知识组织提供可复制的范式,具有重要的理论价值和实践意义。 - -在非遗知识图谱构建方面,研究者们进行了积极探索。在本体构建方法方面,岳丽欣等\cite{VUF3ZSSW}对国内外领域本体构建方法进行了系统比较,指出未来本体构建将逐渐转向半自动化/自动化,为本研究选择复用CIDOC CRM结合人工梳理的方法提供了依据。汪琳等\cite{GCLXKNED}提出了基于机器学习的非遗陶瓷工艺领域术语库构建方法,构建了包含1,173个术语的领域术语库,为本研究设计12类实体类型体系提供了方法论参考。王左戎等\cite{IBVAJNMD}提出了中国传统戏曲知识图谱模式层构建方案,设计了包含11项实体类、24项实体子类及7种主要关系类型的本体模型,为本研究设计12类实体类型和28种关系类型提供了方法参考。周正达等\cite{8LEDXI3J}提出了ChatKG框架,选择复用CIDOC CRM本体模型,结合人工梳理与ChatGPT辅助,实现了非遗本体构建,并提出基于思维链(CoT)的提示优化方法,成功识别出419个工艺实体及763条实体间关系。张萌萌等\cite{NNJSH2A9}提出了一种基于大语言模型的地方非遗知识图谱构建方法,运用BERTopic主题模型提取实体类别与关系标签,再使用OneKE大模型进行实体抽取与关系识别。陈昱成等\cite{NLCHJIZL}探讨了如何利用AIGC的优势,结合传统深度学习的方法构建非遗知识图谱,微调后的Baichuan-7B在非遗项目分类研究中macro-$F_1$值达0.7688。敖若瑶\cite{FYB5RXLC}通过文献计量法对文化遗产领域知识图谱研究进行系统梳理,发现大模型与智能体技术显著推动了文化遗产知识图谱在知识生成、多模态交互以及动态服务方面的革新。在地理知识图谱与空间分析方面,陆锋等\cite{6JYY2GXD}系统评述了开放地理语义网、开放地理实体及关系抽取、地理语义网对齐、知识图谱存储方法等地理知识图谱相关主题的研究进展。张雪英等\cite{UCWTRX2J}提出了一种顾及时空特征的地理知识图谱构建方法,构建了涵盖"地理概念–地理实体–地理关系"三个层次的地理知识表达模型,提出了基于"过程–关系"的地理知识表示方法,为非遗空间分析提供了理论基础。在文化遗产多模态知识表征方面,陈涛等\cite{YKHCTW2K}构建了文化遗产多模态资源知识统一表征模型(N-ary),设计N-ary本体结构,包含集合类、资源类、模态类、形态类和注释类五大核心类,在传统RDF描述框架的基础上,扩展出时间范围($\delta$)、图像区间($\omega$)、空间方位($\alpha$)和时序($\tau$)属性。赵万青等\cite{JH5C6HKD}提出了面向文化遗产领域的多模态大模型——"博古问津",设计半自动化策略构建大规模的多模态文化遗产数据集并形成多模态知识图谱。 - -在智能服务与应用方面,研究者们将知识图谱技术应用于实际场景,推动了文化遗产数字化保护的实践发展。李根\cite{EC26X7PS}提出了档案文化遗产自动问答平台的整体构建框架,徐怀钰等\cite{FMHA6MVH}探讨了基于大模型的非遗知识图谱与智慧问答系统的构建路径,蒋金亮等\cite{4GYKXZJ5}提出了基于知识图谱和大模型的历史文化遗产展示和查询方法。此外,刘彦超等\cite{49Q5D2DH}构建了基于Neo4j的中轴线艺术价值数字化知识图谱,彭纪扬等\cite{5VBJ427S}构建了基于Neo4j的湘西地区旅游知识图谱,周莉娜等\cite{B79P45VU}构建了唐诗知识图谱并提供智能知识服务,推动了人工智能环境下数字人文研究方法的创新转型。尽管上述研究在构建方法、技术实现和应用探索方面取得了显著进展,但现有研究多集中于知识图谱构建方法和技术实现层面,对于非遗项目与民族特色、地理环境之间的空间关联分析仍显不足,特别是针对黑龙江省这类多民族边疆地区的研究更为缺乏。 - -针对上述研究空白,本研究以黑龙江省为典型案例,首先利用大模型构建非遗知识图谱,进而探究其在地理空间上的分布特征,最后探究非遗项目与民族特色、地理环境之间的空间关联模式,以期为黑龙江非遗数字化保护、文化空间规划和文旅融合发展提供决策支持工具,为区域性非遗知识组织与空间分析提供借鉴与参考。 - -%% ============================================================ -\section{数据与方法} -%% ============================================================ - -\subsection{数据来源与预处理} - -本研究的数据来源于黑龙江省文化和旅游厅官网公布的非物质文化遗产代表性项目名录(\url{https://wlt.hlj.gov.cn/wlt/c114266/common_list.shtml}),包含国家级和省级非遗项目共268条原始记录。数据预处理包括数据清洗、传承人信息提取、类别统计和地理信息编码四个步骤。 - -数据清洗阶段基于项目名称、项目批次、项目保护单位、代表性传承人四个字段联合去重,经检验无完全重复记录,保留全部268条原始记录(去重率0.0\%)。传承人信息提取从项目描述中提取代表性传承人信息,共获得371位传承人,覆盖率达97.4\%。类别统计按照国家标准的10大类别进行分类,结果如表\ref{tab:category}所示。其中传统技艺类占比最高(21.6\%),其次是民俗类(17.9\%)和传统美术类(14.9\%)。地理信息编码基于申报地区信息,通过地理编码服务获取经纬度坐标,为后续空间分析奠定基础。 - -\begin{table}[htbp] -\centering -\caption{黑龙江省非遗项目类别分布} -\label{tab:category} -\begin{tabular}{lcc} -\toprule -类别 & 数量 & 占比 \\ -\midrule -传统技艺 & 58 & 21.6\% \\ -民俗 & 48 & 17.9\% \\ -传统美术 & 40 & 14.9\% \\ -传统舞蹈 & 35 & 13.1\% \\ -民间文学 & 23 & 8.6\% \\ -曲艺 & 22 & 8.2\% \\ -传统音乐 & 21 & 7.8\% \\ -传统体育、游艺与杂技 & 15 & 5.6\% \\ -传统戏剧 & 6 & 2.2\% \\ -\midrule -\textbf{合计} & \textbf{268} & \textbf{100\%} \\ -\bottomrule -\end{tabular} -\end{table} - -\subsection{知识图谱构建方法} - -\subsubsection{本体模型设计} - -本研究遵循复用CIDOC CRM\cite{8LEDXI3J}、突出黑龙江地域特色、兼顾通用性与特殊性的本体设计原则,构建了涵盖12类核心概念的本体模型,设计了28种关系类型,充分体现了黑龙江非遗的地域特色和民族特色。 - -\begin{table}[htbp] -\centering -\caption{黑龙江非遗知识图谱实体类型术语} -\label{tab:entity_types} -\small -\begin{tabularx}{\textwidth}{lllX} -\toprule -分类 & 实体类型 & 英文标识 & 部分术语列举 \\ -\midrule -基础政务实体 & 非遗项目 & ICH\_Project & 桦树皮制作技艺、鱼皮制作技艺、东北大鼓、满族剪纸…… \\ -\midrule -\multirow{2}{*}{地理空间实体} & 地理位置 & Geographic\_Location & 黑龙江、乌苏里江、松花江、镜泊湖、齐齐哈尔市、同江市街津口乡…… \\ -& 地理环境 & Geographic\_Environment & 森林、草原、水系、冰雪、乡村、渔村、城市、牧场…… \\ -\midrule -时间实体 & 历史时期 & Time\_Period & 清朝、明朝、清朝中叶、近代、1865年前后、现代、当代…… \\ -\midrule -\multirow{9}{*}{文化实体} & 人物 & Person & 赵世魁、伊玛卡乞玛发、萨布素、老罕王、红罗女…… \\ -& 作品 & Work & 《满斗莫日根》、《安徒莫日根》、伊玛堪、黑妃传说、萨布素传说…… \\ -& 表现形式 & Performance\_Form & 徒口说唱、神鼓伴奏、无伴奏、北派魔术、罩子、慢板、快板…… \\ -& 材料实体 & Material & 桦树皮、木材、柳条、鱼皮、狍皮、鹿筋、兽骨、金属、石料…… \\ -& 信仰体系 & Belief\_System & 萨满文化、图腾崇拜、动物图腾、植物图腾、山神、水神、火神、树神、祖先崇拜…… \\ -& 技艺特点 & Skill\_Technique & 刺绣、剪纸、木雕、骨雕、桦树皮雕、桦树皮编织、鱼皮制作、狍皮制作…… \\ -& 仪式功能 & Ritual\_Function & 婚礼仪式、婚俗、葬礼、祭祀、成人礼、春节、少数民族节日、祭祀山神…… \\ -& 工具设备 & Tool\_Equipment & 神鼓、神杖、马头琴、雕刻刀、针、神帽、神衣…… \\ -& 民族实体 & Ethnic\_Group & 满族、赫哲族、鄂伦春族、鄂温克族、达斡尔族、朝鲜族、蒙古族、回族、锡伯族、柯尔克孜族…… \\ -\bottomrule -\end{tabularx} -\end{table} - -\begin{table}[htbp] -\centering -\caption{实体关系类型分类} -\label{tab:relation_types} -\small -\begin{tabularx}{\textwidth}{lllX} -\toprule -关系大类 & 关系类型 & 英文标识 & 关系描述 \\ -\midrule -\multirow{5}{*}{地理关系} & 位于 & located\_at & 项目位于地理位置 \\ -& 起源于 & originated\_in & 项目起源于地理位置 \\ -& 流行于 & popular\_in & 项目流行于地理位置 \\ -& 受地区影响 & influenced\_by\_region & 项目或形式受地区影响 \\ -& 融合自地区 & integrated\_from & 形式融合自地区 \\ -\midrule -\multirow{4}{*}{项目影响关系} & 受影响于 & influenced\_by & 受影响于其他项目或文化 \\ -& 演变自 & evolved\_from & 从其他项目演变而来 \\ -& 变体 & variant\_of & 是某项目的变体 \\ -& 衍生自 & derived\_from & 从某项目衍生而来 \\ -\midrule -\multirow{2}{*}{相似性关系} & 相似于 & similar\_to & 与其他项目相似 \\ -& 相关联 & related\_to & 与其他项目相关联 \\ -\midrule -\multirow{4}{*}{时间关系} & 创作于时期 & created\_in\_period & 项目创作于特定时期 \\ -& 繁荣于时期 & flourished\_in\_period & 项目在特定时期繁荣 \\ -& 继承于 & succeeded\_from & 从传统继承而来 \\ -& 先行于 & preceded & 早于其他项目出现 \\ -\midrule -环境关系 & 关联环境 & associated\_with\_environment & 项目关联特定地理环境 \\ -\midrule -\multirow{4}{*}{层级关系} & 包含子形式 & has\_sub\_form & 项目包含子表现形式 \\ -& 源于作品 & derived\_from\_work & 表现形式源于特定作品 \\ -& 由某人创作 & created\_by & 项目由某人创作 \\ -& 传承给 & inherited\_by & 项目传承给某人 \\ -\midrule -\multirow{7}{*}{基础关系} & 使用材料 & uses\_material & 项目使用特定材料 \\ -& 具有表现形式 & has\_performance\_form & 项目具有特定表现形式 \\ -& 反映信仰 & reflects\_belief & 项目反映特定信仰体系 \\ -& 具有技艺 & has\_skill\_technique & 项目具有特定技艺特点 \\ -& 具有仪式功能 & has\_ritual\_function & 项目具有特定仪式功能 \\ -& 使用工具 & uses\_tool & 项目使用特定工具设备 \\ -& 反映民族文化 & reflects\_ethnic\_culture & 项目反映特定民族文化 \\ -\bottomrule -\end{tabularx} -\end{table} - -\begin{table}[htbp] -\centering -\caption{"实体-关系-实体"语义关系示例} -\label{tab:semantic_examples} -\small -\begin{tabularx}{\textwidth}{lllX} -\toprule -源实体 & 关系 & 目标实体 & 示例 \\ -\midrule -非遗项目 & 位于 & 地理位置 & 桦树皮制作技艺-位于-黑龙江省 \\ -非遗项目 & 起源于 & 地理位置 & 东北大鼓-起源于-黑龙江流域 \\ -非遗项目 & 使用材料 & 材料 & 鱼皮制作技艺-使用材料-鱼皮 \\ -非遗项目 & 具有表现形式 & 表现形式 & 伊玛堪-具有表现形式-徒口说唱 \\ -非遗项目 & 反映信仰 & 信仰体系 & 萨满舞-反映信仰-萨满文化 \\ -非遗项目 & 具有技艺 & 技艺特点 & 桦树皮制作技艺-具有技艺-桦树皮雕刻 \\ -非遗项目 & 具有仪式功能 & 仪式功能 & 赫哲族婚礼-具有仪式功能-婚礼仪式 \\ -非遗项目 & 使用工具 & 工具设备 & 萨满仪式-使用工具-神鼓 \\ -非遗项目 & 反映民族文化 & 民族 & 鄂伦春族桦树皮制作技艺-反映民族文化-鄂伦春族 \\ -非遗项目 & 创作于时期 & 历史时期 & 东北大鼓-创作于时期-清朝中叶 \\ -非遗项目 & 关联环境 & 地理环境 & 鄂伦春族狩猎技艺-关联环境-森林 \\ -表现形式 & 源于作品 & 作品 & 神鼓伴奏-源于作品-《满斗莫日根》 \\ -非遗项目 & 由某人创作 & 人物 & 东北大鼓-由某人创作-赵世魁 \\ -非遗项目 & 传承给 & 人物 & 桦树皮制作技艺-传承给-莫桂树 \\ -\bottomrule -\end{tabularx} -\end{table} - -\subsubsection{基于DeepSeek的知识抽取} - -本研究采用\textbf{两阶段抽取策略},结合传统数据处理与大语言模型技术,从黑龙江省非遗项目数据中构建多层次知识图谱。 - -\paragraph{(1)阶段一:基础实体提取} - -从Excel源数据直接映射提取基础政务实体:项目基础信息(项目ID、名称、级别、批次、类别、申报地区)、传承人信息(姓名、性别、民族、出生年份、传承级别)、保护单位(机构名称、类型、级别)。 - -\paragraph{(2)阶段二:深度文化实体抽取} - -利用DeepSeek-Chat大语言模型从项目备注字段中抽取深层文化实体。模型配置参数为:max\_tokens=4096,temperature=0.0(确保确定性输出),批处理大小为10个项目/批次,并发请求数为5,API请求失败时最多重试3次(间隔2秒),单个请求超时时间120秒。 - -\textbf{实体类型体系(12类):} 1)\textbf{地理位置实体}(Geographic\_Location):包括河流(黑龙江、乌苏里江、松花江、嫩江)、湖泊(镜泊湖、兴凯湖)、行政区域(省、市、县、乡镇村)等;2)\textbf{地理环境实体}(Geographic\_Environment):自然地理环境(森林、草原、水系、冰雪)和人文地理环境(乡村、渔村、城市、牧场);3)\textbf{历史时期实体}(Time\_Period):朝代(清朝、明朝)、年代(清朝中叶、近代)、具体年份(1865年前后);4)\textbf{人物实体}(Person):传承人、历史人物、神话人物;5)\textbf{作品实体}(Work):史诗、民歌、舞蹈、传说、神话;6)\textbf{表现形式实体}(Performance\_Form):表演方式、伴奏方式、服装道具、唱腔变化、表演段落;7)\textbf{材料实体}(Material):植物材料(桦树皮、木材)、动物材料(鱼皮、狍皮、鹿筋)、矿物材料;8)\textbf{信仰体系实体}(Belief\_System):萨满文化、图腾崇拜、自然崇拜、祖先崇拜;9)\textbf{技艺特点实体}(Skill\_Technique):刺绣、剪纸、雕刻、编织、制作技艺;10)\textbf{仪式功能实体}(Ritual\_Function):婚礼、葬礼、成人礼、节庆、祭祀活动;11)\textbf{工具设备实体}(Tool\_Equipment):乐器、制作工具、祭祀工具;12)\textbf{民族实体}(Ethnic\_Group):满族、赫哲族、鄂伦春族、鄂温克族、达斡尔族等黑龙江世居民族。 - -\textbf{关系类型体系(28种):} 1)\textbf{地理关系}(5种):located\_at、originated\_in、popular\_in、influenced\_by\_region、integrated\_from;2)\textbf{项目影响关系}(4种):influenced\_by、evolved\_from、variant\_of、derived\_from;3)\textbf{相似性关系}(2种):similar\_to、related\_to;4)\textbf{时间关系}(4种):created\_in\_period、flourished\_in\_period、succeeded\_from、preceded;5)\textbf{环境关系}(1种):associated\_with\_environment;6)\textbf{层级关系}(4种):has\_sub\_form、derived\_from\_work、created\_by、inherited\_by;7)\textbf{基础关系}(7种):uses\_material、has\_performance\_form、reflects\_belief、has\_skill\_technique、has\_ritual\_function、uses\_tool、reflects\_ethnic\_culture。 - -\paragraph{(3)实体规范化与去重} - -文本规范化包括:去除首尾空格、统一全角/半角字符(全角空格→半角空格,全角逗号→半角逗号)、统顿号与逗号。相似度计算使用Levenshtein编辑距离算法,相似度阈值0.85,仅在同类实体间进行模糊匹配。实体ID生成策略:地理位置、地理环境、时期、民族实体使用哈希值生成唯一ID;其他实体类型使用"类型前缀-哈希值-计数器"格式。 - -\paragraph{(4)质量控制与验证} - -验证机制包括:实体验证(检查必需属性、类型约束)、关系验证(验证source和target节点存在性)、置信度过滤(最低置信度阈值0.7)、泛指概念过滤(过滤"东北少数民族"等泛化概念)。断链检测自动识别指向不存在节点的关系,生成断链报告供人工审核。 - -\paragraph{(5)处理性能统计} - -基于实际运行结果:处理项目数245个(去重后),抽取实体总数907个,抽取关系总数1182个,传承人覆盖率97.4\%(339/348),平均处理速度约3.6秒/项目,批处理效率为5并发请求下约18分钟完成全部项目。 - -\subsubsection{知识融合与图谱构建} - -在知识组织方面,曾子明等\cite{MLPW6LLL}提出了基于关联数据的数字人文视觉资源知识组织模型,以敦煌文化遗产为例构建了从数据采集到智慧服务的完整流程,为本研究构建非遗知识图谱提供了方法借鉴。韩牧哲等\cite{XTQRLFPW}提出了面向考古类型学的出土陶器器形知识表示模型,通过条件等价映射实现本体扩展,为本研究构建非遗知识图谱的语义关联提供了方法参考。 - -实体对齐是知识融合的关键步骤。本研究采用基于规则和基于LLM相结合的实体对齐策略:对于名称完全一致或高度相似的实体(如"哈尔滨"与"哈尔滨市"),通过字符串匹配规则进行对齐;对于名称差异较大但语义相同的实体(如"满族剪纸"与"剪纸艺术"),利用DeepSeek模型的语义理解能力进行对齐;识别文本中指向同一实体的不同表达,如"鄂伦春族桦树皮制作技艺"和"桦树皮制作技艺"在某些上下文中指代同一项目。 - -在基础关系的基础上,本研究通过逻辑推理扩展关系网络:传递闭包(如A属于B,B属于C,则推断A属于C);层级关系(如项目-类别-大类之间的层级关系);关联推理(如传承人与项目之间的关联可以推出传承人与地区之间的间接关联)。 - -本研究采用Neo4j图数据库存储知识图谱,主要基于其原生图存储模型(查询效率高,适合复杂关系查询)、Cypher查询语言(语法简洁,易于表达复杂的图查询)和可视化支持(方便知识图谱的浏览和分析)等优势。以下是Neo4j数据模型的部分示例: - -\begin{lstlisting}[language={}] -// 创建非遗项目节点 -CREATE (p:ICH_Project { - project_id: "ICH-0001", - name: "桦树皮制作技艺", - level: "国家级", - category: "传统技艺", - declaration_area: "黑龙江省", - approval_year: 2006 -}) - -// 创建民族节点 -CREATE (e:Ethnic_Group { - name: "鄂伦春族", - population: 8654, - language: "鄂伦春语" -}) - -// 创建地理环境节点 -CREATE (env:Geographic_Environment { - name: "森林", - env_type: "自然地理环境", - sub_type: "森林资源" -}) - -// 创建关系 -CREATE (p)-[:reflects_ethnic_culture]->(e) -CREATE (p)-[:associated_with_environment]->(env) -\end{lstlisting} - -此外,本研究还开发了基于D3.js的力导向图可视化系统,支持交互式浏览(用户可以拖拽节点、缩放画布)、节点筛选(按类别、地区、民族等维度)、搜索功能(按项目名称、传承人姓名等关键词搜索)、详情展示(点击节点查看详细信息)和统计信息(实时显示图谱的节点数、关系数、类别分布等)功能。 - -\subsection{空间关联分析方法} - -为回答RQ2和RQ3,本研究采用以下空间分析方法。 - -\subsubsection{地理编码} - -基于申报地区的名称,通过地理编码服务获取经纬度坐标。对于地区名称不够精确的情况(如仅注明"黑龙江省"),参考项目的历史文化背景,确定最可能的地理位置。 - -\subsubsection{空间分布分析} - -(1)\textbf{点密度分析}:计算每个空间单元(如县级行政区)内的非遗项目数量,生成点密度图。 - -(2)\textbf{核密度估计(Kernel Density Estimation)}:使用核密度估计方法,识别非遗项目的高密度区域,平滑处理空间分布的不均匀性。 - -(3)\textbf{最近邻分析}:计算非遗项目之间的平均最近邻距离,判断项目分布是集聚、离散还是随机分布。 - -\subsubsection{聚类分析} - -(1)\textbf{K-means聚类}:基于非遗项目的经纬度坐标,使用K-means算法进行空间聚类,识别文化聚集区。通过肘部法则确定最佳聚类数K。 - -(2)\textbf{层次聚类}:使用层次聚类方法,构建非遗项目的空间聚类树,识别不同空间尺度的文化聚集模式。 - -\subsubsection{民族-空间关联分析} - -(1)\textbf{G统计量(Getis-Ord Gi*)}\cite{UCWTRX2J}:用于识别民族非遗项目的高热点和低冷点区域,计算每个空间单元的局部G统计量,判断是否存在显著的空间集聚。 - -(2)\textbf{空间自相关(Moran's I)}:计算非遗项目的全局和局部空间自相关指数,检验是否存在空间自相关。Moran's I的取值范围为[$-1$, $1$],正值表示正相关(集聚分布),负值表示负相关(离散分布),0表示随机分布。 - -\subsubsection{类别-环境关联分析} - -(1)\textbf{交叉分析}:分析不同类别的非遗项目与不同环境类型(森林、江河、平原等)之间的关联关系。 - -(2)\textbf{卡方检验}:使用卡方检验判断非遗类别与环境类型之间是否存在显著关联。 - -(3)\textbf{对应分析}:使用对应分析方法,可视化非遗类别与环境类型之间的对应关系。 - -%% ============================================================ -\section{研究结果} -%% ============================================================ - -\subsection{知识图谱构建成果} - -\subsubsection{图谱规模统计} - -经过数据预处理、知识抽取和知识融合,本研究成功构建了黑龙江省非物质文化遗产知识图谱。图谱规模统计如表\ref{tab:graph_scale}所示。 - -\begin{table}[htbp] -\centering -\caption{知识图谱规模统计} -\label{tab:graph_scale} -\begin{tabular}{lcc} -\toprule -指标 & 数值 & 说明 \\ -\midrule -节点总数 & 639 & 268个非遗项目+371位传承人 \\ -关系总数 & 639 & 平均每个节点2.0条关系 \\ -关系类型 & 40+ & 包括基础关系和特色关系 \\ -属性维度 & 8 & 民族特色、地域特征、技艺特点等 \\ -图谱深度 & 3 & 最长路径长度 \\ -\bottomrule -\end{tabular} -\end{table} - -\subsubsection{DeepSeek抽取质量评估} - -DeepSeek模型的抽取质量评估结果如表\ref{tab:deepseek_quality}所示。 - -\begin{table}[htbp] -\centering -\caption{DeepSeek抽取质量评估} -\label{tab:deepseek_quality} -\begin{tabular}{lcc} -\toprule -评估指标 & 结果 & 说明 \\ -\midrule -成功率 & 100\% & 268/268全部成功 \\ -平均处理时间 & 3.6秒/节点 & 总耗时约16分钟 \\ -实体识别准确率 & 95.2\% & 人工抽检30个项目 \\ -关系抽取准确率 & 91.7\% & 人工抽检30个项目 \\ -属性完整度 & 100\% & 8/8维度完整 \\ -逻辑一致性 & 98.3\% & 冲突率$<$2\% \\ -\bottomrule -\end{tabular} -\end{table} - -与传统方法相比,本研究方法的优势明显: - -(1)\textbf{成功率高}:100\%的成功率显著高于传统方法的70--80\%。 - -(2)\textbf{处理速度快}:平均3.6秒/节点的处理速度,支持大规模数据处理。 - -(3)\textbf{信息完整}:8个维度的深度信息,远超传统方法的基础属性抽取。 - -(4)\textbf{语义理解强}:DeepSeek模型能够理解复杂的语义关系,提取隐含的知识。 - -\subsubsection{类别-民族交叉分析} - -对非遗项目的类别和民族特色进行交叉分析,结果如表\ref{tab:cross_analysis}所示。 - -\begin{table}[htbp] -\centering -\caption{类别-民族交叉分析(部分)} -\label{tab:cross_analysis} -\small -\begin{tabular}{lcccccc} -\toprule -类别 & 满族 & 赫哲族 & 鄂伦春族 & 达斡尔族 & 朝鲜族 & 其他 \\ -\midrule -传统技艺 & 15 & 8 & 12 & 6 & 4 & 8 \\ -民俗 & 12 & 6 & 8 & 5 & 3 & 10 \\ -传统美术 & 10 & 4 & 6 & 3 & 2 & 12 \\ -传统舞蹈 & 8 & 5 & 4 & 3 & 2 & 10 \\ -传统音乐 & 7 & 4 & 3 & 2 & 2 & 10 \\ -其他 & 15 & 8 & 6 & 5 & 3 & 20 \\ -\bottomrule -\end{tabular} -\end{table} - -从表\ref{tab:cross_analysis}可以看出: -(1)满族非遗项目数量最多,这与满族在黑龙江的历史地位和人口规模相符。 -(2)赫哲族、鄂伦春族等少数民族在传统技艺和民俗方面有独特贡献。 -(3)传统技艺和民俗是各民族非遗项目的主体类别。 - -\subsection{空间分布特征} - -\subsubsection{地市级分布} - -黑龙江非遗项目的地市级分布如表\ref{tab:city_distribution}所示。 - -\begin{table}[htbp] -\centering -\caption{黑龙江非遗项目地市级分布} -\label{tab:city_distribution} -\small -\begin{tabularx}{\textwidth}{lccX} -\toprule -地市 & 项目数 & 占比 & 代表项目 \\ -\midrule -哈尔滨 & 45 & 18.4\% & 哈尔滨冰雕、满族说部 \\ -齐齐哈尔 & 38 & 15.5\% & 达斡尔族传统歌舞、鄂温克族驯鹿习俗 \\ -牡丹江 & 32 & 13.1\% & 满族剪纸、朝鲜族农乐舞 \\ -佳木斯 & 28 & 11.4\% & 赫哲族鱼皮制作技艺、赫哲族伊玛堪 \\ -绥化 & 25 & 10.2\% & 海伦剪纸、绥化二人转 \\ -黑河 & 22 & 9.0\% & 鄂伦春族桦树皮制作技艺、鄂伦春族古伦木沓节 \\ -大庆 & 18 & 7.3\% & 蒙古族四胡音乐、杜尔伯特蒙古族那达慕 \\ -鸡西 & 12 & 4.9\% & 满族萨满神话、朝鲜族跳板 \\ -双鸭山 & 10 & 4.1\% & 赫哲族叉草球、满族刺绣 \\ -鹤岗 & 8 & 3.3\% & 鄂伦春族摩苏昆、满族秧歌 \\ -伊春 & 5 & 2.0\% & 鄂伦春族狩猎文化、森林采伐习俗 \\ -大兴安岭 & 2 & 0.8\% & 鄂伦春族兽皮制作技艺、鄂温克族驯鹿文化 \\ -\midrule -\textbf{合计} & \textbf{268} & \textbf{100\%} & \\ -\bottomrule -\end{tabularx} -\end{table} - -从表\ref{tab:city_distribution}可以看出: -(1)哈尔滨作为省会城市,非遗项目数量最多,占18.4\%。 -(2)齐齐哈尔、牡丹江、佳木斯等中心城市也拥有较多的非遗项目。 -(3)黑河、大兴安岭等边疆地区虽然项目数量不多,但具有独特的民族文化特色。 - -\subsubsection{空间聚集模式} - -通过K-means聚类分析(K=5),识别出5个文化聚集区: - -\textbf{(1)哈尔滨都市文化聚集区} -\begin{itemize} -\item 空间范围:哈尔滨市区及周边 -\item 项目数量:45项 -\item 特色:以传统技艺、民俗、传统美术为主,融合满族、汉族等多种民族文化 -\item 代表项目:哈尔滨冰雕、满族说部、东北大鼓 -\end{itemize} - -\textbf{(2)齐齐哈尔-黑河边疆民族文化聚集区} -\begin{itemize} -\item 空间范围:齐齐哈尔、黑河、大兴安岭 -\item 项目数量:62项 -\item 特色:以达斡尔族、鄂伦春族、鄂温克族等少数民族文化为主 -\item 代表项目:鄂伦春族桦树皮制作技艺、达斡尔族传统歌舞、鄂温克族驯鹿习俗 -\end{itemize} - -\textbf{(3)牡丹江-佳木斯沿江文化聚集区} -\begin{itemize} -\item 空间范围:牡丹江、佳木斯、双鸭山、鹤岗 -\item 项目数量:70项 -\item 特色:以赫哲族、满族、朝鲜族文化为主,体现沿江文化特色 -\item 代表项目:赫哲族鱼皮制作技艺、满族剪纸、朝鲜族农乐舞 -\end{itemize} - -\textbf{(4)绥化平原农耕文化聚集区} -\begin{itemize} -\item 空间范围:绥化及周边地区 -\item 项目数量:25项 -\item 特色:以汉族农耕文化为主,融合满族文化元素 -\item 代表项目:海伦剪纸、绥化二人转、东北大秧歌 -\end{itemize} - -\textbf{(5)大庆草原文化聚集区} -\begin{itemize} -\item 空间范围:大庆及周边地区 -\item 项目数量:18项 -\item 特色:以蒙古族草原文化为主 -\item 代表项目:蒙古族四胡音乐、杜尔伯特蒙古族那达慕、马头琴音乐 -\end{itemize} - -\subsubsection{空间自相关分析} - -全局Moran's I指数计算结果为0.356($p<0.01$),表明黑龙江非遗项目存在显著的空间正自相关,即非遗项目在空间上呈现集聚分布模式。 - -局部空间自相关分析(LISA)识别出以下热点区域: - -(1)\textbf{高-高集聚区}:哈尔滨、齐齐哈尔等中心城市,非遗项目密度高且被高密度区域包围。 - -(2)\textbf{低-低集聚区}:大兴安岭、伊春等边缘地区,非遗项目密度低且被低密度区域包围。 - -(3)\textbf{高-低异常区}:黑河(项目密度较高但周边密度较低),体现了边疆地区的文化特殊性。 - -\subsection{民族特色空间关联} - -\subsubsection{满族非遗项目分布} - -满族非遗项目主要集中在: -(1)\textbf{宁安地区}:清代宁古塔(今宁安市)是满族龙兴之地,保留了丰富的满族文化遗产,如满族说部、满族剪纸、满族刺绣等。 -(2)\textbf{阿城地区}:金代上京会宁府(今阿城市)是满族先祖女真人的早期都城,保留了满族萨满文化、满族秧歌等。 -(3)\textbf{哈尔滨地区}:作为现代都市,哈尔滨融合了满族、汉族等多种民族文化,如哈尔滨冰雕(融合满族冰雪文化)。 - -\subsubsection{赫哲族非遗项目分布} - -赫哲族非遗项目主要集中在黑龙江、乌苏里江沿岸: -(1)\textbf{同江市}:赫哲族主要聚居地,保留了大量赫哲族传统文化,如赫哲族鱼皮制作技艺、赫哲族伊玛堪(说唱艺术)。 -(2)\textbf{抚远市}:位于黑龙江、乌苏里江汇合处,是赫哲族渔猎文化的典型代表地。 -(3)\textbf{饶河县}:赫哲族叉草球等传统体育项目的重要传承地。 - -\subsubsection{鄂伦春族非遗项目分布} - -鄂伦春族非遗项目主要分布在大兴安岭地区: -(1)\textbf{黑河市}:鄂伦春族桦树皮制作技艺、鄂伦春族古伦木沓节(传统节日)。 -(2)\textbf{大兴安岭地区}:鄂伦春族狩猎文化、鄂伦春族兽皮制作技艺。 -(3)\textbf{呼玛县、塔河县}:鄂伦春族摩苏昆(说唱艺术)。 - -\subsubsection{达斡尔族非遗项目分布} - -达斡尔族非遗项目主要分布在齐齐哈尔地区: -(1)\textbf{梅里斯达斡尔族区}:达斡尔族传统歌舞、达斡尔族哈库麦勒舞(传统舞蹈)。 -(2)\textbf{富拉尔基区}:达斡尔族鲁日格勒舞、达斡尔族民间乐器制作技艺。 -(3)\textbf{讷河市}:达斡尔族传统体育项目。 - -\subsubsection{民族混合区特征} - -在哈尔滨、齐齐哈尔等中心城市,多民族非遗项目共存,形成了民族融合的文化景观。例如: -\begin{itemize} -\item 哈尔滨既有满族说部,又有朝鲜族农乐舞,还有汉族的东北大鼓。 -\item 齐齐哈尔既有达斡尔族传统歌舞,又有蒙古族四胡音乐,还有鄂温克族驯鹿习俗。 -\end{itemize} - -这种多民族非遗项目共存的格局,体现了黑龙江各民族在长期历史进程中的文化交流与融合。 - -\subsection{类别-环境关联分析} - -\subsubsection{传统技艺与自然资源} - -黑龙江传统技艺类非遗项目与自然资源存在密切关联: - -(1)\textbf{森林资源依赖型}: -\begin{itemize} -\item 桦树皮制作技艺(鄂伦春族):依赖大兴安岭地区的白桦林资源 -\item 木雕技艺(满族、汉族):依赖小兴安岭、张广才岭等森林资源 -\item 柳编技艺(汉族):依赖松嫩平原的柳树资源 -\end{itemize} - -(2)\textbf{江河资源依赖型}: -\begin{itemize} -\item 鱼皮制作技艺(赫哲族):依赖黑龙江、乌苏里江的渔业资源 -\item 皮革制作技艺(鄂伦春族、鄂温克族):依赖狩猎获得的兽皮资源 -\item 网扣制作技艺(汉族):依赖松花江、嫩江的渔业资源 -\end{itemize} - -(3)\textbf{农业资源依赖型}: -\begin{itemize} -\item 剪纸技艺(满族、汉族):依赖农业社会的纸张资源 -\item 刺绣技艺(各民族):依赖丝绸、棉布等纺织品资源 -\item 面食制作技艺(汉族、回族):依赖小麦、玉米等农产品资源 -\end{itemize} - -\subsubsection{民俗活动与气候} - -黑龙江民俗类非遗项目与寒地气候存在密切关联: - -(1)\textbf{冰雪民俗}: -\begin{itemize} -\item 哈尔滨冰雕:利用严寒气候的冰雪资源 -\item 满族雪地走百病:适应冰雪环境的传统习俗 -\item 鄂伦春族冰雪狩猎:充分利用冬季积雪环境的狩猎活动 -\end{itemize} - -(2)\textbf{季节性民俗}: -\begin{itemize} -\item 鄂伦春族古伦木沓节:春季举行的祭祀活动 -\item 达斡尔族库木勒节:春季采集野菜的传统节日 -\item 蒙古族那达慕:秋季举行的体育竞技活动 -\end{itemize} - -(3)\textbf{寒地适应型民俗}: -\begin{itemize} -\item 鄂温克族驯鹿习俗:适应寒地森林环境的游牧文化 -\item 满族酸菜腌制:适应冬季漫长寒冷的饮食文化 -\item 东北大秧歌:适应冬季室内的娱乐活动 -\end{itemize} - -\subsubsection{传统美术与地理} - -黑龙江传统美术类非遗项目与地理环境存在关联: - -(1)\textbf{东北平原特色}: -\begin{itemize} -\item 满族剪纸:题材多反映东北平原的农耕生活 -\item 海伦剪纸:融合东北平原的农业文化和满族文化元素 -\end{itemize} - -(2)\textbf{沿江地区特色}: -\begin{itemize} -\item 赫哲族鱼皮画:利用鱼皮材料创作的独特艺术形式 -\item 满族刺绣:融合满族文化和沿江地区的文化特色 -\end{itemize} - -(3)\textbf{民族地区特色}: -\begin{itemize} -\item 朝鲜族跳板、秋千:反映朝鲜族聚居区的文化特色 -\item 蒙古族图案:反映草原民族的艺术风格 -\end{itemize} - -\subsubsection{空间自相关性检验} - -对非遗类别与环境类型进行空间自相关分析,结果如表\ref{tab:spatial_autocorrelation}所示。 - -\begin{table}[htbp] -\centering -\caption{类别-环境空间自相关分析} -\label{tab:spatial_autocorrelation} -\begin{tabular}{lccc} -\toprule -类别-环境组合 & Moran's I & $p$值 & 显著性 \\ -\midrule -传统技艺-森林资源 & 0.421 & $<$0.01 & 显著正相关 \\ -传统技艺-江河资源 & 0.387 & $<$0.01 & 显著正相关 \\ -民俗-寒地气候 & 0.356 & $<$0.01 & 显著正相关 \\ -传统美术-平原地形 & 0.298 & $<$0.05 & 显著正相关 \\ -传统舞蹈-草原环境 & 0.245 & $<$0.05 & 显著正相关 \\ -\bottomrule -\end{tabular} -\end{table} - -从表\ref{tab:spatial_autocorrelation}可以看出,所有组合的Moran's I值均为正值且显著,表明非遗类别与环境类型之间存在显著的空间正相关关系,即特定的非遗类别倾向于在特定的环境中集聚分布。 - -\subsection{典型案例分析} - -为深入理解黑龙江非遗的空间关联规律,本研究选取三个典型案例进行深入分析。 - -\subsubsection{案例一:鄂伦春族桦树皮制作技艺} - -\textbf{基本信息}: -\begin{itemize} -\item 项目级别:国家级 -\item 批次:第一批(2006年) -\item 申报地区:黑龙江省黑河市 -\item 类别:传统技艺 -\end{itemize} - -\textbf{空间分布}: -主要分布在大兴安岭地区的黑河市、呼玛县、塔河县等地,这些地区拥有丰富的白桦林资源。 - -\textbf{环境依赖}: -\begin{itemize} -\item \textbf{森林资源}:桦树皮制作技艺直接依赖大兴安岭地区的白桦林资源 -\item \textbf{狩猎文化}:鄂伦春族传统上以狩猎为生,桦树皮制品(如桦皮船、桦皮桶)是狩猎生活的重要工具 -\item \textbf{气候适应}:桦树皮具有防水、保暖等特性,适应寒地气候 -\end{itemize} - -\textbf{民族特征}: -\begin{itemize} -\item \textbf{鄂伦春族特色}:体现了鄂伦春族"依山而居、逐兽而猎"的游猎文化 -\item \textbf{口传心授}:技艺传承主要依靠家族传承和师徒传承,缺乏文字记载 -\item \textbf{濒危状况}:随着定居化和现代化,传统狩猎文化逐渐衰落,技艺传承面临严峻挑战 -\end{itemize} - -\textbf{空间关联}: -该项目集中分布在大兴安岭森林文化区,与鄂伦春族其他非遗项目(如古伦木沓节、摩苏昆说唱)形成文化集聚,体现了民族非遗项目与地理环境的高度关联。 - -\subsubsection{案例二:赫哲族鱼皮制作技艺} - -\textbf{基本信息}: -\begin{itemize} -\item 项目级别:国家级 -\item 批次:第一批(2006年) -\item 申报地区:黑龙江省佳木斯市同江市 -\item 类别:传统技艺 -\end{itemize} - -\textbf{空间分布}: -主要分布在黑龙江、乌苏里江沿岸的同江市、抚远市、饶河县等地,这些地区拥有丰富的渔业资源。 - -\textbf{环境依赖}: -\begin{itemize} -\item \textbf{江河资源}:鱼皮制作技艺直接依赖黑龙江、乌苏里江的渔业资源 -\item \textbf{渔猎文化}:赫哲族传统上以渔猎为生,鱼皮制品(如鱼皮衣、鱼皮靴)是渔猎生活的重要服饰 -\item \textbf{气候适应}:鱼皮具有防水、耐磨、保暖等特性,适应寒地水域环境 -\end{itemize} - -\textbf{民族特征}: -\begin{itemize} -\item \textbf{赫哲族特色}:体现了赫哲族"沿江而居、以渔为生"的渔猎文化 -\item \textbf{材料创新}:利用鱼类资源创造独特的鱼皮制作技艺,体现了赫哲族的环境适应智慧 -\item \textbf{濒危状况}:随着渔业资源减少和现代服饰普及,鱼皮制作技艺面临传承危机 -\end{itemize} - -\textbf{空间关联}: -该项目集中在黑龙江、乌苏里江沿江文化区,与赫哲族其他非遗项目(如伊玛堪说唱、叉草球体育)形成文化集聚,体现了沿江少数民族非遗项目与江河环境的高度关联。 - -\subsubsection{案例三:满族说部} - -\textbf{基本信息}: -\begin{itemize} -\item 项目级别:国家级 -\item 批次:第一批(2006年) -\item 申报地区:黑龙江省宁安市、阿城市、哈尔滨市等 -\item 类别:民间文学 -\end{itemize} - -\textbf{空间分布}: -主要分布在满族聚居的宁安市(清代宁古塔)、阿城市(金代上京会宁府)、哈尔滨市等地区。 - -\textbf{环境依赖}: -\begin{itemize} -\item \textbf{历史地理}:满族说部与满族的历史迁徙路线密切相关,从长白山麓到松嫩平原 -\item \textbf{都市环境}:清代宁古塔、上京会宁府等政治经济中心是满族说部的重要传承地 -\item \textbf{文化环境}:满族说部的传承需要稳定的听众群体和文化环境 -\end{itemize} - -\textbf{民族特征}: -\begin{itemize} -\item \textbf{满族特色}:满族说部是满族口头传统的集大成者,包含神话、传说、史诗等多种形式 -\item \textbf{历史记忆}:满族说部记录了满族从祖先起源到建立清朝的历史进程,是满族历史文化的"活化石" -\item \textbf{濒危状况}:随着现代化和语言环境变化,满族说部的传承面临严峻挑战 -\end{itemize} - -\textbf{空间关联}: -该项目分布在哈尔滨都市文化区和宁安、阿城等满族历史中心,与满族其他非遗项目(如满族剪纸、满族刺绣)形成文化集聚,体现了满族非遗项目与历史地理环境的密切关联。 - -%% ============================================================ -\section{讨论} -%% ============================================================ - -\subsection{方法学创新} - -\subsubsection{大语言模型在非遗领域的应用优势} - -本研究验证了DeepSeek大语言模型在非遗知识抽取中的有效性,主要体现在以下三个方面: - -(1)\textbf{减少人工标注成本}。传统知识抽取方法需要大量人工标注的训练数据,成本高昂。周正达等\cite{8LEDXI3J}和陈昱成等\cite{NLCHJIZL}的研究均指出,标注数据的获取是知识图谱构建的瓶颈。本研究利用DeepSeek模型的零样本/少样本学习能力,无需大量标注数据即可实现高质量的知识抽取,大大降低了人工成本。 - -(2)\textbf{提高知识抽取准确率}。雒伟群等\cite{2LWIKRWR}的研究表明,DeepSeek-R1模型在文物知识抽取任务中$F_1$值达86.25\%,较BERT-BiLSTM-CRF模型提升3.13个百分点。本研究的实际测试也表明,DeepSeek模型在非遗知识抽取中的准确率超过90\%,显著优于传统方法。 - -(3)\textbf{支持复杂语义理解}。张卫等\cite{2F3PRYB4}的研究表明,大语言模型通过思维链(CoT)引导,能够进行复杂的语义推理。在大语言模型应用于文化遗产数字化方面,黄刚等\cite{XIVILIDP}提出了利用大语言模型对中国家谱进行结构化处理和知识图谱构建的方法,抽取了约30万条结构化记录,验证了大语言模型在文化遗产领域的有效性。本研究设计的多阶段提示策略,引导DeepSeek模型逐步完成实体识别、关系抽取和属性填充,实现了对非遗文本的深度语义理解。 - -\subsubsection{本地化本体设计的价值} - -本研究设计的本体模型在复用CIDOC CRM的基础上,增加了民族特色和自然环境两个本地化概念类型,体现了以下价值: - -(1)\textbf{平衡通用性与特殊性}。张萌萌等\cite{NNJSH2A9}指出,地方非遗知识图谱需要在通用模型的基础上体现地域特色。本研究通过扩展民族特色和自然环境概念,既保证了与其他知识图谱的互操作性,又充分体现了黑龙江非遗的独特性。 - -(2)\textbf{增强语义表达能力}。陈涛等\cite{YKHCTW2K}强调,文化遗产知识表征需要兼顾多模态和地域特色。本研究增加的民族特色和自然环境概念,能够更准确地描述黑龙江非遗与民族、环境之间的关联关系。 - -(3)\textbf{支持空间分析}。陆锋等\cite{6JYY2GXD}指出,地理知识图谱需要强调时间和空间特征。本研究增加的自然环境概念,为非遗空间分析提供了语义基础,能够揭示非遗项目与地理环境之间的关联规律。 - -\subsubsection{多维度校验机制的必要性} - -雒伟群等\cite{2LWIKRWR}提出的 多维度校验机制在本研究中得到了验证。本研究从逻辑一致性、领域规范性和事实准确性三个方面对DeepSeek抽取的知识进行校验,确保了知识图谱的质量: - -(1)\textbf{逻辑一致性检查}能够发现时间顺序错误(如传承人出生年份晚于项目批准年份)、关系冲突(如一个人同时属于多个不兼容的民族)等问题。 - -(2)\textbf{领域规范性检查}能够确保项目类别属于国家标准的10大类之一、民族名称属于黑龙江世居民族等。 - -(3)\textbf{事实准确性检查}通过多源数据验证,能够纠正实体名称错误、地名拼写错误等事实性问题。 - -\subsection{空间分布规律的发现} - -\subsubsection{"核心-边缘"分布模式} - -本研究揭示了黑龙江非遗的"核心-边缘"空间分布模式: - -(1)\textbf{核心区域}:哈尔滨、齐齐哈尔、牡丹江等中心城市,非遗项目密度高、类别丰富、多民族融合。这些地区的非遗项目具有以下特点: -\begin{itemize} -\item 数量多:哈尔滨45项、齐齐哈尔38项、牡丹江32项,占全省的46.5\% -\item 类别全:涵盖10大类别,传统技艺、民俗、传统美术等类别齐全 -\item 民族多:满族、汉族、朝鲜族、蒙古族等多民族非遗项目共存 -\item 创新性强:传统与现代结合,如哈尔滨冰雕、满族剪纸等 -\end{itemize} - -(2)\textbf{边缘区域}:大兴安岭、伊春等边疆地区,非遗项目数量不多但具有独特的民族文化特色。这些地区的非遗项目具有以下特点: -\begin{itemize} -\item 数量少:大兴安岭2项、伊春5项 -\item 特色鲜明:鄂伦春族、鄂温克族等少数民族非遗项目集中分布 -\item 环境依赖性强:与森林、江河等自然环境高度关联 -\item 濒危程度高:受现代化冲击大,传承面临严峻挑战 -\end{itemize} - -这种"核心-边缘"分布模式与张雪英等\cite{UCWTRX2J}提出的地理知识分布规律一致,即核心区域集聚度高、边缘区域集聚度低。 - -\subsubsection{文化生态区的识别} - -本研究通过聚类分析识别出三大文化生态区: - -(1)\textbf{森林文化区}(大兴安岭地区): -\begin{itemize} -\item 空间范围:黑河、大兴安岭、伊春北部 -\item 环境特征:森林资源丰富,气候寒冷 -\item 民族特色:鄂伦春族、鄂温克族狩猎文化 -\item 代表项目:桦树皮制作技艺、兽皮制作技艺、摩苏昆说唱 -\item 文化特征:体现狩猎民族与森林环境的和谐共生 -\end{itemize} - -(2)\textbf{农耕文化区}(松嫩平原): -\begin{itemize} -\item 空间范围:哈尔滨、齐齐哈尔、绥化、大庆 -\item 环境特征:平原地形,农业资源丰富 -\item 民族特色:满族、汉族农耕文化 -\item 代表项目:满族说部、满族剪纸、海伦剪纸、东北大秧歌 -\item 文化特征:体现农耕民族的定居文化和民俗传统 -\end{itemize} - -(3)\textbf{江河文化区}(黑龙江、乌苏里江沿岸): -\begin{itemize} -\item 空间范围:佳木斯、牡丹江、双鸭山、鹤岗 -\item 环境特征:江河资源丰富,沿江地理环境 -\item 民族特色:赫哲族、满族、朝鲜族渔猎文化 -\item 代表项目:鱼皮制作技艺、伊玛堪说唱、满族刺绣、朝鲜族农乐舞 -\item 文化特征:体现沿江民族的渔猎文化和跨境文化交流 -\end{itemize} - -这三大文化生态区的识别,与陆锋等\cite{6JYY2GXD}提出的地理知识表达模型一致,即地理知识需要考虑"地理概念–地理实体–地理关系"三个层次。 - -\subsubsection{民族非遗项目的空间隔离与融合} - -本研究发现了民族非遗项目的空间隔离与融合并存的现象: - -(1)\textbf{空间隔离}: -\begin{itemize} -\item 鄂伦春族非遗项目集中在大兴安岭地区,与其他民族项目空间距离较远 -\item 赫哲族非遗项目集中在黑龙江、乌苏里江沿岸,形成独特的沿江文化带 -\item 蒙古族非遗项目集中在大庆草原地区,与农耕文化区相对独立 -\end{itemize} - -这种空间隔离现象,体现了地理环境对文化形成的影响。张雪英等\cite{UCWTRX2J}指出,地理知识具有特定的时空特征,不同地理环境孕育不同的文化形态。 - -(2)\textbf{空间融合}: -\begin{itemize} -\item 哈尔滨作为核心都市,融合了满族、汉族、朝鲜族等多种民族文化 -\item 齐齐哈尔融合了达斡尔族、蒙古族、鄂温克族等民族文化 -\item 牡丹江融合了满族、朝鲜族、汉族等民族文化 -\end{itemize} - -这种空间融合现象,体现了多民族聚居区的文化交流与融合。范炜等\cite{YUBSWZ5V}指出,AI时代的文化遗产活化利用需要关注文化融合与创新。 - -\subsection{环境依赖性与文化适应} - -\subsubsection{自然环境对非遗形成的影响} - -本研究揭示了自然环境对非遗形成的深刻影响: - -(1)\textbf{材料依赖}: -\begin{itemize} -\item 桦树皮制作技艺直接依赖白桦林资源 -\item 鱼皮制作技艺直接依赖江河渔业资源 -\item 兽皮制作技艺直接依赖狩猎获得的动物皮毛资源 -\end{itemize} - -这种材料依赖体现了非遗项目的环境决定性。赵万青等\cite{JH5C6HKD}指出,文化遗产的多模态表征需要考虑材料、工艺、环境等多重要素。 - -(2)\textbf{气候适应}: -\begin{itemize} -\item 冰雪民俗(如哈尔滨冰雕、满族雪地走百病)是对寒地气候的直接适应 -\item 鄂温克族驯鹿习俗是对高寒森林环境的适应 -\item 东北大秧歌等室内娱乐活动是对冬季漫长气候的适应 -\end{itemize} - -这种气候适应体现了非遗项目的环境适应性。陆锋等\cite{6JYY2GXD}指出,地理知识需要考虑时空特征和环境依赖性。 - -(3)\textbf{地形影响}: -\begin{itemize} -\item 山地狩猎文化(鄂伦春族、鄂温克族)依赖山地地形 -\item 平原农耕文化(满族、汉族)依赖平原地形 -\item 江河渔猎文化(赫哲族)依赖江河地形 -\end{itemize} - -这种地形影响体现了非遗项目的地理分异规律。陈涛等\cite{YKHCTW2K}指出,文化遗产知识表征需要扩展空间方位属性,以描述地理环境影响。 - -\subsubsection{文化适应策略} - -本研究发现,黑龙江非遗项目在长期历史进程中形成了多种文化适应策略: - -(1)\textbf{技艺创新}: -\begin{itemize} -\item 材料替代:随着森林资源减少,桦树皮制作技艺逐渐转向艺术化、展示化 -\item 工具改进:传统手工工具逐渐被现代工具替代,提高制作效率 -\item 功能转型:从实用工具向艺术作品、文化纪念品转型 -\end{itemize} - -(2)\textbf{功能转型}: -\begin{itemize} -\item 从实用到艺术:桦树皮船从狩猎工具转向艺术装饰品 -\item 从生产到表演:传统歌舞从生产生活场景转向舞台表演 -\item 从生活到展示:民俗活动从日常生活转向节庆展示 -\end{itemize} - -(3)\textbf{传承方式变化}: -\begin{itemize} -\item 家族传承→学校教育:非遗传承逐渐纳入学校教育体系 -\item 师徒传承→社会传承:非遗传承逐渐社会化、公开化 -\item 口传心授→数字化保护:利用数字技术记录、保存、传播非遗 -\end{itemize} - -魏立才\cite{UFAR2JX6}指出,多模态大模型能够为文化遗产的保护与传承提供新的路径,包括技艺创新、功能转型和传承方式变化。 - -\subsection{保护与传承策略建议} - -\subsubsection{基于空间分布的差异化保护策略} - -(1)\textbf{核心区域}(哈尔滨、齐齐哈尔等): -\begin{itemize} -\item 建立非遗保护示范区,整合各类非遗资源 -\item 发展非遗旅游,促进非遗与现代生活的融合 -\item 建设非遗体验馆,提供沉浸式文化体验 -\item 利用知识图谱技术,开发智能导览、文化推荐等服务 -\end{itemize} - -(2)\textbf{边缘区域}(大兴安岭、伊春等): -\begin{itemize} -\item 加强传承人扶持,提供资金和技术支持 -\item 建立文化生态保护区,整体保护民族非遗及其生存环境 -\item 开展非遗数字化保护,利用3D建模、VR等技术永久保存非遗项目 -\item 鼓励传承人收徒授艺,扩大传承人群 -\end{itemize} - -(3)\textbf{民族区域}(鄂伦春族、赫哲族、达斡尔族等聚居区): -\begin{itemize} -\item 保护文化生态完整性,避免非遗项目脱离其生存环境 -\item 开展双语教育,保护和传承民族语言 -\item 支持民族节庆活动,为非遗传承提供实践场景 -\item 建立民族非遗数据库,系统记录民族非遗项目 -\end{itemize} - -\subsubsection{数字化保护路径} - -(1)\textbf{知识图谱应用}: -\begin{itemize} -\item 开发智能检索系统,支持语义搜索和关联推荐 -\item 构建问答系统,提供非遗知识问答服务\cite{EC26X7PS,FMHA6MVH} -\item 可视化展示知识图谱,帮助公众理解非遗项目之间的关联 -\item 利用知识图谱进行空间分析,支持文化空间规划 -\end{itemize} - -(2)\textbf{多模态资源整合}\cite{YKHCTW2K,JH5C6HKD}: -\begin{itemize} -\item 采集非遗项目的图像、音视频等多模态资源 -\item 利用多模态大模型进行内容理解和生成 -\item 开发沉浸式VR/AR体验,提供身临其境的文化体验 -\item 构建多模态知识库,支持跨模态检索和推理 -\end{itemize} - -(3)\textbf{虚拟现实展示}\cite{UFAR2JX6}: -\begin{itemize} -\item 开发非遗VR体验系统,重现非遗项目的历史场景 -\item 利用AR技术,在现实环境中叠加非遗信息 -\item 开发非遗数字博物馆,突破时空限制展示非遗 -\item 构建非遗元宇宙,提供虚拟社交和互动体验 -\end{itemize} - -\subsubsection{政策建议} - -(1)\textbf{文化空间规划}: -\begin{itemize} -\item 将非遗保护纳入城乡建设规划,保护非遗赖以生存的文化空间 -\item 建立非遗保护利用设施,如非遗展示馆、传承基地等 -\item 规划非遗旅游线路,促进非遗与旅游融合发展 -\item 保护非遗的自然环境,避免非遗项目脱离其生存环境 -\end{itemize} - -(2)\textbf{跨区域协作}: -\begin{itemize} -\item 建立东北三省非遗保护联盟,促进区域交流与合作 -\item 开展跨境非遗保护合作,保护赫哲族等跨境民族的非遗 -\item 建立非遗保护信息共享平台,促进经验交流 -\item 开展联合申报世界非物质文化遗产,提升国际影响力 -\end{itemize} - -(3)\textbf{传承人培养}: -\begin{itemize} -\item 将非遗纳入中小学教育,开展非遗传承普及教育 -\item 支持高校设立非遗相关专业,培养专业人才 -\item 建立传承人津贴制度,保障传承人基本生活 -\item 鼓励传承人收徒授艺,扩大传承人群 -\end{itemize} - -\subsection{研究局限性} - -本研究存在以下局限性: - -(1)\textbf{数据完整性}:部分非遗项目缺少详细的地理信息和传承人信息,影响空间分析的精度。未来需要补充采集这些信息。 - -(2)\textbf{时态信息}:本研究主要关注非遗项目的当前状态,对历史演变过程分析不足。未来需要构建时序知识图谱,追溯非遗项目的历史变迁。 - -(3)\textbf{关系推理}:部分隐性关系依赖人工标注,自动化程度有待提高。未来需要引入更先进的推理算法,提高关系推理的自动化水平。 - -(4)\textbf{可视化限制}:当前的知识图谱可视化系统主要展示静态关联,难以展现动态演变过程。未来需要开发时序可视化、动态演化等功能。 - -\subsection{未来研究方向} - -基于本研究的发现和局限,未来研究可以从以下方向展开: - -(1)\textbf{时序知识图谱}:构建非遗历史演变知识图谱,追溯非遗项目从起源到现在的历史变迁,分析其演化规律和影响因素。 - -(2)\textbf{多模态融合}:整合非遗项目的文本、图像、音视频等多模态资源,构建多模态知识图谱,支持跨模态检索和推理\cite{JH5C6HKD}。 - -(3)\textbf{跨区域对比}:将黑龙江非遗与吉林、辽宁等东北其他省份进行对比研究,揭示东北非遗的共性与差异,构建东北区域非遗知识图谱。 - -(4)\textbf{智能应用}:基于知识图谱开发智能问答系统\cite{EC26X7PS}、文化推荐系统、非遗传承预警系统等,为非遗保护提供智能化工具。 - -(5)\textbf{预测分析}:基于历史数据和当前趋势,预测非遗项目的传承发展趋势,识别高风险项目,为保护决策提供科学依据。 - -%% ============================================================ -\section{结论} -%% ============================================================ - -\subsection{主要发现总结} - -本研究针对黑龙江省非物质文化遗产知识组织与空间分析的问题,提出了基于DeepSeek大语言模型的非遗知识图谱构建方法,并系统分析了其空间分布特征与关联性。主要发现如下: - -(1)\textbf{成功构建了黑龙江省非遗知识图谱}。通过DeepSeek模型的知识抽取,构建了包含639个节点、639条关系的知识图谱,涵盖12类核心概念、40余种关系类型。DeepSeek模型在知识抽取中的成功率达100\%,平均处理时间3.6秒/节点,实体识别准确率95.2\%,关系抽取准确率91.7\%。 - -(2)\textbf{验证了DeepSeek大模型在非遗知识抽取中的有效性}。与传统方法相比,本研究方法具有明显优势:减少人工标注成本、提高知识抽取准确率、支持复杂语义理解。多维度校验机制确保了知识图谱的质量,逻辑一致性达98.3\%。 - -(3)\textbf{揭示了黑龙江非遗"核心-边缘"的空间分布模式}。哈尔滨、齐齐哈尔等中心城市是非遗分布的核心区域,项目密度高、类别丰富、多民族融合;大兴安岭、伊春等边缘地区项目数量不多但具有独特的民族文化特色。 - -(4)\textbf{识别了三大文化生态区}:森林文化区(大兴安岭地区,鄂伦春族、鄂温克族狩猎文化)、农耕文化区(松嫩平原,满族、汉族农耕文化)、江河文化区(黑龙江、乌苏里江沿岸,赫哲族、满族、朝鲜族渔猎文化)。 - -(5)\textbf{发现了非遗项目与民族特色、地理环境的显著空间关联}。Moran's I指数为0.356($p<0.01$),表明非遗项目存在显著的空间正自相关。传统技艺-森林资源(Moran's I=0.421)、传统技艺-江河资源(Moran's I=0.387)、民俗-寒地气候(Moran's I=0.356)等组合均表现出显著的空间正相关。 - -\subsection{理论贡献} - -本研究的理论贡献主要体现在以下三个方面: - -(1)\textbf{提出了基于大语言模型的非遗知识图谱构建方法}。本研究设计了多阶段任务分解的联合抽取策略,包括实体属性提取、三元组关系抽取和多维度校验,为非遗知识图谱构建提供了新方法。 - -(2)\textbf{设计了融合地域特色的本体模型}。本研究在复用CIDOC CRM的基础上,增加了民族特色和自然环境两个本地化概念类型,为区域性非遗知识组织提供了可复制的范式。 - -(3)\textbf{建立了非遗空间关联分析框架}。本研究综合运用核密度估计、聚类分析、G统计量、空间自相关分析等方法,为非遗空间分析提供了系统的方法论框架。 - -\subsection{实践价值} - -本研究的实践价值主要体现在以下三个方面: - -(1)\textbf{为黑龙江非遗数字化保护提供技术工具}。构建的知识图谱和可视化系统可支持非遗资源的智能检索、知识问答和空间分析,为非遗数字化保护提供了技术支撑。 - -(2)\textbf{为文化空间规划提供科学依据}。揭示的"核心-边缘"分布模式和三大文化生态区,为文化空间规划、保护政策制定提供了科学依据。 - -(3)\textbf{促进非遗文化的传播与教育应用}。构建的知识图谱可应用于非遗教育、文化旅游、文化创意等领域,促进非遗文化的传播与创新性发展。 - -\subsection{展望} - -随着"大模型+知识图谱"双轮驱动范式的发展\cite{LJ5QBY4I},非遗数字化保护将进入智能化、个性化、沉浸化的新阶段。未来应进一步探索以下方向: - -(1)\textbf{多模态知识表征}:整合文本、图像、音视频等多模态资源,构建多模态非遗知识图谱\cite{YKHCTW2K,JH5C6HKD}。 - -(2)\textbf{智能问答系统}:基于知识图谱和大模型,开发非遗智能问答系统,提供精准的知识问答服务\cite{EC26X7PS,FMHA6MVH}。 - -(3)\textbf{文化遗产虚拟现实}:利用VR/AR技术,开发沉浸式非遗体验系统,提供身临其境的文化体验\cite{UFAR2JX6}。 - -(4)\textbf{预测与决策支持}:基于知识图谱和时空分析,开发非遗传承预警系统和保护决策支持系统,为非遗保护提供智能化工具。 - -(5)\textbf{跨区域协同保护}:构建东北区域非遗知识图谱,开展跨区域协同保护,提升非遗保护的整体效能。 - -通过上述方向的研究与实践,将为非遗保护与传承提供更强有力的技术支撑,推动中华优秀传统文化创造性转化、创新性发展。 - -%% ============================================================ -\printbibliography[title=参考文献] - -\section*{致谢} - -本研究得到了XXX基金(项目编号:XXX)的资助。 -为此,我们衷心感谢XXX基金的支持。同时,感谢XXX大学XXX实验室提供的计算资源和技术支持,以及XXX教授在研究设计和论文撰写过程中给予的宝贵建议。 - - - -\end{document} -% subtree test Sat May 30 01:21:34 2026 -% test change -% test from hook