大容量古籍文本隐性知识体系挖掘与重构 ——基于《太平御览》的数史互证
摘要:大容量古籍的文本结构化和知识体系化是当前古籍工作的重要范畴。然而,相关研究集中在目录层级,如何深入到文本内部是当前亟待解决的难题。LDA主题模型在大规模文档潜在主题识别中表现优异。本研究目的是探究其在类书等大容量古籍文本隐性知识体系挖掘和重构中的作用。本研究方法以《太平御览》为样本,通过LDA模型与情感词典进行主题与情感识别、依托IEMP权力理论建构隐性知识体系模型,再通过“大模型+prompts提示词”和Gr
摘要:大容量古籍的文本结构化和知识体系化是当前古籍工作的重要范畴。然而,相关研究集中在目录层级,如何深入到文本内部是当前亟待解决的难题。LDA主题模型在大规模文档潜在主题识别中表现优异。本研究目的是探究其在类书等大容量古籍文本隐性知识体系挖掘和重构中的作用。本研究方法以《太平御览》为样本,通过LDA模型与情感词典进行主题与情感识别、依托IEMP权力理论建构隐性知识体系模型,再通过“大模型+prompts提示词”和Gr