ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

【IEEE Access 2025】EQ-KG-LLM:基于大语言模型的地震应急信息知识图谱构建与应用|从灾害知识工程视角

【IEEE Access 2025】EQ-KG-LLM:基于大语言模型的地震应急信息知识图谱构建与应用|从灾害知识工程视角 摘要本文解读 IEEE Access 2025 论文《基于大语言模型的地震应急信息知识图谱构建与应用》Research on the Construction and Application of Earthquake Emergency Information Knowledge Graph Based on Large Language Models。该论文聚焦地震应急信息知识图谱的构建与应用提出面向地震应急的领域知识抽取方法 TPES-LLM通过融合三层提示工程指令微调—需求感知—案例匹配、双向图注意力网络 Bi-GAT与路径置信度约束算法 PCCA把震后微博、微信、新闻与震害报告等多源异构文本抽取成 RDF 三元组并在Neo4j中构建可查询、可推理的应急知识图谱其特别之处在于把大模型的知识注入与图结构上的可靠性推理连成闭环而不是停留在一次性抽取。实验表明实体识别 F1 达 0.9152、关系抽取 F1 达 0.8824均超过 BiLSTM-CRF 与通用大模型基线三个真实震例的图谱问答 Hit1 分别为 0.8962、0.8728 与 0.9023响应时间全部低于 2.5 秒为灾害应急信息化与领域知识图谱建设提供了重要借鉴。视频讲解点击观看 B 站视频摘要论文基本信息背景与动机研究主线从问题到结论基准/方法设计分类全景方法细节实验设计与结果结果对比总结关键发现局限性常见问题FAQ这篇论文的核心方法 TPES-LLM 是什么它和直接用大模型做信息抽取有什么区别Bi-GAT 与 PCCA 分别解决什么问题知识图谱最终能做什么论文的数据规模有多大引用论文数字时需要注意什么参考链接论文基本信息项目内容标题英文Research on the Construction and Application of Earthquake Emergency Information Knowledge Graph Based on Large Language Models标题中文基于大语言模型的地震应急信息知识图谱构建与应用作者Wentao Zhou, Meng Huang通讯, Shuai Liu, Qiao You, Fanxin Meng机构防灾科技学院 (Institute of Disaster Prevention) · 河北省高校智慧应急应用技术研发中心 · 四川省减灾中心会议IEEE Access, vol. 13, pp. 127742–127757, 2025arXivDOI: 10.1109/ACCESS.2025.3586370项目网站IEEE Xplore 论文页背景与动机震后信息有三个特征同时成立来源异构、语义表达复杂、相互关联薄弱。社交媒体、新闻报道与震后现场调查会在短时间内产生大量实时文本官方通报里震中区发生强烈震动、数百栋建筑倒塌、应急队伍已派出这类表述语义清晰却普遍缺少精确地理信息与统一数据格式与此同时灾情评估、救援力量部署、物资调配、医疗资源分配与交通状况分属不同类型跨类信息的关联推理能力不足容易造成信息掌握不完整、应急响应不及时。从技术脉络看这个问题并不是简单再做一次命名实体识别就能解决。传统抽取器如BiLSTM-CRF与UIE在通用领域表现稳定但面对地震专业术语与应急需求感知时覆盖不完整、精度不足把 HanLP 这类工具用于震后多源数据也难以理解应急场景中的专业语义。知识推理侧规则路径搜索与单跳向量距离方法依赖显式存在的关系面对灾害链中跨句、隐含的因果与演化关系时推理覆盖率和泛化能力都有限。2023 年以来大语言模型驱动的领域图谱构建在水利、电子、电子信息等场景陆续出现但地震应急域仍然缺少把领域知识注入与图推理可靠性打通的完整方案。这正是本文的切入点不把大模型当作通用问答机器人而是把它工程化为知识生产的一环——先用领域知识把抽取做准再用置信度把推理做稳最后用图数据库把答案做成可查询、可追溯的服务。结合历史视角看知识图谱技术经历了三个阶段2012 年 Google 知识图谱确立了以实体—关系网络替代字符串检索的范式2013 年 TransE 把关系建模为向量平移 $s r \approx o$为知识推理提供了分布式表示基石2018—2022 年领域知识图谱在水务、医疗、洪水风险、核电等垂直场景大量涌现2023—2025 年大语言模型驱动的图谱构建成为主流。本文处在第三阶段的末端把 LLM 抽取与图推理拼成地震应急闭环。研究主线从问题到结论图 9EQ-KG-LLM 的研究主线——从多源异构震后文本到可推理的应急知识图谱Mermaid 流程图基准/方法设计论文的核心设计是五层知识图谱构建框架数据层汇聚多源异构原始数据本体层定义统一的语义模式实例层把具体数据映射为实体与关系实例存储层用 Neo4j 承载应用层提供问答与决策支持。这套分层把数据—语义—实例—存储—应用逐级解耦直接后果是换灾种只需替换本体层换模型只需替换实例层的抽取器。数据层用 Python 爬虫配合 APScheduler 任务调度自动抓取微博、微信群与公众号、新闻网站和论坛并用 PyMuPDF、python-docx 解析震害报告类文档统一转为结构化震害文本采集过程做了匿名化去标识、限流与访问控制只使用公开可访问内容。本体层则基于地震专家分类框架高忠等、先富等的震害信息分类工作建立实体—关系模板体系覆盖10 大类、33 子类包括震中位置、受灾区域、基础设施损毁、次生灾害、资源调配、人员伤亡、应急处置与救援行动同时预置知识三元组作为对齐参考例如 $\langle$震中位置, is, 泸定县$\rangle$、$\langle$交通, damaged, 山区道路$\rangle$、$\langle$次生灾害, includes, 滑坡$\rangle$。实例层由 TPES-LLM 抽取实体与关系输出标准 RDF 三元组例如 $\langle$四川泸定 6.8 级地震, 震中位置, 泸定县附近$\rangle$、$\langle$四川泸定 6.8 级地震, 震源深度, 10 千米$\rangle$、$\langle$四川泸定 6.8 级地震, 触发, 滑坡$\rangle$。据论文报告实体抽取准确率提升至 90.84%实体—关系抽取准确率提升至 89.35%相比 BiLSTM-CRF 与 UIE 有明显优势。图 1TPES-LLM 知识抽取总体框架——三层提示工程把任务模板、注意力权重与历史案例逐级注入大模型抽取结果直接以 RDF 三元组形式落地分类全景本体层的实体—关系模板体系按事件—区域—承灾体—次生灾害—应急响应组织十类实体并不是平行罗列而是围绕一次地震事件的处置链条展开图 10地震应急本体的分类全景——事件、区域、承灾体、次生灾害与应急响应五类实体及其关键联系Mermaid 分类图方法细节第一层指令微调LoRA。为了在不破坏通用能力的前提下注入地震领域知识论文采用 LoRA只训练下投影矩阵 $A$ 与上投影矩阵 $B$调整后的权重为 $W W A \cdot B$原始权重 $W$ 保持不变。训练样本来自地震专家分类框架与行业标准文本用 BIO 标注方案逐词标注例如泸定县标注为震中位置的起始符滑坡标注为次生灾害的起始符再转为指令式模板论文给出的示例是对抽取次生灾害及其影响区域这一指令输入地震引发多处滑坡阻断通往丹巴县的主干道期望输出为[次生灾害滑坡]、[影响区域丹巴县]。在多轮知识驱动样本训练后$A \cdot B$ 的乘积学到地震导致交通中断降雨加剧次生灾害这类语义偏置。第二层需求感知。这一层不再改任务模板而是改注意力分布。论文统计实体对 $(e_i, e_j)$ 在真实震例文本中的共现频率 $C(e_i, e_j) \sum_{n1}^{N} \mathbb{1}(e_i \in X_n \land e_j \in X_n)$其中 $X_n$ 是第 $n$ 篇文本的实体集合指示函数在二者同时出现时取 1随后把共现频率归一化为多头注意力中各实体的权重 $\alpha_h(e_i)$。论文以 2022 年泸定 6.8 级地震文本为例从中抽出 6 对实体总共现频次为 10其中道路损毁与交通中断这一对的共现频次为 7归一化权重为 0.7——高频共现实体对获得更大注意力权重从而引导模型关注真正影响抽取结果的文本特征。第三层案例匹配。在实体识别与语义建模之后论文引入36 个代表性历史震例把抽取到的实体对与历史震害数据对齐激活大模型预训练阶段已经具备的关联模式。论文用 2022 年四川芦山 6.1 级地震作为实证案例从震中位于 30.2°N、103.0°E可能触发滑坡等次生灾害S104 省道需在震后 48 小时内抢通这段文本中抽取出 $\langle$芦山 6.1 级地震, 震中位置, 30.2°N/103.0°E$\rangle$、$\langle$芦山 6.1 级地震, 可能触发次生灾害, 滑坡$\rangle$、$\langle$S104 省道, 抢通时间, 震后 48 小时内$\rangle$ 等三元组。推理侧Bi-GAT PCCA。抽取完成后仍有大量隐含信息没有显式记录传统知识图谱推理机制难以捕捉跨实体、跨事件的隐式语义与多跳逻辑路径。论文设计双向图注意力网络把注意力机制用于聚合节点及其关键邻居的特征聚焦局部邻域而规避代价高昂的全局计算同时为邻居节点分配可学习权重以反映其相对重要性再用路径置信度约束算法对高权重邻居构成的路径逐跳打分路径置信度定义为路径上各跳置信度的乘积 $P \prod_{(e,r) \in Path} C(e,r)$其中单跳置信度 $C(e,r) \exp(-|h_e h_r - h_{e}|)$ 由 TransE 的向量关系计算$h_e$、$h_r$ 与 $h_{e}$ 分别是头实体、关系与尾实体的向量表示。推理时先做路径聚合再用注意力为不同路径分配权重 $\alpha_i$置信度越高的路径权重越大最终以 $\hat{o} \arg\sum_{P \in P} \alpha_P \exp(-|h_s h_{\hat{r}} - h_o|)$ 选出得分最高的目标实体。举例来说地震触发滑坡、滑坡导致交通中断与地震触发滑坡、滑坡导致救援困难是两条候选路径模型按置信度判断哪条更可靠多跳推理由此可以补全完整灾害链地震6.8 级→ 触发 → 滑坡 → 阻断 → 主干道 → 导致 → 疏散困难 → 造成 → 人员被困 → 增加 → 伤亡。图 2三层提示工程系统的 LLM 知识抽取流程——指令微调、需求感知与案例匹配逐级串联形成可累积的知识抽取能力图 3Bi-GAT PCCA 多跳关系推理结构——候选路径按置信度加权隐含的灾害链被补全图 4地震应急知识图谱的五层构建框架——模块化解耦使方法可迁移到其他灾种知识融合与动态更新。不同来源的命名习惯会导致同一实体出现多种表述论文采用异构实体对齐策略把它们归一到标准实体例如将泸定 6.8 级地震四川泸定地震泸定震中统一到四川泸定 6.8 级地震将滑坡灾害岩崩山体崩塌统一到滑坡与落石。系统还会接入应急人员反馈来更新时空关联数据库使推理过程持续迭代优化最终形成动态的地震灾害知识图谱。实验设计与结果实验使用来自社交媒体、新闻报道与震后现场调查的多源非结构化文本共8139 条长短文本覆盖 2022 年 9 月 5 日四川泸定 6.8 级地震、2023 年 12 月 18 日甘肃积石山 6.2 级地震与 2025 年 1 月 7 日西藏定日 6.8 级地震。抽取实验基于地震情况、灾情与救援物资储备等信息构建了6021 条训练数据与 2119 条测试数据消融实验另外收集了5292 篇震后新闻。评测指标为精确率 $P \frac{TP}{TPFP}$、召回率 $R \frac{TP}{TPFN}$ 与 $F1 2 \times \frac{P \times R}{P R}$同时统计平均识别时间问答环节用 Hit1 衡量 Top-1 结果是否包含正确答案。基线包括 BiLSTM-CRF、零样本通用抽取模型 UIE-base以及不加任何提示的通用大模型。实验环境为 Python 3.8.17、CUDA 11.8 与一块 NVIDIA Tesla V100S实体与关系匹配阈值设为 0.75。实体识别对比转写自论文表 2模型PrecisionRecallF1耗时 (s)BiLSTM-CRF0.76850.72320.745285.12UIE-base0.84560.81540.830266.73LLM0.87660.85650.866452.84TPES-LLM0.92840.90120.915236.51关系抽取对比转写自论文表 3模型PrecisionRecallF1耗时 (s)BiLSTM-CRF0.71540.70520.7103141.65UIE-base0.78320.76240.7727127.54LLM0.82010.81290.816582.98TPES-LLM0.89350.87160.882447.46耗时方面TPES-LLM 的实体识别平均 36.51 秒、关系抽取平均 47.46 秒相比 BiLSTM-CRF实体识别精度提升15.99%、时效提升57.11%关系抽取精度提升17.81%、时效提升66.42%——精度与速度同时改善而不是用算力换精度。消融实验明细转写自论文表 4 与表 5模型实体 P实体 F1关系 P关系 F1LLM 无任何提示0.80690.78740.80690.7822TPES-LLM (WIF去指令微调)0.83410.80690.81410.7869TPES-LLM (WD去需求感知)0.83650.82020.81650.8002TPES-LLM (WCMA去案例匹配)0.85230.84290.83420.8196TPES-LLM完整0.90940.89200.88940.8652消融梯度是单调的实体 F1 从 0.7874 一路升到 0.8920平均识别时间从 41.47 秒降到 23.84 秒说明三层提示中的每一层都不可替代——去指令微调的损失最大去案例匹配对时效的影响最突出。图谱问答检索效果转写自论文表 6地震事件检索问题Hit1平均响应时间 (s)2022 四川泸定本次地震的伤亡情况如何0.89622.32023 甘肃积石山本次地震的伤亡情况如何0.87282.52025 西藏定日本次地震的伤亡情况如何0.90232.1图 5实体识别模型对比——TPES-LLM 的精确率、召回率与 F1 全面领先耗时也最短图 6关系抽取模型对比——需求感知与案例匹配把关系 F1 从通用 LLM 的 0.8165 提升到 0.8824图谱构建结果。以 2022 年 9 月 5 日泸定 6.8 级地震为例从多源震后文本中抽取136 个实体合并后得到68 个唯一实体与 118 条关系随后在 Neo4j 中完成可视化构建。实体抽取在中层表现也有差异像地震震情信息地震灾情信息这类特征清晰的类型精确率超过 90%而灾害现场动态信息这类边界模糊的类型明显更弱关系抽取中支撑影响类关系优于提供类关系。图 7基于 TPES-LLM 的本体模型设计与知识抽取——本体层是整套系统的语义契约决定实体对齐与路径推理的可行空间图 8地震应急知识图谱智能问答应用——从问题中抽取关键实体在图谱中做关系匹配与推理返回结构化答案结果对比总结图 11从基线到落地——TPES-LLM 在三类基线上同时取得精度与效率优势并支撑图谱问答Mermaid 对比图关键发现三层提示带来单调增益实体 F1 从无提示的 0.7874经 WIF 0.8069、WD 0.8202、WCMA 0.8429升到完整模型0.8920同时耗时从 41.47 秒降到23.84 秒。相对单级指令微调全面领先实体识别的精确率提升8.90%、召回率提升11.99%、F1 提升10.55%时效提升26.14%。实体抽取普遍优于关系抽取特征清晰的实体类型精确率超过90%而关系抽取需要跨句理解上下文语义提供类关系最弱。问答满足应急时效要求三个真实震例的 Hit1 分别为0.8962、0.8728、0.9023全部高于 87%平均响应2.1–2.5 秒。推理补全隐含灾害链经 Bi-GAT 与 PCCA 打分后可串出地震 → 滑坡 → 阻断主干道 → 疏散困难 → 人员被困 → 伤亡增加的完整链条。可复用性与可迁移性五层框架解耦后换灾种只需换本体层泸定单一震例即得到 68 个唯一实体与 118 条关系说明本体与对齐策略可复用到同类事件。局限性域内局限研究只覆盖地震场景灾害领域标注语料稀缺尚未在洪涝、滑坡、台风等其他灾种上广泛应用。规模化未验证虽然实验结果可观但在大规模、长期、多类型、连续实时数据流场景下的可扩展性与泛化性仍待验证。隐含语义仍难多灾种与具体位置的关系、灾害演化常跨句隐含表达仍需更深的语义解析文本噪声与冗余高度重复例如余震不断与未来 24 小时可能发生 2–3 级余震。证据面偏窄完整图谱统计只给出泸定一个震例136 个实体 → 68 个唯一实体、118 条关系实体对齐阈值 0.75 的敏感性没有系统分析。数字口径需核对论文正文报告采集 8139 条文本结论章节写作 8136 条摘要写2024 年积石山地震正文与表 6 写2023 年甘肃积石山第三节的实体抽取准确率 90.84%与表 2 的 0.9284 也不一致。作者提出的未来方向是把方法扩展到洪涝、滑坡、台风等跨域灾害并引入图像、语音、视频等多模态数据。常见问题FAQ这篇论文的核心方法 TPES-LLM 是什么TPES-LLM 是一个三层提示工程体系指令微调用 LoRA 把地震专家分类体系与行业标准注入 Qwen2.5-7B建立标准化的抽取任务模板需求感知按实体共现频率归一化多头注意力权重让模型关注高共现实体对案例匹配引入 36 个历史震例对齐抽取到的实体对以激活预训练中的关联模式。它和直接用大模型做信息抽取有什么区别直接用通用大模型抽取的实体 F1 只有 0.8664关系 F1 只有 0.8165加入三层提示后分别提升到0.9152 与 0.8824而且平均耗时从 41.47 秒降到 23.84 秒。差别不在模型规模而在是否把领域知识、注意力先验与历史案例逐级注入。Bi-GAT 与 PCCA 分别解决什么问题Bi-GAT 用局部邻域注意力聚合关键邻居节点特征避免全局计算并提升泛化PCCA 基于 TransE 为每一跳计算置信度 $C(e,r) \exp(-|h_e h_r - h_{e}|)$再以路径置信度 $P \prod_{(e,r) \in Path} C(e,r)$ 对多跳路径整体打分从而在灾害链推理中给出可靠性排序而不是把所有路径等同看待。知识图谱最终能做什么基于 Neo4j 构建的图谱支撑一个地震应急信息智能问答助手可以回答伤亡情况、受灾最重区域、已派出救援队伍、应急物资需求、道路与桥梁阻断、可用医院与安置点、相似历史震例等问题。三个真实震例的 Top-1 检索准确率在0.8728–0.9023之间响应时间2.1–2.5 秒。论文的数据规模有多大多源文本共8139 条来自社交媒体、新闻报道与震后现场调查抽取实验使用6021 条训练数据与 2119 条测试数据消融实验额外收集5292 篇震后新闻知识注入与案例匹配使用36 个历史震例本体覆盖10 大类、33 子类。引用论文数字时需要注意什么建议回到原始表格核对。论文存在几处口径不一致正文 8139 条与结论 8136 条摘要2024 年积石山与正文/表 6 的2023 年甘肃积石山第三节90.84%与表 2 的 0.9284。表格数据本身自洽引用时以表格为准更稳妥。参考链接论文IEEE Access 2025: 10.1109/ACCESS.2025.3586370 / IEEE Xplore 页面LoRA: Low-Rank Adaptation of Large Language Models: arXiv:2106.09685LasUIEUIE 系通用信息抽取: arXiv:2304.06248 / NeurIPS 2022A Survey on Knowledge Graphs: Representation, Acquisition, and Applications: IEEE TNNLS 2022Gemini and Physical World: LLMs Can Estimate the Intensity of Earthquake Shaking from Multimodal Social Media Posts: Geophys. J. Int. 2025 / arXiv:2405.18732给大家推荐一款自用写文献综述、无虚构文献的 AI复旦大学 FudanNLP 团队自研 切问学术官网qiewenpaper.com覆盖3.6 亿篇可溯源真实中英文文献能自动整合文献观点生成规范综述还能挖掘研究创新点、复现实验配合视频教学新手快速上手文献综述写作后记博客的关键词集中在编程、算法、机器人、人工智能、数学等等持续高质量输出中。讨论QQ群白拾的小屋 (750365700)⭐B站账号白拾的物理AI组会活跃于知识区和动画区✨GitHub主页YhbCode000工程文件
返回列表