首页/文章/ 详情

“拆成Token”交给Transformer|新开源论文:QuakeF2G近断层地震动预测模型

1月前浏览1193
 

https://doi.org/10.1016/j.cacaie.2026.100183

0 太长不看版

近断层地震动预测有一个很现实的矛盾:越靠近断层,破裂方向、有限断层几何和盆地效应越重要;但越精细地描述这些物理过程,计算成本通常也越高。

为此,我们提出 QuakeF2G:在此前 QuakeFormer 的基础上,不再把大地震简单表示为一个“点”,而是把有限断层离散成一组 fault-segment tokens,再通过 Transformer 的自注意力和交叉注意力机制,将断层几何、震源信息、场地条件以及可选的站点观测统一融合,用于概率型 PGV 预测。

模型基于南加州 CyberShake 约 62.6 万个地震场景训练。研究表明:显式引入有限断层几何后,相比点源方法,测试集 RMSE 降低约 36%;在空间插值实验中,QuakeF2G 也优于 Ordinary Kriging。

此外,本研究的论文为开放获取,代码公开。文末附代码、数据和论文链接,便于进一步检查、复现和扩展。

 

图1  CyberShake 数据集中的站点、断层与数据分布(原文 Fig. 1)


1 为什么近断层地震动特别难预测?

远离断层时,很多地震动指标可以在一定程度上用“震级 + 距离 + 场地条件”来描述。但到了近断层区域,问题会明显复杂起来。破裂从震源点向外传播时,不同断层段释放的能量可能在某些方向上叠加,形成显著的破裂方向性(rupture directivity);同时,盆地结构、传播路径和场地条件还会进一步改变地震动空间分布。

传统经验型地震动模型(GMPE/GMM)计算很快,但通常需要用有限数量的参数概括断层几何;物理波动传播模拟可以更直接地描述三维速度结构和破裂过程,但计算和存储成本很高。

因此,这项研究希望回答的问题是:能否把高保真物理模拟中学到的区域规律压缩到一个轻量模型中,同时把有限断层几何特征显式地保留下来?


2 核心思路:把有限断层变成 Transformer 能处理的 Token

QuakeF2G 的关键变化,是不再把震源只压缩为震中位置和震级,而是把复杂断层离散为一组长度可变的 token。每个断层段携带位置(纬度、经度、深度)、方向(走向、倾角、滑动角)和类别等信息;震源点则作为一个特殊 token,帮助模型识别破裂起始位置。

这些 fault-segment tokens 首先进入专门的 Fault Encoder,通过多尺度位置编码、RoPE 和自注意力学习断层内部的空间关系。随后,Fault Encoder 输出的断层表示与站点—震源序列在 Main Encoder 中通过 cross-attention 融合。

 

图2  QuakeF2G 模型架构:Fault Encoder + geometry-aware cross-attention(原文 Fig. 2)


这里还有一个很重要的细节:对于每一个“断层段—站点”组合,模型预先计算断层段到站点的距离以及沿走向方位角,并把这些几何量转化为 cross-attention 的可学习偏置。也就是说,模型不仅知道“有哪些断层段”,还显式知道“这个断层段相对这个站点在哪里”。

最终,模型输出的不是一个单一 PGV 数值,而是每个站点 ln(PGV) 的概率分布参数,从而可以用于概率地震危险性分析。


3 同一个框架,适配四种不同精细程度的震源信息

论文没有假设任何时候都能立刻得到完整的有限断层模型,而是设计了四种逐步复杂的震源表示。这个设计很贴近真实的震后信息获取过程:越早得到的信息越简单,随着时间推移,震源机制和有限断层几何才会逐步完善。

Point Source(PS)只使用震源位置和震级;PS + Focal Mechanism(PS+FM)进一步加入走向、倾角和滑动角;Line Source(LS)用线段近似破裂范围;Plane Source(PL)则把断层离散为三维断层段,可以表达更复杂、非平面或多段断层几何。

 

图3  四种不同精细程度的震源表示:PS、PS+FM、LS 和 PL(原文 Fig. 3)


4 有限断层几何信息确实可以提升精度

消融实验给出了一个很清晰的结果。对于 rupture distance ≤ 100 km 的测试数据,点源模型 PS 的总 RMSE 为 0.379;加入震源机制后降至 0.359;使用 Line Source 后进一步降至 0.246;完整 Plane Source 为 0.243。也就是说,从点源到有限断层表示后,RMSE 总体降低约 36%。

 

图4  不同震源表示对两个 CyberShake 场景预测结果的影响(原文 Fig. 4)


因此,把有限断层及其与站点的几何关系显式加入模型,比简单点源表示更有效;至于更细致的断层面表达能够带来多大进一步收益,还需要更丰富的破裂运动学数据来验证。


5 2019 Ridgecrest Mw 7.1 地震案例

论文进一步将 QuakeF2G 应用于 2019 年 Mw 7.1 Ridgecrest 地震。对比了 QuakeF2G 的 Point Source、Plane Source 与 ASK14、ASK14+BS13 等经验模型。

 
 

图5  2019 Mw 7.1 Ridgecrest 地震的预测与残差对比(原文 Fig. 10)


在本文采用的台站和对比设置下,QuakeF2G 的 PS 和 PL 残差箱线图中位数更接近零、离散程度也更小;同时,加入有限断层信息后的 PL 相比 PS 进一步改善。这说明在这个真实地震案例中,显式考虑断层几何对地震动空间预测是有帮助的。


6 不仅可以预测,还可以做 PSHA 和空间插值

QuakeF2G 的另一个特点,是同一套 masked Transformer 思路可以在不同信息条件下工作。没有站点观测时,它是纯预测模型;如果部分站点已有 PGV 观测或模拟结果,这些信息可以作为可见 token 输入,模型对其余站点进行条件预测。

在 PSHA 示例中,论文在 NVIDIA RTX 6000 GPU 上计算一条 hazard curve 的时间约为 32 min,而 CyberShake 模拟流程对应的计算时间约为 1592 h。神经网络训练完成后,可以把大规模模拟数据库中的区域规律转化为快速重复调用的代理模型。

空间插值实验也很有意思:当 QuakeF2G 只使用 50% 的训练站点时,RMSE 约为 0.05;Ordinary Kriging 即使使用 100% 的训练站点,RMSE 仍约为 0.08。论文在所测试的 10%、50% 和 100% 采样密度下,QuakeF2G在相同的测试台站中均取得更低的 RMSE。

 

图6  QuakeF2G 与 Ordinary Kriging 的空间插值 RMSE 对比(原文 Fig. 12)


来源:陆新征课题组
振动非线性化学建筑消防BIM理论Opensees材料多尺度科普数字孪生控制
著作权归作者所有,欢迎分享,未经许可,不得转载
首次发布时间:2026-08-26
最近编辑:1月前
地震那些事
博士 抗震防灾数值模拟仿真
获赞 84粉丝 73文章 676课程 0
点赞
收藏
作者推荐

新论文:基于图像-文本输入的双向RC框架梁-柱子结构连续倒塌分析模型 (数据集及代码已开源)

论文:Progressive collapse an alytical model for bidirectional RC beam-column substructures based on multi-modal deep learning with image-text inputDOI: https://doi.org/10.1016/j.engstruct.2026.1230220太长不看版 建筑结构在爆炸、撞击和火灾等偶然作用下可能发生局部构件失效,并进一步引发连续倒塌。由于连续倒塌过程是复杂的大变形非线性行为,传统有限元分析计算耗时长;已有理论模型多集中于单一抗力机制或单向梁-柱子结构,难以全面描述双向RC梁-柱子结构的完整倒塌响应。 为此,本文提出一种基于图像-文本多模态输入的深度学习预测模型(图1)。该模型基于结构的几何尺寸、配筋、混凝土强度和边界刚度等参数构造抗连续倒塌特征图像,通过改进ResNet18网络架构,实现双向RC框架梁-柱子结构的连续倒塌荷载-位移曲线预测。通过与基于OpenSees的有限元数据库、既有试验结果以及多种机器学习模型对比,验证了该模型的准确性和效率。 图1 图像-文本多模态输入架构1研究背景 钢筋混凝土框架结构是实际工程中常见的结构体系。柱失效后,剩余结构通过替代传力路径承担竖向荷载,其抗力机制主要包括小变形阶段的抗弯作用和压拱作用,以及大变形阶段的悬链线作用等。现有理论模型计算过程较复杂,且多针对单向梁-柱子结构,较少考虑双向梁之间的协同作用。 近年来,机器学习和深度学习方法逐渐被广泛应用于结构连续倒塌响应预测。然而,现有模型多采用数值参数作为单模态输入,难以保留构件的空间分布信息;而单纯采用图像表征又可能导致梁跨、截面尺寸等参数在图像处理过程中失真。为此,本文提出图像-文本双模态输入方法,以同时表征结构空间关系和精确几何信息,提高双向RC框架梁-柱子结构的连续倒塌响应预测能力。2研究方法(1)数据库建立 首先,基于OpenSees建立有限元数据集,采用纤维梁柱单元模拟RC框架梁,混凝土采用Concrete01材料模型,钢筋采用Hysteretic材料模型(图2a)。通过既有试验[1]验证建模方法的可靠性,如图2c所示。随后,选取跨度、截面尺寸、配筋率、混凝土强度以及边界刚度等参数作为主要变量,通过拉丁超立方抽样并建立样本数据集。 图2 有限元模拟(2)特征点提取 为了描述连续倒塌全过程响应,本文将荷载-位移曲线简化为四个关键特征点,并将其作为深度学习模型的预测目标:通过边界反力确定峰值点与转换点(图3),通过最远点法确定屈服点,最后,根据0.2倍短跨长度对应的位移确定倒塌点。具体可参见论文原文2.3节。 图3 特征点提取准则示意图(3)特征图绘制 不同于传统机器学习模型仅采用数值参数作为输入,本文将结构信息以图像和文本两种形式进行混合表征(图4),以保留构件的空间分布特征,并避免单一图像表征造成的信息失真。其中,图像用于描述结构拓扑关系、配筋参数、材料强度和边界条件;文本用于保留梁跨、截面尺寸等几何信息。 图4 样本特征图像3预测结果 研究首先采用5000个样本进行模型训练,并在数据集之外另选100个独立样本开展验证,典型样本的计算结果对比如图5所示。结果表明,所提出的模型能够较为准确地预测不同参数条件下双向RC框架梁-柱子结构的连续倒塌响应,并能较好地反映结构从压拱作用阶段过渡至悬链线作用阶段的抗力发展全过程。 图5 有限元样本验证 此外,研究还采用既有试验中的试件T1[1]和XB1[2]对模型进行了验证(图6),具体计算过程可以参考论文原文第4.3节,结果同样表明模型能够较好地反映试件各阶段的受力特征。 图6 实际试验验证4讨论(1)训练样本数量敏感性分析 为在计算成本与预测精度之间取得平衡,开展了训练样本数量的敏感性分析(图7)。通过比较不同训练样本规模下模型的预测性能,评估样本数量对模型精度和泛化能力的影响,最终将训练样本数量确定为2500。 图7 不同训练样本数量结果对比(2)不同模型对比 为验证所提出模型的优越性,选取了常用的机器学习模型,包括Decision Tree、SVR、Random Forest、XGBoost、Kriging以及单模态图像输入模型作为对比(图8)。结果表明,本文提出的图像-文本双模态模型在各个特征点均表现出更高的预测精度。 图8 不同模型预测结果对比(3)边柱失效工况拓展 为了进一步验证模型对不同拆除构件工况的适用性,本文将所提出方法扩展至边柱失效工况,并开展模型训练。随后,同样通过有限元样本(图9)和实际试验试件BE1[3](图10)进行验证,结果表明,所提出模型在边柱失效场景下同样具有较高的预测精度。 图9 有限元样本验证 图10 实际试验验证5结语(1)提出了一种基于图像-文本双模态输入的双向RC框架梁-柱子结构连续倒塌响应预测模型。(2)建立了连续倒塌有限元模型数据集,并提出了子结构连续倒塌受力特征点的标签生成方法。(3)与传统机器学习和单模态输入模型相比,图像-文本双模态输入模型具有更高的预测精度。(4)所提出模型能够较准确预测双向RC梁-柱子结构在中柱和边柱失效场景下的连续倒塌全过程响应。6参考文献[1] Qian K, Li B, Ma JX. Load-carrying mechanism to resist progressive collapse of RC buildings. J Struct Eng 2015;141(2):04014107.[2] Wang Y, Zhang B, Gu XL, et al. Experimental and numerical investigation on progressive collapse resistance of RC frame structures considering transverse beam and slab effects. J Build Eng 2022;47:103908.[3] Lu XZ, Lin KQ, Li Y, et al. Experimental investigation of RC beam–slab substructures against progressive collapse subject to an edge-column removal scenario. Eng Struct 2017;149:91–103.---End--- 来源:陆新征课题组

未登录
还没有评论
课程
培训
服务
行家
VIP会员 学习计划 福利任务
下载APP
联系我们
帮助与反馈