首页/文章/ 详情

远景能源等团队力作:给AI装上“物理大脑”,零样本跨体系预判电池寿命

3月前浏览858

锂离子电池(LIB)的衰退预测一直是一块硬骨头。传统上,我们有两种手段来搞定它:要么用纯粹的纯物理模型,要么用数据驱动的机器学习模型。

但这两条路都有着难以跨越的硬伤。纯物理模型虽然理解深刻,但面对现实世界里错综复杂的电化学、热力学不确定性时,其参数调优难度呈指数级上升;数据驱动的机器学习模型虽然擅长在特定数据集上“找规律”,可一旦遇到电池加速衰退等关键且极端的使用场景,它就会因缺乏泛化能力而彻底翻车,更别提黑盒模型根本无法解释“电池为什么死得这么快”。

这篇由来自远景能源(Envision Energy)等尖端能源机构的研究团队 James Sadler、Rizwaan Mohammed、Michael Castle 以及 Kotub Uddin 共同发表的论文,提供了一个极其精妙的解题思路:他们推出了名为 ACCEPT(Adaptive Contrastive Capacity Estimation Pre-Training)的跨界底层框架。它不试图在物理和 AI 之间二选一,而是利用对比学习(Contrastive Learning)将两者编织在了一个统一的表示空间中,从而实现电池衰退的零样本(Zero-Shot)预测和根本原因诊断。

核心痛点与跨界突破点

电池的衰退,在物理本质上主要表现为锂离子库存损失(LLI)和活性物质损失(LAM)。

过去,学术界和工业界的重大痛点在于:真实的电池运行数据(如在电动汽车或网侧储能系统中采集到的温度、电压、电流和历史容量)很难直接对应到微观的 LLI 和 LAM 指标上,除非你把电池拆解做物理化学表征。

ACCEPT 的核心启发点就在于:既然物理世界做实验又贵又慢,而纯数据模型又缺乏物理常识,那么何不让物理模型做“模拟演练”,再让 AI 在虚拟与现实中连线

其背后借用了 OpenAI 旗下 CLIP 模型的灵感。CLIP 是通过对比学习,让“图片”和“文字”在共享空间里找到对应关系;而 ACCEPT 则是让“真实的电池运行特征”与“基于物理模型生成的衰退曲线”在共享的隐空间(Shared Embedding Space)里相互对齐。

多模态双塔架构的解题路径

为了实现这种跨模态的物理与数据融合,ACCEPT 采用了类似大模型中的“双塔架构(Two-Tower Architecture)”。

如下图所示,框架由两个独立的编码器(Encoders)组成:

  1. 运行特征塔(Operational Encoder):负责接收在现实环境中观测到的时间序列数据,例如电池的历史容量衰退轨迹,并融入温度、电流、电压等动态控制特征。
  2. 模拟轨迹塔(Simulation Encoder):基于一组无量纲的、描述 LLI 和 LAM 物理演变的常微分方程(ODE),在线快速且廉价地模拟出成千上万条不同衰退机理下的预测曲线。

图解(见原论文 Figure 1): 模拟编码器与真实运行编码器分别将物理方程生成的演变规律和现实中采集的多维时序特征(温、压、流、容)映射到同一个多维 hypersphere 隐空间。通过对比损失函数(Contrastive Loss),模型拉近“同一物理机理下的真实轨迹与模拟曲线”的距离,推开不匹配的轨迹。

这种架构的精妙之处在于,训练过程中并不需要电池真的跑完整个生命周期。物理模型相当于一个“剧透器”,把所有可能的衰退走向全部在虚拟空间里演练了一遍。对比学习则帮助 AI 建立了一张映射表:只要看到前 20% 循环的真实多维特征,就能在隐空间里精准匹配到最可能对应的那条物理模拟曲线。

零样本泛化:打破“一电池一模型”的魔咒

在传统的工业实践中,换一种电池化学体系(例如从三元锂到磷酸铁锂),或者换一个运行环境,原有的 AI 预测模型就要全部推倒重练。而这项研究展示了强大的下游泛化能力。

由于同一化学体系(甚至不同体系之间)的电池衰退在底层的物理衰退路径(LLI 和 LAM 的交互)上具有高度的相似性,ACCEPT 可以直接进行零样本推理(Zero-Shot Inference)

如下图所示,在面对完全未见过的测试电池时,模型能够输出概率最高的几种未来衰退路径。

图解(见原论文 Figure 6): 展示了模型对未知测试电池未来的衰退预测。模型没有只给出一个绝对的死板预测,而是给出了 Top-5 最可能的衰退路径(Prediction 1 到 5),并与真实值(Ground Truth)紧密贴合。更为关键的是,每条预测路径都深度绑定了其背后的物理机理诊断(比如准确指出是由于高放电率引起的 LLI 加剧)。

不仅如此,由于该框架支持在运行特征中加入静态的分类元数据(Categorical Metadata,如电池类型、出厂批次),它甚至展现出了跨越不同锂电化学体系的泛化潜力。

所以呢?这项研究对行业的真正改变

对于准专业人士而言,这项研究的价值不能仅停留在“又多了一个高精度的 AI 模型”,它的核心卖点和工业落地意义在于:

  • 从“黑盒预测”到“根本原因诊疗”:当储能电站或电动汽车的电池管理系统(BMS)发出衰退预警时,ACCEPT 告诉你的不仅仅是“这块电池还有 3 个月寿命”,它还能准确判断“这是由于特定的温度和充放电倍率导致的活性物质 LAM 损失”。这就为延长电池寿命的精准热管理和精细化运维提供了物理依据。
  • 极大地缩短研发与验证周期:传统的电池衰退测试往往需要持续数月甚至数年。利用该框架的零样本预测能力,新研发的电池只需要运行极少部分的循环,就能通过其运行特征和物理模拟的隐空间对齐,“快进”预测出其长期的安全寿命。

这项研究建立了一个电池衰退领域的“基础模型(Foundational Model)路径”。它向行业证明:将硬核的物理先验(电化学退化方程)作为对比学习的锚点,能让深度学习模型摆脱对海量、高质量、端到端全生命周期真实数据集的病态依赖,从而在真实且残酷的工业边界场景中,提供具备确定性的可靠预测。


参考文献:
Sadler, James, et al. "ACCEPT: Diagnostic Forecasting of Battery Degradation Through Contrastive Learning." arXiv preprint arXiv:2501.10492 (2025).

来源:锂电芯动
化学汽车UG储能控制METADAP
著作权归作者所有,欢迎分享,未经许可,不得转载
首次发布时间:2026-05-27
最近编辑:3月前
锂电芯动
博士 中科院博士,电芯仿真高级工程师
获赞 9粉丝 21文章 71课程 0
点赞
收藏
作者推荐

高级仿真工程师,到底“高级”在哪里?

这几年,我参加过很多仿真工程师的面试。有时候,我坐在桌子这一边,是面试官。有时候,我坐在对面,是候选人。慢慢地,我发现了一个非常普遍、也非常“致命”的问题。很多仿真工程师,其实从一开始,就准备错了方向。一个你一定经历过的场景很多人是这样准备高级岗位面试的:我会 Ansys / Comsol / Abaqus我做过不少仿真项目我会写脚本、UDF,模型跑得又快又稳这些能力重要吗?重要,而且是必须的。但问题在于——它们只够你胜任初级或中级岗位。一旦你开始冲击高级仿真工程师,这些优势会突然变得“不够用”。你可能会发现,面试官不再关心你按钮点得熟不熟,而是反复追问:为什么用这个模型?这个结果你信吗?你怎么证明它是可信的?这时候,很多人会开始慌。真正的分水岭:你在“扮演谁”?在我看来,仿真工程师之间,最本质的差别,不是软件,而是角色认知。第一种角色:仿真软件操作员这是大多数人停留的阶段。他们的关注点是:功能会不会用模型能不能跑结果出得够不够快这些能力很重要,但它们只解决一件事:把仿真“做出来”。如果一场面试主要问你:“你会不会这个软件?”“你用过哪些模块?”“脚本写得熟不熟?”那你其实被当成的,是一个软件操作员。但高级岗位,根本不是在招“操作员”很多人忽略了一件事:仿真的真正目的,从来不是把模型跑完。它只有一个核心价值: 降低工程决策的不确定性。这,才是高级仿真岗位存在的原因。所以,当你坐在高级岗位的面试中,面试官真正期待你扮演的角色是:工程决策的支持者,而不是软件使用者。为什么他们总问“你信不信这个结果”?站在面试官的视角,高级仿真工程师每天在做什么?不是建模本身,而是不断回答这些问题:这个结论,能不能支撑设计选择?哪些结果是趋势判断,哪些是定量依据?如果方向错了,代价有多大?所以他们才会反复追问:为什么选择这个模型?关键假设是什么?有哪些你自己都不太放心的地方?这些问题,根本不是在考软件。他们真正想看的是三件事:你是否理解背后的物理本质你是否意识到模型的局限性你能不能用仿真结果,参与工程取舍高级仿真工程师,真正稀缺的是什么?说一句可能有点残酷的话:软件技能,是可以培训的。工程判断力,极难替代。真正把人拉开差距的,从来不是你会多少模块,而是:你知不知道哪些结果不能信你能不能解释清楚为什么这样取舍当仿真和实验不一致时,你的第一反应是什么高级仿真工程师,本质上是在为决策负责。重新定义“高级仿真工程师”如果用一句话总结:高级仿真工程师,不是模型跑得最快的人,而是能用仿真结果,让团队少走弯路的人。所以,如果你正准备下一次面试,或者正思考如何从中级走向高级,不妨先问自己一个问题:如果我是面试官,我会信我现在给出的这些结论吗?这,才是真正的分水岭。来源:锂电芯动

未登录
还没有评论
课程
培训
服务
行家
VIP会员 学习计划 福利任务
下载APP
联系我们
帮助与反馈