MatPL-pro 是龙讯旷腾推出的 NEP 机器学习力场专业级 GPU 推理引擎。通过从头构建软硬协同的底层算子,MatPL-pro 在不改变 NEP 模型精度的前提下,推理速度实现 2–3 倍跨越式提升,全面释放硬件潜能。
MatPL-pro 核心特性
模型兼容性
NEP 变体全覆盖:NEP4, NEP5, NEP4_ZBL, NEP5_ZBL, typewise-ZBL
跨平台势函数兼容:支持 MatPL-2025.3+ 及 GPUMD 训练的 nep.txt 文件
热流直接计算:GPU 端 MatPL 热流 + 时间平均 fix,无需传统后处理
GPU 兼容矩阵
性能基准:六大体系 × 五款 GPU 实测
测试覆盖 H₂O、Cu、Graphene、W、HfO₂、WMoTaV 六大典型材料体系,在 3080ti、3090、4090、5090、V100 五款 NVIDIA GPU 上系统对比。所有测试均为单卡,原子规模覆盖 2000 至 1100 万原子。
总体加速比
六大体系 × 五款 GPU 最大速度综合对比
浅色 = MatPL,深色 = MatPL-pro
各 GPU 最大模拟速度 (Matom-step/s)
旗舰性能:W 体系 + RTX 5090 + MatPL-pro = 110.8 Matom-step/s,单卡即可驱动千万级原子模拟。
加速比热图:六大体系 × 五款GPU,MatPL-pro 对 MatPL 的加速倍数
5090 上六大体系加速比详情
5090 上六大体系加速比高度一致(2.23–2.60×),性能提升稳定可预期。
RTX 5090 上六大体系速度 vs 原子数曲线
实线 = MatPL-pro,虚线 = MatPL,各体系各规模全面领先
快速开始
环境要求
LAMMPS
推荐版本:stable_22Jul2025_update4
CUDA Toolkit
推荐版本:11.6+(匹配 .so CUDA 版本)
GCC
推荐版本:8.3+(需 C++17)
OpenMPI
推荐版本:4.1.x
CMake3.18+
推荐版本:3.18+
Mcloud上调用
自主安装三步部署
LAMMPS 输入示例
运行命令
License 暑期开放评估
KOKKOS 包装层、补丁脚本、示例、测试:GPL v2+ 开源
libnep_gpu.so:评估使用
summer_holiday.lic:评估 License(最大 16 卡,2026-08-31 前有效)
MatPL-pro —— 让每一卡 GPU 都物尽其用!
MatPL-pro 在龙讯旷腾自建的Mcloud 超算云上完全开放使用;联系邮箱caoqihang @pwmat.com,备注主题“测试MatPL-pro”,留下您的单位和姓名,可额外获得3000元测试机时;商业使用或 License 续期请联系邮箱:matpl@pwmat.com。
https://github.com/LonxunQuantum/lammps-MatPL/releases/tag/MatPL-pro-v2026.6