首页/文章/ 详情

基于UE5的CARLA 0.10.0 发布啦,快来看看有哪些新功能吧

8月前浏览559

引言



CARLA团队今天正式发布CARLA 0.10.0版本!该版本最大的更新是从虚幻引擎(UE)4.26到5.5版本的迁移,在视觉保真度方面实现了巨大的飞跃。CARLA 0.10.0 在 CARLA 的核心渲染引擎中引入了全新的 Lumen 和 Nanite 技术,从而增强了逼真度、细节和性能。该引擎升级通过UE5的增强型渲染技术大大提高了视觉传感器的保真度。

为了更好地利用引擎升级带来的新功能,0.10.0版本中的环境和资产也进行了升级,包括Town 10和更逼真的车辆,以及由CARLA理事会单位深信科创提供的越野露天矿地图。

此外,0.10.0 版还完成了与 Inverted AI 交通流仿真模型的集成、原生 ROS2 集成、更新的 Python 兼容性等,带来了最先进的生成式 AI 交通模拟!



亮点介绍

01  提升视觉传感器的仿真性能


 

UE 5.5 显著增强了CARLA渲染高度详细几何体的能力,具有令人惊叹的真实光影和反射效果。新的Nanite虚拟化几何体系统可动态调整用于渲染资产的多边形数量,确保在远距离观察物体时性能高效,同时在近距离保留足够的细节。这意味着CARLA地图和资产现在几乎拥有无限的几何体资源,可以在不牺牲性能的情况下使用高度精细的 3D 资产。Lumen 通过更精确地模拟复杂的光照行为(如漫反射和镜面反射),将虚拟场景光照和反射的逼真度提升到了一个新的水平。这使得场景看起来更加自然,能够以逼真的方式动态适应光照变化。总之,UE 5.5 以惊人的效果增强了 CARLA 的整体视觉保真度。




 

02   新的虚拟环境和数字资产  

  • 升级后的Town 10

作为 CARLA 底层基础的几何体处理系统为渲染数量更多的多边形和更加逼真的光照环境打开了大门。为了充分发挥这一优势,CARLA 新版本推出了升级的 Town 10地图,其中包括全新的建筑、人行道、道路和植被,所有这些都围绕着与之前版本相同的道路拓扑。 

       新改造的Town 10包括采用了炫目的反光玻璃的新塔楼和底层的零售门店。新几何系统所允许的额外渲染细节在地图上多处华丽的古典风格建筑中得到了真实展现。

此外,Town 10还引入了一些新的建筑工地资产,给人一种城市景观不断演变的印象。


  • 强化的道路拓扑

Town 10 在细节方面的改进延伸到了路面本身。Town 10 的道路现在具有逼真的外倾角和零星的路面变化,如坑洼和减速带,这进一步增强了道路外观,车辆运动状态和传感器仿真的逼真度。


  • 升级后的车辆列表

除了Town 10的升级之外,0.10.0 版本还配备了 11 辆更逼真的车辆,利用更高的几何成本和改进的照明来更清晰的捕捉每一个细节。


UE 5 还引入了新的 Chaos 物理引擎,为车辆动力学建模提供了更多可配置选项。CARLA 0.10.0 中包含的所有车辆现在都使用了新引擎,从而使得车辆的悬挂更为逼真。

  • 深信科创提供的越野露天矿地图


在0.10.0版本中,CARLA推出了一个壮观的露天矿地图,由CARLA理事会单位深信科创提供。该地图包括一个停车场,通过一系列小型通道与矿区相连。  

 


 
此外,深信科创还提供了一台巨型矿车素材,用于模拟矿山地图上的交通场景。  

 
 


           

 

03  Inverted AI 交通流仿真模型


 

Inverted AI 提供了基于生成式人工智能的最新交通模拟技术,该技术使用广泛的真实交通数据进行训练。Inverted AI 的交通流仿真模型为 CARLA 仿真中的模拟者提供反应灵敏、逼真、类人类的行为,这有助于安全应对驾驶员不可预测行为的自动驾驶智能体的开发。所有功能都通过方便的基于 Web 的 Python API 提供,与 CARLA 的集成非常简单。我们提供了一个示例脚本,帮助您开始使用逼真且行为多样的交通流。



04  ROS2 原生接口


   

0.10.0 版正式引入 CARLA 新的原生 ROS2 接口。这意味着 ROS2 接口直接内置于 CARLA 服务端中,无需中间桥接进程,从而降低了延迟并简化了 AD 栈设置。您可以使用新的命令行标志启用 ROS2 连接:

 




05   SCENIC 3 集成


   

CARLA 0.10.0 现在完全支持 SCENIC 3。CARLA 用户可以利用 SCENIC 3 场景描述语言在 CARLA 0.10.0 中定义和执行场景。




   

06   更新的 Python 兼容性

最新版本的CARLA改进了对新Python版本的兼容性。CARLA 0.10.0 在 Ubuntu 和 Windows 中都支持以下 Python 版本:

● 3.8

● 3.9

● 3.10

● 3.11

● 3.12

此版本不再支持 Python 版本 3.7 及更低版本。




文档

基于UE 4.26的CARLA版本和基于UE 5.5的CARLA版本在可预见的未来会共存一段时间,我们认识到有些用户可能期望探索UE 5.5带来的更强的渲染能力,而其他用户可能会继续依赖于还未被迁移到UE 5.5的CARLA功能和数字资产。因此,基于UE 5.5 版本的 CARLA 的文档将托管在一个新的 URL 上,以明确区分与基于UE 4.26 版本的CARLA的不同。

CARLA UE 5.5 文档托管在自己的 URL 上,网址为:

carla-ue5.readthedocs.io 

CARLA UE 4.26 的文档一如既往地位于:

carla.readthedocs.io 





CARLA 0.9.15 和 0.10.0 版本差异

CARLA 0.10.0 版本带来了令人难以置信的新功能。为此,CARLA团队努力将尽可能多的功能从以前的版本迁移到新版本中。但这仍是一项进行中的工作,一些功能和内容仍待更新。以下是 0.10.0 版本中缺失或未测试的功能概览:


○ 性能:在内部测试中记录的当前峰值帧率大约为24/25 FPS,我们已经确定了一些提高性能的途径,详见GitHub上关于性能的说明。

○ 硬件要求:显存少于12GB的GPU可能无法加载默认地图(Town 10)。建议0.10.0版本至少需要16GB的显存。

○ 天气固定设置为白天。云层、雨水、雾和太阳位置无法修改。

○ 地图:CARLA 地图 1-9、11、12、13 和 15 尚未升级,不包括在内,Town 10 已升级

○ 不支持地图层 API

○ 不支持大型地图

○ 不支持数字孪生处理管道

○ 不支持新数字资产导入

○ 车辆:11 辆车已更新并包含在 0.10.0 版本中:* 林肯 MKZ * 日产 patrol * 道奇充电器 * 道奇充电器警察 * 消防车 * 福特皇冠出租车 * 迷你库珀 * CarlaCola 卡车 * 福特救护车 * 梅赛德斯 Sprinter 面包车 * 三菱 Fusorosa 巴士 * 采矿推土机(来自深信科创) 所有其他车辆已从 0.10.0 的蓝图库中删除

○ 可修改车辆灯光,但灯光强度和颜色调整尚未进行广泛的测试

○ 道具:大部分道具仍然可用

○ 不支持 OpenStreetMap 导入

○ 联合仿真已禁用或未经测试:SUMO、Chrono、PTV Vissim

○ 不支持 V2X

○ 不支持获取 Gbuffer数据

○ 应用纹理 API 仅适用于具有蓝图的对象

○ 对于低于 1080p 的分辨率,将禁用运动模糊以避免伪影

○ LightManager 和相关类已从 0.10.0 中删除


其他更改、修复和升级:


○ 重新设计了语义分割和实例分割管道,以提高稳定性和性能

○ 现在可以通过编辑器查看语义分割以进行调试

○ 构建系统已重新设计,改为 Cmake

○ 新增 Python 示例脚本



END

来源:车路漫漫
建筑python消防UM自动驾驶数字孪生渲染人工智能管道
著作权归作者所有,欢迎分享,未经许可,不得转载
首次发布时间:2025-12-10
最近编辑:8月前
李慢慢
硕士 自动驾驶仿真工程师一枚
获赞 14粉丝 93文章 320课程 0
点赞
收藏
作者推荐

华为、理想、特斯拉是怎么用世界模型是做智驾仿真的?

以下文章来源于公 户号:佐思汽车研究 ,作者周彦武,格式略有改变。图片来源:论文《World Models for Autonomous Driving: An Initial Survey》最近世界模型(World Model)很火,甚至有人说世界模型是终极自动驾驶解决方案,实际上它只是端到端大模型的一种,和VLM没有本质区别。目前的研究基本都集中在用世界模型生成视频或其他连续时间序列上的可视化数据,再用这些视频训练传统或端到端的自动驾驶模型,几乎没有人研究直接用世界模型做自动驾驶的。即便是视频生成,也还是处于实验室的学术研究阶段。图片来源:网络为什么要做世界模型,它实际上是端到端自动驾驶的闭环仿真,世界模型可以看做VLM的逆向工程,用prompt这些文字提示输出视频。世界模型和端到端模型是一个互相帮助的过程,世界模型生成的视频交给车端大模型,车端大模型通过它的规划执行接下来的动作,接下来的动作产生新的场景、新的视角,再通过世界模型继续生成新的数据,进行闭环仿真的测试。图片来源:网络不同于CARLA这些测试型仿真,世界模型是训练型仿真,它要达到海量规模才有价值。图片来源:网络世界模型生成视频可以是自监督的,无需3D标签,可以使用海量网络汽车驾驶视频。最重要的是它可以生成现实世界中极难采集到的长尾视频,这是其核心价值。换句话说它生成的视频价值是现实世界采集到的视频数据的价值百倍以上,但成本是其1%不到。图片来源:网络所谓世界模型就是视频生成加prompt控制。视频生成有四大类型,包括基于对抗网络GAN的,基于扩散模型的,基于自回归模型(基本上就是transformer)和基于掩码的。其中,扩散模型再分为Stable Video Diffusion (SVD)和Stable Diffusion (SD)两种,它们还有一种共同的称呼即隐扩散模型(Latent Diffusion Model, LDM)。目前也有结合diffusion和transformer的模型即DiT,但它本质上还是扩散模型,只不过用transformer替换了扩散模型中的Unet。大名鼎鼎的SORA则是复合型,Sora模型的核心组成包括Diffusion Transformer(DiT)、Variational Autoencoder(VAE)和Vision Transformer(ViT)。DiT负责从噪声数据中恢复出原始的视频数据,VAE用于将视频数据压缩为潜在表示,而ViT则用于将视频帧转换为特征向量以供DiT处理。据说特斯拉就是用的SVD。基于世界模型的端到端训练,图片来源:网络生成视频的质量分为两部分,一是视频本身的准确度,主要指标有三个,一个是FID/FVD,另一个是CLIP得分。FID(Fréchet Inception Distance)是一种用于评估生成模型,尤其是在图像生成任务中,生成图像的质量和多样性的指标。它通过比较生成图像与真实图像在特定空间内的分布来工作。这个特定的空间通常是通过预训练的Inception网络的某一层来定义的。对于生成图像集和真实图像集,分别通过Inception网络(通常是Inception V3模型)计算它们的特征表示。这一步骤会得到每个图像集的特征向量,计算每个集 合的特征向量的均值和协方差矩阵,并做对比,都是高等数学的课程,这里就不展开说了。FVD和FID接近,相当于把FID的图像特征提取网络换成视频特征提取网络,其他都差不多。最后一个是北大提出来的,就是Trajectory Agent IoU (NTA-IoU),与设定轨迹的交并比,Novel Trajectory Lane IoU (NTL-IoU),与设定车道的交并比。二是视频本身的长度、帧率和分辨率,要尽可能与传统自动驾驶训练视频达到一致的帧率和分辨率。目前世界模型生成视频的方向有两个,一个是追求更长、更多视角、更高分辨率,代表作有商汤的《InfinityDrive: Breaking Time Limits in Driving World Models》,华为的《MagicDriveDiT: High-Resolution Long Video Generation》,Wayve的GAIA-1,地平线的DrivingWorld。另一个是追求近乎真实的3D场景渲染,理想在这方面情有独钟,理想的Street Gaussians、ReconDreamer、DriveDreamer4D都是这个方向,也是这个领域的主要代表作。图片来源:网络特斯拉用的什么世界模型,自然是未知,也许它根本就没用世界模型。注:“Ours”指的就是InfinityDrive图片来源:商汤论文《InfinityDrive: Breaking Time Limits in Driving World Models》图片来源:华为的MagicDriveDiT华为不仅能生成超高分辨率,还能生成多个角度的视频。数据来源:地平线的DrivingWorld,数据尺度比较大,分辨率也很高我们再来看另一条3D渲染线,它的核心应该说有点偏离世界模型的本来意义了,它是追求接近真实的3D渲染,基本上是理想汽车的独角戏。三个比较有价值的模型基本都有理想汽车的身影,第一个是Street Gaussians: Modeling Dynamic Urban Scenes with Gaussian Splatting,浙江大学和理想汽车合作,九位作者,其中来自理想汽车的作者占四位。第二个是DriveDreamer4D: World Models Are Effective Data Machines for 4D Driving Scene Representation,由极佳科技联合中国科学院自动化研究所、理想汽车、北京大学、慕尼黑工业大学等单位提出,十二位作者两位来自理想汽车。第三个是ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration,总共十六位作者,其中来自理想汽车的多达八位,来自极佳科技的有六位。图片来源:论文《ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration》上图可以看到,理想汽车与极佳科技合作的最新成果就是ReconDremaer,纯粹StreetGaussians的话,一旦偏离中心视角,容易出现空洞或鬼影,车道线也出现扭曲。ReconDreamer整体框架, 图片来源:论文《ReconDreamer: Crafting World Models for Driving Scene Reconstruction via Online Restoration》除了生成视频,还有生成激光雷达点云视频,如理想与澳门大学合作的《OLiDM: Object-aware LiDAR Diffusion Models for Autonomous Driving》,还有生成语义分割图的《SynDiff-AD: Improving Semantic Segmentation and End-to-End Autonomous Driving with Synthetic Data from Latent Diffusion Models》。OLiDM的整体框架,图片来源:论文《OLiDM: Object-aware LiDAR Diffusion Models for Autonomous D riving》上图中,世界模型生成激光雷达点云视频,再拿这个去训练激光雷达的识别能力。数据来源:论文《OLiDM: Object-aware LiDAR Diffusion Models for Autonomous Driving》OLiDM的效果,能有两三个点的提升,已经是非常难得了,现在在nuScenes上0.001的提升都需要一年半以上的时间。世界模型一点也不神秘,不仅是端到端自动驾驶,它对传统自动驾驶也有明显的提升,自动驾驶的数据成本也大幅度下降至少95%以上,那些所谓影子模式变得毫无价值,实际上没有世界模型生成视频,影子模式本身也毫无价值,这也是马斯克说他用扩散模式生成视频的原因,如果影子模式真有价值,何必多此一举?-- END --声明:内容源自佐思汽车研究,文中观点仅供分享交流,不代表本公众 号立场,如涉及版权等问题,请您告知,将及时处理!来源:车路漫漫

未登录
还没有评论
课程
培训
服务
行家
VIP会员 学习计划 福利任务
下载APP
联系我们
帮助与反馈