全向高分辨多模态数据集OmniHD-Scenes技术分享~

作者 | 整数家 编辑 | 整数智能

点击下方卡片,关注“自动驾驶之心”公众号

戳我-> 领取自动驾驶近15个方向学习路线

>>点击进入→自动驾驶之心『自动驾驶』技术交流群

本文只做学术分享,如有侵权,联系删文

更多OmniHD-Scenes的技术细节和实现方案:
技术博客:https://www.2077ai.com/OmniHD-Scenes
研究论文:https://arxiv.org/abs/2412.10734

1.直播回放

感谢大家对OmniHD-Scenes技术分享会的关注与支持!本次直播整数智能联合自动驾驶之心,深入探讨了基于4D毫米波雷达的全向环境感知数据集,详细介绍了多模态数据集的构建方法、4D标注真值生成、基于VLM的Occupancy标注以及多传感器融合实验分析等核心内容。

错过直播的小伙伴不用着急,我们已将完整直播内容上传:

2.问题解答

同时,我们整理了直播过程中的众多精彩提问,并由专家团队进行了详细解答,欢迎查看完整问答内容:

1. 是否有OmniHD的测试代码?/代码是否开源?
项目代码将全部开源。

2. 数据集目前是否可以下载?
数据集预计于三月底完成法务流程后开放下载。

3. VLM如何帮助3D真值生成?/ OCC如何和VLM配合使用?
项目创新性地将Grounded-SAM应用于自动驾驶场景的真值生成。通过优化的Prompts strategy实现精确的交通场景语义分割,为点云数据提供丰富的语义信息。实验结果表明,在仅使用50%的OCC伪标签情况下,系统可达到92%以上的真值训练性能,显著提升了标注效率。当前技术在远距离目标的投影精度和复杂遮挡场景下仍存在一定局限性,这也是未来优化的重点方向。
                     

4. 运动中的车辆如何标注?
         


5. 4D Radar是如何去除多径虚景?
系统采用高精度同步触发机制进行数据采集,为确保多传感器数据的精确对齐,实现了完整的运动补偿方案。考虑到LiDAR 10Hz的采样频率会导致运动畸变,系统通过高频率自测获取精确的位姿信息,结合线性插值或球面线性插值算法进行补偿。该方案有效解决了传统点云采集中的运动畸变问题,显著提升了数据质量和后续处理精度。

6. 如何进行脱敏处理?
在进行数据脱敏处理时,需要重点关注人脸和车牌两大核心对象。对于人脸识别,系统要求在不同图像分辨率下(如长边>690像素时最小检出人脸≥长边/60)满足特定姿态角度范围(水平转动±45°,俯仰角±30°,倾斜角±45°),并确保关键部位的完整度达标。车牌识别则需要依据图像高度(>1080像素时最小检出高度≥高度/54)设定检测标准。脱敏处理采用统一色块或马赛克替换方案,确保数据不可逆且不可恢复。整个处理过程需满足严格的性能指标:脱敏区域与实际区域交并比维持在50%~85%之间,同时检测准确率不低于90%,误检率不超过10%,召回率达到90%以上。为确保数据的多样性和代表性,建议采集不少于300小时的不同地域车载摄像头视频序列,并保持原始分辨率和帧率进行处理。

7. 构建地图的时候,点云有做运动补偿吗?
动态障碍物补偿是自动驾驶感知中的关键挑战。由于LiDAR的360度扫描特性,在切包处补偿后可能出现显著的位移偏差。我们的解决方案包括:

  • 通过标注信息精确计算跟踪目标的运动状态(速度矢量、朝向等)

  • 基于状态估计对点云和检测框进行位置补偿

  • 在100ms扫描周期内采用匀速直线运动假设    

8. 抽帧有什么建议?

基于dynamic object detection技术,我们建议采用每秒2帧的抽帧频率,这一方案在标注效率和经济性方面达到最优平衡。

9. ICP会改变某一帧点云结果吗?

ICP主要输出位姿信息,通过匹配方式优化动态目标点云叠加效果。由于采用刚体转换,不会改变点云本身的形态特征。

10. 目前是否支持复现其他目标识别算法?

项目将开源baseline和完整的数据评估流程。

11. 动态障碍物运动补偿有什么建议?

LiDAR 360度扫描特性导致切包处补偿后存在位移偏差。可通过标注信息计算跟踪目标状态(速度、朝向等)进行点云和框的位置计算。目前采用100ms内匀速直线运动假设。

12.有没有三维重建这种虚拟数据方向?

数据采集自国家测试路段和封闭测试场,提供局部坐标系下的位姿信息及经脱敏处理的图像数据,可支持不同的重建任务。

13. 请问真值是用什么软件标注的?

采用整数智能自研的MooreData数据工程平台进行标注。该平台专注于自动驾驶场景下的数据标注需求,通过智能化工具和专业标注团队的配合,显著降低了4D数据标注成本,为用户提供高效、专业、经济的标注解决方案。目前该平台在高精度点云处理、多模态数据融合等方面具有显著优势。

14. 这个动态框也是标注之后合成的吗?

系统实现了高精度的多模态数据标注映射机制。具体流程包括:

  • 基于标注的3D信息进行初始化处理

  • 通过精确标定的转换矩阵实现雷达坐标系到相机坐标系的变换

  • 利用相机内参将3D信息投影至成像平面

  • 建立像素级的精确映射关系

这个机制确保了不同传感器数据间的精确对齐,为后续的感知算法开发提供了高质量的训练数据。

15. 相机是什么模型?鱼眼吗?

本项目采用标准针孔相机模型进行图像采集,区别于鱼眼结构,该配置能够确保更高的几何精度和成像质量。相机系统经过严格的参数标定,可提供稳定的成像效果和准确的投影关系,其视场角和焦距的选择均经过优化,以满足自动驾驶场景的特定需求。在雷达系统方面,项目选用几何伙伴(Geometric Partner)最新一代4D毫米波雷达,保留了完整的原始点云数据,包含空间和多普勒信息,并支持直接访问原始电源数据。

关于多径效应处理,我们选择保留原始多径信息,使研究者可以根据具体需求选择适当的处理方案,如基于空间滤波的方法、基于多普勒特征的分离技术或深度学习based的去噪方案等。我们将发布包含完整原始数据、详细传感器标定参数以及标注结果的综合数据集,并提供相应的评估基准,以支持研究者开展多样化的算法探索和验证工作。

16. 开源数据是7V还是11V的方案?

采用6V的方案,前后视配置800万像素,侧视配置200万像素。系统将开放所有数据,包括点云、图像数据、标注结果及投影外参。

如果您对OmniHD-Scenes还有任何疑问,欢迎在评论区留言,我们会持续关注并及时回复。

自动驾驶之心

论文辅导来啦

知识星球交流社区

近4000人的交流社区,近300+自动驾驶公司与科研结构加入!涉及30+自动驾驶技术栈学习路线,从0到一带你入门自动驾驶感知(大模型、端到端自动驾驶、世界模型、仿真闭环、3D检测、车道线、BEV感知、Occupancy、多传感器融合、多传感器标定、目标跟踪)、自动驾驶定位建图(SLAM、高精地图、局部在线地图)、自动驾驶规划控制/轨迹预测等领域技术方案、大模型,更有行业动态和岗位发布!欢迎加入。

独家专业课程

端到端自动驾驶大模型、VLA、仿真测试、自动驾驶C++、BEV感知、BEV模型部署、BEV目标跟踪、毫米波雷达视觉融合、多传感器标定、多传感器融合、多模态3D目标检测、车道线检测、轨迹预测、在线高精地图、世界模型、点云3D目标检测、目标跟踪、Occupancy、CUDA与TensorRT模型部署、大模型与自动驾驶、NeRF、语义分割、自动驾驶仿真、传感器部署、决策规划、轨迹预测等多个方向学习视频

学习官网:www.zdjszx.com

内容概要:本文系统研究了Picard迭代法在非线性常微分方程参数估计中的应用,深入阐述了该方法的数学原理及其在参数辨识中的收敛性与稳定性优势。通过构建最小化误差的目标函数,并结合数值积分技术,采用迭代方式逐步逼近系统的真实参数值,有效解决了非线性动态系统中因缺乏解析解而难以进行精确建模的问题。文中提供了完整的Matlab代码实现,涵盖模型定义、迭代求解、参数更新与结果可视化等关键环节,增强了方法的可操作性与工程实用性。研究通过典型非线性系统案例验证了算法的有效性,展示了其在科学计算与工程建模中的良好适应性与推广潜力。; 适合人群:具备常微分方程理论、数值分析基础及Matlab编程能力,从事系统建模、参数辨识、动力学仿真等相关方向的研究生、科研人员和工程技术开发者。; 使用场景及目标:①解决实际工程中非线性微分方程模型的未知参数估计问题;②深入理解Picard迭代法在科学计算中的实现机制与数值特性;③为学术论文复现、科研项目开发或课程设计提供可运行、易调试的技术方案与代码参考。; 阅读建议:建议读者结合文中的数学推导与Matlab代码逐行分析,重点关注迭代流程、目标函数构造与数值积分的耦合实现,通过修改模型结构或噪声条件进行扩展实验,以深化对算法鲁棒性与适用边界的理解。配套资源可通过指定公众号和网盘链接获取,推荐同步学习以加速科研进程。
内容概要:本文详细介绍了一种基于多尺度集成极限学习机(Extreme Learning Machine, ELM)的回归方法,并提供了完整的Matlab代码实现。该方法通过构建多尺度特征表示与集成学习机制,有效提升了ELM在处理非线性、高维复杂数据时的预测精度与模型鲁棒性,特别适用于时间序列回归任务。文档不仅阐述了算法的核心原理与技术流程,还系统展示了其在风电功率预测等工程场景中的应用潜力。同时,文中附带了丰富的科研仿真案例集合,涵盖智能优化算法、深度学习、信号处理、电力系统调度等多个前沿方向,体现了多学科交叉融合的技术优势与实践价值。; 适合人群:具备一定Matlab编程能力,从事科学研究或工程应用的研究生、科研人员及工程技术开发者,尤其适合专注于机器学习、智能算法优化、新能源预测与电力系统建模等相关领域的专业人员。; 使用场景及目标:①用于风电、光伏、负荷等时间序列数据的高精度回归预测任务;②为科研工作者提供可复现的多尺度集成ELM模型代码框架,支持快速算法验证与二次开发;③满足实际工程项目中对高效建模、实时预测与智能决策的技术需求。; 阅读建议:建议读者结合所提供的Matlab代码进行动手实践,深入理解多尺度特征构造与集成策略的设计思想,同时可参考文档中其他相关算法案例进行横向比较与综合应用,以提升整体科研创新能力。
内容概要:本文详细介绍了一种基于Simulink的Ćuk转换器仿真方法,该转换器能够将输入的直流电压高效地转换为极性相反的输出直流电压,具备优异的升降压能力与系统稳定性。文章深入剖析了Ćuk转换器的核心工作原理、电路拓扑结构(包含开关管、电感、电容、二极管等关键元件)及其在能量存储与传递过程中的动态行为。通过构建精确的Simulink仿真模型,验证了系统在不同输入条件下的稳态与暂态响应特性,充分展示了其输出电压反相、纹波小、效率高的优势,适用于对负压电源有严苛要求的应用场景。此外,文档还整合了大量基于Matlab/Simulink和Python的科研仿真资源,涵盖风电预测、微电网优化、GAN场景生成、电力电子系统建模等多个前沿方向,凸显了其在现代电力电子与系统仿真研究中的重要价值。; 适合人群:电气工程、自动化、电力电子及相关专业的本科生、研究生、科研人员及具备电路理论基础和Simulink仿真经验的工程技术人员。; 使用场景及目标:①深入理解Ćuk转换器的工作机理及其在直流-直流变换中的独特优势;②利用Simulink平台开展电力电子电路的建模、仿真与性能分析;③为需要稳定负压输出的电源系统设计提供理论依据和技术验证方案。; 阅读建议:建议结合Simulink软件动手实践,重点掌握电路拓扑搭建、关键参数配置及仿真结果解读技巧,同时可延伸学习文中提供的其他科研案例,以拓宽技术视野并提升综合仿真能力。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值