☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜
masked autoencoding已经成为文本、图像和最近的点云的transformer模型的一个成功的预训练范例。原始的汽车数据集适合进行自监督的预训练,因为与3d目标检测(od)等任务的标注相比,它们的收集成本通常较低。然而,针对点云的masked autoencoders的开发仅仅集中在合成和室内数据上。因此,现有的方法已经将它们的表示和模型定制为小而稠密的点云,具有均匀的点密度。在这项工作中,本文研究了在汽车设置中对点云进行的masked autoencoding,这些点云是稀疏的,并且在同一场景中,点云的密度在不同的物体之间可以有很大的变化。为此,本文提出了voxel-mae,这是一种为体素表示而设计的简单的masked autoencoding预训练方案。本文对基于transformer三维目标检测器的主干进行了预训练,以重建masked体素并区分空体素和非空体素。本文的方法提高了具有挑战性的nuscenes数据集上1.75 map和1.05 nds的3d od性能。此外,本文表明,通过使用voxel-mae进行预训练,本文只需要40%的带注释数据就可以超过随机初始化的等效数据。
本文提出了Voxel-MAE(一种在体素化的点云上部署MAE-style的自监督预训练的方法),并在大型汽车点云数据集nuScenes上对其进行了评估。本文的方法是第一个使用汽车点云Transformer主干的自监督预训练方案。
本文针对体素表示定制本文的方法,并使用一组独特的重建任务来捕捉体素化点云的特征。
本文证明了本文的方法数据高效,并且减少了对带注释数据的需求。通过预训练,当只使用40%的带注释的数据时,本文的性能优于全监督的数据。
此外,本文发现Voxel-MAE在mAP中将基于Transformer检测器的性能提高了1.75个百分点,在NDS中将其性能提高了1.05个百分点,与现有的自监督方法相比,其性能提高了2倍。
这项工作的目的是将MAE-style的预训练扩展到体素化的点云。核心思想仍然是使用编码器从对输入的部
分观察中创建丰富的潜在表示,然后使用解码器重构原始输入,如图2所示。经过预训练后,编码器被用作3D目标检测器的主干。但是,由于图像和点云之间的基本差异,需要对Voxel-MAE的有效训练进行一些修改。
TTSMaker
TTSMaker是一个免费的文本转语音工具,提供语音生成服务,支持多种语言。
2275
查看详情

图2:本文的Voxel-MAE方法。首先,用固定的体素大小对点云进行体素化。图中的体素大小已被夸大,以实现可视化的目的。在训练前,很大一部分(70%)的非空体素被随机mask掉了。然后,编码器只应用于可见体素,使用嵌入[46]的动态体素特征嵌入这些体素。masked非空体素和随机选择的空体素使用相同的可学习mask tokens嵌入。然后,解码器对mask tokens序列和编码的可见体素序列进行处理,以重构masked点云并区分空体素和非空体素。在预训练之后,丢弃解码器,并将编码器应用于unmasked点云。

图1:MAE(左)将图像划分为固定大小的不重叠的patches。现有的masked点建模方法(中)通过使用最远点采样和k近邻创建固定数量的点云patches。本文的方法(右)使用非重叠体素和动态数量的点。






Hess G, Jaxing J, Svensson E, et al. Masked autoencoder for self-supervised pre-training on lidar point clouds[C]//Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision. 2025: 350-359.
以上就是用于激光雷达点云自监督预训练SOTA!的详细内容,更多请关注其它相关文章!
# 上海
# seo实战课程
# 推广网站话术英语
# 文章seo写作模板
# 环保工程东莞网站建设
# 梵蜜琳线上营销方案推广
# 山西正规网站建设差异化
# 新闻页seo方案
# 企业网站优化渠道
# 成都网站建设出 名
# 山亭快速推广网站
# 技术
# 应用于
# 提出了
# 腾讯
# 万元
# 华为
# 提高了
# 中国科学院
# 重构
# 开源
# 雷达
相关栏目:
【
Google疑问12 】
【
Facebook疑问10 】
【
优化推广96088 】
【
技术知识133117 】
【
IDC资讯59369 】
【
网络运营7196 】
【
IT资讯61894 】
相关推荐:
亚马逊确认今年不会举办 re:MARS 机器人和人工智能大会
Goodnotes 6推出,带来多项全新AI功能,让电子笔记更智能
AI 助手 Copilot 上线,微软 Win11 Dev 预览版 Build 23493 发布
首家承认ChatGPT影响其收入的公司Chegg选择拥抱AI ,裁减4%员工
Meta推出VR订阅服务Quest +:每月免费玩两款游戏,7.99美元/月
Xreal AR 眼镜用投屏盒子 Beam 发布:分体式设计,到手 699 元
边喷火边跳踢踏舞,机器狗最新技能爆火全网!网友直呼真·热狗
新华全媒+|AI:当心,我可能欺骗了你!
全国体育人工智能大会举办,专家聚焦体育人工智能领域人才培养
美图秀秀“AI 扩图”功能上线,可根据图像生成更大画幅
报告称 70% 程序员已使用各种 AI 工具编程
高质量数据推动AI场景化应用快速发展及落地
人工智能产业协同创新中心:全产业链资源在这里汇聚
百川智能发布Baichuan-13B AI模型,号称“130亿参数开源可商用”
WHEE使用教程
「模仿学习」只会套话?解释微调+130亿参数Orca:推理能力打平ChatGPT
清华&中国气象局大模型登Nature:解决世界级难题,「鬼天气」预报时效首次达3小时
美图设计室2.0使用教程
马斯克:将来机器人比人类多!特斯拉机器人亮相人工智能大会
百亿量化私募:量化投资进入“精耕细作”时代 AI带来行业新变革
复盘MWC上海:AI大模型时代到来 通信网络将会怎样改变?
谷歌推出 SAIF 框架,倡导安全环境下探索和发展人工智能
日本学校探索引入 AI 和无人机:提高安保效率,节省劳动力
小艺将具备大模型能力,鸿蒙4加速AI普及之路
ChatGPT会成为你家新的语音助手吗?
塑造全能智能管家:华为小艺AI加成应对大模型挑战
“上海市民营企业人工智能赋能创新中心”揭牌成立
大模型训练成本降低近一半!新加坡国立大学最新优化器已投入使用
13万个注释神经元,5300万个突触,普林斯顿大学等发布首个完整「成年果蝇」大脑连接组
Adobe旗下Illustrator引入生成式AI工具Firefly
联想创投携手12家被投企业MWC展示元宇宙、机器人等技术
华为昇腾AI原生支持30多种基础大模型,包括GPT
人工智能快速发展 打开就业新空间
标贝科技亮相国际顶会ICASSP2025 加速布局海外AI数据市场
《自然》杂志拒绝刊登人工智能生成的图片和视频
WHEE安装教程
参考封面|人工智能“淘金热”
“技术+实践+生态”三箭齐发,京东方抢占物联网高地
乐天派AI桌面机器人提供的正能量情绪价值直接拉满,妥妥的治愈系
AI生成会议纪要 百度如流升级推出超级助手、智能编码等功能
套娃不可取:研究人员证实用AI生成的结果训练AI将导致模型退化
找对了风口想不火都难,乐天派机器人,安卓机器人的最终形态?
看懂AI,找到增长新势能 | 笔记侠AI峰会等你来
利好来了,AI再起一波?
亚马逊CEO:人工智能将成为公司未来战略的重中之重
斑马推出全新升级版思维机:以人工智能为核心的交互式学习体验
上天下海登极,青岛与昇腾AI握手一起探索星辰大海
软通动力多项AI创新产品及应用亮相2025世界人工智能大会
小米又拿下国际比赛第一:AI翻译立功
小米发布CyberDog2 - 他们的第二代仿生四足机器人展示
2023-09-15
运城市盐湖区信雨科技有限公司是一家深耕海外推广领域十年的专业服务商,作为谷歌推广与Facebook广告全球合作伙伴,聚焦外贸企业出海痛点,以数字化营销为核心,提供一站式海外营销解决方案。公司凭借十年行业沉淀与平台官方资源加持,打破传统外贸获客壁垒,助力企业高效开拓全球市场,成为中小企业出海的可靠合作伙伴。