三维点云(3D Point Cloud)

三维点云是用大量离散的三维坐标点来表示物体或场景空间结构的一种数据形式。每个"点"本质上是一个坐标(x,y,z)(x, y, z),有时还附带额外信息,如颜色(R,G,B)(R, G, B)、反射强度、法向量等。

如何获取

  • 激光雷达(LiDAR):通过发射激光脉冲并测量反射时间来获取距离,是最主流的采集方式,广泛用于自动驾驶

  • 深度相机(RGB-D):如 Intel RealSense、Microsoft Kinect,同时采集彩色图像和深度图

  • 结构光扫描仪:常用于工业级高精度三维重建

  • 多视图重建(MVS/SfM):从多张普通照片中还原三维结构

核心特点

  • 无序性:点与点之间没有固定的拓扑关系,不像图像有规则的像素网格

  • 稀疏性:空间中大部分区域没有点,数据分布不均匀

  • 高维度:大型场景的点云可能包含数百万乃至数十亿个点

主要应用

领域

用途

自动驾驶

障碍物检测、高精地图构建

机器人

环境感知、抓取规划

文物保护

文物/建筑的数字化存档

工业检测

零件尺寸测量、缺陷检测

医疗影像

CT/MRI 数据的三维可视化

处理挑战

由于点云的无序性,传统卷积神经网络无法直接处理它。为此,学界提出了多种专门的深度学习方法,其中 PointNet(2017)是最具代表性的开创性工作,后续还有 PointNet++、VoxNet、PointPillars 等方法。

简单来说,点云就是用"一堆散点"在三维空间中勾勒出真实世界的形状。