高德地图已开源 ABot-Recon 三维重建模型。该模型只需连续 12 帧单目 RGB 视频,就能实时重建超 1 万帧规模的场景。
ABot-Recon 采用固定的 12 帧局部上下文,不依赖随视频长度增长的长期记忆,而是将局部点云和相机位姿逐步拼接成完整场景。官方测试中,模型在 KITTI-02 数据集上达到 24.45 帧/秒,峰值显存约 6.71GB,并开放了推理代码、评测脚本和预训练权重。

高德地图已开源 ABot-Recon 三维重建模型。该模型只需连续 12 帧单目 RGB 视频,就能实时重建超 1 万帧规模的场景。
ABot-Recon 采用固定的 12 帧局部上下文,不依赖随视频长度增长的长期记忆,而是将局部点云和相机位姿逐步拼接成完整场景。官方测试中,模型在 KITTI-02 数据集上达到 24.45 帧/秒,峰值显存约 6.71GB,并开放了推理代码、评测脚本和预训练权重。
