Robbyant/lingbot-map
LingBot-Map 是 Robbyant 团队开发的前馈式 3D 基础模型,通过几何上下文 Transformer(Geometric Context Transformer)在单一流式框架内统一坐标接地、密集几何线索和长程漂移校正,实现超过 10,000 帧长序列下约 20 FPS(518×378 分辨率)的稳定流式 3D 重建,并声称在多种基准上优于现有流式及迭代优化方法(ECCV 2026 最佳论文候选)。
GitHub查看原文 →
面向长序列视频的 3D 重建基础模型:Robbyant/lingbot-map(LingBot-Map)是 Robbyant 团队的前馈式 3D 基础模型,通过几何上下文 Transformer 在单一流式框架内统一坐标接地、密集几何线索与长程漂移校正,借助分页 KV 缓存注意力在 518×378 分辨率、超过 10,000 帧序列上实现约 20 FPS 稳定推理,提供评估基准、天空遮罩、窗口推理与离线渲染流水线,宣称在多种基准上优于现有流式与迭代优化方法。
LingBot-Map 是 Robbyant 团队开发的前馈式 3D 基础模型,通过几何上下文 Transformer(Geometric Context Transformer)在单一流式框架内统一坐标接地、密集几何线索和长程漂移校正,实现超过 10,000 帧长序列下约 20 FPS(518×378 分辨率)的稳定流式 3D 重建,并声称在多种基准上优于现有流式及迭代优化方法(ECCV 2026 最佳论文候选)。