论文详情

在候选信息与下一步动作之间切换,统一管理今日论文。

Google Scholar Alert 已全文快扫 相邻启发,暂不精读

GeoWAM: Visual Geometry World Action Models for Autonomous Driving

2026 · T5 Google Scholar Alerts personal keywords

推荐理由

核心判断

论文摘要(中文)

全文概述(未提取到摘要):GeoWAM 将视觉几何表示与世界动作模型用于自动驾驶。当前全文证据显示,它在各个评测预测时域取得最低的 Abs Rel,并将最强基线的总体均值从 0.274 降至 0.257。

研究动机(中文总结)

作者基于前述观察提出 GeoWAM,将视觉几何世界动作模型用于自动驾驶;当前提取的引言证据没有保留更完整的问题背景,需回看 PDF 引言确认。

创新与贡献(中文总结)

提出面向自动驾驶的视觉几何世界动作模型 GeoWAM;当前证据显示其重点是以几何信息支撑世界状态与动作建模。

方法与证据

方法(中文总结)

全文当前提取到的方法证据不足,只有结论中对 GeoWAM 的总体描述;具体模块与训练方式需补读方法章节。

实验结果(中文总结)

作者报告 GeoWAM 在每个评测时域都取得最低 Abs Rel;总体均值由最强基线 Epona+DVGT 的 0.274 降至 0.257。