该杂志刊期列表
- 2026年
- 1期
国内刊号:11-2925/TP
国际刊号:1003-9775
发布日期:
作者:范文刚, 兰育青, 易任娇, 朱晨阳, 徐凯
关键词:三维场景图, 超图, 多模态基础模型, 任务规划
三维场景图生成是具身智能体实现自主环境交互的核心挑战之一。现有的方法虽然能够建模几何结构与对象间基本关系,但是在功能性语义表征、交互属性推理及上下文关联建模等高层次语义理解层面仍存在局限性。针对上述问题,提出多模态基础模型驱动的层次化三维场景图生成方法。首先构建增量式多模态感知网络,并通过联合几何-语义共同约束的融合策略实现几何与语义一致的三维重建;然后利用视觉-语言模型实现对象标签的上下文语义增强,生成融合功能属性与空间约束的复合描述符;最后引导大语言模型推导和预测多元语义关联,并将这种由多个对象参与的高层次语义关系形式化为超边结构,系统化构建包含几何-功能-交互多维耦合的语义超图。在Replica数据集上的实验结果表明,所提方法的可行性超越主流基线方法;在消融实验中的结果表明,高层次语义关系能够使任务规划成功率提升26.6个百分点;该方法能够有效地构建三维场景的几何与多维度语义表征,相较于文中对比方法,为复杂环境下的智能体认知决策提供了更为丰富和准确的推理信息。
来源:2026年第1期
《计算机辅助设计与图形学学报》期刊编辑部