空间智能与智能体 AI

空间智能 × 智能体 AI

从长时序三维建模
到自进化智能体。

构建理解三维空间、借助世界模型推演与行动,并能从经验中持续进化的智能体。

助理教授 · 人工智能学域 · 香港科技大学(广州)

王浩照片
学术简介

香港科技大学(广州)人工智能学域长聘轨助理教授,博士毕业于新加坡南洋理工大学。团队聚焦结合空间智能与智能体 AI,已发表 70 余篇学术论文。担任 ACL ARR Area Chair、AAAI 高级程序委员会委员(SPC)。入选广东省青年拔尖人才。

空间智能世界模型多模态智能体自进化智能体

代表工作

LongStream 长距离三维重建01 空间智能长时序三维感知、场景重建、SLAM 与人体空间理解
arXiv 2026

HorizonStream

仅以 RGB 视频为输入,实现万帧级稳定流式三维重建。

ECCV 2026

KiloGS-SLAM

面向公里级室外场景的单目 3D Gaussian SLAM。

CVPR 2026

LongStream

面向长序列的流式自回归视觉几何建模。

CVPR 2026 Findings

VGGT4D

从视觉几何 Transformer 中挖掘运动线索,实现免训练的四维场景重建。

IEEE TVCG 2026

MultiGO++

通过几何与纹理协同,从单张图像重建带纹理的三维服装人体。

ICML 2026

MotionGRPO

以强化学习后训练提升扩散式第一视角人体运动恢复。

AAAI 2026

FastAnimate

以可学习模板与姿态变形实现高效三维人体动画。

ICCV 2025

S3PO-GS

以全局尺度一致的三维高斯点图提升室外单目 SLAM。

ICCV 2025

RegGS

通过 3DGS 配准,从稀疏且无相机位姿的图像中重建场景。

ICRA 2025

OpenGS-SLAM

仅以 RGB 图像为输入,面向无边界室外场景的 Gaussian SLAM。

ICLR 2025

GraphGS

利用相机图结构,从图像中高效重建大规模开放场景。

NeurIPS 2024

GVKF

以高斯体素核函数高效重建开放场景表面。

EvolveNav 自进化导航智能体02 世界模型从环境预测走向行动决策与智能体自进化
ICLR 2026

ReCAPA

通过分层预测校正,抑制具身智能体长时序任务中的错误级联。

2026 · 框架与综述

EmbodiedWM

从生成可信、动作可控到服务决策,系统刻画具身世界模型的能力层级。

arXiv 2026

EvolveNav

通过结果预判与自进化规则记忆,让零样本导航智能体持续改进。

2026 · 综述

AI4AI

系统梳理 AI 如何改进数据、训练、评测、研发流程乃至自身。

CaM-Wolf 多模态社交推理智能体03 游戏智能多模态交互、策略推理与社会智能
ACM MM 2026

CaM-Wolf

面向社交推理游戏的因果感知多模态智能体。

ACL 2026

The Stackelberg Speaker

利用博弈建模优化社交推理智能体的说服性沟通。

EMNLP 2025

VistaWise

以跨模态知识图谱构建高效、低成本的 Minecraft 智能体。

EMNLP Findings 2025

CausalMACE

以因果推理增强 Minecraft 多智能体协作。

ACM MM 2025

MultiMind

融合多模态推理与心智理论的狼人杀智能体。

EMNLP 2024

LLM-Based Agent Society

以 Avalon 为试验场,研究大语言模型智能体之间的协作、对抗与社会行为。

共同推动空间智能与智能体研究落地。

期待与学界和产业界围绕长时序三维建模、数字孪生、具身智能与游戏智能、世界模型和自进化系统开展合作。

联系合作 →