arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Hong Kong University of Science and Technology(香港科技大学)

共收录 372
2607.16806 2026-07-21 cs.RO 新提交

Token-Wise Latent Streaming from Slow Reasoners to Fast Planners for Dynamic Vision Language Navigation

用于动态视觉语言导航的从慢速推理器到快速规划器的逐令牌潜在流

Tianshuai Hu, Yangyi Zhong, Zeying Gong, Lingdong Kong, Xiaodong Mei, Guoyang Zhao, Xiaolu Liu, Song Wang, Rong Li, Junwei Liang

机构 * The Hong Kong University of Science and Technology(香港科技大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) National University of Singapore(新加坡国立大学) Zhejiang University(浙江大学)

AI总结 针对动态视觉语言导航中语言推理慢与规划需即时的矛盾,提出SPARK-VLN双系统框架,通过三个模块将慢速VLM推理器知识流到快速规划器,引入新基准套件,提高了导航成功率、社会合规性及推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16354 2026-07-21 cs.LG cs.AI 新提交

A Predict-then-Correct Loop Based on Few-Shot Continuous Contextual Bandit for Demand Forecasting

基于少样本连续上下文博弈的预测-校正循环用于需求预测

Zhiwei Lei, Benedict Jun Ma, Ilya Jackson

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Massachusetts Institute of Technology(麻省理工学院)

AI总结 研究针对零售需求预测难题,提出预测-校正框架,运用少样本连续上下文博弈校正策略等,经实验在多需求模式下显著降低误差、提高RMSE并降低库存成本,证明在线预测校正能连接离线需求学习与实时零售决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16320 2026-07-21 cs.CV 新提交

The Devil is in the Dark Pixels: Toward Brightness Bias-Robust Denoising

魔鬼藏于暗像素中:迈向亮度偏差鲁棒去噪

Sungjun Cho, Zhuangzhuang Chen, Xiaomeng Li

机构 * The Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究图像去噪中暗区域信噪比低、MSE训练去噪器加剧偏差的问题,提出亮度偏差鲁棒去噪(BBRD)方法,将像素分亮度带,归一化误差并应用Group-DRO,实验证明该方法能同时改善各亮度带,在暗区域增益最大。

Comments 6 figures, 4 tables. Code: https://github.com/xmed-lab/BBRD

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16251 2026-07-21 cs.LG 新提交

Learning Spatio-Temporal Foundation Models from Pure Synthetic Data

从纯合成数据中学习时空基础模型

Yutong Feng, Shiyuan Piao, Yutong Xia, Xu Liu, Wenqi Fan, Fugee Tsung, See-Kiong Ng, Yuxuan Liang

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) National University of Singapore(新加坡国立大学) Hong Kong University of Science and Technology(香港科技大学) Hong Kong Polytechnic University(香港理工大学)

AI总结 研究旨在学习时空基础模型,提出NeoST,通过在程序生成的合成系统上预训练,引入可扩展语料库、潜在空间推理架构和目标,实验证明其在多样真实世界时空系统中性能优越,有长期稳定性和推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15901 2026-07-20 cs.AI 新提交

DSWorld: A Data Science World Model for Efficient Autonomous Agents

DSWorld:用于高效自主智能体的数据科学世界模型

Zherui Yang, Fan Liu, Hao Liu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 研究自主数据科学智能体依赖试错流程效率低的问题,提出数据科学世界模型概念及DSWorld框架,含多种技术。构建数据集并引入优化策略,实验显示其加速智能体训练和推理,在转换预测任务上超基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15830 2026-07-20 cs.AR cs.AI cs.LG 新提交

RTL-Sequencer: Towards Scalable RTL Timing Prediction with the Sequence-based Paradigm

RTL-Sequencer:基于序列范式实现可扩展的RTL时序预测

Ziyan Guo, Wenji Fang, Wenkai Li, Yuchao Wu, Shang Liu, Zhiyao Xie

机构 * Hong Kong University of Science and Technology (HKUST)(香港理工大学)

AI总结 针对RTL精确时序预测难题,现有基于图的方法存在局限。RTL-Sequencer提出基于序列的范式,通过线性化逻辑锥、应用序列模型及定制协同技术实现可扩展预测,实验证明其相比基线有显著改进,推动早期时序优化。

Comments Accepted by Design Automation Conference (DAC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15806 2026-07-20 cs.CV 新提交

HybridSim: A Physics-Learning Hybrid Digital Twin for mmWave Human Sensing

HybridSim:用于毫米波人体感知的物理学习混合数字孪生

Weitao Xiong, Tianyu Liu, Peng Li, Kok Chung Chua, Toa Chean Khim, Pu Wang, Hongfei Xue

机构 * Xiamen University Malaysia(厦门大学马来西亚分校) The Hong Kong University of Science and Technology(香港科技大学) University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

AI总结 研究针对毫米波雷达信号模拟成本高问题,提出HybridSim混合模拟器,用三平面和图卷积网络等提取人体特征、稳定优化,通过逆渲染等建模信号路径,实验显示其能有效增强特定地点数据,提升人体感知任务表现。

Comments Accepted to ECCV 2026. Project Page: https://weitao-xiong.github.io/HybridSim/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15278 2026-07-17 cs.CV 新提交

Hierarchical Denoising For Multi-Step Visual Reasoning

用于多步视觉推理的分层去噪

Zezhong Qian, Xiaowei Chi, Chak-Wing Mak, Tianze Zhou, Ruibin Yuan, Yuhan Rui, Hengzhe Sun, Zhuoqun Wu, Yuming Li, Siyuan Qian, Sirui Han, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机科学学院多媒体信息处理技术国家重点实验室) The Hong Kong University of Science and Technology(香港科技大学) Beihang University(北京航空航天大学) Fuzhou University(福州大学) Muka Robotics(木卡机器人)

AI总结 研究针对视频模型多步推理不足的问题,提出HDR框架,通过树形层次结构和稀疏分层注意力模式进行多步推理,在新基准测试中提升了成功率和进度,推理更快,数据效率更高,在机器人实验中展现潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15053 2026-07-17 cs.NI cs.AI 新提交

ANet Patu-1: The Value of Connection in the Agent Network

ANet Patu-1:智能体网络中连接的价值

Mu Yuan, Jinke Song, Zhaomeng Zhou, Lan Zhang

机构 * Agent Network Research(代理网络研究) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology(香港科学与技术大学) University of Science and Technology of China(中国科学技术大学)

AI总结 研究人工智能智能体网络连接价值,通过建模推导最优协作协议属性,引入ANet Patu-1协议。结果表明,异构便宜模型集体价值能超同构强模型,且异构网络能自收敛重构连接价值规律。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14706 2026-07-17 cs.LG 新提交

MESHA: Mechanism-Enforced Sequential Halving for Strategic Linear Bandits

MESHA:用于策略性线性博弈的机制强化序贯减半算法

Xin Li, Zixin Zhong

机构 * Data Science and Analytics Thrust, Hong Kong University of Science and Technology (Guangzhou)(数据科学与分析方向,香港科技大学(广州))

AI总结 研究策略性线性博弈中最佳臂识别问题,提出MESHA算法,采用朴素均匀采样规则和逐轮严厉触发条件,证明其在固定预算内失败概率上界,指出基于\(G\)最优设计的算法在此环境会失败,实验表明MESHA优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14681 2026-07-17 cs.CV 新提交

ReBind: Multi-Reference Video Editing via Structured Instructions with Explicit Reference Relationships

ReBind:通过具有显式参考关系的结构化指令进行多参考视频编辑

Xinyu Liu, Shihao Li, Weihong Lin, Xinlong Chen, Yang Shi, Yujin Han, Yiyang Cai, Yanghao Wang, Ruibin Yuan, Yuanxing Zhang, Pengfei Wan, Wenhan Luo, Yike Guo

机构 * HKUST(香港科技大学) Kling Team(克林团队) NJU(南京大学) UCAS(中国科学院大学) PKU(北京大学) HKU(香港大学)

AI总结 研究针对多参考图像条件视频编辑中现有方法难以协调多视觉源信息的问题,提出ReBind框架,通过带嵌入参考令牌的语义指令及两阶段渐进方案学习建立显式绑定,实现轻量级适配,在指令质量和性能上表现出色。

Comments Project Page: https://rebind-mrv2v.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14497 2026-07-17 cs.CV 新提交

Reinforcing Egocentric Spatial Perception in Multimodal Large Language Models via Ego Scene Augmentation

通过自我场景增强在多模态大语言模型中强化自我中心空间感知

Chi Kit Wong, Ye Pan, Yuanhuiyi Lyu, Xu Zheng, Zidong Cao, Lutao Jiang, Zixin Zhang, Huiyu Zhou, Xuming Hu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Guangxi Zhuang Autonomous Region Information Center(广西壮族自治区信息中心) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究如何强化多模态大语言模型的自我中心空间感知,提出自我场景增强框架ESA,利用自我元素图作为中间表示,通过视觉基础模型增强空间感知,在EgoTextVQA基准上取得显著性能提升。

Comments 14 pages, 8 figures. Chi Kit Wong and Ye Pan contributed equally. Code: https://github.com/Chikit-WONG/spatialGraph

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14245 2026-07-17 eess.SY cs.RO cs.SY 新提交

Information-Theoretic Adaptive Cooling for Deterministic MPPI via Entropy Feedback

通过熵反馈实现确定性MPPI的信息论自适应冷却

Shuqi Wang, Wenrong Sun, Tao Han, Yue Gao, Xiang Yin

机构 * School of Automation & Intelligent Sensing, Shanghai Jiao Tong University(自动化与智能感知学院,上海交通大学) Department of Physics, The Hong Kong University of Science and Technology(物理系,香港科技大学)

AI总结 研究基于MPPI的确定性最优控制中冷却策略难题,提出ITAC框架,利用重要性权重香农熵作反馈信号调节温度,证明其渐近收敛,实验显示该框架提升采样效率且收敛更快,不影响MPPI无导数特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13558 2026-07-16 cs.AI 新提交

Multi-Agent Collaborative Reasoning with Tool-Augmented Evidence for Urban Region Profiling

基于工具增强证据的多智能体协作推理用于城市区域剖析

Xixuan Hao, Yutian Jiang, Jiabo Liu, Yihang Yang, Guangyin Jin, Song Gao, Yuxuan Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Washington(华盛顿大学) Chang’an University(长安大学) University of Wisconsin - Madison(威斯康星大学麦迪逊分校)

AI总结 研究针对城市区域剖析问题,提出UrbanAgent框架,通过多智能体协作推理解决跨模态不一致,将指标预测扩展为闭环过程,经实验验证其性能优于现有基线,在未见城市设置中有强泛化性。

Comments Accepted by KDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13500 2026-07-16 cs.CV 新提交

Attention-Free and Lightweight Token Reduction for Efficient Vision-Language Models

用于高效视觉语言模型的无注意力轻量级令牌约简

Xuanyi Hao, Zuoyuan Zhang, Zhibo Wang, Xiaoyi Pang, Jiahui Hu, Jiacheng Du, Shuguo Zhuo

机构 * Zhejiang University(浙江大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 针对视觉语言模型在边缘设备部署难的问题,提出无注意力轻量级令牌约简框架,通过基于熵的准则估计令牌重要性,引入一致性信号确保视觉覆盖,经实验验证该框架在精度和效率权衡上表现出色。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13481 2026-07-16 cs.CV 新提交

GPOcc++: Unified Sparse Gaussian Occupancy Prediction with Visual Geometry Priors

GPOcc++:具有视觉几何先验的统一稀疏高斯占用预测

Changqing Zhou, Yueru Luo, Yulan Guo, Bing Wang, Jie Qin, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Sun Yat-sen University(中山大学) The Hong Kong Polytechnic University(香港理工大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

AI总结 研究针对3D场景理解中从视觉观察恢复完整体积表示的挑战,提出GPOcc++,它基于视觉几何先验,将其转换为占用感知的稀疏高斯表示,能在统一框架中处理多视图观察和时间序列,扩展到室外,实验证明其性能强、效率高且泛化能力好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13245 2026-07-16 cs.CV cs.RO 新提交

Just-In-Time Scene Graph Growth: Combating Perceptual Saturation in Long-Horizon Robotics

即时场景图增长:应对长期机器人感知饱和

Yue Chang, Rufeng Chen, Yifan Tian, Dazhi Huang, Zhaofan Zhang, Yi Chen, Wenze Zhang, Li Chen, Hui Xiong, Sihong Xie

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Jilin University(吉林大学)

AI总结 研究针对长期机器人任务中传统3D场景图构建方式导致感知饱和的问题,提出JITOMA闭环框架,利用任务热图过滤观察、大语言模型解析意图动态唤醒锚点,经JITOMA-Bench评估,该框架有效减小图大小和延迟,保持处理时间稳定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13108 2026-07-16 cs.LG cs.AI 新提交

STKAN: Kolmogorov-Arnold Networks for Spatio-Temporal Forecasting

STKAN:用于时空预测的柯尔莫哥洛夫-阿诺德网络

Sicong Lai, Yuehong Hu, Siru Zhong, Si Qiao, Yuxuan Liang, Guangyin Jin

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Chang’an University(长安大学) China University of Geosciences(中国地质大学)

AI总结 针对现实交通数据时空预测难题,提出STKAN架构,将泰勒多项式柯尔莫哥洛夫-阿诺德网络模块引入时空令牌混合,经实验验证其性能有竞争力,表明非线性函数逼近器设计对时空预测架构设计有补充作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13160 2026-07-16 cs.IT cs.AI eess.SP math.IT 新提交

Active Beyond-Diagonal RIS Empowered Heterogeneous Edge Computing: A Distributional Reinforcement Learning Approach

主动式非对角可重构智能表面赋能异构边缘计算:一种分布式强化学习方法

Tianyu Pang, Hongyu Li

机构 * Internet of Things Thrust, The Hong Kong University of Science and Technology (Guangzhou)(物联网 thrust,香港科学与技术大学(广州))

AI总结 研究互易主动BD-RIS辅助异构MEC的能量感知卸载与资源分配问题,基于分布式软演员-评论家算法改进版DSAC-T构建端到端联合优化框架,相比其他算法,实现了更好的能量-延迟奖励、可行性比率及更快在线决策时间

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12928 2026-07-15 cs.LG 新提交

Efficient Sequential Calibration with $O(T^{2/3-ε})$ Error Bound

具有\(O(T^{2/3 - ε})\)误差界的高效序贯校准

Zihan Zhang

机构 * HKUST(香港科技大学)

AI总结 研究在线二元序贯校准问题,基于已有突破成果,提出结合\textsc{SPR - 校准}程序与外部校正层的随机预测器,实现\(O(T^{2/3 - ε})\)期望校准误差,并对总校准误差进行分解及控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12893 2026-07-15 cs.AI cs.CL 新提交

MemOps: Benchmarking Lifecycle Memory Operations in Long-Horizon Conversations

MemOps:在长期对话中对生命周期内存操作进行基准测试

Xixuan Hao, Zeyu Zhang, Zehao Lin, Yihang Sun, Ziliang Guo, Xichong Zhang, Yuxuan Liang, Feiyu Xiong, Zhiyu Li

机构 * MemTensor (Shanghai) Technology Co., Ltd.(墨天轮(上海)科技有限公司) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Renmin University of China(中国人民大学)

AI总结 研究针对长期对话中内存操作评估,引入MemOps基准测试,将对话内存视为操作生命周期,通过可控管道嵌入操作并评估,揭示了当前系统内存操作的问题,推动评估从答案评分转向操作级诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12489 2026-07-15 cs.RO 新提交

Infra-Swarm: Robust Vision-Based Multi-Robot Swarming via Near-Infrared Spectral Vision

Infra-Swarm:通过近红外光谱视觉实现基于视觉的鲁棒多机器人集群

Haoyu Chen, Qijin Li, Wanyu Xiang, Xiuxiu Lin, Zian Ning, Shiyu Zhao

机构 * Westlake University(西湖大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Zhejiang University(浙江大学)

AI总结 研究针对分布式集群受带宽或环境限制问题,提出Infra-Swarm,通过机器人配备近红外光源和相机,利用光学耀斑测量邻居3D位置,借助窄带滤波器抗干扰,以最小计算开销实现集群大规模可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12455 2026-07-15 cs.AI cs.CE 新提交

EVOQUANT: Self-Evolving Verifier-Guided Strategy Optimization for Robust Quantitative Trading

EVOQUANT:用于稳健量化交易的自进化验证器引导策略优化

Jie Mao, Changlun Li, Xiang Li, Qiqi Duan, Jinhui Yuan, Xiang Liu, Yuyu Luo, Jing Tang, Xiaowen Chu, Nan Tang

机构 * HKUST(GZ)(香港科技大学(广州)) Paradoox AI Research(悖论人工智能研究)

AI总结 研究针对量化策略优化多依赖人工且易出错的问题,提出EVOQUANT框架,利用大语言模型诊断瓶颈、生成候选编辑,经多阶段验证选最佳策略,能提炼经验持续改进,实验表明该方法有效提升夏普比率,为金融策略研究提供新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12406 2026-07-15 cs.AI 新提交

Isolation as a First-Class Principle for LLM-Agent System Safety: Concepts, Taxonomy, Challenges and Future Directions

隔离作为大语言模型智能体系统安全的头等原则:概念、分类法、挑战及未来方向

Huihao Jing, Wenbin Hu, Shaojin Chen, Haochen Shi, Sirui Zhang, Hanyu Yang, Changxuan Fan, Zhongwei Xie, Hongyu Luo, Wun Yu Chan, Wei Fan, Haoran Li, Yangqiu Song

机构 * HKUST(香港科技大学) NYU(纽约大学) SWUPL(西南政法大学)

AI总结 探讨大语言模型智能体系统安全问题,将隔离作为头等原则,用边界中心分类法组织文献,助于识别隔离丧失位置、妥协传播方式及相关防御,还总结了故障路径,讨论挑战并勾勒研究议程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12375 2026-07-15 cs.CV cs.AI eess.IV 新提交

IQA-T1: Tool-based Visual Evidence Reasoning for Image Quality Assessment

IQA-T1:基于工具的图像质量评估视觉证据推理

Jinjian Wu, Jiaqi Tang, Wei Wei, Yingying Yan, Jianmin Chen, Botong Geng, Lei Zhang, Qifeng Chen

机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机科学学院) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 针对开放世界图像质量评估难题,提出IQA-T1框架,通过自主调用工具生成视觉证据增强多模态大语言模型推理,构建Q-Tool数据集,实验表明该框架性能最佳且评估可解释、基于证据。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11644 2026-07-14 cs.CV 新提交

Motion4Motion: Motion Transfer Across Subjects at Inference

Motion4Motion:推理时跨主体的运动转移

Ling-Hao Chen, Zixin Yin, Duomin Wang, Xianfang Zeng, Gang Yu

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究视频间运动转移,此前方法依赖骨骼结构有局限。提出免训练的Motion4Motion框架,对角色运动流建模,突破跨物种运动转移难题,实验结果显示该方法优于基线。

Comments SIGGRAPH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11221 2026-07-14 cs.CV cs.AI 新提交

HandFlow: Fully Generative 4D Hand Recovery with Flow Matching

HandFlow:基于流匹配的全生成式4D手部恢复

Mingxi Xu, Bowen Duan, Yi Gu, Zhengyang Shen, Renjing Xu, Yutao Yue

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Google(谷歌)

AI总结 针对单目4D手部重建难题,HandFlow提出全生成式流匹配框架,利用ODE积分、双流变压器和掩码机制,在世界空间精度、时间平滑性及重建速度上表现优异,性能达最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11041 2026-07-14 cs.RO 新提交

PAKE: Learning Whole-Body Loco-Manipulation with Partial Kinematic Embeddings

PAKE:利用部分运动学嵌入学习全身移动操作

Zhengmao He, Moonkyu Jung, Hyeongjun Kim, Jiseong Lee, Hui Zhang, Jemin Hwangbo, Jie Song

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Korea Advanced Institute of Science and Technology(韩国科学技术院) ETH Zurich(苏黎世联邦理工学院)

AI总结 研究针对高自由度机器人全身移动操作面临的挑战,提出将其分解为部分参考运动生成和低级模仿控制的框架,用KNF模型生成参考运动,经高低级控制器实现精确控制,在模拟和硬件实验中均表现优异,为相关操作提供实用方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10995 2026-07-14 cs.CV 新提交

AsySplat: Efficient Asymmetric 3D Gaussian Splatting for Long-Sequence Scene Modeling

AsySplat:用于长序列场景建模的高效非对称3D高斯点云渲染

Yingji Zhong, Dave Zhenyu Chen, Fuzhao Ou, Youyu Chen, Zhihao Li, Lanqing Hong, Dan Xu

机构 * HKUST(香港科技大学) Huawei Noah’s Ark Lab(华为诺亚方舟实验室) CityU(城市大学)

AI总结 研究针对长序列场景建模中3D高斯点云渲染的冗余计算问题,提出非对称架构解耦几何与外观建模,通过双边连接交互,减少计算冗余,提高参数效率,在32视图960P输入上大幅提升效率并超越零样本性能。

Comments The project page is at https://zhongyingji.github.io/asysplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10840 2026-07-14 cs.CV 新提交

OmniX: Any-view and Any-time 4D Reconstruction via Feed-forward Trajectory Fields

OmniX:通过前馈轨迹场进行任意视角和任意时刻的4D重建

Yanqin Jiang, Tengfei Wang, Zhengwei Wang, Chenjie Cao, Junta Wu, Wenhan Luo, Weiming Hu, Jin Gao, Chunchao Guo

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯混元) HKUST(香港科技大学) Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(多模态信息超智能安全北京重点实验室) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

AI总结 针对前馈4D重建方法局限,提出OmniX框架,通过解耦动态运动建模与静态几何预测,利用动态令牌和3D运动结构生成轨迹场,并构建数据引擎和数据集,在多任务上取得领先性能。

Comments Accepted by ECCV 2026, project page: https://omnix4d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏