arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-06-24 至 2026-06-24 共收录 4
2606.24292 2026-06-24 cs.CV 新提交

ActiveScope: Actively Seeking and Correcting Perception for MLLMs

ActiveScope: 主动寻求和纠正MLLMs的感知

Yajing Wang, Chao Bi, Junshu Sun, Shufan Shen, Zhaobo Qi, Shuhui Wang, Qingming Huang

机构 * University of Chinese Academy of Sciences(中国科学院大学) State Key Lab of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院人工智能安全国家重点实验室,计算技术研究所,北京,中国) Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海))

AI总结 提出ActiveScope框架,通过语义锚点定位和干扰抑制细化模块,解决MLLMs在高分辨率图像中的细粒度感知问题,在V* Bench上达到96.34%准确率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24101 2026-06-24 cs.RO cs.CV 新提交

NavWM: A Unified Navigation World Model for Foresight-Driven Planning

NavWM:一种用于前瞻性规划的统一导航世界模型

Yanghong Mei, Longteng Guo, Ming-Ming Yu, Guiyu Zhao, Xingjian He, Jing Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 提出NavWM统一导航世界模型,通过潜在世界令牌提取几何与语义先验,结合锚点多模态轨迹预测框架生成多样化动作空间,利用视觉前瞻评估最优路径,在多种机器人数据集上显著提升未来状态生成与零样本导航成功率。

Comments 13 pages, 5 figures, accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23759 2026-06-24 cs.AR cs.AI cs.SE 新提交

VeriPilot: An LLM-Powered Verilog Debugging Framework

VeriPilot:一个基于LLM的Verilog调试框架

Yihan Wang, Cheng Liu, Jiazheng Zhang, Lei Zhang, Long Cheng, Xiaowei Li, Huawei Li

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所国家专用集成电路设计实验室) University of Chinese Academy of Sciences(中国科学院大学) North China Electric Power University(华北电力大学)

AI总结 提出VeriPilot框架,利用黄金参考模型和LLM实现细粒度Verilog调试,通过内部变量语义对齐和CDFG信号追踪定位并修复错误,在CVDP基准上将GPT-4o修复成功率从54.3%提升至85.71%。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22984 2026-06-24 cond-mat.dis-nn cond-mat.stat-mech cs.LG 新提交

Scalable Physics-Inspired Transformers for Spin Glasses

可扩展的物理启发式Transformer用于自旋玻璃

Lu Zhong, Wenli Duan, Jing Liu, Pan Zhang, Ying Tang

机构 * Institute of Fundamental and Frontier Sciences, University of Electronic Science and Technology of China(基础与前沿科学研究院,电子科技大学) School of Physical Science and Technology, Beijing University of Posts and Telecommunications(物理科学与技术学院,北京邮电大学) Institute of Theoretical Physics, Chinese Academy of Sciences(理论物理研究所,中国科学院) School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS(基础物理与数学科学学院,杭州先进研究院,UCAS) School of Physics, University of Electronic Science and Technology of China(物理学院,电子科技大学) Key Laboratory of Quantum Physics and Photonic Quantum Information, Ministry of Education, University of Electronic Science and Technology of China(量子物理与光量子信息重点实验室,教育部,电子科技大学) Non-classical Information Science Basic Discipline Research Center of Sichuan Province, University of Electronic Science and Technology of China(四川省非经典信息科学基础学科研究中心,电子科技大学)

AI总结 针对受阻自旋玻璃中玻尔兹曼分布采样效率低的问题,提出一种具有可解释稀疏注意力和自旋定制位置嵌入的物理启发式Transformer,利用FlashAttention实现并行祖先采样,在单GPU上实现前所未有的系统规模模拟,并解决现有方法在特定温度下的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏