arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 1511
2604.20204 2026-04-23 cs.LG

ACT: Anti-Crosstalk Learning for Cross-Sectional Stock Ranking via Temporal Disentanglement and Structural Purification

ACT:通过时间解耦和结构净化进行交叉截面股票排名的抗串扰学习

Juntao Li, Liang Zhang

机构 * School of Computing and Data Science, University of Hong Kong(香港大学计算与数据科学学院) Thrust of Financial Technology, Hong Kong University of Science and Technology (Guangzhou)(香港理工大学(广州)金融科技研究所)

AI总结 本文提出ACT框架,通过时间解耦和结构净化解决交叉截面股票排名中的串扰问题,提升排名准确性和投资组合表现。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19564 2026-04-23 cs.CV cs.AI

EgoSelf: From Memory to Personalized Egocentric Assistant

EgoSelf:从记忆到个性化第一人称助手

Yanshuo Wang, Yuan Xu, Xuesong Li, Jie Hong, Yizhou Wang, Chang Wen Chen, Wentao Zhu

机构 * Eastern Institute of Technology(东部技术研究所) Hong Kong Polytechnic University(香港理工大学) Peking University(北京大学) Commonwealth Scientific and Industrial Research Organization(澳大利亚联邦科学与工业研究组织) University of Hong Kong(香港大学)

AI总结 EgoSelf通过构建基于图的交互记忆和个性化学习任务,实现个性化第一人称助手,有效整合长期用户数据以提升服务效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.20208 2026-04-23 cs.LG cs.AI

Unlock the Potential of Large Language Models for Predictive Tabular Tasks in Data Science with Table-Specific Pretraining

解锁大型语言模型在数据科学中预测表格任务的潜力:通过表格特定预训练

Yazheng Yang, Yuqi Wang, Yaxuan Li, Sankalok Sen, Lei Li, Lin Qiu, Qi Liu

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Department of Information Systems and Management Engineering, Southern University of Science and Technology(南方科技大学信息 systems 和管理工程系)

AI总结 本文通过表格特定预训练方法提升LLM在表格预测任务中的表现,验证了定制化训练对提升表格智能的有效性。

Comments 10 pages; Accepted by TKDE

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20806 2026-04-23 cs.CV cs.AI cs.CL

OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model

OMIBench:用于大型视觉-语言模型在奥林匹克级多图像推理中的基准测试

Qiguang Chen, Chengyu Luan, Jiajun Wu, Qiming Yu, Yi Yang, Yizhuo Li, Jingqi Tong, Xiachong Feng, Libo Qin, Wanxiang Che

机构 * Research Center for Social Computing and Interactive Robotics(社会计算与交互机器人研究室) Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学) Fudan University(复旦大学) The University of Hong Kong(香港大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Text Computing and Cognitive Intelligence Ministry of Education Engineering Research Center(教育部文本计算与认知智能工程研究中心) Guizhou University(贵州大学)

AI总结 OMIBench旨在评估多图像推理能力,包含生物、化学、数学和物理奥林匹克问题,提供精确和语义答案匹配的评估协议,实验显示现有模型性能存在显著差距。

Comments ACL 2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11098 2026-04-23 cs.CV cs.LG eess.SP

Efficient Transceiver Design for Aerial Image Transmission and Large-scale Scene Reconstruction

高效空中图像传输与大规模场景重建的收发器设计

Zeyi Ren, Jialin Dong, Wei Zuo, Yikun Wang, Bingyang Cheng, Sheng Zhou, Zhisheng Niu

机构 * Department of Electronic Engineering, Tsinghua University, Beijing, China(清华大学电子工程系) Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(香港大学电子与计算机工程系)

AI总结 本文提出一种基于深度学习的端到端收发器设计,整合3D高斯点划法提升场景恢复质量,通过稀疏导频方案降低传输开销,实现实时高效的大规模场景重建。

Comments 6 pages, 6 figures, Accepted in ISIT 2026 IEEE International Symposium on Information Theory-w

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20627 2026-04-23 cs.LG cs.RO

Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning

占用奖励塑造:改进离线目标导向强化学习中的信用分配

Aravind Venugopal, Jiayu Chen, Xudong Wu, Chongyi Zheng, Benjamin Eysenbach, Jeff Schneider

机构 * Carnegie Mellon University(卡内基梅隆大学) The University of Hong Kong(香港大学) INFIFORCE Intelligent Technology(INFIFORCE智能技术) Princeton University(普林斯顿大学)

AI总结 本文提出占用奖励塑造方法,通过提取世界模型中的时间信息,改进稀疏奖励下的信用分配问题,在13种长周期运动和操作任务中提升了2.2倍性能。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00505 2026-04-23 cs.LG cs.AI

Towards Initialization-dependent and Non-vacuous Generalization Bounds for Overparameterized Shallow Neural Networks

面向初始化依赖和非空的泛化界限的过参数化浅层神经网络

Yunwen Lei, Yufeng Xie

机构 * Department of Mathematics, The University of Hong Kong(香港大学数学系)

AI总结 本文研究了过参数化浅层神经网络的初始化依赖和非空泛化界限,提出基于路径范数的初始化距离复杂度界限,并通过实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12036 2026-04-23 cs.CL

Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models

Composition-RL:为大型语言模型的强化学习编纂可验证提示

Xin Xu, Clive Bai, Kai Yang, Tianhao Chen, Yangkun Chen, Weijie Liu, Hao Chen, Yang Wang, Saiyong Yang, Can Yang

机构 * The Hong Kong University of Science(香港科学与技术大学) HY, Tencent(HY,腾讯) The University of Hong Kong(香港大学)

AI总结 Composition-RL通过自动组合多个问题生成新可验证问题,提升有限提示的利用效率,实验表明其能提升推理能力并支持跨领域强化学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19734 2026-04-22 cs.RO cs.AI

UniT: Toward a Unified Physical Language for Human-to-Humanoid Policy Learning and World Modeling

UniT:迈向人类到人形机器人政策学习和世界建模的统一物理语言

Boyu Chen, Yi Chen, Lu Qiu, Jerry Bai, Yuying Ge, Yixiao Ge

机构 * XPENG Robotics(小鹏机器人) Tsinghua University(清华大学) The University of Hong Kong(香港大学)

AI总结 UniT通过三分支交叉重建机制建立统一物理语言,实现人类到人形机器人的跨身体迁移,提升政策学习和世界建模的效率与鲁棒性。

Comments Project page: https://xpeng-robotics.github.io/unit/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18982 2026-04-22 cs.AI

SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attribution

SAVOIR:通过基于Shapley的奖励归因学习社交能力

Xiachong Feng, Yi Jiang, Xiaocheng Feng, Deyi Yin, Libo Qin, Yangfan Ye, Lei Huang, Weitao Ma, Yuxuan Gu, Chonghan Qin, Bing Qin, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 本文提出SAVOIR框架,基于合作博弈理论解决语言代理训练中的信用分配问题,通过预期效用转移和Shapley值实现公平奖励分配,实验显示其在SOTOPIA基准上达到新状态-of-the-art性能。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18564 2026-04-22 cs.CV

MultiWorld: Scalable Multi-Agent Multi-View Video World Models

多世界:可扩展的多智能体多视角视频世界模型

Haoyu Wu, Jiwen Yu, Yingtian Zou, Xihui Liu

机构 * The University of Hong Kong(香港大学) Sreal AI

AI总结 多世界框架通过多智能体控制模块和全局状态编码器,实现多智能体多视角视频世界建模,提升视频保真度和多视角一致性。

Comments 15 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18418 2026-04-21 cs.CV

MedProbeBench: Systematic Benchmarking at Deep Evidence Integration for Expert-level Medical Guideline

MedProbeBench: 在深度证据整合中的系统性基准测试用于专家级医疗指南

Jiyao Liu, Jianghan Shen, Sida Song, Tianbin Li, Xiaojia Liu, Rongbin Li, Ziyan Huang, Jiashi Lin, Junzhi Ning, Changkai Ji, Siqi Luo, Wenjie Li, Chenglong Ma, Ming Hu, Jing Xiong, Jin Ye, Bin Fu, Ningsheng Xu, Yirong Chen, Lei Jin, Hong Chen, Junjun He

机构 * Fudan University(复旦大学) Nanjing University(南京大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Hong Kong(香港大学)

AI总结 本文提出MedProbeBench,首个利用高质量临床指南作为专家级参考的基准,通过1200+任务自适应评估标准和5130+原子性声明验证,评估17种LLM和深度研究代理在证据整合和指南生成中的能力差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18026 2026-04-21 cs.LG cs.AI

RASP-Tuner: Retrieval-Augmented Soft Prompts for Context-Aware Black-Box Optimization in Non-Stationary Environments

RAPSTuner:基于检索的软提示用于在非平稳环境中具有情境意识的黑盒优化

Enze Pan

机构 * Department of Computer Science, The University of Hong Kong(香港大学计算机科学系)

AI总结 本文提出RAPSTuner,通过检索相似历史情境来识别模式代理,利用混合专家代理预测短期损失,并在低维提示子空间中进行适应,以减少非平稳环境中黑盒优化的累积遗憾。

Comments Withdraw by ICML and prepare for NeurIPS or ICLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08364 2026-04-21 cs.CV

MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping

MegaStyle: 通过一致的文本到图像风格映射构建多样化和可扩展的风格数据集

Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Yuanpeng Tu, Fei Shen, Weidong Zhang, Cairong Zhao, Jun Zhang

机构 * Tencent(腾讯) Nanyang Technological University(南洋理工大学) Hong Kong University of Science and Technology(香港科技大学) Fuzhou University(福州大学) University of Hong Kong(香港大学) National University of Singapore(新加坡国立大学)

AI总结 本文提出MegaStyle数据集,通过现有大生成模型的一致文本到图像风格映射能力,构建了包含170k风格提示和400k内容提示的多样化数据集,并提出风格监督对比学习方法和FLUX风格迁移模型。

Comments project website https://jeoyal.github.io/MegaStyle/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04695 2026-04-21 cs.AI cs.LG

Tape: A Cellular Automata Benchmark for Evaluating Rule-Shift Generalization in Reinforcement Learning

Tape:一种用于评估强化学习中规则转移泛化能力的单元自动机基准

Enze Pan

机构 * The University of Hong Kong(香港大学)

AI总结 Tape通过隔离动态中的潜在规则转移,保持观测-动作接口不变,评估强化学习在分布外泛化中的表现,发现稳定/周期性/混沌规则间的显著异质性。

Comments ICML reject and seeking for NeurIPS

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19897 2026-04-21 cs.AI cs.CL cs.CV cs.HC

ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows

ScienceBoard: 评估多模态自主代理在真实科学工作流中的表现

Qiushi Sun, Zhoumianze Liu, Chang Ma, Zichen Ding, Fangzhi Xu, Zhangyue Yin, Haiteng Zhao, Zhenyu Wu, Kanzhi Cheng, Zhaoyang Liu, Jianing Wang, Qintong Li, Xiangru Tang, Tianbao Xie, Xiachong Feng, Xiang Li, Ben Kao, Wenhai Wang, Biqing Qi, Lingpeng Kong, Zhiyong Wu

机构 * The University of Hong Kong(香港大学) Shanghai AI Laboratory(上海人工智能实验室) Fudan University(复旦大学) Peking University(北京大学) Nanjing University(南京大学) East China Normal University(华东师范大学) Yale University(耶鲁大学)

AI总结 ScienceBoard通过真实多领域环境和169个高质量任务评估多模态自主代理在科学工作流中的能力,发现现有代理在复杂任务中仅达到15%的成功率,揭示了改进设计原则的必要性。

Comments ICLR 2026 Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15304 2026-04-21 cs.AI cs.CY

AI Agents and Hard Choices

AI代理与艰难抉择

Kangyu Wang

机构 * The University of Hong Kong(香港大学)

AI总结 本文探讨AI代理在面对多目标不可比情况下的局限性,提出识别与解决难题,并提出集体解决方案以增强自主决策能力。

Comments 20 pages. v2: Substantially revised and rewritten; now typeset in LaTeX. Reflects the version presented at ACM FAccT 2026 (non-archival track). A revised version is under submission to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.16476 2026-04-21 cs.CV cs.AI

SVGDreamer: Text Guided SVG Generation with Diffusion Model

SVGDreamer:基于扩散模型的文本引导SVG生成

Ximing Xing, Haitao Zhou, Chuang Wang, Jing Zhang, Dong Xu, Qian Yu

机构 * Beihang University(北航) The University of Hong Kong(香港大学)

AI总结 SVGDreamer提出一种基于扩散模型的文本引导SVG生成方法,通过引入语义驱动的图像向量化过程和向量粒子基于的分数蒸馏技术,提升生成的可编辑性、视觉质量和多样性。

Comments Accepted by CVPR 2024. Project Page: https://ximinng.github.io/SVGDreamer-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17810 2026-04-21 cs.RO cs.IT math.IT

Memory Centric Power Allocation for Multi-Agent Embodied Question Answering

面向多智能体具身问答的记忆导向功率分配

Chengyang Li, Shuai Wang, Kejiang Ye, Weijie Yuan, Boyu Zhou, Yik-Chung Wu, Chengzhong Xu, Huseyin Arslan

机构 * Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(香港大学电子与计算机工程系) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences, Shenzhen, China(中国科学院深圳先进技术研究所) Southern University of Science and Technology, Shenzhen, China(南方科技大学) University of Macau, Macau, China(澳门大学) Istanbul Medipol University, Istanbul, Turkey(伊斯坦布尔Medipol大学)

AI总结 本文提出基于生成对抗考试(GAE)的记忆质量模型和记忆导向功率分配方法,通过优化通信资源约束下的QoM函数,提升多智能体具身问答性能。

Comments 6 pages, submitted to GLOBECOM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17696 2026-04-21 cs.AI

Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play

战略:通过轨迹调节的游戏自我对战学习可转移的推理

Xiachong Feng, Deyi Yin, Xiaocheng Feng, Yi Jiang, Libo Qin, Yangfan Ye, Lei Huang, Weitao Ma, Qiming Li, Yuxuan Gu, Bing Qin, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 本文提出STRATAGEM,通过轨迹调节游戏自我对战学习可转移的推理,解决领域特定性和上下文停滞问题,提升数学推理和代码生成等任务的性能。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17691 2026-04-21 cs.LG cs.AI

SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models

SafeAnchor:在大语言模型连续领域适应中防止累积安全性侵蚀

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong(香港大学) Brain Investing Limited

AI总结 SafeAnchor通过识别低秩安全子空间并约束梯度更新,有效防止连续领域适应中的安全性侵蚀,实验显示其在多个领域任务中保持了较高的安全性对齐度。

Comments 16 pages (12 main + 4 appendix), 2 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17245 2026-04-21 cs.RO

MM-Hand: A 21-DOF Multi-modal Modular Dexterous Robotic Hand with Remote Actuation

MM-Hand:一种21自由度多模态模块化灵活机械手 with 远程驱动

Zhuoheng Li, Qingquan Lin, Checheng Yu, Qiangyu Chen, Zhiqian Lan, Lutong Zhang, Hongyang Li, Ping Luo

机构 * The University of Hong Kong(香港大学) City University of Hong Kong(香港城市大学) XiFengGu Ltd.(西风谷有限公司)

AI总结 MM-Hand通过远程驱动技术实现21自由度多模态模块化机械手,集成了弹簧回弹腱驱动手指、3D打印模块化手指和手掌结构、快速腱连接器及多模态传感系统,验证了其轻量、传感丰富和可维护性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16940 2026-04-21 cs.LG cs.AI

D-QRELO: Training- and Data-Free Delta Compression for Large Language Models via Quantization and Residual Low-Rank Approximation

D-QRELO:通过量化和残差低秩近似实现大型语言模型的训练和数据无关的delta压缩

Junlin Li, Shuangyong Song, Guodong Du, Ngai Wong, Xuebo Liu, Yongxiang Li, Min Zhang, Jing Li, Xuelong Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) TeleAI of China Telecom(中国电信TeleAI) The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学)

AI总结 本文提出DQRELO方法,通过量化和残差低秩近似实现大型语言模型的delta压缩,解决大规模数据训练导致的压缩误差问题,提升压缩效果和实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16917 2026-04-21 cs.CL

x1: Learning to Think Adaptively Across Languages and Cultures

x1: 在多种语言和文化中学习适应性思考

Yangfan Ye, Xiaocheng Feng, Xiachong Feng, Yichong Huang, Zekun Yuan, Lei Huang, Weitao Ma, Qichen Hong, Yunfei Lu, Dandan Tu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Peng Cheng Laboratory(鹏城实验室) The University of Hong Kong(香港大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 x1通过在实例层面选择有利语言进行推理,提升多语言数学推理和文化相关任务的性能,挑战了单纯扩大模型规模的假设。

Comments Findings of ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16883 2026-04-21 cs.LG cs.AI

SinkRouter: Sink-Aware Routing for Efficient Long-Context Decoding in Large Language and Multimodal Models

SinkRouter: 为大语言和多模态模型高效长上下文解码的感知路由

Junnan Liu, Xinyan Liu, Peifeng Gao, Zhaobo Qi, Beichen Zhang, Weigang Zhang, Antoni Bert Chen

机构 * Harbin Institute of Technology (Weihai)(哈尔滨工业大学(威海)) University of Hong Kong(香港大学) City University of Hong Kong(城市大学)

AI总结 本文提出SinkRouter,通过感知路由机制提升长上下文解码效率,减少计算冗余,实现在512K上下文下的2.03倍加速,保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16586 2026-04-21 cs.LG cs.AI q-bio.QM

A Systematic Survey and Benchmark of Deep Learning for Molecular Property Prediction in the Foundation Model Era

在基础模型时代对深度学习用于分子性质预测的系统调查和基准测试

Zongru Li, Xingsheng Chen, Honggang Wen, Regina Qianru Zhang, Ming Li, Xiaojin Zhang, Hongzhi Yin, Qiang Yang, Kwok-Yan Lam, Pietro Lio, Siu-Ming Yiu

机构 * The University of Hong Kong, Hong Kong SAR(香港大学) Nanyang Technological University, Singapore(南洋理工大学) University of Cambridge, United Kingdom(剑桥大学) Zhejiang Normal University, China(浙江师范大学) The Hong Kong University of Science and Technology, Hong Kong SAR(香港科学与技术大学) The University of Queensland(昆士兰大学) The Hong Kong Polytechnic University, Hong Kong SAR(香港理工大学)

AI总结 本文系统调查了深度学习在分子性质预测中的应用,探讨了四种互补范式,并提出了未来三个发展方向,包括物理感知学习、可信推理的基础模型和整合计算与实验数据的基准生态系统。

Comments 32 pages. It is just accepted by Journal of Chemical Theory and Computation 2026

Journal ref Journal of Chemical Theory and Computation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11811 2026-04-21 cs.CL cs.AI cs.CV cs.CY

Enhancing Geo-localization for Crowdsourced Flood Imagery via LLM-Guided Attention

通过LLM引导注意力增强 crowdsourced 洪水影像的地理定位

Fengyi Xu, Jun Ma, Waishan Qiu, Cui Guo, Jack C. P. Cheng

机构 * Department of Urban Planning and Design, The University of Hong Kong(香港大学城市规划与设计系) Urban Systems Institute, The University of Hong Kong(香港大学都市系统研究所) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(香港理工大学土木与环境工程系)

AI总结 本文提出VPR-AttLLM框架,通过整合大语言模型的语义推理与地理知识,提升 crowdsourced 洪水影像的地理定位精度,实验表明在真实洪水影像上召回率提升1-3%,最高达8%。

Comments Updated author list to include additional contributor. Revised title and improved methodology section based on collaborative feedback

Journal ref Computers, Environment and Urban Systems, 127, 102434 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16299 2026-04-20 cs.CV

Repurposing 3D Generative Model for Autoregressive Layout Generation

将3D生成模型重新利用于自回归布局生成

Haoran Feng, Yifan Niu, Zehuan Huang, Yang-Tian Sun, Chunchao Guo, Yuxin Peng, Lu Sheng

机构 * School of Software, Beihang University(北航软件学院) Tsinghua University(清华大学) University of Hong Kong(香港大学) Tencent Hunyuan(腾讯文英) Peking University(北京大学)

AI总结 本文提出LaviGen框架,利用3D生成模型直接在3D空间中生成布局,通过自回归过程建模几何关系和物理约束,提升3D场景的物理合理性与效率。

Comments https://fenghora.github.io/LaviGen-Page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16004 2026-04-20 cs.CL cs.AI

AgentV-RL: Scaling Reward Modeling with Agentic Verifier

AgentV-RL: 通过代理验证器扩展奖励建模

Jiazheng Zhang, Ziche Fu, Zhiheng Xi, Wenqing Jing, Mingxu Chai, Wei He, Guoqiang Zhang, Chenghao Fan, Chenxin An, Wenxiang Chen, Zhicheng Liu, Haojie Pan, Dingwei Zhu, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Huazhong University of Science and Technology(华中科技大学) The University of Hong Kong(香港大学) ByteDance Seed(字节跳动种子) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院) Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室)

AI总结 本文提出Agentic Verifier框架,通过多轮工具增强的反思过程提升奖励建模效果,实验显示其在并行和顺序TTS任务中表现优异,4B变体超越现有最优ORMs 25.2%。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15769 2026-04-20 cs.LG cs.AI

Closing the Theory-Practice Gap in Spiking Transformers via Effective Dimension

通过有效维度关闭理论与实践之间的差距:脉冲变换器

Dongxin Guo, Jikun Wu, Siu Ming Yiu

机构 * The University of Hong Kong, Hong Kong, China(香港大学) Brain Investing Limited, Hong Kong, China(脑投有限公司)

AI总结 本文提出首个脉冲自注意力的理论框架,通过有效维度分析解释为何少量时间步足以实现高精度,提供设计规则和实验验证。

Comments 6 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏