arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The University of Hong Kong(香港大学)

共收录 1508
2605.26820 2026-08-11 cs.RO 版本更新

Can Vision-Language-Action Models Learn from Real-World Data Continually without Forgetting?

VLA 模型能否从现实世界数据中持续学习而不遗忘?

Jiarun Zhu, Yijun Hong, Xiaoquan Sun, Zetian Xu, Qijun He, Haijier Chen, Zhiyong Wang, Mingqi Yuan, Wenjun Zeng, Jiayu Chen

机构 * HKU(香港大学) INFIFORCE EIT, Ningbo(宁波工程学院) HUST(华中科技大学) SUSTech(南方科技大学) HITSZ(香港理工大学)

AI总结 本研究通过构建包含四个顺序操作任务的真实世界持续学习数据集,实证发现视觉-语言-动作(VLA)模型在持续学习异构真实世界演示时存在严重灾难性遗忘,并系统评估了经验回放方法的关键实施因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20537 2026-08-11 cs.CV

PFGNet: A Fully Convolutional Frequency-Guided Peripheral Gating Network for Efficient Spatiotemporal Predictive Learning

PFGNet: 一种全卷积频率引导边缘门控网络,用于高效的时空预测学习

Xinyong Cai, Changbin Sun, Yong Wang, Hongyu Yang, Yuankai Wu

机构 * College of Computer Science, Sichuan University(四川大学计算机科学学院) Department of Data and Systems Engineering, The University of Hong Kong(香港大学数据与系统工程系)

AI总结 PFGNet通过像素级频率引导门控动态调节感受野,实现高效的时空预测学习,无需递归或注意力机制,在多个数据集上取得SOTA性能。

Comments Accepted to CVPR 2026

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026, pp. 38848-38858

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17108 2026-08-11 cs.LG cs.AI eess.SP 版本更新

Hybrid Mamba-Attention Neural Architecture for Channel Estimation

MambaNet:结合注意力机制的Mamba辅助信道估计神经网络

Dianxin Luan, Chengsi Liang, Jie Huang, Zheng Lin, Kaitao Meng, John Thompson, Cheng-Xiang Wang, Ozgur Akan

机构 * Institute for Imaging, Data and Communications, School of Engineering, University of Edinburgh(影像、数据与通信研究所,工程学院,爱丁堡大学) James Watt School of Engineering, University of Glasgow(詹姆斯·瓦特工程学院,格拉斯哥大学) National Mobile Communications Research Laboratory, Southeast University(国家移动通信研究中心,东南大学) Purple Mountain Laboratories, Nanjing(紫金山实验室,南京) Department of Electrical and Electronic Engineering, The University of Hong Kong(电气与电子工程系,香港大学) Department of Electrical and Electronic Engineering, University of Manchester(电气与电子工程系,曼彻斯特大学)

AI总结 MambaNet通过结合自注意力机制和定制化Mamba架构,实现低复杂度的OFDM信道估计,尤其在大规模子载波配置中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07005 2026-08-10 cs.RO 新提交

Real-time Whole-Body Motion Planning for Mobile Manipulators Carrying Arbitrarily Shaped Payloads via Kinematically-Coupled SVSDF

基于运动学耦合SVSDF的移动操作臂携带任意形状负载的实时全身运动规划

Yisheng Li, Longji Yin, Tingrui Zhang, Ruize Xue, Haoda Zhu, Nan Chen, Siqi Liang, Yuxi Liu, Fu Zhang

机构 * University of Hong Kong(香港大学) Tsinghua University(清华大学)

AI总结 本文提出基于KC-SVSDF的移动操作臂实时全身运动规划框架,通过链分解碰撞检查等方法,可可靠在复杂环境中运输大型非凸任意形状负载。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06802 2026-08-10 cs.CL 新提交

Simple-OPD: Demystifying Warm-up for On-policy Distillation

Simple-OPD:揭开策略内蒸馏的预热阶段之谜

Tao Liu, Taiqiang Wu, Mao Zheng, Xuan Luo, Runming Yang, Xuewei Yang, Junjie Wang, Yujiu Yang

机构 * Tsinghua University(清华大学) The University of Hong Kong(香港大学) Tencent(腾讯)

AI总结 本文通过数据与训练视角研究OPD的预热阶段,发现预热依赖教师兼容CoT监督、LoRA近饱和训练优于全参数SFT,提出Simple-OPD方法并验证其有效性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07554 2026-08-10 cs.RO

Efficient Swept Volume-Based Trajectory Generation for Arbitrary-Shaped Ground Robot Navigation

高效扫掠体积基轨迹生成用于任意形状地面机器人导航

Yisheng Li, Longji Yin, Yixi Cai, Jianheng Liu, Fangcheng Zhu, Mingpu Ma, Siqi Liang, Haotian Li, Fu Zhang

机构 * Department of Mechanical Engineering, University of Hong Kong(香港大学机械工程系) Division of Robotics, Perception, and Learning, KTH Royal Institute of Technology(皇家理工学院机器人、感知与学习 division)

AI总结 本文提出了一种高效扫掠体积基轨迹生成方法,通过粗到细的框架提升任意形状地面机器人在复杂环境中的导航效率和碰撞避免能力。

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06020 2026-08-07 cs.AI cs.LG 新提交

From Economic Agents to Agentic Economies: A Systems Blueprint for Economic World Models

从经济智能体到智能体经济:经济世界模型的系统蓝图

Jiale Han, Xiang Li, Jing Qian, Wenyuan Gu, Pin Gao, Ye Luo, Hongyuan Zha, Dacheng Tao, Benyou Wang, Lin William Cong

机构 * Shenzhen Loop Area Institute(深圳河套学院) School of Data Science, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)数据科学学院) University of Hong Kong(香港大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出经济世界模型(EWM)的六级能力阶梯实施蓝图,旨在加速可作为人类决策沙箱与AI智能体基础的下一代高保真经济模拟环境开发。

Comments Project page: https://github.com/FreedomIntelligence/Awesome-Economic-World-Models

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05703 2026-08-07 cs.CV 新提交

StreamArena: Toward Continuous, Interactive, and Long-Horizon Agentic Streaming Video Understanding

StreamArena:面向连续、交互式且长视界的智能体流媒体视频理解

Xichen Zhang, Guankai Li, Yinghao Zhu, Shijian Wang, Sitong Wu, Shaozuo Yu, Meng Chu, Yuan Lu, Jiaya Jia

机构 * The Hong Kong University of Science and Technology(香港科技大学) Xiaohongshu Inc.(小红书公司) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 针对当前智能体流媒体视频理解评估的缺陷,提出StreamArena基准,设计StreamMind架构解决连续交互与长视界理解的张力,在四项能力上优于现有基线并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05549 2026-08-07 cs.SD cs.MM 新提交

Beyond Residual Connections: Manifold-Constrained Hyper-Connections for Robust Speaker Representation Learning

超越残差连接:用于鲁棒说话人表示学习的流形约束超连接

Zezhong Jin, Xiaoyu Wang, Zhe Li, Chong-Xin Gan, Zilong Huang, Man-Wai Mak, Kong Aik Lee

机构 * The Hong Kong Polytechnic University(香港理工大学) Baidu Inc.(百度公司) The University of Hong Kong(香港大学)

AI总结 该研究针对残差连接的信息流限制问题,提出流形约束超连接(mHC)方法,替换多种主干网络的残差连接后,在VoxCeleb1数据集上持续提升了说话人表示学习的性能。

Comments Accepted to INTERSPEECH 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06363 2026-08-07 cs.LG cs.AI cs.DS math.ST stat.TH 新提交

An Optimal Agnostic PAC Algorithm

一种最优的不可知PAC算法

Markus Engelund Mathiasen, Jian Qian, Nikita Zhivotovskiy

机构 * Aarhus University(奥胡斯大学) The University of Hong Kong(香港大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 该研究针对有限VC维的二元分类函数类,构造出达到统计最优风险界的不可知PAC学习算法,确定了其样本复杂度(仅差通用常数),匹配了已有下界。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28609 2026-08-07 cs.AI cs.CL cs.CV 版本更新

OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models

OSReward:为跨平台计算机使用奖励模型建立标准化评估

Qiushi Sun, Kanzhi Cheng, Yian Wang, Bowen Yang, Hang Yan, Liheng Chen, Fangzhi Xu, Zichen Ding, Nuo Chen, Jialin Cao, Xingdong Gong, Zehao Li, Kaiming Jin, Xinfeng Yuan, Zhoumianze Liu, Jingyang Gong, Zhangyue Yin, Jiahui Gao, Zhiyong Wu, Tianbao Xie, Jianbing Zhang, Ben Kao, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Nanjing University(南京大学) University of Science and Technology of China(中国科学技术大学) National University of Singapore(新加坡国立大学) Fudan University(复旦大学)

AI总结 本研究推出OSReward基准评估VLM评判者的可靠性,构建OS-Shepherd开源奖励模型缩小成本差距,为规模化可靠CUA奖励设计提供参考

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26663 2026-08-07 cs.RO 版本更新

Tactile-WAM: Touch-Aware World Action Model with Tactile Asymmetric Attention

Tactile-WAM:具有触觉非对称注意力的触觉感知世界动作模型

Siyu Wu, Linjing You, Junjie Zhu, Yaozu Liu, Huang Kaixiang, Chen Yonghang, Jituo Li, Changhao Zhang, Jian Liu, Zhu Hengshuo, Qi Li, Hengshuang Zhao

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学) The University of Hong Kong(香港大学) Shenzhen Loop Area Institute(深圳河套学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 针对接触丰富操作中视觉预测不完整的问题,提出Tactile-WAM,通过触觉非对称注意力机制(TAAM)在保护视觉预测的同时利用触觉信息生成动作,整体成功率提升38.9%。

Comments Submitted to RSS2026 WorkShop Tactile for FM

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05049 2026-08-06 cs.CV 新提交

OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing

OmniEdit-Bench:基于指令的视频编辑综合基准

Chenxuan Miao, Yutong Feng, Yi Lu, Yunfeng Yan, Donglian Qi, Shiwei Zhang, Yu Liu, Xi Chen, Hengshuang Zhao

机构 * The University of Hong Kong(香港大学) Alibaba Group(阿里巴巴集团) Zhejiang University(浙江大学) Peking University(北京大学)

AI总结 针对现有基于指令的视频编辑基准的任务覆盖有限、指标不足的问题,OmniEdit-Bench将编辑任务分解为多维度并提出含惩罚机制的评估框架,实验显示当前IVE模型仍待提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04623 2026-08-06 cs.CV 新提交

Visual Anchoring in Diffusion: Multimodal Zero-Shot Skeleton Action Recognition

扩散模型中的视觉锚定:多模态零样本骨骼动作识别

Zehao Bao, Shujun Guo, Bruce X. B. Yu

机构 * The University of Hong Kong(香港大学) Zhejiang University(浙江大学)

AI总结 该研究针对零样本骨骼动作识别中模态融合的问题,提出TDSM-MM模型,通过生成式分类范式结合视觉锚定,在NTU数据集上取得优异零样本识别性能,为零样本学习提供新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04305 2026-08-06 cs.LG q-fin.RM 新提交

Adaptive Finite-Budget Training for CVaR Risk-Aware Q-Learning

面向CVaR风险感知Q学习的自适应有限预算训练

Yifan Wu, Junjie Lei, Wenjie Huang

机构 * The University of Hong Kong(香港大学)

AI总结 本文针对CVaR风险感知Q学习提出自适应有限预算训练控制器,通过六个协同机制优化训练流程,在比特币交易任务中大幅降低贝尔曼残差、提升策略风险调整后表现。

Comments 8 pages, 3 figures, submit to ACM International Conference on AI in Finance: ICAIF '26 Milan

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04196 2026-08-06 cs.RO cs.CV cs.LG 新提交

SiMDex: Mining Similar Egocentric Videos for Cross-Embodiment Dexterous Manipulation

SiMDex:挖掘相似的自我中心视频以实现跨 embodiment 的灵巧操作

Nie Lin, Takehiko Ohkawa, Sijin Chen, Ruoshi Wen, Zhuohang Li, Liqun Huang, Zhengming Zhu, Yiming Bao, Yunfei Li, Minjie Cai, Xiao Ma, Wei Xu, Yoichi Sato

机构 * The University of Tokyo(东京大学) ByteDance Seed(字节跳动 Seed) The University of Hong Kong(香港大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学)

AI总结 该研究提出SiMDex框架,通过三层流程从海量自我中心人类视频中挖掘与任务相关的子集,用于VLA后训练,仅用少量样本便显著提升了机器人灵巧操作的成功率,证明选择性数据整理更有效。

Comments 12 pages, 4 figures. Project page: https://lin-nie.github.io/SiMDex/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04021 2026-08-06 cs.CL cs.LG 新提交

When More Becomes Less: Position-Dependent Repetition Effects in Language Models

当多变为少:语言模型中与位置相关的重复效应

Han-yu Wang

机构 * The University of Hong Kong(香港大学)

AI总结 该研究发现语言模型中目标 token 的重复效应与读取位置相关,位移重复会呈现倒U型规律,且该效应经多语言和多模型验证,归因于精确词汇重复而非其他因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00094 2026-08-05 cs.CV 版本更新

Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh

视频模型作为原生4D渲染器:基于动画网格的世界 grounding 条件

Junhao Chen, Mingjin Chen, Henghaofan Zhang, Minglin Chen, Liaoyuan Fan, Boran Zhang, Saining Zhang, Mingze Sun, Hao Zhao, Ruqi Huang, Zhihao Li, Yufei Wang

机构 * Tsinghua University(清华大学) The Hong Kong Polytechnic University(香港理工大学) University of Electronic Science and Technology of China(电子科技大学) Sun Yat-sen University(中山大学) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学) Nanyang Technological University(南洋理工大学)

AI总结 该研究提出参考引导渲染器DAR,扩展Wan2.2相机控制,用跟踪和世界位置组成的4D G缓冲作为条件,在DAR-4D基准上实现优于现有方法的视频生成性能。

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19066 2026-08-05 cs.CL cs.AI 版本更新

Large Language Models provide support for the parallelogram theory of analogy

平行四边形反击:LLM生成的类比优于人类

Qiawen Ella Liu, Raja Marjieh, Jian-Qiao Zhu, Adele E. Goldberg, Thomas L. Griffiths

机构 * Princeton University(普林斯顿大学) The University of Hong Kong(香港大学)

AI总结 研究比较了人类和LLM在类比任务中的表现,发现LLM生成的类比更符合平行四边形结构,且人类在生成关系保持的类比时表现较差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01635 2026-08-04 cs.CV 新提交

Mitigating Visual Degradation in MLLMs via Spatial-Spectral Visual Anchor Learning

通过空间-光谱视觉锚学习缓解多模态大语言模型(MLLMs)中的视觉退化

Qianlong Yang, Bowen Ye, Xianda Guo, Yanlun Peng, Wenke Huang, Hongyuan Zhang, Yulei Jia

机构 * China University of Petroleum (East China)(中国石油大学(华东)) Shanghai Jiao Tong University(上海交通大学) Wuhan University(武汉大学) Great Wall Motor(长城汽车) Nanyang Technological University(南洋理工大学) The University of Hong Kong(香港大学)

AI总结 针对MLLMs推理时的视觉表示退化问题,提出SSVAL方法,通过VAPI及辅助对齐损失实现稳定视觉锚,性能优于现有方法。

Comments This paper has been accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01328 2026-08-04 cs.CL cs.AI cs.CV 新提交

LongChart VQA: A Comprehensive Benchmark for MLLMs with Complex Multi-Chart Reasoning

LongChart VQA:面向具备复杂多图表推理能力的多模态大语言模型的综合基准

Ziyan Xiao, Yinghao Zhu, Wenting Zhang, Heaju Kim, Lequan Yu

机构 * The University of Hong Kong(香港大学)

AI总结 LongChart VQA是面向具备复杂多图表推理能力的MLLMs的综合基准,该基准含平均6.5张图像与31.2个问题,评估10个SOTA MLLMs发现其准确率随计算复杂性提升下降,为多图表推理研究指明方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00694 2026-08-04 cs.CV 新提交

E2Pano: Learning Event-to-Panorama Image Reconstruction

E2Pano:学习从事件数据到全景图像的重建

Zhenyang Li, Zongqi He, Jia Pan, Shijie Lin, Yifan Peng

机构 * The University of Hong Kong(香港大学)

AI总结 提出几何引导的事件到全景图像重建框架E2Pano,结合球面Transformer与频域监督,构建含4370个合成及30个真实场景的PanoScan数据集,实现高质量低计算成本的全景图像重建。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00635 2026-08-04 cs.RO 新提交

FlowPilot: Real-Time World-Action Modeling for Agile UAV Navigation

FlowPilot:面向敏捷无人机导航的实时世界-动作建模

Runqing Wang, Ding Yu, Pengyuan Min, Xinhong Zhang, Wei Xiao, Yu Hu, Jie Chen, Fu Zhang, Gang Wang

机构 * Beijing Institute of Technology(北京理工大学) Zhongguancun Academy(中关村学院) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学)

AI总结 FlowPilot是一种基于流匹配的紧凑世界-动作模型,采用双流混合Transformer,在三级深度金字塔数据上训练,可实现敏捷无人机实时导航,性能优于基线,能在杂乱环境中以5.5m/s速度运行。

Comments 8 pages, 9 figures, 2 tables, submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00019 2026-08-04 cs.LG cs.AI 新提交

Uncertainty-Aware Simulation-Based Inference for Operations Research with Large Language Models

面向运筹学的基于模拟的不确定性感知大语言模型推理

Liang Guo, Lin Shaochong, Shen Zuo-Jun Max, Zhang Kun

机构 * Institute of Statistics and Big Data, Renmin University of China(中国人民大学统计与大数据研究院) The University of Hong Kong(香港大学) School of Information, Renmin University of China(中国人民大学信息学院)

AI总结 本文针对大语言模型用于运筹学建模时的短视策略易引发下游错误的问题,提出一种不确定性感知无训练推理框架,通过短前瞻模拟与重要性重采样提升OR公式生成的可靠性,在多基准上表现优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01715 2026-08-04 cs.AI 版本更新

Distributionally Robust Listwise Preference Optimization

分布鲁棒列表偏好优化

Xudong Wu, Jian Qian, Pangpang Liu, Vaneet Aggarwal, Jiayu Chen

机构 * The University of Hong Kong(香港大学) Yale University(耶鲁大学) Purdue University(普渡大学)

AI总结 针对列表偏好排序标签不确定性,提出点态全变差鲁棒Plackett-Luce目标,将内层最大化简化为排序,在离线和在线设置中均具有理论保证,实验表明能保持干净标签性能并提升噪声鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18540 2026-08-04 cs.LG 版本更新

GAPSL: A Gradient-Aligned Parallel Split Learning over Data-Heterogeneous Edge Computing Systems

GAPSL: 一种在异构数据上基于梯度对齐的并行分割学习

Zheng Lin, Ons Aouedi, Zihan Fang, Wei Ni, Yue Gao, Symeon Chatzinotas, Xianhao Chen

机构 * Department of Electrical and Electronic Engineering, University of Hong Kong(香港大学电子与电气工程系) Data61, CSIRO(CSIRO数据61) Interdisciplinary Centre for Security, Reliability and Trust (SnT), University of Luxembourg(卢森堡大学安全、可靠与信任跨学科中心)

AI总结 本文提出GAPSL框架,通过梯度对齐和方向一致性增强,提升异构数据下分割学习的训练准确率和延迟。

Comments 13 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00740 2026-08-04 cs.CL cs.AI 版本更新

MedTextWeaver: Procedural Knowledge Evolution in Agentic Medical Text Editing

ExperienceWeaver: 优化基于 LLM 的临床文本改进的小样本经验学习

Ziyan Xiao, Yinghao Zhu, Liang Peng, Kyongtae T Bae, Lequan Yu

机构 * School of Computing and Data Science, The University of Hong Kong(计算与数据科学学院,香港大学)

AI总结 ExperienceWeaver 通过经验学习优化小样本下 LLM 的临床文本改进,通过提炼反馈知识提升模型修订能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04923 2026-08-04 quant-ph cs.AI cs.LG

Artificial intelligence for representing and characterizing quantum systems

Yuxuan Du, Yan Zhu, Yuan-Hang Zhang, Min-Hsiu Hsieh, Patrick Rebentrost, Weibo Gao, Ya-Dong Wu, Jens Eisert, Giulio Chiribella, Dacheng Tao, Barry C. Sanders

机构 * College of Computing Data Science, Nanyang Technological University, Singapore 639798, Singapore Computation Initiative, Department of Computer Science, The University of Hong Kong, Pokfulam Road, Hong Kong Department of Physics, University of California, San Diego, La Jolla, CA 92093, USA Hon Hai (Foxconn) Research Institute, Taipei, Taiwan Centre for Quantum Technologies, National University of Singapore Department of Computer Science, National University of Singapore School of Electrical \& Electronic Engineering, Nanyang Technological University, Singapore 639798, Singapore John Hopcroft Center for Computer Science, Shanghai Jiao Tong University, Shanghai 200240, China Dahlem Center for Complex Quantum Systems, Freie Universitat Berlin, 14195 Berlin, Germany Department of Computer Science, Parks Road, Oxford, OX1 3QD, United Kingdom Perimeter Institute for Theoretical Physics, Waterloo, Ontario N2L 2Y5, Canada Institute for Quantum Science Technology, University of Calgary, Alberta T2N 1N4, Canada

Comments 32 pages. Comments are welcome

Journal ref Nature Reviews Physics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03668 2026-08-04 cs.CL 版本更新

CTR-Sink: Attention Sink for Language Models in Click-Through Rate Prediction

CTR-Sink:用于点击率预测的语言模型中的注意力汇聚点

Zixuan Li, Binzong Geng, Jing Xiong, Yong He, Yuxuan Hu, Jian Chen, Dingwei Chen, Xiyu Chang, Ngai Wong, Liang Zhang, Linjian Mo, Chengming Li, Chuan Yuan, Zhenan Sun

机构 * NLPR, Institute of Automation, Chinese Academy of Sciences(神经信息处理教育部重点实验室,自动化研究所,中国科学院) Ant Group(蚂蚁集团) The University of Hong Kong(香港大学) City University of Hong Kong(香港城市大学) Sun Yat-sen University(中山大学) Shenzhen MSU-BIT University(深圳MSU-BIT大学)

AI总结 针对用户行为序列与语言模型预训练文本之间的结构差异导致的语义碎片化问题,提出CTR-Sink框架,通过引入行为级注意力汇聚点并动态调节注意力聚合,提升点击率预测性能。

Comments Accepted by the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2026). The source code of this paper has been made publicly available at https://github.com/UGUESS-lzx/CTR-SINK

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29464 2026-08-03 cs.RO cs.SY eess.SY 新提交

Automated Straight-line Sewing of Stretchable Fabrics with Different Lengths

不同长度可拉伸织物的自动直线缝纫

Bingchen Jin, Akinari Kobayashi, Dipankar Bhattacharya, Akira Seino, Fuyuki Tokuda, Norman Chihnan Tien, Kazuhiro Kosuge

机构 * The University of Hong Kong(香港大学) Centre for Transformative Garment Production(创新服装生产中心)

AI总结 本研究针对不同长度可拉伸织物的直线自动化缝纫难题,提出新型机器人缝纫系统DLRoSS,通过四阶段流程实现对齐缝纫,实验验证其可完成不同材料和长度织物的高质量缝纫。

Comments 9 pages. Published in IEEE Robotics and Automation Letters, 2025

Journal ref IEEE Robot. Autom. Lett. 10 (2025) 12165-12172

详情

展开后加载摘要…

URL PDF HTML 收藏