arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

The Chinese University of Hong Kong(香港中文大学)

共收录 2402
2601.18631 2026-01-29 cs.AI cs.CL cs.CV cs.MA

AdaReasoner: Dynamic Tool Orchestration for Iterative Visual Reasoning

AdaReasoner: 多步骤视觉推理中的动态工具协调

Mingyang Song, Haoyu Sun, Jiawei Gu, Linjie Li, Luxin Xu, Ranjay Krishna, Yu Cheng

机构 * Fudan University(复旦大学) Tongji University(同济大学) National University of Singapore(新加坡国立大学) University of Washington(华盛顿大学) University of Electronic Science and Technology of China(电子科技大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 AdaReasoner通过动态工具协调提升多模态模型的视觉推理能力,实现工具自适应和泛化,超越现有系统性能。

Comments 28 pages, 10 figures and 13 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08430 2026-01-29 cs.AI

RubricHub: A Comprehensive and Highly Discriminative Rubric Dataset via Automated Coarse-to-Fine Generation

RubricHub: 通过自动化粗到细生成构建一个全面且高度判别性的评分标准数据集

Sunzhu Li, Jiale Zhao, Miteto Wei, Huimin Ren, Yang Zhou, Jingwen Yang, Shunyu Liu, Kaike Zhang, Wei Chen

机构 * Li Auto Inc. Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳))

AI总结 RubricHub通过自动化粗到细生成方法构建了一个大规模多领域评分标准数据集,通过后训练流程显著提升了模型在HealthBench上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18206 2026-01-29 eess.AS cs.SD eess.SP

Adaptive Per-Channel Energy Normalization Front-end for Robust Audio Signal Processing

自适应通道能量归一化前端用于鲁棒音频信号处理

Hanyu Meng, Vidhyasaharan Sethu, Eliathamby Ambikairajah, Qiquan Zhang, Haizhou Li

机构 * The University of New South Wales, Sydney, Australia(新南威尔士大学) Tongyi Speech Lab, Alibaba Group, China(通义语音实验室) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)人工智能学院)

AI总结 本文提出了一种自适应通道能量归一化前端,通过闭环神经控制器提升音频信号处理的鲁棒性与适应性。

Comments Accepted by ICASSP2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16922 2026-01-29 cs.CV

MSPCaps: A Multi-Scale Patchify Capsule Network with Cross-Agreement Routing for Visual Recognition

MSPCaps: 一种具有跨共识路由的多尺度补丁化胶囊网络用于视觉识别

Yudong Hu, Yueju Han, Rui Sun, Jinke Ren

机构 * CUHK-Shenzhen(香港中文大学(深圳))

AI总结 MSPCaps通过多尺度特征学习和跨共识路由提升视觉识别性能,实现高效且鲁棒的特征表示学习。

Comments 9 pages, 4 figures; Code is available at https://github.com/abdn-hyd/MSPCaps

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13332 2026-01-29 cs.CL

The Imitation Game: Turing Machine Imitator is Length Generalizable Reasoner

模仿游戏:图灵机模仿器是长度可推广的推理机

Zhouqi Hua, Wenwei Zhang, Chengqi Lyu, Yuzhe Gu, Songyang Gao, Kuikun Liu, Dahua Lin, Kai Chen

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

AI总结 本文提出TAIL方法,通过合成图灵机执行过程的链式思维数据,提升LLM的长度泛化能力,超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04207 2026-01-29 cs.LG cs.AI cs.CL cs.CV

Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning

推动多模态推理:从优化冷启动到分阶段强化学习

Shuang Chen, Yue Guo, Zhaochen Su, Yafu Li, Yulun Wu, Jiacheng Chen, Jiayu Chen, Weijie Wang, Xiaoye Qu, Yu Cheng

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Soochow University(苏州大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出ReVisual-R1,通过优化冷启动和分阶段强化学习提升多模态推理能力,在多个挑战性基准测试中取得新突破。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01256 2026-01-29 cs.CV cs.LG

NLPrompt: Noise-Label Prompt Learning for Vision-Language Models

NLPrompt: 噪声标签提示学习用于视觉-语言模型

Bikang Pan, Qun Li, Xiaoying Tang, Wei Huang, Zhen Fang, Feng Liu, Jingya Wang, Jingyi Yu, Ye Shi

机构 * ShanghaiTech University(上海科技大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) RIKEN Center for Advanced Intelligence Project(日本RIKEN高级智能项目中心) University of Technology Sydney(悉尼科技大学) University of Melbourne(墨尔本大学)

AI总结 NLPrompt通过结合PromptMAE和PromptOT,提升视觉-语言模型在噪声标签下的提示学习鲁棒性与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19850 2026-01-28 cs.CV

EgoHandICL: Egocentric 3D Hand Reconstruction with In-Context Learning

EgoHandICL: 以自身为中心的3D手重建与上下文学习

Binzhu Xie, Shi Qiu, Sicheng Zhang, Yinqiao Wang, Hao Xu, Muzammal Naseer, Chi-Wing Fu, Pheng-Ann Heng

机构 * Department of Computer Science and Engineering, The Chinese University of Hong Kong(计算机科学与工程系,香港中文大学) Institute of Medical Intelligence and XR, The Chinese University of Hong Kong(医学智能与XR研究院,香港中文大学) Department of Computer Science, Khalifa University(计算机科学系,哈利法大学)

AI总结 EgoHandICL通过上下文学习框架提升以自身为中心的3D手重建的鲁棒性和一致性,结合视觉语言模型和掩码自动编码器实现更精确的手-物体交互推理。

Comments Accepted in ICLR 2026, Codebase: https://github.com/Nicous20/EgoHandICL

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19747 2026-01-28 cs.AR cs.AI cs.SE

Veri-Sure: A Contract-Aware Multi-Agent Framework with Temporal Tracing and Formal Verification for Correct RTL Code Generation

Veri-Sure:一种具有时间追踪和形式验证的合同感知多智能体框架,用于正确RTL代码生成

Jiale Liu, Taiyu Zhou, Tianqi Jiang

机构 * School of Physics and Astronomy, The University of Edinburgh, Edinburgh, UK(物理与天文学院,爱丁堡大学,爱丁堡,英国) State Key Laboratory of Analog and Mixed-Signal VLSI, University of Macau, Macau(模拟与混合信号VLSI国家重点实验室,澳门大学,澳门) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, Shenzhen, China(科学与工程学院,香港中文大学(深圳))

AI总结 Veri-Sure通过合同感知多智能体框架结合时间追踪与形式验证,实现高正确性的RTL代码生成,优于独立LLMs和传统智能体系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13687 2026-01-28 cs.AI

Understanding Mental States to Guide Social Influence in Multi-Person Group Dialogue

理解心理状态以引导多人物群体对话中的社会影响

Zhichao Liang, Satoshi Nakamura

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 SocialMindChange基准通过引导多人物群体对话中的心理状态变化,评估语言模型在复杂社交互动中的表现与能力。

Comments Minor update

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.13356 2026-01-28 cs.RO

MODUR: A Modular Dual-reconfigurable Robot

MODUR:一种模块化双级可重构机器人

Jie Gu, Tin Lun Lam, Chunxu Tian, Zhihao Xia, Yongheng Xing, Dan Zhang

机构 * Institute of AI and Robotics, Academy for Engineering & Technology, Fudan University(人工智能与机器人研究院,工程与技术学院,复旦大学) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen(科学与工程学院,香港中文大学(深圳)) Shenzhen Institute of Artificial Intelligence and Robotics for Society(深圳人工智能与机器人社会研究院) Department of Mechanical Engineering, The Hong Kong Polytechnic University(机械工程系,香港理工大学)

AI总结 MODUR是一种具备双级重构能力的模块化机器人,通过紧凑连接器和剪式连杆组实现模块自我重构与基本运动执行。

Journal ref Proceedings of the 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), pp. 10212-10219

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21778 2026-01-28 cond-mat.mtrl-sci cs.AI

Beyond Structure: Invariant Crystal Property Prediction with Pseudo-Particle Ray Diffraction

超越结构:基于伪粒子射线衍射的不变晶体性质预测

Bin Cao, Yang Liu, Longhan Zhang, Yifan Wu, Zhixun Li, Yuyu Luo, Hong Cheng, Yang Ren, Tong-Yi Zhang

机构 * Guangzhou Municipal Key Laboratory of Materials Informatics, Advanced Materials Thrust, The Hong Kong University of Science and Technology (Guangzhou)(广州材料信息重点实验室,先进材料方向,香港科技大学(广州)) The Chinese University of Hong Kong(香港中文大学) Data Science and Analytics Thrust, The Hong Kong University of Science and Technology (Guangzhou)(数据科学与分析方向,香港科技大学(广州)) Department of physics, The City University of Hong Kong(香港城市大学物理系) Materials Genome Institute, Shanghai University(材料基因组研究所,上海大学)

AI总结 PRDNet通过结合伪粒子射线衍射与图表示,实现了对晶体性质的不变预测,展示了在材料科学中的高效性能。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01943 2026-01-28 cs.CV

Learning Video Generation for Robotic Manipulation with Collaborative Trajectory Control

基于协作轨迹控制的机器人操作视频生成学习

Xiao Fu, Xintao Wang, Xian Liu, Jianhong Bai, Runsen Xu, Pengfei Wan, Di Zhang, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Kuaishou Technology(快手科技) Zhejiang University(浙江大学)

AI总结 RoboMaster通过协作轨迹控制方法,解决多物体交互建模问题,实现机器人操作视频生成的高保真度与多物体交互建模。

Comments ICLR 2026. Project Page: https://fuxiao0719.github.io/projects/robomaster/

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18771 2026-01-28 cs.LG cs.SI

Exploring Graph Learning Tasks with Pure LLMs: A Comprehensive Benchmark and Investigation

探索纯大语言模型在图学习任务中的应用:全面的基准测试与调查

Yuxiang Wang, Xinnan Dai, Wenqi Fan, Yao Ma

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Michigan State University(密歇根州立大学) The Hong Kong Polytechnic University(香港理工大学) Rensselaer Polytechnic Institute(纽约理工学院)

AI总结 本研究探讨纯大语言模型在图学习任务中的应用,通过全面的基准测试与分析,发现指令微调的LLMs在少样本设置中表现优异,具备强大的领域迁移能力和良好的泛化与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16435 2026-01-28 cs.CV cs.CL

Human Cognitive Benchmarks Reveal Foundational Visual Gaps in MLLMs

人类认知基准揭示大规模多模态语言模型中的基础视觉缺陷

Jen-Tse Huang, Dasen Dai, Jen-Yuan Huang, Youliang Yuan, Xiaoyuan Liu, Wenxuan Wang, Wenxiang Jiao, Pinjia He, Zhaopeng Tu, Haodong Duan

机构 * CUHK(香港中文大学) PKU(北京大学) CUHKSZ(香港中文大学深圳分校) RUC(中国人民大学) Tencent(腾讯) SHLab(深圳实验室)

AI总结 人类认知基准揭示大规模多模态语言模型在基础视觉能力上的不足,通过VisFactor评估发现模型在关键视觉任务上表现不佳。

Comments Update: Evaluated 23 SOTA MLLMs

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18733 2026-01-27 cs.RO cs.AI cs.CV

Advances and Innovations in the Multi-Agent Robotic System (MARS) Challenge

多智能体机器人系统(MARS)挑战的进展与创新

Li Kang, Heng Zhou, Xiufeng Song, Rui Li, Bruno N. Y. Chen, Ziye Wang, Ximeng Meng, Stone Tao, Yiran Qin, Xiaohong Liu, Ruimao Zhang, Lei Bai, Yilun Du, Hao Su, Philip Torr, Zhenfei Yin, Ruihao Gong, Yejun Zeng, Fengjun Zhong, Shenghao Jin, Jinyang Guo, Xianglong Liu, Xiaojun Jia, Tianqi Shan, Wenqi Ren, Simeng Qin, Jialing Yang, Xiaoyu Ma, Tianxing Chen, Zixuan Li, Zijian Cai, Yan Qin, Yusen Qin, Qiangyu Chen, Kaixuan Wang, Zhaoming Han, Yao Mu, Ping Luo, Yuanqi Yao, Haoming Song, Jan-Nico Zaech, Fabien Despinoy, Danda Pani Paudel, Luc Van Gool

机构 * SJTU(上海交通大学) Oxford(牛津大学) USTC(中国科学技术大学) Shanghai AI Lab(上海人工智能实验室) CMU(卡内基梅隆大学) HKU(香港大学) Tongji(同济大学) UC San Diego(南加州大学) CUHK-SZ(香港中文大学(深圳)) SYSU(华南理工大学) Harvard(哈佛大学)

AI总结 MARS挑战通过多智能体具身规划与控制任务,推动多智能体协作AI系统的发展。

Comments MARS Challenge @ NeurIPS 2025 Workshop on Space in Vision, Language, and Embodied AI. Challenge page: https://mars-eai.github.io/MARS-Challenge-Webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18335 2026-01-27 cs.SD cs.AI

Analytic Incremental Learning For Sound Source Localization With Imbalance Rectification

分析增量学习用于声音源定位的不平衡校正

Zexia Fan, Yu Chen, Qiquan Zhang, Kainan Chen, Xinyuan Qian

机构 * University of Science and Technology Beijing(北京科技大学) The Chinese University of Hong Kong(香港中文大学) Tongyi Speech Lab(通义语音实验室) Alibaba(阿里巴巴) Eigenspace GmbH

AI总结 本文提出分析增量学习方法,通过数据增强和动态不平衡校正技术,提升声音源定位在现实环境中的鲁棒性和准确性。

Comments Accepted by ICASSP26

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18264 2026-01-27 cs.LG cs.AI

Neural Network Approximation: A View from Polytope Decomposition

神经网络近似:从多面体分解的角度看待

ZeYu Li, ShiJun Zhang, TieYong Zeng, FengLei Fan

机构 * The Chinese University of Hong Kong(香港中文大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出从多面体分解角度研究ReLU网络的通用近似能力,通过显式核多项式方法和多面体域分解提升近似效率与灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18130 2026-01-27 cs.AI

RouteMoA: Dynamic Routing without Pre-Inference Boosts Efficient Mixture-of-Agents

RouteMoA: 动态路由无需预推断提升高效混合代理

Jize Wang, Han Wu, Zhiyuan You, Yiming Song, Yijun Wang, Zifei Shan, Yining Li, Songyang Zhang, Xinyi Le, Cailian Chen, Xinping Guan, Dacheng Tao

机构 * Shanghai Jiao Tong University(上海交通大学) CUHK(香港中文大学) Tencent(腾讯) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(新加坡国立大学)

AI总结 RouteMoA通过动态路由机制无需预推断提升混合代理效率,显著降低推理成本和延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16912 2026-01-27 cs.LG cs.AI cs.CL

Exploration vs Exploitation: Rethinking RLVR through Clipping, Entropy, and Spurious Reward

探索与利用:通过截断、熵和虚假奖励重新思考RLVR

Peter Chen, Xiaopeng Li, Ziniu Li, Wotao Yin, Xi Chen, Tianyi Lin

机构 * Columbia(哥伦比亚大学) CUHK SZ(香港大学) DAMO, Alibaba US(阿里云实验室) NYU Stern(纽约大学 Stern 学院)

AI总结 本文通过截断、熵和虚假奖励机制,重新审视RLVR框架,揭示了探索与利用权衡对大语言模型推理能力提升的影响。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17438 2026-01-27 cs.IR cs.LG

UniGRec: Unified Generative Recommendation with Soft Identifiers for End-to-End Optimization

UniGRec: 一种基于软标识符的统一生成推荐方法用于端到端优化

Jialei Li, Yang Zhang, Yimeng Bai, Shuai Zhu, Ziqi Xue, Xiaoyan Zhao, Dingxian Wang, Frank Yang, Andrew Rabinovich, Xiangnan He

机构 * University of Science and Technology of China(科学技术大学) National University of Singapore(国立新加坡大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 UniGRec通过统一生成推荐框架解决端到端优化中的软标识符问题,提出退火推理对齐、码字均匀性正则化和双协作蒸馏机制,提升推荐性能。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.18951 2026-01-27 cs.DB cs.AI

SWE-SQL: Illuminating LLM Pathways to Solve User SQL Issues in Real-World Applications

SWE-SQL:揭示LLM解决现实应用中用户SQL问题的路径

Jinyang Li, Xiaolong Li, Ge Qu, Per Jacobsson, Bowen Qin, Binyuan Hui, Shuzheng Si, Nan Huo, Xiaohan Xu, Yue Zhang, Ziwei Tang, Yuanshuai Li, Florensia Widjaja, Xintong Zhu, Feige Zhou, Yongfeng Huang, Yannis Papakonstantinou, Fatma Ozcan, Chenhao Ma, Reynold Cheng

机构 * HKU STAR Lab(香港大学STAR实验室) Google Cloud(谷歌云) CUHKSZ(香港中文大学) CUHK(香港中文大学) THU(清华大学) The BIRD Team(BIRD团队)

AI总结 SWE-SQL通过引入BIRD-CRITIC基准和Six-Gym训练环境,提升开源模型解决SQL问题的能力,实现对复杂SQL调试任务的突破。

Comments 29 pages, 10 figures, NeurIPS 2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17000 2026-01-27 cs.CY cs.AI

Investigating Self-regulated Learning Sequences within a Generative AI-based Intelligent Tutoring System

探究基于生成式人工智能的智能教学系统中的自主学习序列

Jie Gao, Shasha Li, Jianhua Zhang, Shan Li, Tingting Wang

机构 * McGill University(麦吉尔大学) The Chinese University of Hong Kong(香港中文大学) Lehigh University(莱维大学) Renmin University of China(中国人民大学)

AI总结 本研究探讨了生成式人工智能辅助智能教学系统中学生自主学习序列的特征,通过序列和聚类分析发现学生在信息获取与转换上的使用差异,以及GenAI使用与学习表现之间的非显著相关性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16686 2026-01-26 cs.RO

Adaptive Reinforcement and Model Predictive Control Switching for Safe Human-Robot Cooperative Navigation

自适应强化学习与模型预测控制切换用于安全的人机协作导航

Ning Liu, Sen Shen, Zheng Li, Matthew D'Souza, Jen Jen Chung, Thomas Braunl

机构 * School of Engineering, The University of Western Australia(西澳大学工程学院) Department of Mechanical and Automation Engineering, The Chinese University of Hong Kong(香港中文大学机械与自动化工程系) School of Electrical Engineering and Computer Science, The University of Queensland(昆士兰大学电气工程与计算机科学学院)

AI总结 ARMS通过结合强化学习与模型预测控制,实现安全的人机协作导航,提升复杂环境下的导航效率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16685 2026-01-26 cs.AI

AgentsEval: Clinically Faithful Evaluation of Medical Imaging Reports via Multi-Agent Reasoning

AgentsEval: 通过多智能体推理实现医学影像报告的临床可信评估

Suzhong Fu, Jingqi Dong, Xuan Ding, Rui Sun, Yiming Yang, Shuguang Cui, Zhen Li

机构 * FNii-Shenzhen, The Chinese University of Hong Kong (Shenzhen) School of Science and Engineering(深圳FNii、香港中文大学(深圳)科学与工程学院)

AI总结 AgentsEval通过多智能体推理框架,实现医学影像报告的临床可信评估,提供结构化反馈和稳健的评估结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16618 2026-01-26 cs.CL

PROST-LLM: Progressively Enhancing the Speech-to-Speech Translation Capability in LLMs

PROST-LLM:逐步增强大语言模型中的语音到语音翻译能力

Jing Xu, Jiaqi Wang, Daxin Tan, Xiao Chen

机构 * The Chinese University of Hong Kong Huawei Artificial Intelligence Laboratory (Leibniz)(香港中文大学华为人工智能实验室(莱布尼茨))

AI总结 PROST-LLM通过逐步增强方法提升大语言模型在语音到语音翻译中的能力,采用三任务学习和模态链方法,结合自我采样和回译生成偏好对,最终通过偏好优化提升翻译性能。

Comments Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16486 2026-01-26 cs.CL cs.AI

Timely Machine: Awareness of Time Makes Test-Time Scaling Agentic

及时机器:时间意识使测试时间缩放成为代理

Yichuan Ma, Linyang Li, Yongkang chen, Peiji Li, Xiaozhe Li, Qipeng Guo, Dahua Lin, Kai Chen

机构 * Fudan University Shanghai AI Laboratory(复旦大学上海人工智能实验室) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 Timely Machine通过重新定义测试时间为实时时钟时间,提出Timely-RL方法提升时间预算意识,以应对高频工具调用和时间受限推理的挑战。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16480 2026-01-26 cs.CL

TL-GRPO: Turn-Level RL for Reasoning-Guided Iterative Optimization

TL-GRPO:基于回合的强化学习用于推理引导的迭代优化

Peiji Li, Linyang Li, Handa Sun, Wenjin Mai, Yongkang Chen, Xiaozhe Li, Yue Shen, Yichuan Ma, Yiliu Sun, Jiaxi Cao, Zhishu He, Bo Wang, Xiaoqing Zheng, Zhaori Bi, Xipeng Qiu, Qipeng Guo, Kai Chen, Dahua Lin

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学)

AI总结 TL-GRPO通过回合级分组采样优化解决迭代优化任务中的轨迹级强化学习问题,实现更精细的优化效果。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16447 2026-01-26 cs.CL

Mixing Expert Knowledge: Bring Human Thoughts Back To the Game of Go

融合专家知识:将人类思维带回围棋游戏

Yichuan Ma, Linyang Li, Yongkang Chen, Peiji Li, Jiasheng Ye, Qipeng Guo, Dahua Lin, Kai Chen

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 LoGos通过融合围棋专家知识与通用推理能力,实现了在围棋领域的专业水平表现,展示了自然语言推理和战略决策能力。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.16413 2026-01-26 cs.CV

A Cosine Network for Image Super-Resolution

用于图像超分辨率的余弦网络

Chunwei Tian, Chengyuan Zhang, Bob Zhang, Zhiwu Li, C. L. Philip Chen, David Zhang

机构 * IEEE(国际电气与电子工程师协会) University of Macau(澳门大学) South China University of Technology(华南理工大学) Pazhou Lab(琶洲实验室) Chinese University of Hong Kong (Shenzhen)(香港中文大学(深圳))

AI总结 本文提出CSRNet,通过改进网络架构和优化训练策略,提升图像超分辨率的性能。

Comments in IEEE Transactions on Image Processing (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏