arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Science and Technology of China(中国科学技术大学)

2026-05-08 至 2026-05-08 共收录 11
2605.06592 2026-05-08 cs.CV cs.AI cs.LG

DINORANKCLIP: DINOv3 Distillation and Injection for Vision-Language Pretraining with High-Order Ranking Consistency

DINORANKCLIP:基于DINOv3蒸馏与注入的视觉-语言预训练高阶排名一致性方法

Shuyang Jiang, Nan Yu, Yiming Zhang, Zenghui Ding, Zhenyu Wu

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Aimaikj(阿米亚克j) HFIPS, Chinese Academy of Sciences(中国科学院HFIPS) University of Science and Technology of China(中国科学技术大学) Chinese Academy of Sciences(中国科学院) National University of Defense Technology(国防科技大学)

AI总结 DINORANKCLIP通过融合DINOv3教师模型与高阶排名一致性损失,改进CLIP在视觉-语言预训练中的表现,提升细粒度和分布外推理能力。

Comments 18 pages, 7 figures, 9 tables. Code will be made publicly available upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06326 2026-05-08 cs.CL

Teaching Thinking Models to Reason with Tools: A Full-Pipeline Recipe for Tool-Integrated Reasoning

教授思考模型进行工具推理:一种完整的全管道配方用于工具集成推理

Qianjia Cheng, Yuchen Zhang, Zhilin Wang, Yuxin Zuo, Shunkai Zhang, Yuchen Fan, Yu Qiao, Bowen Zhou, Ning Ding, Yu Cheng, Yun Luo, Ganqu Cui

机构 * Zhejiang University(浙江大学) Shanghai AI Laboratory(上海人工智能实验室) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学) Tsinghua University(清华大学) University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出一种全管道配方,通过注入自然工具使用行为提升强思考模型的工具集成推理能力,同时保持文本推理能力,展示在Qwen3模型上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06192 2026-05-08 cs.CV cs.AI cs.RO

EA-WM: Event-Aware Generative World Model with Structured Kinematic-to-Visual Action Fields

EA-WM:事件感知生成世界模型与结构运动-视觉动作场

Zhaoyang Yang, Yurun Jin, Lizhe Qi, Cong Huang, Kai Chen

机构 * Fudan University(复旦大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) University of Science and Technology of China(中国科学技术大学) DeepCybo(深瞳)

AI总结 EA-WM通过结构化运动-视觉动作场闭环连接运动控制与视觉感知,提升机器人空间几何和细粒度交互动态的生成精度。

Comments Preprint. 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06121 2026-05-08 cs.CV

Pest-Thinker: Learning to Think and Reason like Entomologists via Reinforcement Learning

Pest-Thinker: 通过强化学习学习像昆虫学家一样思考和推理

Xueheng Li, Yu Wang, Tao Hu, Ji Huang, Ke Cao, Qize Yang, Rui Li, Jie Zhang, Chengjun Xie

机构 * Institute of Intelligent Machines, Hefei Institute of Physical Science, Chinese Academy of Sciences(智能机器研究所、合肥物理科学研究所、中国科学院) University of Science and Technology of China(中国科学技术大学) Zhongke Hefei Institute of Technology Innovation Engineering(中科创新合肥科技研究院) Hefei University of Technology(合肥工业大学)

AI总结 本文提出Pest-Thinker框架,通过强化学习提升多模态大语言模型对害虫形态的细粒度理解,构建了两个高精度害虫基准数据集,并通过监督微调和GRPO优化提升模型在农业害虫识别中的表现。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15270 2026-05-08 cs.CL cs.AI

From Documents to Spans: Scalable Supervision for Evidence-Based ICD Coding with LLMs

从文档到跨度:基于LLM的证据导向ICD编码可扩展监督方法

Xu Zhang, Wenxin Ma, Chenxu Wu, Rongsheng Wang, Zhiyang He, Xiaodong Tao, Kun Zhang, S. Kevin Zhou

机构 * School of Biomedical Engineering, Division of Life Sciences and Medicine, USTC(生物医学工程学院,生命科学与医学系,中国科学技术大学) MIRACLE Center, Suzhou Institute for Advance Research, USTC(MIRACLE中心,苏州先进研究院,中国科学技术大学) Jiangsu Provincial Key Laboratory of Multimodal Digital Twin Technology(江苏省多模态数字孪生技术重点实验室) State Key Laboratory of Precision and Intelligent Chemistry, USTC(精密与智能化学国家重点实验室)

AI总结 本文提出Span-Centric Learning框架,通过局部跨度学习提升ICD编码能力,以更低成本实现宏F1提升8.2点,并提供明确证据支持预测代码。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05854 2026-05-08 cs.AI

AirQualityBench: A Realistic Evaluation Benchmark for Global Air Quality Forecasting

AirQualityBench:一个用于全球空气质量预报的现实评估基准

Xing Xu, Xu Wang, Yudong Zhang, Huilin Zhao, Zhengyang Zhou, Yang Wang

机构 * University of Science and Technology of China(中国科学技术大学) Suzhou Institute for Advanced Research(苏州先进研究院) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出AirQualityBench,一个全球多污染物基准,用于评估在现实条件下(如不均匀覆盖、缺失数据等)的空气质量预报模型,揭示了在标准化数据集上表现良好的模型在真实场景中可能不适用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05832 2026-05-08 cs.AI

MolRecBench-Wild: A Real-World Benchmark for Optical Chemical Structure Recognition

MolRecBench-Wild:光学化学结构识别的现实世界基准

Haote Yang, Hui Wang, Chen Zhu, Jingchao Wang, Linye Li, Hongbin Lai, Huijie Ao, Yongxuan Lyu, Jiang Wu, Jiaxing Sun, Lua Chen, Yuanyuan Cao, Ruijie Zhang, Shengxin Lu, Lijun Wu, Bin Wang, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) King’s College London(伦敦国王学院) East China University of Science and Technology(东华大学) East China Normal University(东华师范大学) Tongji University(同济大学) Peking University(北京大学) Fudan University(复旦大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出MolRecBench-Wild基准,包含5029个化学结构,覆盖真实出版物中的难度范围,通过CARBON表示语言和双轨评估协议提升语义评估能力,揭示现有专利基准与现实学术场景间的性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.04719 2026-05-08 cs.CL

Every Step Counts: Step-Level Credit Assignment for Tool-Integrated Text-to-SQL

每一步都重要:面向工具集成文本到SQL的步骤级信用分配

Yaxun Dai, Baolin Sun, Junying Wang, Pengfei Wang, Yingqi Gao, Xuemei Dong, Mengdie Chu, Xiang Qi, Pingfu Chao

机构 * Institute of Computer Science and Technology, Soochow University, China(苏州大学计算机科学与技术学院) Ant Digital Technologies, Ant Group(蚂蚁集团数字技术部) School of Management, University of Science and Technology of China(中国科学技术大学管理学院)

AI总结 本文提出FineStep框架,通过独立过程奖励设计和步骤级信用分配机制,解决文本到SQL中粗粒度监督导致的信用分配问题,提升模型效率和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23629 2026-05-08 cs.AI cond-mat.dis-nn cond-mat.stat-mech cs.LG physics.soc-ph

Emergent Slow Thinking in LLMs as Inverse Tree Freezing

大语言模型中涌现的慢思考作为逆树冻结

Sihan Hu, Xiansheng Cai, Yuan Huang, Zhiyuan Yao, Linfeng Zhang, Pan Zhang, Youjin Deng, Kun Chen

机构 * Hefei National Laboratory, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室) Hefei National Laboratory for Physical Sciences at the Microscale and Department of Modern Physics, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室和现代物理系) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所) School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院基础物理与数学科学学院) DP Technology(DP技术) Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics, Lanzhou University(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科省重点实验室、兰州大学) AI for Science Institute, Beijing(北京人工智能科学研究院)

AI总结 本文通过统计物理视角揭示大语言模型中慢思考的涌现机制,提出逆树冻结结构,并提出Annealed-RLVR方法提升模型性能。

Comments 34 pages, 17 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11659 2026-05-08 cs.NE cs.AI cs.LG q-bio.NC

Toward Practical Equilibrium Propagation: Brain-inspired Recurrent Neural Network with Feedback Regulation and Residual Connections

迈向实用的平衡传播:受大脑启发的具有反馈调节和残差连接的循环神经网络

Zhuo Liu, Tao Chen

机构 * School of Microelectronics University of Science and Technology of China(微电子学院 中国科学技术大学)

AI总结 本文提出一种受大脑启发的反馈调节残差循环神经网络(FRE-RNN),通过减少谱半径加速收敛,显著降低计算成本,性能与反向传播相当,同时缓解深度RNN中梯度消失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21938 2026-05-08 cs.LG cs.AI cs.CR

Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection

针对随机带隙的实用对抗攻击:通过伪造数据注入

Qirun Zeng, Eric He, Richard Hoffmann, Xuchuang Wang, Jinhang Zuo

机构 * University of Science and Technology of China(中国科学技术大学) California Institute of Technology(加州理工学院) University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) City University of Hong Kong(香港城市大学)

AI总结 本文提出一种更实际的对抗模型,通过有限的伪造反馈样本误导带隙算法,分析了在现实约束下对抗攻击的可行性与有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏