arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

共收录 2931
2512.23440 2025-12-30 cs.CL

ClinDEF: A Dynamic Evaluation Framework for Large Language Models in Clinical Reasoning

ClinDEF: 一种用于大语言模型临床推理的动态评估框架

Yuqi Tang, Jing Yu, Zichang Su, Kehua Feng, Zhihui Zhu, Libin Wang, Lei Liang, Qiang Zhang, Keyan Ding, Huajun Chen

机构 * ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州全球科技创新中心) ZJU-UIUC Institute, Zhejiang University(浙江大学UIUC研究院) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) The Polytechnic Institute, Zhejiang University(浙江大学 polytechnic 院) AntGroup(蚂蚁集团)

AI总结 ClinDEF通过模拟诊断对话评估大语言模型的临床推理能力,利用疾病知识图谱生成病例并进行多轮交互,提供细粒度效率分析和诊断质量评估,揭示LLM在临床推理中的关键不足。

Comments 23 pages, 4 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22957 2025-12-30 cs.RO cs.SY eess.SY

PreGME: Prescribed Performance Control of Aerial Manipulators based on Variable-Gain ESO

PreGME:基于变增益ESO的空中机械臂预设性能控制

Mengyu Ji, Shiliang Guo, Zhengzhen Li, Jiahao Shen, Huazi Cao, Shiyu Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) WINDY Lab, Department of Artificial Intelligence, Westlake University(西湖大学人工智能研究院WINDY实验室) College of Artificial Intelligence, Zhejiang University(浙江大学人工智能学院) Research Center for Industries of the Future, Westlake University(未来产业研究中心)

AI总结 PreGME通过变增益ESO和预设性能控制,实现空中机械臂高精度运动控制,有效应对动态耦合挑战。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04678 2025-12-30 cs.CV

Reward Forcing: Efficient Streaming Video Generation with Rewarded Distribution Matching Distillation

奖励强制:基于奖励分布匹配蒸馏的高效流式视频生成

Yunhong Lu, Yanhong Zeng, Haobo Li, Hao Ouyang, Qiuyu Wang, Ka Leong Cheng, Jiapeng Zhu, Hengyuan Cao, Zhipeng Zhang, Xing Zhu, Yujun Shen, Min Zhang

机构 * Zhejiang University(浙江大学) Ant Group(蚂蚁集团) SIAS-ZJU SJTU(上海交通大学)

AI总结 奖励强制通过EMA-Sink和Re-DMD提升流式视频生成效率与质量,实现23.1 FPS的高性能视频生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15545 2025-12-30 cs.CL cs.AI

TokenTiming: A Dynamic Alignment Method for Universal Speculative Decoding Model Pairs

TokenTiming: 一种适用于通用推测解码模型对的动态对齐方法

Sibo Xiao, Jinyuan Fu, Zhongle Xie, Lidan Shou

机构 * Zhejiang University(浙江大学)

AI总结 TokenTiming通过动态对齐方法实现通用推测解码,无需重新训练即可处理不同词汇模型,提升LLM推理效率1.57倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08270 2025-12-30 cs.LG cs.AI cs.CL cs.MM

Doctor Sun: A Bilingual Multimodal Large Language Model for Biomedical AI

Doctor Sun: 一种双语多模态大语言模型用于生物医学AI

Dong Xue, Ziyao Shao, Zhaoyang Duan, Fangzhou Liu, Bing Li, Zhongheng Zhang

机构 * Key Laboratory of Smart Manufacturing in Energy Chemical Process, Ministry of Education East China University of Science and Technology(能源化工过程智能制造重点实验室,东华大学) Research Institute of Intelligent Control and Systems Harbin Institute of Technology(智能控制与系统研究室,哈尔滨工业大学) Department of Emergency Medicine, Sir Run Run Shaw Hospital Zhejiang University School of Medicine(浙江大学医学院急诊医学科) Provincial Key Laboratory of Precise Diagnosis Treatment of Abdominal Infection, Sir Run Run Shaw Hospital Zhejiang University School of Medicine(腹部感染精准诊断治疗省级重点实验室,浙江大学医学院) School of Medicine Shaoxing University(绍兴大学医学院)

AI总结 Doctor Sun是一种双语多模态大语言模型,通过整合预训练视觉编码器和医学LLM,提升生物医学多模态任务的性能,并提供SunMed-VL数据集支持研究进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17951 2025-12-30 cs.CV cs.AI

Robust Polyp Detection and Diagnosis through Compositional Prompt-Guided Diffusion Models

通过组成提示引导的扩散模型实现鲁棒的息肉检测与诊断

Jia Yu, Yan Zhu, Peiyao Fu, Tianyi Chen, Junbo Huang, Quanlin Li, Pinghong Zhou, Zhihua Wang, Fei Wu, Shuo Wang, Xian Yang

机构 * Zhejiang University(浙江大学) Shanghai Institute for Advanced Study of Zhejiang University(浙江大学上海高等研究院) Endoscopy Center, Zhongshan Hospital, Fudan University(复旦大学中山医院内窥镜中心) Shanghai Collaborative Innovation Center of Endoscopy(上海内窥镜协同创新中心) Digital Medical Research Center, School of Basic Medical Sciences, Fudan University(复旦大学基础医学院数字医疗研究中心) Shanghai Key Laboratory of MICCAI(上海MICCAI重点实验室) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学联盟商学院) Data Science Institute, Imperial College London(伦敦帝国学院数据科学研究所)

AI总结 本文提出PSDM模型,通过整合多种临床注释生成合成图像,提升息肉检测、分类和分割的鲁棒性和泛化能力。

Journal ref IEEE Trans. Med. Imaging, vol. 44, no. 12, pp. 5245-5257, Dec. 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05050 2025-12-30 cs.LG quant-ph

Sequential learning on a Tensor Network Born machine with Trainable Token Embedding

基于可训练标记嵌入的张量网络生机器的序列学习

Wanda Hou, Miao Li, Yi-Zhuang You

机构 * Department of Physics, University of California, San Diego, CA 92093, USA(加州大学圣地亚哥分校物理系) School of Physics, Zhejiang University, Hangzhou 310027, China(浙江大学物理学院) Department of Physics, Georgia Institute of Technology, Atlanta, GA 30332, USA(佐治亚理工学院物理系)

AI总结 本文提出基于可训练POVM嵌入的Born机器,通过改进张量网络结构,提升量子启发序列建模中复杂数据相关性的建模能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22745 2025-12-30 cs.CV

Split4D: Decomposed 4D Scene Reconstruction Without Video Segmentation

Split4D: 分解式4D场景重建无需视频分割

Yongzhen Hu, Yihui Yang, Haotong Lin, Yifan Wang, Junting Dong, Yifu Deng, Xinyu Zhu, Fan Jia, Hujun Bao, Xiaowei Zhou, Sida Peng

机构 * Zhejiang University China Shanghai AI Lab China State Key Lab of CAD\&CG, Zhejiang University China Zhejiang University Shanghai AI Lab State Key Lab of CAD\&CG, Zhejiang University

AI总结 Split4D通过Freetime FeatureGS和流式特征学习策略,实现无需视频分割的4D场景重建,提升重建质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22605 2025-12-30 cs.AI cs.CV

Learning Multi-Modal Mobility Dynamics for Generalized Next Location Recommendation

学习多模态移动动态以实现通用的下一站推荐

Junshu Dai, Yu Wang, Tongya Zheng, Wei Ji, Qinghong Guo, Ji Cao, Jie Song, Canghong Jin, Mingli Song

机构 * Zhejiang University(浙江大学) Hangzhou City University(杭州市大学) Nanjing University(南京大学)

AI总结 本文提出多模态移动(M^3ob)方法,通过构建统一时空关系图和门控机制,提升位置推荐任务的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22492 2025-12-30 cs.DC cs.AI cs.LG

Role-Based Fault Tolerance System for LLM RL Post-Training

基于角色的LLM强化学习后训练容错系统

Zhenqian Chen, Baoquan Zhong, Xiang Li, Qing Dai, Xinkui Zhao, Miao Ye, Ren Cheng, Lufei Zhang, Jianwei Yin

机构 * Zhejiang University(浙江大学) State Key Laboratory of Mathematical Engineering and Advanced Computing(数学工程与先进计算国家重点实验室)

AI总结 RobustRL通过基于角色的故障隔离技术,有效提升LLM强化学习后训练的容错性能,实现训练时间比率提升80%以上。

Comments 16 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22491 2025-12-30 cs.CL cs.AI

ManchuTTS: Towards High-Quality Manchu Speech Synthesis via Flow Matching and Hierarchical Text Representation

曼juTTS: 通过流匹配和分层文本表示实现高质量曼ju语音合成

Suhua Wang, Zifan Wang, Xiaoxin Sun, D. J. Wang, Zhanbo Liu, Xin Li

机构 * Department of Computer Science, Changchun Humanities and Sciences College(计算机科学系,长春人文科学学院) School of Information Science and Technology, Northeast Normal University(信息科学与技术学院,东北师范大学) College of Optical Science and Engineering, Zhejiang University(光学科学与工程学院,浙江大学)

AI总结 ManchuTTS通过流匹配和分层文本表示,解决曼ju语音合成中的黏着性和数据稀缺问题,实现高质量语音生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22483 2025-12-30 cs.CV

Scalpel-SAM: A Semi-Supervised Paradigm for Adapting SAM to Infrared Small Object Detection

Scalpel-SAM: 一种用于适应红外小目标检测的半监督范式

Zihan Liu, Xiangning Ren, Dezhang Kong, Yipeng Zhang, Meng Han

机构 * School of Computer Science, Chengdu University(成都大学计算机科学学院) China University of Geosciences(中国地质大学) Zhejiang University(浙江大学) Intelligent Computing Infrastructure Innovation Center, Zhejiang Lab(浙江实验室智能计算基础设施创新中心)

AI总结 Scalpel-SAM通过半监督范式利用SAM作为教师模型,解决红外小目标检测中的数据稀缺问题,通过知识蒸馏和迁移提升下游模型性能。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22324 2025-12-30 cs.CV

DeMoGen: Towards Decompositional Human Motion Generation with Energy-Based Diffusion Models

DeMoGen:基于能量扩散模型的分解式人类动作生成

Jianrong Zhang, Hehe Fan, Yi Yang

机构 * ReLER, AAII, University of Technology Sydney(技术悉尼大学) CCAI, Zhejiang University(浙江大学)

AI总结 DeMoGen通过能量扩散模型实现动作分解生成,提出三种训练变体以促进动作分解学习,并构建文本分解数据集支持组合训练。

Comments Project page: https://jiro-zhang.github.io/DeMoGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12004 2025-12-30 eess.IV cs.LG eess.SP

NLCG-Net: A Model-Based Zero-Shot Learning Framework for Undersampled Quantitative MRI Reconstruction

NLCG-Net:一种用于欠采样定量磁共振成像重建的基于模型的零样本学习框架

Xinrui Jiang, Yohan Jun, Jaejin Cho, Mengze Gao, Xingwang Yong, Berkin Bilgic

机构 * Fudan University(复旦大学) Harvard Medical School(哈佛医学院) Massachusetts General Hospital(麻省总医院) Stanford University(斯坦福大学) Zhejiang University(浙江大学)

AI总结 NLCG-Net通过结合U-Net正则化器和单指数信号建模,实现了基于模型的零样本学习,用于高加速因子下的T2/T1定量磁共振成像重建。

Comments 5 pages, 5 figures, accepted by International Society for Magnetic Resonance in Medicine 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22102 2025-12-29 cs.LG

Explainable Multimodal Regression via Information Decomposition

通过信息分解实现可解释的多模态回归

Zhaozhao Ma, Shujian Yu

机构 * Zhejiang University(浙江大学) Georgia Institute of Technology(佐治亚理工学院) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) UiT - The Arctic University of Norway(挪威北极大学)

AI总结 本文提出基于部分信息分解的多模态回归框架,通过分解模态特定表示为唯一、冗余和协同组件,提升预测准确性和可解释性,并在多个数据集上验证其有效性。

Comments Project Page: https://github.com/zhaozhaoma/PIDReg

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21849 2025-12-29 cs.CL cs.AI

HeartBench: Probing Core Dimensions of Anthropomorphic Intelligence in LLMs

HeartBench: 探索大语言模型中拟人智能的核心维度

Jiaxin Liu, Peiyi Tu, Wenyu Chen, Yihong Zhuang, Xinxia Ling, Anji Zhou, Chenxi Wang, Zhuo Han, Zhengkai Yang, Junbo Zhao, Zenan Huang, Yuanyuan Wang

机构 * Ant Group(蚂蚁集团) Xiamen University(厦门大学) Beijing Normal University(北京师范大学) Zhejiang University(浙江大学)

AI总结 HeartBench通过理论驱动的分类体系评估中文大语言模型的情感、文化和伦理维度,揭示其在拟人智能方面的性能上限及改进方向。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05607 2025-12-29 cs.CL

CC-GSEO-Bench: A Content-Centric Benchmark for Measuring Source Influence in Generative Search Engines

CC-GSEO-Bench: 一种以内容为中心的基准,用于衡量生成搜索引擎中源影响力

Qiyuan Chen, Jiahe Chen, Hongsen Huang, Qian Shao, Jintai Chen, Renjie Hua, Hongxia Xu, Ruijia Wu, Ren Chuan, Jian Wu

机构 * Zhejiang University(浙江大学) Soochow Securities(苏州证券) HKUST(GZ)(香港科技大学(广州)) Shanghai Jiaotong University(上海交通大学)

AI总结 CC-GSEO-Bench通过大规模数据集和创作者导向的评估框架,量化生成搜索引擎中源文章的影响,涵盖曝光、忠实信用、因果影响等核心维度。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21706 2025-12-29 cs.CL cs.AI

Enabling Conversational Behavior Reasoning Capabilities in Full-Duplex Speech

实现全双工语音中对话行为推理能力

Shuchang Pan, Siddharth Banerjee, Dhruv Hebbar, Siddhant Patel, Akshaj Gupta, Kan Jen Cheng, Hanjo Kim, Zeyi Austin Li, Martin Q. Ma, Tingle Li, Gopala Anumanchipalli, Jiachen Lian

机构 * Zhejiang University(浙江大学) University of California, Berkeley(加州大学伯克利分校) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出一种基于图的思维框架,通过建模对话行为的因果推断,实现全双工语音交互中的行为推理与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21641 2025-12-29 cs.CV cs.AI

TrackTeller: Temporal Multimodal 3D Grounding for Behavior-Dependent Object References

TrackTeller: 基于时间的多模态3D定位用于行为依赖的对象引用

Jiahong Yu, Ziqi Wang, Hailiang Zhao, Wei Zhai, Xueqiang Yan, Shuiguang Deng

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学) Huawei Technologies Ltd.(华为技术有限公司)

AI总结 TrackTeller通过融合LiDAR图像、语言条件解码和时间推理,提升动态3D场景中基于语言的物体定位与跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21584 2025-12-29 cs.CV

UltraLBM-UNet: Ultralight Bidirectional Mamba-based Model for Skin Lesion Segmentation

UltraLBM-UNet:轻量双向Mamba模型用于皮肤病变分割

Linxuan Fan, Juntao Jiang, Weixuan Liu, Zhucun Xue, Jiajun Lv, Jiangning Zhang, Yong Liu

机构 * Data Science Institute, Vanderbilt University(维斯尼尔大学数据科学学院) College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院) School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院)

AI总结 UltraLBM-UNet通过整合双向Mamba机制和多分支局部特征感知,实现轻量级皮肤病变分割,具有高效计算和高分割精度。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21515 2025-12-29 cs.LG cs.CL

Perplexity-Aware Data Scaling Law: Perplexity Landscapes Predict Performance for Continual Pre-training

感知度意识的数据扩展定律:感知度景观预测持续预训练的表现

Lei Liu, Hao Zhu, Yue Shen, Zhixuan Chu, Jian Wang, Jinjie Gu, Kui Ren

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学)

AI总结 本文提出感知度意识的数据扩展定律,通过感知度景观预测持续预训练的表现,有效提升数据利用效率和训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21495 2025-12-29 cs.CV

Generative Multi-Focus Image Fusion

生成式多焦点图像融合

Xinzhe Xie, Buyu Guo, Bolin Li, Shuangyan He, Yanzhen Gu, Qingyan Jiang, Peiliang Li

机构 * State Key Laboratory of Ocean Sensing & Ocean College, Zhejiang University(海洋传感国家重点实验室与海洋学院,浙江大学) Donghai Laboratory(东海实验室) Hainan Institute, Zhejiang University(海南学院,浙江大学) Hainan Provincial Observatory of Ecological Environment and Fishery Resource in Yazhou Bay(三亚市生态环境与渔业资源省级观测站)

AI总结 本文提出GMFF框架,通过确定性融合和生成式修复两个阶段,实现高效多焦点图像融合,解决边缘伪影问题并提升实际应用性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21486 2025-12-29 cs.LG eess.SP

When Bayesian Tensor Completion Meets Multioutput Gaussian Processes: Functional Universality and Rank Learning

当贝叶斯张量补全遇见多输出高斯过程:函数通用性和秩学习

Siyuan Li, Shikai Fang, Lei Cheng, Feng Yin, Yik-Chung Wu, Peter Gerstoft, Sergios Theodoridis

机构 * College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Zhejiang Provincial Key Laboratory of Multi-Modal Communication Networks and Intelligent Information Processing(浙江省多模态通信网络与智能信息处理重点实验室) School of Science & Engineering, The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)科学与工程学院) Department of Electrical and Electronic Engineering, The University of Hong Kong(香港大学电子与电气工程系) Technical University of Denmark(丹麦技术大学) NoiseLab, University of California, San Diego(加州大学圣地亚哥分校NoiseLab) HERON - Center of Excellence in Robotics, Athena R.C(HERON-机器人卓越中心)

AI总结 本文提出RR-FBTC方法,结合贝叶斯张量补全与多输出高斯过程,实现对连续多维信号的通用近似,并通过变分推断框架高效学习模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20619 2025-12-29 cs.CV

SemanticGen: Video Generation in Semantic Space

SemanticGen: 语义空间中的视频生成

Jianhong Bai, Xiaoshi Wu, Xintao Wang, Xiao Fu, Yuanxing Zhang, Qinghe Wang, Xiaoyu Shi, Menghan Xia, Zuozhu Liu, Haoji Hu, Pengfei Wan, Kun Gai

机构 * Zhejiang University(浙江大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) CUHK(香港中文大学) DLUT(大连理工大学) HUST(华中科技大学)

AI总结 SemanticGen通过在语义空间中生成视频,提高了长视频生成的效率和质量,优于现有方法。

Comments Project page: https://jianhongbai.github.io/SemanticGen/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20355 2025-12-29 cs.RO

FAR-AVIO: Fast and Robust Schur-Complement Based Acoustic-Visual-Inertial Fusion Odometry with Sensor Calibration

FAR-AVIO:基于Schur补的快速且稳健的声学-视觉-惯性融合里程计

Hao Wei, Peiji Wang, Qianhao Wang, Tong Qin, Fei Gao, Yulin Si

机构 * Zhejiang University(浙江大学) Global Institute of Future Technology(未来技术全球研究院) Shanghai Jiao Tong University(上海交通大学)

AI总结 FAR-AVIO通过基于Schur补的EKF实现快速且稳健的水下声学-视觉-惯性融合里程计,结合自适应权重调整和在线校准,提升定位精度与计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20312 2025-12-29 cs.LG cs.AI

TableGPT-R1: Advancing Tabular Reasoning Through Reinforcement Learning

TableGPT-R1: 通过强化学习推进表格推理

Saisai Yang, Qingyi Huang, Jing Yuan, Liangyu Zha, Kai Tang, Yuhang Yang, Ning Wang, Yucheng Wei, Liyao Li, Wentao Ye, Hao Chen, Tao Zhang, Junlin Zhou, Haobo Wang, Gang Chen, Junbo Zhao

机构 * Zhejiang University Institute of Computing Innovation(浙江大学计算创新研究院)

AI总结 TableGPT-R1通过强化学习框架提升表格推理能力,整合数据工程、奖励系统和多阶段训练框架,实现复杂表格任务的先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.03606 2025-12-29 cs.RO cs.CV

VTAO-BiManip: Masked Visual-Tactile-Action Pre-training with Object Understanding for Bimanual Dexterous Manipulation

VTAO-BiManip: 带物体理解的遮蔽视觉-触觉-动作预训练用于双臂灵巧操作

Zhengnan Sun, Zhaotai Shi, Jiayin Chen, Qingtao Liu, Yu Cui, Qi Ye, Jiming Chen

机构 * College of Control Science and Engineering, Zhejiang University, Hangzhou, 310027, China(浙江大学控制科学与工程学院)

AI总结 VTAO-BiManip通过结合视觉-触觉-动作预训练与物体理解,提升双臂灵巧操作的课程强化学习效果,实现超过现有方法20%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21336 2025-12-25 cs.CL cs.AI cs.LG

Optimizing Decoding Paths in Masked Diffusion Models by Quantifying Uncertainty

通过量化不确定性优化掩码扩散模型的解码路径

Ziyu Chen, Xinbei Jiang, Peng Sun, Tao Lin

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) University of Chicago(芝加哥大学)

AI总结 通过引入去噪熵度量,优化掩码扩散模型的解码路径以提升生成质量与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21302 2025-12-25 cs.CV

AndroidLens: Long-latency Evaluation with Nested Sub-targets for Android GUI Agents

AndroidLens: 长延迟评估与嵌套子目标用于Android GUI代理

Yue Cao, Yingyao Wang, Pi Bu, Jingxuan Xing, Wei Jiang, Zekun Zhu, Junpeng Ma, Sashuai Zhou, Tong Lu, Jun Song, Yu Cheng, Yuning Jiang, Bo Zheng

机构 * Nanjing University(南京大学) Alibaba Group(阿里巴巴集团) Fudan University(复旦大学) Zhejiang University(浙江大学)

AI总结 AndroidLens通过引入571个长延迟任务和嵌套子目标,评估Android GUI代理的性能,揭示了现实环境中任务完成的挑战。

Comments 23 pages, 13 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20954 2025-12-25 cs.CL cs.AI

Reflection Pretraining Enables Token-Level Self-Correction in Biological Sequence Models

反射预训练使生物序列模型实现token级自我修正

Xiang Zhang, Jiaqi Wei, Yuejin Yang, Zijie Qiu, Yuhan Chen, Zhiqiang Gao, Muhammad Abdul-Mageed, Laks V. S. Lakshmanan, Wanli Ouyang, Chenyu You, Siqi Sun

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of British Columbia(不列颠哥伦比亚大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) Stony Brook University(石溪大学)

AI总结 本文提出反射预训练方法,通过生成辅助标记提升生物序列模型的token表达能力,实现token级自我修正和推理能力提升。

详情

展开后加载摘要…

URL PDF HTML 收藏