arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-07 至 2026-07-07 共收录 442 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 149 篇

2607.05297 2026-07-07 cs.AI 新提交 70%

MetaSkill-Evolve: Recursive Self-Improvement of LLM Agents via Two-Timescale Meta-Skill Evolution

MetaSkill-Evolve:基于双时间尺度元技能演化的大语言模型智能体递归自改进方法

Zefeng Wang, Minxi Yan, Jinhe Bi, Sikuan Yan, Volker Tresp, Yunpu Ma

机构 * LMU Munich(慕尼黑大学) The Chinese University of Hong Kong(香港中文大学) MCML MemAgents Lab(MemAgents实验室)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 针对现有自改进智能体演化非递归的局限,提出双时间尺度框架,任务技能与元技能分层递归演化,在三类基准上显著提升测试精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05032 2026-07-07 cs.CL 新提交 70%

Multi-Large Language Model Orchestrated Severity Assessment of Clinical Records (MOSAIC)

临床记录的多大型语言模型编排严重程度评估(MOSAIC)

Manuela Del Castillo Suero, Arnault-Quentin Vermillet, Nicole Sonne Heckmann, Darmendra Ramcharran, Maurizio Sessa

机构 * Department of Drug Design and Pharmacology, University of Copenhagen(哥本哈根大学药物设计与药理学系) GSK(葛兰素史克) School of Pharmacy, University of Rhode Island(罗德岛大学药学院)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.CL

AI总结 研究用MOSAIC这一两阶段智能语言模型框架对2型糖尿病严重程度进行表型分析,以合成队列评估其与多种算法真值对比情况及全因死亡率等,结果显示该框架有优势,智能分类与固定规则执行不同。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03283 2026-07-07 cs.AI 新提交 70%

Embodied Operators and Benchmarking: Toward Reusable and Deployable Embodied Intelligence Systems

具身算子与基准测试:迈向可复用和可部署的具身智能系统

Junwu Xiong, Jiaxuan Gao, Wei Chai, Renxing Chen, Yuzhen Li, Yu Guo, Yucheng Guo, Mingxi Luo, Wenyang Ma, Yiyun Mou, Yifei Zhang, Chen Zhou, Yongjian Guo

机构 * JDT Tsinghua University(清华大学) Tianjin University(天津大学) Beihang University(北京航空航天大学)

专题命中 规划决策 :planning(abstract);workflow(abstract);分类 cs.AI

AI总结 研究具身智能系统中可复用功能模块即具身算子,明确其定义边界、构建分类法,提出多维度基准框架,探讨加速及挑战,为具身智能系统提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27780 2026-07-07 cs.AI 新提交 70%

Understanding Rollout Error in Graph World Models

理解图世界模型中的展开误差

Xinyuan Song, Zekun Cai

机构 * Emory University(埃默里大学) The University of Tokyo(东京大学) LocationMind

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文研究图世界模型中的长时域展开误差,提出统一框架分析拓扑与模型引起的误差放大,并设计误差感知图世界模型,通过谱正则化、展开一致性和关键节点加权防止长时域发散。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26720 2026-07-07 cs.RO cs.AI 版本更新 70%

SutureFormer: Learning Surgical Trajectories via Goal-conditioned Offline RL in Pixel Space

SutureFormer: 通过像素空间中的目标引导离线强化学习学习手术轨迹

Huanrong Liu, Chunlin Tian, Tongyu Jia, Tailai Zhou, Qin Liu, Yu Gao, Yutong Ban, Yun Gu, Guy Rosman, Xin Ma, Qingbiao Li

机构 * University of Macau(澳门大学) The Chinese PLA General Hospital(中国人民解放军总医院) Duke University(杜克大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出SutureFormer,一种基于目标引导的离线强化学习框架,通过稀疏标注到密集奖励信号的插值,有效学习手术针轨迹预测,减少平均位移误差58.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05433 2026-07-07 cs.LG 70%

CRISP: Compressed Reasoning via Iterative Self-Policy Distillation

CRISP: 通过迭代自策略蒸馏实现压缩推理

Hejian Sang, Yuanda Xu, Zhengze Zhou, Ran He, Zhipeng Wang, Jiachen Sun

专题命中 规划决策 :planning(abstract);agentic(abstract);分类 cs.LG

AI总结 CRISP通过自蒸馏使模型更简洁推理,无需真实答案或预算,在数学和多步骤规划任务中实现显著的token减少和精度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05311 2026-07-07 cs.CV 新提交 67%

Deep Learning for Semen Analysis in Male Infertility: Computer Vision, Multimodal Fusion, and Clinical Translation

男性不育症精液分析深度学习技术:计算机视觉、多模态融合与临床转化

Runwei Guan, Shaofeng Liang, Jiacheng Weng, Xiaoyi Gu, Jia Weng, Daizong Liu, Duo Pan, Qingxin Zhang, Xiao Liang, Weiping Ding, Suoyu Zhu, Ming Yuan, Yanhua Fei

机构 * Department of Gynaecology and Obstetrics, The Affiliated Jiangyin Hospital of Nantong University(南通大学附属江阴医院妇产科) Department of Oncology, the Affiliated Jiangyin Hospital of Nantong University(南通大学附属江阴医院肿瘤科) Thrust of AI, Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)人工智能推力实验室) FertiTech AI(生殖科技人工智能公司) Department of Oncology, Suzhou Xiangcheng People’s Hospital(苏州市相城区人民医院肿瘤科) Department of Biological Sciences and Bioinformatics, School of Science, Xi’an Jiaotong-Liverpool University(西交利物浦大学理学院生物科学与生物信息学系) School of Artificial Intelligence and Computer Science, Nantong University(南通大学人工智能与计算机科学学院)

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 针对传统精液分析的主观性强等缺陷,综述聚焦计算机视觉与深度学习驱动的精子分析技术,梳理方法、数据集与落地障碍,提出分阶段临床转化路线。

Comments 46 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04728 2026-07-07 cs.CL cs.AI cs.LG 新提交 67%

Turning Off-Policy Tokens On-Policy: A Plug-in Approach for Improving LLM Alignment

将离策略令牌转换为策略内令牌:一种改进大语言模型对齐的插件方法

Yu Li, Xiuyu Li, Mingyang Yi, Jiaxing Wang, zhangliangxu, Zhaolong Xing, Zhen Chen

机构 * Renmin University of China(中国人民大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究针对大语言模型强化学习后训练中离策略数据问题,提出选择性重要性采样(SIS),受拒绝采样启发,以离策略模型为提议分布进行令牌级拒绝测试,理论证明可减少梯度估计差距,实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04561 2026-07-07 cs.CG 新提交 67%

An Exact Generalized k-Cell Decomposition

一种精确的广义k细胞分解

Yeganeh Bahoo, Sajad Saeedi, Roni Sherman

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 研究为配备k调制解调器的智能体在多边形环境中进行可见性规划提出精确k细胞分解,通过消除冗余线,确保可见性事件发生在分解线上,改进复杂度,明确关键事件位置并适用于带孔多边形,有实际应用。

Comments To appear in the Proceedings of the 38th Canadian Conference on Computational Geometry (CCCG 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04309 2026-07-07 cs.GT 新提交 67%

Mechanism Design for Locating a Bridge Between Regions with Prelocated Facilities

在有预定位设施的区域间定位桥梁的机制设计

Genjie Qin, Chenhao Wang, Jianan Lin, Qizhi Fang, Wenjing Liu

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 研究在两个有预定位设施的区域间建桥的机制设计问题,考虑不同机制下社会成本和最大成本,给出最优解特性及多种近似机制和下界。

Comments 12 pages, 1 figure; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04149 2026-07-07 cs.CV 新提交 67%

Beyond Scene Priors: Fine-Grained Traffic Scene Reasoning with Benchmarking and Query-Guided Small-Object Focus

超越场景先验:通过基准测试和查询引导的小目标聚焦进行细粒度交通场景推理

Waikit Xiu, Qiang Lu, Zian Wang, Xinjie Yang, Zhiwei Chen, Chen Sun, Xiying Li

机构 * The University of Hong Kong(香港大学) Sun Yat-Sen University(中山大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 针对安全关键交通场景中复杂问题,提出细粒度交通推理基准FGTR - Bench和文本引导小目标推理MLLM(TSR - MLLM),解决视觉语言对齐中关键小目标被忽视问题,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03177 2026-07-07 cs.SE cs.AI cs.LG 新提交 67%

CRRL: A Causality-Based Reinforcement Learning Framework for Autonomous System Recovery

CRRL:一种用于自主系统恢复的基于因果关系的强化学习框架

Safia Fatima, Kai Olav Ellefsen, Leon Moonen

机构 * Simula Research Laboratory(Simula研究实验室) University of Oslo(奥斯陆大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG、cs.SE

AI总结 研究自主系统恢复中传统强化学习问题,引入基于因果关系的CRRL框架,利用驾驶日志因果关系塑造训练信号,使策略与基于规则的恢复有效协作,提升相关指标。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19954 2026-07-07 cs.AI cs.CL cs.LG 版本更新 67%

On the Ability of Transformers to Verify Plans

Transformer 在验证计划能力上的表现

Yash Sarrof, Yupei Du, Katharina Stein, Alexander Koller, Sylvie Thiébaux, Michael Hahn

机构 * Saarland University(萨尔兰大学) Australian National University(澳大利亚国立大学) University of Toulouse / LAAS-CNRS(图卢兹大学 / LAAS-CNRS)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究分析了解码器-only模型验证计划的能力,提出C*-RASP框架以保证序列长度和词汇量增长时的泛化能力,发现某些经典规划领域中Transformer能有效学习验证长计划。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05339 2026-07-07 cs.LG cs.AI stat.ML 新提交 62%

TREK: Distill to Explore, Reinforce to Refine

TREK:蒸馏以探索,强化以优化

Yuanda Xu, Zhengze Zhou, Kayhan Behdin, Jelena Markovic-Voronov, Hejian Sang, Xiaomin Li, Wenhui Zhu, Xinchen Du, Aida Rahmattalabi, Ran He, Sen Na, Zhipeng Wang, Alborz Geramifard

机构 * LinkedIn Corporation(领英公司) Harvard University(哈佛大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 针对GRPO在学生策略覆盖外的难提示样本上失效问题,提出TREK方法,通过蒸馏扩展探索空间再结合GRPO优化,在多推理与智能体任务上大幅提升模型性能。

Comments 18 pages, 3 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05272 2026-07-07 cs.LG cs.AI cs.DC cs.PF 新提交 62%

Adaptive Inference Batching using Policy Gradients

基于策略梯度的自适应推理批处理

Ruslan Sharifullin

机构 * NVIDIA Corporation(英伟达公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 针对突发异构负载下推理服务的调度难题,采用强化学习学习自适应批处理路由策略,在多GPU场景下消除队头阻塞,性能远超传统启发式方法。

Comments 5 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04541 2026-07-07 cs.CV cs.AI cs.LG cs.RO 新提交 62%

CRISP: A Spatiotemporal Camera-Radar Backbone for Driving via Forecasting-Based World-Model Pretraining

CRISP:一种通过基于预测的世界模型预训练实现驾驶的时空相机-雷达主干网络

Jingyu Song, Yi Liu, Katherine A. Skinner

机构 * Department of Robotics, University of Michigan(密歇根大学机器人系)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究通过基于预测的表示学习预训练时空相机-雷达主干网络CRISP,利用历史多视图图像和雷达扫描,通过预测未来激光雷达点云学习统一鸟瞰图表示,介绍相关组件,实验表明其能提升点云预测并有效迁移至下游任务。

Comments 17 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03386 2026-07-07 cs.AI cs.LG 新提交 62%

When Aggregate Alignment Misleads: Auditing Policy Repair Without Per-State Expert Actions

当聚合对齐产生误导时:无需逐状态专家操作的审核策略修复

Peiying Zhu, Sidi Chang

机构 * Blossom AI(绽放人工智能公司) Blossom AI Labs(绽放人工智能实验室)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究在酒店定价模拟器中,智能策略编辑器仅接收区域级诊断反馈时的策略修复问题,用多重启大语言模型编辑器进行修复,其不仅提升收益还减小情节构成距离,结果表明应按诊断反馈是否成可靠闭环结果评估策略修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03190 2026-07-07 cs.LG cs.AI 新提交 62%

A Bayesian Framework for Evaluating Scenario Compatibility in Generative Population Synthesis

用于评估生成性人口合成中情景兼容性的贝叶斯框架

Zhenlin Qin, Leizhen Wang, Yancheng Ling, Zhenliang Ma

机构 * Department of Civil and Architectural Engineering, KTH Royal Institute of Technology, Stockholm, Sweden(瑞典皇家理工学院土木与建筑工程系,瑞典斯德哥尔摩) Digital Futures, KTH Royal Institute of Technology, Stockholm, Sweden(瑞典皇家理工学院数字未来中心,瑞典斯德哥尔摩) Department of Data Science and Artificial Intelligence, Monash University, Melbourne, Australia(澳大利亚莫纳什大学数据科学与人工智能系,澳大利亚墨尔本)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究情景目标与生成模型的兼容性问题,提出基于集成的贝叶斯更新框架,通过人口感知条件变分自编码器学习分布,用有效样本量量化兼容性,为情景可行性和结构一致性评估提供诊断模型。

Comments Accepted for publication in the Proceedings of the 2026 IEEE International Conference on Intelligent Transportation Systems (ITSC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03065 2026-07-07 cs.LG cs.AI 新提交 62%

Spectral Rewiring for Exploration, Purification, and Model Merging

用于探索、提纯和模型合并的频谱重布线

Zhilong Zhang, Hongli Yu, Huan-ang Gao, Hanlin Wu, Yuxuan Song, Wei-Ying Ma, Ya-Qin Zhang, Hao Zhou

机构 * SIA-Lab of Tsinghua AIR(清华-字节跳动联合研究中心SIA实验室) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究强化学习中参数更新瓶颈,提出子空间对齐重布线方法,保留频谱核心去除正交分量,可提纯训练更新、实现模型合并,提升推理和跨域性能,是无训练机制提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02944 2026-07-07 cs.LG cs.AI 新提交 62%

A Precedent-Guided Co-Scientist for Side-Effect-Aware Drug Redesign

一种用于副作用感知药物重新设计的先例引导协同科学家

Yujin Kim, Charmgil Hong

专题命中 规划决策 :workflow(abstract);分类 cs.AI、cs.LG

AI总结 提出PRECEDE用于副作用感知药物重新设计,将重新设计视为基于证据的推理,由LLM编排,定位为人监督的科学工作流,可审核、证伪且受先前药理学限制。

Comments Accepted at the ICML 2026 Workshop on AI for Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09348 2026-07-07 cs.LG cs.CL 新提交 62%

PBSD: Privileged Bayesian Self-Distillation for Long-Horizon Credit Assignment

PBSD: 特权贝叶斯自蒸馏用于长程信用分配

Yang Tian, Rui Wang, Xumeng Wen, Junjie Li, Shizhao Sun, Lei Song, Jiang Bian, Bo Zhao

机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) XYZ AI Lab(XYZ AI实验室)

专题命中 规划决策 :agentic(abstract);分类 cs.CL、cs.LG

AI总结 提出PBSD方法,通过贝叶斯校准的自蒸馏将稀疏最终奖励转化为细粒度步骤级信用信号,解决长程智能体任务中的信用分配问题,实验表明其提升领域内外性能并促进泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10840 2026-07-07 cs.LG cs.AI q-bio.QM 版本更新 62%

Clin-JEPA: A Multi-Phase Co-Training Framework for Joint-Embedding Predictive Pretraining on EHR Patient Trajectories

Clin-JEPA:一种多阶段协同训练框架,用于EHR患者轨迹的联合嵌入预测预训练

Yixuan Yang, Mehak Arora, Ryan Zhang, Baraa Abed, Junseob Kim, Tilendra Choudhary, Md Hassanuzzaman, Kevin Zhu, Ayman Ali, Chengkun Yang, Alasdair Edward Gent, Victor Moas, Rishikesan Kamaleswaran

机构 * Duke University(杜克大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出Clin-JEPA框架,通过多阶段预训练稳定协同训练编码器和预测器,解决EHR数据中联合嵌入预测的挑战,实现多任务下游任务的高性能表现。

Comments 18 pages, 4 figures, 8 tables. Code: https://github.com/Kamaleswaran-Lab/Clin-JEPA

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01858 2026-07-07 cs.CL cs.AI 版本更新 62%

Web-CogReasoner: Towards Multimodal Knowledge-Induced Cognitive Reasoning for Web Agents

Web-CogReasoner:迈向用于网络智能体的多模态知识诱导认知推理

Yuhan Guo, Cong Guo, Aiwen Sun, Hongliang He, Xinyu Yang, Yue Lu, Yingji Zhang, Xuntao Guo, Dong Zhang, Jianzhuang Liu, Jiang Duan, Yijia Xiao, Liangjian Wen, Hai-Ming Xu, Yong Dai

机构 * Southwestern University of Finance and Economics(西南财经大学) Shanghai Jiao Tong University(上海交通大学) Central South University(中南大学) Hithink Research(Hithink研究) Westlake University(西湖大学) Harbin Institute of Technology(哈尔滨工业大学) University of Manchester(曼彻斯特大学) University of California, Los Angeles(加州大学洛杉矶分校) University of Adelaide(阿德莱德大学) Fudan University(复旦大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Chengdu Everimaging Science and Technology Co., Ltd(成都亿联科技有限公司)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 研究将网络智能体能力分解为知识内容学习和认知过程两阶段,提出框架分类知识,构建数据集,基于此用新推理框架开发训练智能体,实验显示其优势,还引入评估套件。

Comments Accepted to ICLR 2026. Our code and data is released at https://github.com/Gnonymous/Web-CogReasoner

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05795 2026-07-07 cs.LG cs.AI 版本更新 62%

Robust Counterfactual Explanations under Model Multiplicity Using Multi-Objective Optimization

使用多目标优化在模型多样性下的鲁棒反事实解释

Keita Kinjo

机构 * Faculty of Business(商学部) Kyoritsu Women’s University(京都女子大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对机器学习中反事实解释在多相似精度模型下不鲁棒的问题,提出引入帕累托改进观点及多目标优化方法生成鲁棒反事实解释,实验验证了该方法的鲁棒性与实用性。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10805 2026-07-07 cs.CV cs.AI cs.LG cs.RO 版本更新 62%

Learning to Visually Connect Actions and their Effects

学习在视觉上连接动作及其效果

Paritosh Parmar, Eric Peh, Basura Fernando

机构 * Institute of High-Performance Computing, Agency for Science, Technology and Research, Singapore(高性能计算研究所,科技研究局,新加坡)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 该研究引入视觉连接动作及其效果(CATE)概念,探索其动作选择和效果亲和力评估两方面,设计基线模型,发现模型在该任务中表现不佳,人类远超模型,还表明CATE可作为自监督任务学习视频表征。

Comments WACV 2025 (Two Reviewer Nominations for Best Paper Candidate; Oral Presentation)

详情

展开后加载摘要…

URL PDF HTML 收藏
2208.00657 2026-07-07 cs.CV cs.AI cs.LG 交叉投稿 62%

SiamixFormer: a fully-transformer Siamese network with temporal Fusion for accurate building detection and change detection in bi-temporal remote sensing images

SiamixFormer:一种用于双时相遥感图像中精确建筑物检测和变化检测的具有时间融合的全变压器连体网络

Amir Mohammadian, Foad Ghaderi

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出SiamixFormer连体模型,用灾后和灾前遥感图像作输入,有双编码器和分层变压器架构,通过时间变压器融合特征,能更好保持大感受野,在多数据集上检测性能优于现有模型。

Journal ref International Journal of Remote Sensing(2023), 44:12, 3660-3678

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03593 2026-07-07 eess.IV cs.AI cs.CV 新提交 57%

An Interpretable Deep Learning Framework for Discovery and Clinical Validation of Deep Radiomic Signatures in Tumor Classification

用于深度影像组学特征在肿瘤分类中发现与临床验证的可解释深度学习框架

Chengkun Sun, Jinqian Pan, Renjie Liang, Zhengkang Fan, Xin Miao, Yi Guo, Mei Liu, Muxuan Liang, Russell Terry, Jie Xu

机构 * Department of Health Outcomes and Biomedical Informatics, University of Florida(健康结果与生物医学信息学系,佛罗里达大学) Tiktok Department of Biostatistics, MD Anderson Cancer Center(生物统计学系,MD安德森癌症中心) Department of Urology, University of Florida(泌尿科,佛罗里达大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对深度学习影像特征可解释性差阻碍临床落地的问题,该框架融合分割、可解释分类与影像组学分析,多数据集验证可提升肿瘤分类性能与生物可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05378 2026-07-07 cs.LG 新提交 57%

CompactionRL: Reinforcement Learning with Context Compaction for Long-Horizon Agents

CompactionRL:面向长视界智能体的带上下文压缩强化学习

Yujiang Li, Zhenyu Hou, Yi Jing, Jie Tang, Yuxiao Dong

机构 * Tsinghua University(清华大学)

专题命中 规划决策 :agentic(abstract);分类 cs.LG

AI总结 针对长视界大语言模型智能体受上下文窗口限制的问题,提出结合上下文压缩的强化学习方法,联合优化任务执行与摘要生成,在智能体编码任务上取得显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05257 2026-07-07 cs.LG 新提交 57%

GeoFlow: Geo-Aware Modeling of Inter-Area Relationships in Origin-Destination Flow Prediction and Generation

GeoFlow:用于起讫点流预测与生成的区域间关系地理感知建模

Zherui Huang, Guanjie Zheng, Hao Xue, Linghe Kong

机构 * Zherui Huang(黄泽睿) Guanjie Zheng(郑冠杰) Hao Xue(徐浩) Linghe Kong(孔令和)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对现有OD流建模忽略地理属性的缺陷,提出GeoFlow框架融合多类地理特征与定制编解码器,提升OD流预测精度与生成样本的真实性多样性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05174 2026-07-07 cs.AI 新提交 57%

AgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments

AgentGym2:在去理想化真实世界环境中评测大语言模型智能体

Zhiheng Xi, Dingwen Yang, Jiaqi Liu, Jixuan Huang, Honglin Guo, Baodai Huang, Tinggang Chen, Qi Zhang, Zhonghang Lu, Chenyu Liu, Jiajun Sun, Jiazheng Zhang, Dingwei Zhu, Xin Guo, Junzhe Wang, Zhihao Zhang, Yuming Yang, Junjie Ye, Minghe Gao, Dongrui Liu, Jiaming Ji, Guohao Li, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Shanghaijiaotong University(上海交通大学) Peking University(北京大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对现有LLM智能体基准过于理想化的问题,提出去理想化评测框架AgentGym2,可全面测查智能体实操能力,实验显示当前SOTA模型仍存在明显性能缺口。

Comments Accepted as a main conference paper at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏