arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-30 至 2026-06-30 共收录 294 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 101 篇

2505.05769 2026-06-30 physics.soc-ph nlin.CD 67%

Hierarchical Synchronization and Distortion Scaling in Social Media Networks: A Fractal-Like Topology Theory

社交媒体网络中的分层同步与失真缩放:一种类似分形的拓扑理论

Kaiming Luo

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 本文提出一种分形启发的分层网络模型,研究社交媒体中信息失真与同步机制,通过模拟和实证验证,揭示噪声累积对意见传播的影响及拓扑结构对治理的启示。

Journal ref Chaos, Solitons and Fractals 202 (2026) 117581

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29687 2026-06-30 quant-ph cs.AI cs.LG cs.LO math.OC 62%

A Machine-Verified Proof of a Quantum-Optimization Conjecture

一个量子优化猜想的机器验证证明

Uri Kol, Maor Ben-Shahar, Kfir Sulimany, Dirk Englund

机构 * Center of Mathematical Sciences and Applications, Harvard University(哈佛大学数学科学中心) MIT Center for Theoretical Physics - a Leinweber Institute(麻省理工学院理论物理中心 - 莱因韦伯研究所) Research Laboratory of Electronics, Massachusetts Institute of Technology(麻省理工学院电子研究实验室)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 利用大语言模型Claude Fable 5发现证明,并通过Lean 4证明助手端到端验证了Farhi-Goldstone-Gutmann猜想,即深度p的量子近似优化算法在环上的近似比恰好为(2p+1)/(2p+2)。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29503 2026-06-30 cs.CL cs.AI 62%

The Verbose Context Problem in Medical Records

医疗记录中的冗长上下文问题

Shiva Kaul, Min-Gyu Kim, Anjum Khurshid, Sriram Vishwanath

机构 * Department of Population Medicine(人口医学部) Department of Biomedical Informatics(生物医学信息学部) School of Electrical and Computer Engineering(电气与计算机工程学院)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 针对群体健康分析中结构化概念导致的长文本瓶颈,提出PopMedQA基准,通过人工患者记录生成库neopatient构建任务,发现领域无关方法无法缓解该问题。

Comments SD4H ICML 2026 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29315 2026-06-30 cs.AI cs.LG 62%

Hierarchical Experimentalist Agents

分层实验者智能体

Abhranil Chandra, Sankaran Vaidyanathan, Utsav Dhanuka, Varun Gandhi, Scott Niekum

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 提出HExA框架,通过主动实验迭代设计实验、学习可复用技能,无需训练或外部监督,在Interphyre基准上将Claude Sonnet成功率从2%提升至77%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28980 2026-06-30 cs.CV cs.AI cs.LG 62%

Evidence-Based Text-Conditioned 3D CT Synthesis for Ovarian Cancer

基于证据的文本条件3D CT合成用于卵巢癌

Francesca Pia Panaccione, Eugenio Lomurno, Francesca Fati, Carlotta Pecchiari, Marina Rosanu, Luigi De Vitis, Lucia Ribero, Gabriella Schivardi, Giovanni Damiano Aletti, Nicoletta Colombo, Maria Francesca Spadea, Francesco Multinu, Matteo Matteucci, Elena De Momi

机构 * AIRLab, Politecnico di Milano(米兰理工学院AIR实验室) Politecnico di Milano(米兰理工学院) NEARLab, Politecnico di Milano(米兰理工学院NEAR实验室) Istituto Europeo di Oncologia(欧洲肿瘤研究所) Università degli Studi dell’Insubria(意大利北部大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出OvESyn框架,利用CT衍生描述符和临床元数据构建标准文本,无需原始放射学报告,通过潜在扩散模型生成腹部盆腔3D CT,首次实现文本条件合成在卵巢癌中的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01215 2026-06-30 cs.CV cs.AI cs.CL cs.MM 62%

Distilling Neuro-Symbolic Programs into 3D Multi-modal LLMs

将神经符号程序蒸馏到3D多模态大语言模型中

Wentao Mo, Yang Liu

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.CL

AI总结 提出APEIRIA,通过三阶段课程学习将符号推理模式蒸馏到3D多模态大语言模型中,实现透明推理与开放词汇空间推理的统一。

Comments To appear in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12277 2026-06-30 cs.CL cs.AI cs.CR 62%

Prompt Injection as Role Confusion

提示注入作为角色混淆

Charles Ye, Jasmine Cui, Dylan Hadfield-Menell

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 本文通过角色探测和CoT伪造攻击,揭示提示注入源于LLM对文本来源的角色感知混淆,并提出角色混淆程度可预测攻击成功率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13562 2026-06-30 cs.CR cs.AI cs.CL 62%

Mitigating the Safety-utility Trade-off in LLM Alignment via Adaptive Safe Context Learning

通过自适应安全上下文学习缓解LLM对齐中的安全性与效用权衡

Yanbo Wang, Minzheng Wang, Jian Liang, Lu Wang, Yongcan Yu, Ran He

机构 * Ritzz-AI

专题命中 规划决策 :tool-use(abstract);分类 cs.AI、cs.CL

AI总结 本文提出ASCL框架,通过多轮工具使用过程提升推理能力,引入IFPO平衡优势估计,实现更高的整体性能。

Comments ICML 2026 Poster

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06133 2026-06-30 math.OC cs.AI cs.LG 62%

LLM Serving Optimization with Variable Prefill and Decode Lengths

具有可变预填和解码长度的LLM服务优化

Meixuan Wang, Yinyu Ye, Zijie Zhou

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系) Department of Industrial Engineering and Decision Analytics, HKUST(香港科技大学工业工程与决策分析系)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究在固定KV缓存内存预算下,异构提示和响应长度的离线调度问题,提出Sorted-F算法以平衡批次大小与下游解码成本,实现常数因子近似保证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01906 2026-06-30 cs.AI cs.LG cs.NE 62%

Instance-Conditioned Adaptation for Large-scale Generalization of Neural Routing Solver

实例条件适应:神经路由求解器的大规模泛化

Changliang Zhou, Xi Lin, Zhenkun Wang, Xialiang Tong, Mingxuan Yuan, Qingfu Zhang

机构 * School of Automation and Intelligent Manufacturing and Guangdong Provincial Key Laboratory of Fully Actuated System Control Theory and Technology, Southern University of Science and Technology, Shenzhen 518055, China(自动化与智能制造学院和广东省全驱动系统控制理论与技术重点实验室,南方科技大学,深圳518055,中国) Department of Computer Science, City University of Hong Kong, Hong Kong SAR, China(计算机科学系,香港城市大学,香港特别行政区,中国) Huawei Noah’s Ark Lab, Hong Kong SAR, China(华为诺亚实验室,香港特别行政区,中国)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出实例条件适应模型(ICAM),通过简单高效的实例条件适应函数和低复杂度的适应模块,显著提升神经路由求解器在大规模旅行商问题(TSP)、容量车辆路径问题(CVRP)和非对称旅行商问题(ATSP)上的泛化性能,同时保持快速推理速度。

Comments accepted by IEEE Transactions on Intelligent Transportation Systems

Journal ref IEEE Transactions on Intelligent Transportation Systems, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21359 2026-06-30 cs.LG cs.AI cs.IR 62%

ProSpec RL: Plan Ahead, then Execute

ProSpec RL:提前规划,然后执行

Liangliang Liu, Yi Guan, BoRan Wang, Rujia Shen, Yi Lin, Chaoran Kong, Lian Yan, Jingchi Jiang

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 ProSpec RL通过前瞻性思维优化决策,结合动态模型和模型预测控制,提升策略规划与数据效率,实现低风险高价值决策。

Comments Withdrawn by the authors due to substantial errors in the analysis that affect the main conclusions of the paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30642 2026-06-30 cs.SD cs.AI 57%

LeVo 2: Stable and Melodious Song Generation via Hierarchical Representation Modeling and Progressive Post-Training

LeVo 2:通过层次表示建模和渐进式后训练实现稳定悦耳的歌曲生成

Shun Lei, Huaicheng Zhang, Dapeng Wu, Yaoxun Xu, Lishi Zuo, Wei Tan, Hangting Chen, Guangzheng Li, Jianwei Yu, Zhiyong Wu, Dong Yu

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Tencent(腾讯) Wuhan University(武汉大学) Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出LeVo 2混合LLM-Diffusion框架,通过层次化建模(先预测混合令牌进行语义规划,再并行预测人声和伴奏令牌)解决全曲生成中协调性与细节保真度的权衡,并引入美学引导训练策略,在主观和客观指标上超越开源基线,接近商业系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30520 2026-06-30 quant-ph cs.LG 57%

Staged Hybridisation for Visual Quantum Reinforcement Learning via Knowledge Distillation

基于知识蒸馏的分阶段混合视觉量子强化学习

Javier Lazaro, Juan-Ignacio Vazquez, Pablo Garcia-Bringas

机构 * University of Deusto(德乌斯大学) FSAS International Quantum Center(FSAS国际量子中心) Fujitsu(富士通)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 提出分阶段知识蒸馏策略,先训练经典视觉教师网络,冻结编码器后蒸馏策略到紧凑下游头(经典或VQC),解决视觉QRL中高维观测与VQC联合训练困难的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30417 2026-06-30 cs.CV cs.AI 57%

Beyond Point Estimates for Glaucoma Visual Field Forecasting with Diffusion Models

超越点估计:基于扩散模型的青光眼视野预测

Marta Colmenar Herrera, Pablo Márquez Neila, Şerife Seda Kucur Ergünay, Martin S. Zinkernagel, Raphael Sznitman

机构 * ARTORG Center for Biomedical Engineering Research, UniBe, Switzerland(瑞士UniBe生物医学工程研究中心ARTORG) PeriVision SA, Epalinges, Switzerland(瑞士Epalinges市PeriVision公司) Department of Ophthalmology, Inselspital, Bern, Switzerland(瑞士伯恩Inselspital眼科部门)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出使用条件去噪扩散模型进行概率性视野预测,生成未来视野的分布,实现校准良好的预测,并在点估计上达到最先进精度,支持从点估计向不确定性感知的临床风险评估转变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30068 2026-06-30 cs.LG 57%

Predictive Objectives Discard Exogenous Control-Relevant Features: A Controlled Mechanistic Study

预测目标丢弃外生控制相关特征:一项受控机制研究

Ayan Pendharkar

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究发现联合嵌入预测目标会丢弃外生但控制相关的特征,即使这些特征易于编码;通过受控实验比较六种目标,发现无奖励预测目标均导致该特征接近随机精度,而奖励接地变体可选择性保留。

Comments 15 pages 3 tables 5 figures for associated github repo see https://github.com/bushesarebetter/jepa_research_project

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29700 2026-06-30 cs.AI 57%

Toward Secure and Reliable PDDL Formalization of Large Language Models with Planner-in-the-Loop Feedback

面向具有规划器反馈的大型语言模型的安全可靠PDDL形式化

Jiamei Jiang, Jiajing Zhang, Feifei Mo, Linjing Li, Daniel Zeng

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Industry-education Integration, University of Chinese Academy of Sciences(中国科学院大学产教融合学院)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出NL-PDDL-Bench基准和规划器在环框架,通过验证器诊断和偏好优化提升LLM生成PDDL规范的可执行性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29556 2026-06-30 cs.LG cs.MA 57%

Persona-Trained Monte Carlo: Estimating Market-Outcome Distributions via Swarms of Persona-Conditioned Neural Policy Bots in a Limit Order Book

人格训练蒙特卡洛:通过限价订单簿中人格条件神经策略机器人群体估计市场结果分布

Salavat Ishbulatov

机构 * Independent researcher(独立研究者)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 提出人格训练蒙特卡洛方法,通过模拟人格条件神经策略交易机器人群体在限价订单簿中的交互,估计市场结果统计量的分布,并给出形式化估计器、跨学科设计理由和验证路线图。

Comments 58 pages, 3 figures, 9 tables, 3 algorithms. Survey and proposed framework; no implementation or empirical results

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29424 2026-06-30 cs.CL 57%

EntroRouter: Learning Efficient Model Routing via Entropy Regulation

EntroRouter: 通过熵调控学习高效模型路由

Kaiyi Zhang, Xueliang Zhao, Zhuocheng Gong, Wei Wu, Yankai Lin

专题命中 规划决策 :planning(abstract);分类 cs.CL

AI总结 针对多轮路由中“信任区域坍塌”问题,提出单轮路由框架EntroRouter,通过软监督初始化策略和软锚定强化学习调控熵,在保留98.3%最强专家精度的同时降低48.25%计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29265 2026-06-30 cs.CL 57%

MIThinker: A Plug-and-Play Policy-Optimized Thinker For Motivational Interviewing Counseling

MIThinker:一种用于动机性访谈咨询的即插即用策略优化思考器

Yizhe Yang, Palakorn Achananuparp, Heyan Huang, Jing Jiang, Ee-Peng Lim

机构 * Beijing Institute of Technology(北京理工大学) Singapore Management University(新加坡国立大学) Australian National University(澳大利亚国立大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 提出轻量级思考模型MIThinker,通过逆向工程从咨询师回应中生成治疗性思考,结合监督微调和强化学习训练,以显式对齐咨询策略,提升动机性访谈咨询效果,计算量降低一个数量级。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29115 2026-06-30 cs.RO cs.AI cs.CV cs.HC 57%

When Stopping Fails: Rethinking Minimal Risk Conditions through Human-Interactive Autonomous Driving for Safe Transportation Systems

当停止失效:通过人机交互自动驾驶重新思考安全交通系统的最小风险条件

Yash Tandon, Giovanni Tapia Lopez, Marcus Blennemann, Mohan Trivedi, Ross Greer

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 分析自动驾驶车辆因停止行为导致的交通阻塞、应急干扰等事故,提出需从被动策略转向人机交互自主性,增强感知、规划与控制能力。

Comments 8 pages, 1 figure, Accepted to IEEE ITSC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28758 2026-06-30 cs.CV cs.AI 57%

X-Mind: Efficient Visual Chain-of-Thought via Predictive World Model for End-to-End Driving

X-Mind: 通过预测世界模型实现高效视觉思维链的端到端驾驶

Bohao Zhao, Chengrui Wei, Guangfeng Jiang, Ruixin Liu, Xuejie Lv, Liu Liang, Sutao Deng, Xiuyang Fan, Pengkun Zheng, Jinyun Zhou, Rui Guo, Hanpeng Liu, Yutong Zheng, Yi Guo, Xinlong Zheng, Qingyu Luo, Zhuangzhuang Ding, Yu Zhang, Hang Zhang, Xianming Liu

机构 * XPeng Inc.(小鹏汽车)

专题命中 规划决策 :autonomous agent(abstract);分类 cs.AI

AI总结 提出X-Mind框架,将预测世界模型内化为视觉思维链,通过紧凑的草图表示和循环块扩散方案,实现高效、低延迟的端到端驾驶策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28712 2026-06-30 cs.RO cs.LG 57%

J-LAW: Joint Localization and Actionable World Modeling via Coupled Latent Factor Graphs

J-LAW:通过耦合潜在因子图实现联合定位与可操作世界建模

Guanqun Cao, Liang Chen

机构 * Geely Technology Europe(吉利技术欧洲公司) State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing (LIESMARS)(信息工程测绘与遥感国家重点实验室(LIESMARS)) Wuhan University(武汉大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出J-LAW,通过耦合因子图联合优化度量物体位姿、潜在世界状态和潜在地标嵌入,实现定位与可操作世界建模的协同提升,实验证明能显著降低潜在预测误差和端点漂移。

Comments 5 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28710 2026-06-30 cs.AI cs.GT 57%

The Two Genie Game: Adoption and Welfare in Audit-Grounded AI Governance

双精灵博弈:审计基础AI治理中的采纳与福利

Darrell Lewis-Sandy

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 利用进化博弈论研究在竞争市场中,最小化危害的AI代理如何取代RLHF代理,并分析其采纳条件及对社区福利的影响。

Comments 36 pages, 3 figures. Lean 4 formalization and figure scripts: https://github.com/dlewissandy/two-genie-scripts

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28553 2026-06-30 cs.LG 57%

Improving Coherence in Hierarchical Time Series Forecasting using Structured Temporal Fusion

改进层次时间序列预测中的一致性的结构化时间融合方法

Ruchi Pakhle

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出层次时间融合(HTF)模型,通过结构化层次嵌入和一致性损失函数,在训练中直接嵌入一致性约束,同时建模时间动态和结构一致性,在M5和能源数据集上降低不一致性并提升预测精度。

Comments 7 pages, 2 figures. Preprint. Source files included

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28524 2026-06-30 cs.CL 57%

Developmental Trajectories of Situation Modeling and Mentalizing in Transformer Language Models

Transformer语言模型中情境建模与心理推理的发展轨迹

Pamela D. Rivière, Cameron Jones, Sean Trott

机构 * Rutgers University - Newark(新泽西州立大学罗格斯大学-新ark分校) Stony Brook University(史泰文斯布鲁克大学)

专题命中 规划决策 :agent(abstract);分类 cs.CL

AI总结 本文从发展视角研究大型语言模型在虚假信念任务中的表现,发现其依赖于模型大小和训练量,且后期训练提升显著,但情境建模能力先于并优于心理推理,且两者均存在脆弱性。

Comments Non-archival submission to the First Workshop on Computational Developmental Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10044 2026-06-30 cs.AI 新提交 57%

Business World Model

商业世界模型

Cecil Pang, Hiroki Sayama

机构 * AI Engineering, USA TODAY Co., Inc.(AI工程,USA TODAY公司) School of Systems Science and Industrial Engineering, Binghamton University, State University of New York(系统科学与工业工程学院,宾夕法尼亚州立大学宾夕法尼亚州立大学) Binghamton Center of Complex Systems, Binghamton University, State University of New York(宾夕法尼亚州立大学复杂系统中心) Waseda Innovation Lab, Waseda University, Tokyo, Japan(早稻田大学创新实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出商业世界模型(BWM)架构,将世界模型思想应用于商业环境,通过编码状态、动态、约束和目标,支持自主决策与规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25063 2026-06-30 cs.LG cond-mat.mtrl-sci 57%

Reinforcement Learning with a Bilevel World-Model Architecture for Scan-Order Optimisation in Laser Directed Energy Deposition

激光增材制造扫描顺序优化的强化学习:用于奖励和世界模型诊断的双层代理-有限元分析诊断框架

Xian Wu, Haoran Li, Yuanqi Chu, Dongbin Zhao, Bin Wang

机构 * College of Engineering, Design and Physical Sciences, Brunel University London(布鲁内尔大学伦敦工程、设计与物理科学学院) Pattern Recognition Laboratory, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别实验室) ISIS Neutron and Muon Source, Science and Technology Facilities Council, Rutherford Appleton Laboratory(Rutherford Appleton实验室,科学与技术设施委员会ISIS中子与μ子源)

专题命中 规划决策 :workflow(abstract);分类 cs.LG

AI总结 本文提出一个双层代理-有限元分析诊断框架,通过轻量代理和稀疏有限元模拟,诊断强化学习在激光增材制造扫描顺序优化中的奖励和世界模型保真度问题。

Comments 31 pages, 7 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02176 2026-06-30 cs.CL 57%

Adam's Law: Textual Frequency Law on Large Language Models

Adam的定律:大型语言模型中的文本频率定律

Hongyuan Adam Lu, Z. L., Victor Wei, Zefan Zhang, Zhao Hong, Qiqi Xiang, Bowen Cao, Wai Lam

机构 * FaceMind Corporation(FaceMind公司) The Chinese University of Hong Kong(香港中文大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 本文提出文本频率定律,通过优化文本频率提升LLM的提示和微调效果,并通过文本频率蒸馏和课程训练方法验证了其有效性。

Comments ACL 2026 Main Conference; The latest version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23559 2026-06-30 cs.CR cs.AI cs.CV 57%

CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training

针对原生GUI代理的CAPTCHA解决:自动化推理-行动数据生成与自我纠正训练

Yuxi Chen, Haoyu Zhai, Chenkai Wang, Rui Yang, Lingming Zhang, Gang Wang, Huan Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 本文提出ReCAP,一种能解决现代交互式CAPTCHA挑战的原生GUI代理,通过自动化数据生成和自我纠正训练提升CAPTCHA解决能力,同时保持通用GUI任务性能。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00095 2026-06-30 cs.LG cs.NE 57%

Financial Decision Making using Reinforcement Learning with Dirichlet Priors and Quantum-Inspired Genetic Optimization

利用Dirichlet先验和量子启发式遗传优化的强化学习进行财务决策

Prasun Nandy, Debjit Dhar, Rik Das

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 本文提出结合Dirichlet分布和量子启发式遗传优化的强化学习框架,用于动态预算分配,以提高企业财务决策的适应性与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏