arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-10 至 2026-07-10 共收录 84 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工具调用 8 篇

2607.08010 2026-07-10 cs.CL cs.LG cs.SE 新提交 75%

Tool-Making and Self-Evolving LLM Agents in Low-Latency Systems

低延迟系统中的工具制作与自我进化大语言模型智能体

Kalle Kujanpää, Ning Liu, Shahnawaz Alam, Yeshwanth Reddy Sura, Tianyu Yang, Kristina Klinkner, Shervin Malmasi

机构 * Amazon(亚马逊)

专题命中 工具调用 :agent(abstract);agentic(abstract);分类 cs.CL、cs.LG、cs.SE

AI总结 研究如何解决生产LLM智能体因重复生成代码浪费延迟和可靠性的问题,提出用智能工具制作管道取代推理时编码循环,部署该方法使系统更快、更可靠、易操作,降低延迟和错误率,提高可审计性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07984 2026-07-10 cs.AI 新提交 74%

Agentic Neural Architecture Search

智能体神经架构搜索

Seokhoon Jeong, Mijung Kim, Taehwan Kim

机构 * Artificial Intelligence Graduate School, Ulsan National Institute of Science and Engineering(人工智能研究生院,乌山科学与工程研究院) Department of Computer Science and Engineering, Ulsan National Institute of Science and Engineering(计算机科学与工程系,乌山科学与工程研究院)

专题命中 工具调用 :agentic(title);分类 cs.AI

AI总结 研究探索LLM驱动设计与NAS驱动搜索的分工,提出用LLM生成种子架构并分解为带插槽架构供NAS搜索的机制,在AgentNAS中实例化,在多任务上表现出色,两种搜索机制互补。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07721 2026-07-10 cs.AI cs.LG 新提交 62%

Context Graphs for Proactive Enterprise Agents

用于主动企业智能体的上下文图

Avinash Kumar

专题命中 工具调用 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究旨在让企业智能体更主动,提出上下文图结构,定义相关检测引擎、评分器和呈现层,形式化组件并给出Python实现,经案例研究评估,该方法提升了Precision@5,降低误报率和平均呈现时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08274 2026-07-10 cs.HC cs.SE 新提交 57%

How Analysts Use AI in High-Stakes Crime Linkage: An Industrial Study

分析师如何在高风险犯罪关联中使用人工智能:一项行业研究

Jessica Woodhams, Amy Burrell, Wanyin Li, Fahim Ahmed, Matthew Tonkin, Jan Lemeire, Arkady Konovalov, Steven Frisson, Mark Webb, Sarah Galambos, Vesna Nowack, Dalal Alrajeh

专题命中 工具调用 :workflow(abstract);分类 cs.SE

AI总结 研究探讨分析师在高风险犯罪关联中如何用AI,通过与英国执法机构合作开发工具并进行混合方法可用性研究,发现分析师有选择地用AI预测且常验证,还关注模型特征,强调AI决策支持工具要整合解释与传统方法及现场评估的重要性。

Comments 12 pages, 6 figures, FSE Industry

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08491 2026-07-10 stat.ME stat.CO 新提交 50%

weightflow: declarative, recipe-aware survey weighting in R

Weightflow:R 中声明式、可感知配方的调查加权

Juan Pablo Ferreira

专题命中 工具调用 :workflow(abstract)

AI总结 研究为复杂调查生成权重的方法,提出 Weightflow 包,通过声明式 API 构建权重,将定义与应用分离,可重现可审计,能传播各阶段不确定性,实现多种校准及调整,经验证在实际数据中能恢复已知贫困率。

Comments 13 pages, 7 figures. Software on CRAN: https://CRAN.R-project.org/package=weightflow ; docs: https://jpferreira33.github.io/weightflow/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08232 2026-07-10 cs.CR 新提交 50%

Mini-Programs, Mega-Problems: Unveiling OAuth-based Authentication Misuses in Mini-Programs via Dynamic Analysis

小程序、大问题:通过动态分析揭示小程序中基于 OAuth 的认证滥用情况

Zidong Zhang, Zhentao Xie, Lingyun Ying, Qinsheng Hou, Yacong Gu, Wenrui Diao, Jianliang Wu

专题命中 工具调用 :workflow(abstract)

AI总结 研究通过动态分析揭示小程序中基于 OAuth 的认证滥用问题,设计 MINIAUTH 框架,对大量微信和百度小程序进行分析,发现多种滥用案例及百度 API 加密缺陷,强调加强开发者指导与平台保护的必要性。

Comments Accepted by ACM CCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08753 2026-07-10 math.OC 新提交 50%

Finding Simple Proofs for First-Order Optimization

寻找一阶优化的简单证明

Daniel Berg Thomsen, Manu Upadhyaya, Baptiste Goujaud, Aymeric Dieuleveut, Adrien Taylor

专题命中 工具调用 :workflow(abstract)

AI总结 该研究针对一阶优化,将寻找简单证明结构设为第二阶段优化问题,从对偶证书出发,运用稀疏优化等工具开发后处理程序,通过特定特征衡量复杂度并引入多种方法,能简化证明结构,降低后续人工处理复杂度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07783 2026-07-10 astro-ph.IM 新提交 50%

Blind Line Search System: BLiSS

盲线搜索系统:BLiSS

Luis Abalo, Graciela Sanjurjo-Ferrín, Jessica Planelles-Villalva, José Joaquín Rodes-Roca, José Miguel Torrejón

专题命中 工具调用 :workflow(abstract)

AI总结 针对X射线天文台揭示更多微弱和混合发射线,现有分析方法难对大型数据集均匀分析的问题,提出开源Python包BLiSS,可快速盲检测和表征发射线候选者,无需先验模型,经实例验证性能良好,提供了相关工作流程。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 规划决策 27 篇

2607.08497 2026-07-10 cs.CV cs.AI cs.CL cs.LG 新提交 85%

Cognitive-structured Multimodal Agent for Multimodal Understanding, Generation, and Editing

用于多模态理解、生成和编辑的认知结构多模态智能体

Feng Wang, Canmiao Fu, Zhipeng Huang, Chen Li, Jing Lyu, Ge Li

机构 * Peking University(北京大学) Tencent Inc(腾讯公司)

专题命中 规划决策 :agent(title,abstract);planning(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 研究针对统一多模态模型在长时多模态对话中的局限,提出认知结构多模态智能体,通过外化视觉信息等方式改进。开发统一场景引擎,构建评估基准。实验显示该智能体检索准确率高、推理时间减半,还介绍了工具包,为长时多模态智能体提供新范式。

Comments 16 pages, 7 figures, 8 tables. Project page: https://caseclose.github.io/cma-harness/ Code: https://github.com/caseclose/cma-harness

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08400 2026-07-10 cs.CR cs.AI cs.LG 新提交 81%

TRACE: A Two-Channel Robust Attribution Watermark via Complementary Embeddings for LLM-Agent Trajectories

TRACE:一种通过互补嵌入实现的用于大语言模型智能体轨迹的双通道鲁棒归属水印

Zheng Gao, Xiaoyu Li, Xiaoyan Feng, Jiaojiao Jiang, Yang Song, Yulei Sui, Zhenchang Xing, Liming Zhu

机构 * University of New South Wales(新南威尔士大学) Griffith University(格里菲斯大学) CSIRO’s Data61(澳大利亚联邦科学与工业研究组织(CSIRO)的数据61)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI、cs.LG

AI总结 研究针对大语言模型智能体轨迹归属水印易被经销商攻击的问题,提出TRACE方法,通过互补嵌入构建双通道水印,包括基于局部内容的选择通道和基于日志框架的计数通道,实验表明该方法能保证水印鲁棒性,保持智能体成功率且检测分数高。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08024 2026-07-10 cs.CV cs.AI cs.LG cs.RO 新提交 81%

APIVOT: Adaptive Planning with Interleaved Vision-Language Thoughts

APIVOT:具有交错视觉语言思维的自适应规划

Emily Jin, Joy Hsu, Yiqing Xu, Weiyu Liu, Nick Haber, Jiajun Wu

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究长期机器人规划问题,提出基于VLM的APIVOT规划器,通过自适应交错语言和视觉思维,利用语言语义推理、视觉思维验证几何可行性,在长期厨房任务中表现出色,提升了规划成功率和推理效率。

Comments Project Page: https://emilyzjin.github.io/projects/apivot.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07844 2026-07-10 cs.RO cs.AI cs.LG 新提交 81%

Shift & Drift: A Zero-Shot Benchmark for Generalizable and Robust Autonomous Driving Motion Planning

Shift & Drift:用于可泛化且稳健的自动驾驶运动规划的零样本基准测试

Alessandro Canevaro, Hang Yu, Julian Schmidt, Peizheng Li, Silvan Lindner, Wilhelm Stork, Georg Martius, Julian Jordan

机构 * Mercedes-Benz AG, Research & Development(梅赛德斯-奔驰股份公司,研发部) University of Tübingen(图宾根大学) Karlsruhe Institute of Technology, ITIV(卡尔斯鲁厄理工学院,ITIV)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 研究自动驾驶运动规划器在新城市拓扑泛化及执行扰动恢复方面的不足,提出Shift & Drift双轨基准测试,通过语义转移和状态分布漂移测试不同规划范式,发现模仿学习与强化学习在性能上的差异,为评估可靠部署提供基准。

Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08233 2026-07-10 cs.AI cs.CV 新提交 79%

Playing ZendoWorld: Challenging AI Agents on Active Visual Concept Induction

玩禅道世界:在主动视觉概念归纳中挑战人工智能代理

Sophia Koehler, Antonia Wüst, Inga Ibs, Wasu Top Piriyakulkij, Wolfgang Stammer, Constantin Rothkopf, Kevin Ellis, Kristian Kersting

机构 * AIML Lab, TU Darmstadt(人工智能机器学习实验室,达姆施塔特工业大学) Hessian Center for AI (hessian.AI)(黑森州人工智能中心) Psychology of Information Processing, TU Darmstadt(信息处理心理学,达姆施塔特工业大学) Centre for Cognitive Science, TU Darmstadt(认知科学中心,达姆施塔特工业大学) Cornell University(康奈尔大学) Max Planck Institute for Informatics, SIC(马克斯·普朗克信息学研究所,SIC组) German Center for AI (DFKI)(德国人工智能研究中心)

专题命中 规划决策 :AI agent(title);agent(abstract);分类 cs.AI

AI总结 研究构建智能系统时代理感知、假设形成及实验设计问题,提出禅道世界环境,评估多种代理方法,发现预测标签精度与恢复潜在规则无关,感知和归纳是不同瓶颈,基于视觉语言模型的代理实验无信息,还收集人类数据揭示差距及改进途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05544 2026-07-10 cs.RO 新提交 78%

Dynamic Evaluation of Classical and Control-Aware Optimal Trajectory Planning in Robot Manipulators

机器人操作器中经典和控制感知最优轨迹规划的动态评估

Bhanuka Dayawansa, Rohan Munasinghe

专题命中 规划决策 :planning(title,abstract)

AI总结 研究机器人操作器轨迹规划,提出控制感知最优轨迹规划框架,纳入动力学和执行器努力,用中点线性化策略,通过统一评估框架对比经典方法,能降低跟踪误差等,证明仅运动学平滑不能确保高效执行。

Comments Accepted at MERCon 2026. To be presented at MERCon 2026. 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08093 2026-07-10 cs.AI cs.CL cs.LG 新提交 75%

CausalDS: Benchmarking Causal Reasoning in Data-Science Agents

因果DS:数据科学智能体中的因果推理基准测试

Andrej Leban, Yuekai Sun

机构 * Department of Statistics University of Michigan(统计学系密歇根大学)

专题命中 规划决策 :tool use(abstract);agentic(abstract);分类 cs.AI、cs.CL、cs.LG

AI总结 介绍用于评估数据科学智能体因果推理的CausalDS基准,由含观测数据的结构因果模型和合成自然语言故事构成场景,导出跨越Pearl三个层级的任务,联合评估符号因果推理、数据科学等多方面能力。

Comments 55 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08647 2026-07-10 cs.LG cs.AI 新提交 73%

Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning

用于稳健奖励学习的多模态、多环境机器教学

Ali Larian, Qian Lin, Chang Zong Wu, Daniel S. Brown

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI、cs.LG

AI总结 研究自主智能体在多环境下奖励学习问题,提出分层机器教学算法,先选信息丰富环境,再查询低成本反馈,实验表明该方法比统一教学基线有更低遗憾值和更强泛化能力,凸显多环境多模态教学对稳健奖励学习的重要性。

Comments Accepted to RLC 2026. Conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08066 2026-07-10 cs.AI cs.LG 新提交 73%

Persuasion Attacks Can Decrease Effectiveness of CoT Monitoring

说服攻击会降低思维链监测的有效性

Jennifer Za, Julija Bainiaksina, Nikita Ostrovsky, Tanush Chopra, Victoria Krakovna

机构 * LASR Labs(LASR实验室) University College London(伦敦大学学院) Google DeepMind(谷歌DeepMind)

专题命中 规划决策 :agent(abstract);AI agent(abstract);分类 cs.AI、cs.LG

AI总结 研究 CoT 监测在对抗性说服攻击下的有效性,设计评估框架发现其单独使用不足以抵御攻击,引入事实核查监测框架,不同模型家族配对可有效减少违反政策行动批准,为 CoT 监测抗攻击提供有力缓解措施。

Comments 25 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08331 2026-07-10 cs.LG cs.AI 新提交 62%

ArtMine: Discovering and Formalizing Artistic Processes

ArtMine:发现并形式化艺术创作过程

Kaustubh Kumar, Ashutosh Ranjan, Vivek Srivastava, Blessin Varkey, Shirish Karande

机构 * TCS Research(TCS研究)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 研究如何从异构历史证据发现并形式化艺术创作过程,核心方法是将证据合成存储库,由溯因智能体推断生产步骤并优化,主要贡献是迈向以过程为中心的人机协同创作系统,支持多方面研究。

Comments 47 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26366 2026-07-10 cs.AI cs.CL cs.CY 新提交 62%

Narration-of-Thought: Inference-Time Scaffolding for Defeasible Ethical Reasoning in Large Language Models

思维叙述:大型语言模型中可废止伦理推理的推理时支架

Patrick Cooper, Alvaro Velasquez

机构 * Department of Computer Science(计算机科学系) University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.CL

AI总结 针对道德困境中标准思维链的两种失败模式,提出思维叙述(NoT)系统提示,将思维链结构化为五个部分,无需训练即可大幅减少利益相关者崩溃和不确定性抑制,并通过消融实验和跨家族训练法官验证其有效性。

Comments 24 pages, 8 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08703 2026-07-10 cs.LG 新提交 57%

MPFlow: Learning Budgeted Max-Flow Optimization on the Lightning Network with Deep Graph Reinforcement Learning

MPFlow:基于深度图强化学习的比特币闪电网络预算最大流优化学习

Harrison Rush, Vincent Davis, Simone Antonelli, Vikash Singh, Jesse Shrader, Emanuele Rossi

机构 * Amboss Technologies(Amboss技术公司) CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全中心) Stillmark(Stillmark公司) Sapienza University of Rome(罗马萨皮恩扎大学)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究比特币闪电网络中给定预算下节点如何打开通道最大化路由容量的问题,采用图强化学习方法,结合消息传递策略网络、PPO和动作掩码,在真实网络快照实验中表现优于启发式基线,还用于生产中的对等推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08602 2026-07-10 cs.AI 新提交 57%

Towards Precision Therapy in Hepatocellular Carcinoma: A Clinical-Reasoning LLM for Risk Stratification and Treatment Guidance

迈向肝细胞癌的精准治疗:用于风险分层和治疗指导的临床推理大语言模型

Peng Cui, Jitao Wang, Siyan Xue, Yao Huang, Haoming Xia, Dong Li, Dengxiang Liu, Weilin Wang, Liping Liu, Leida Zhang, Yunfu Cui, Tao Peng, Daolin Ji, Haitao Zhao, Wei Zhang, Xiaojuan Wang, Weijie Ma, Zongren Ding, Jinlong Li, Yuan Ding, Jiajing Zhao, Zhiyu Chen, Chengkun Yang, Ziyue Huang, Jiaqi Liu, Fusheng Liu, Yang Zhou, Xiaojuan Wang, Zhongquan Sun, Shiyun Bao, Xiaojun Wang, Ming Yang, Guangxin Li, Bin Shu, Yong Liao, Hongxuan Li, Yao Tang, Shizhong Yang, Yongyi Zeng, Yufeng Yuan, Yinpeng Dong, Jihui Hao, Jun Zhu, Jiahong Dong

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 研究针对肝细胞癌治疗问题,提出HCC-STAR临床推理大语言模型。通过处理电子病历叙述输出风险分层、治疗方案等。经多中心队列验证,性能领先,能助医生决策,是可靠的肝细胞癌风险分层和精准治疗决策支持系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08554 2026-07-10 cs.AI 新提交 57%

CommuniWave:A Machine Learning Model for Quantifying the Degree of Temporary Informal Behavior in Urban Communities

CommuniWave:一种用于量化城市社区临时非正式行为程度的机器学习模型

Hongye Yang, Shien Liu, Zhihao Xie

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究针对城市社区规划缺乏量化居民非正式行为指标的问题,引入CommuniWave模型,它整合BCN、YLX和BEM,通过生成DIB波动图实现动态监测,助力城市管理者提升社区整体韧性。

Comments 17 pages, 4 figures. Presented at ASCAAD 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08449 2026-07-10 cs.CV cs.LG 新提交 57%

Predicting Viticulture Potential through an Ensemble of U-Net and a Geospatial Foundation Model

通过U-Net和地理空间基础模型的集成预测葡萄种植潜力

Jorge Ignacio Perez, Hwaai Kang Kee, Lucas Rassbach

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对ImageCLEF AI4Agri 2026法国南部葡萄种植潜力预测子任务,DS@GT ARC团队采用U-Net和地理空间基础模型集成方法,其最佳模型准确率达68.32,在7个团队中排第二,且实现已公开。

Comments To be published in CLEF 2026 Working Notes

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08443 2026-07-10 cs.NI cs.AI 新提交 57%

ADORN: Adaptive Drift handling for Open RAN using Reinforcement Learning

ADORN:使用强化学习的开放式RAN自适应漂移处理

Ashit Kumar Subudhi, Bhargav Chirumamilla, Shubham Vaishnav, Mduduzi C. Hlophe, Praveen Kumar Donta, Andrea Fumagalli, Venkateswarlu Gudepu, Koteswararao Kondepu

机构 * Indian Institute of Technology Dharwad, Karnataka, India(印度理工学院达拉德分校) University of Pretoria, Pretoria, South Africa(南非彼得里亚大学) Johns Hopkins University, USA(约翰霍普金斯大学) Stockholm University, Sweden(斯德哥尔摩大学) Open Networking Advanced Research (OpNeAR) Lab, The University of Texas at Dallas, TX, USA(开放网络高级研究实验室,德克萨斯大学达拉斯分校)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 针对开放式无线接入网络中因动态流量变化导致的模型性能下降问题,提出基于Q学习的自适应重新训练方法,通过将决策制定为马尔可夫决策过程,结合多专家长短期记忆集成,有效降低重新训练开销并维持系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08436 2026-07-10 cs.RO cs.AI 新提交 57%

EgoWAM: World Action Models Beyond Pixels with In-the-Wild Egocentric Human Data

EgoWAM:利用野外自我中心人类数据超越像素的世界行动模型

Baoyu Li, Xinchen Yin, Mengying Lin, Yixin Zhang, Danfei Xu

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究利用野外自我中心人类数据训练机器人操纵模型,引入EgoWAM框架,固定部分设置仅改变世界预测目标,比较不同方法。结果表明WAM协同训练更有效,DINO和3D流提升显著,为机器人操纵提供新训练思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08357 2026-07-10 cs.AI 新提交 57%

MobiDiff: Semantic-Aware Multi-Channel Discrete Diffusion for Human Mobility Data Generation

MobiDiff:用于人类移动性数据生成的语义感知多通道离散扩散

Rongchao Xu, Lin Jiang, Dahai Yu, Ximiao Li, Taichi Liu, Desheng Zhang, Yuan Tian, Guang Wang

机构 * Florida State University(佛罗里达州立大学) Rutgers University(罗格斯大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究旨在解决人类移动性数据生成难题,提出MobiDiff框架,通过直接对多通道语义骨架去噪生成数据,避免复杂管道。该框架能分解事件通道并采用掩码捕获移动模式与依赖性,实验证明其在保真度、隐私保护和效率上表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07763 2026-07-10 cs.LG 新提交 57%

Unlocking Temporal Generalization in Hamiltonian Video Dynamics Models

解锁哈密顿视频动力学模型中的时间泛化

Eli Laird, Corey Clark

机构 * Department of Computer Science, Southern Methodist University(南卫理公会大学计算机科学系)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究世界模型在可变时间分辨率下预测动力学的问题,利用哈密顿生成网络(HGN),指出其在非保守环境中时间泛化失效的问题及原因,通过针对性修复实现稳定动力学预测,推荐连续时间视频生成中时间泛化的策略。

Comments To appear in the 1st Workshop on Physics-Aware Video Generation and Restoration at the 28th International Conference on Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07761 2026-07-10 cs.AI 新提交 57%

Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning

对齐临床需求与人工智能能力:医学推理大语言模型综述

Qi Peng, Jiatong Li, Sirui Huang, Yiyang Jiang, Kaisong Gong, Ronger Ding, Shijie Ye, Changmeng Zheng, Yi Cai, Xiaobo Yang, Jin Huang, Xiao-Yong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) Hong Kong University(香港大学) South China University of Technology(华南理工大学) University of Toronto(多伦多大学) Peking Union Medical College Hospital(北京地坛医院) West China Hospital, Sichuan University(四川大学华西医院)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 综述医学大语言模型在医疗领域的进展,提出双视角方法,连接临床实践与计算方法,建立五级能力方案并关联推理模式与医学任务,引入基准数据集并报告模型结果,讨论进展与挑战及未来方向。

Comments Accepted by Machine Intelligence Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08759 2026-07-10 econ.GN q-fin.EC 新提交 50%

Measuring Consumption with Credit Card Data: Benchmarking and Beyond

用信用卡数据衡量消费:基准测试及其他

Aditya Aladangady, Ricardo Duque Gabriel, Carlo Wix

专题命中 规划决策 :agent(abstract)

AI总结 该研究利用美联储Y - 14M报告中的信用卡数据构建县级月度消费数据集,证明其与传统消费指标近似。通过县 - 月面板估计货币政策冲击的异质消费反应,发现低收入县支出下降幅度大,还为相关研究者提供了实用指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08503 2026-07-10 cs.CV 新提交 50%

CT-CLIP Representations for Multimodal Lung Cancer Survival Prediction

用于多模态肺癌生存预测的CT-CLIP表示

Sofie Allgöwer, Mikael Johansson, Andreas Hallqvist, Jonas Andersson, Åse Johnsson, Ida Häggström, Jennifer Alvén

机构 * Chalmers University of Technology(查尔姆斯理工大学) Umeå University(于默奥大学) Sahlgrenska University Hospital(萨尔格伦斯卡大学医院) Sahlgrenska Academy at Gothenburg University(哥德堡大学萨尔格伦斯卡学院)

专题命中 规划决策 :planning(abstract)

AI总结 研究评估特定领域基础模型CT-CLIP用于肺癌多模态生存预测,通过多种策略提取特征,结果显示冻结的CT-CLIP模型结合可训练生存头表现出色,能有效区分高低风险组。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏