arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-05 至 2026-03-05 共收录 93 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 10 篇

2603.03475 2026-03-05 cs.LG cs.AI cs.CL 86%

When Shallow Wins: Silent Failures and the Depth-Accuracy Paradox in Latent Reasoning

浅层胜出:潜在推理中的沉默失败与深度-准确性悖论

Subramanyam Sahoo, Aman Chadha, Vinija Jain, Divya Chaudhary

机构 * Independent(独立研究者) AWS Generative AI Innovation Center, Amazon Web Services(亚马逊生成AI创新中心,亚马逊网络服务) Meta AI Stanford University(斯坦福大学) Northeastern University, Seattle, WA, USA(东北ern大学,西雅图,华盛顿州,美国)

专题命中 数学推理 :reasoning(title,abstract);CoT(abstract,comments);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示数学推理模型在深度增加时准确率无提升,且存在大量不可靠推理路径,需改革评估方法以衡量稳定性。

Comments Accepted at ICLR 2026 Workshop on Latent & Implicit Thinking - Going Beyond CoT Reasoning. 19 Pages and 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03975 2026-03-05 cs.AI cs.CV 83%

Phi-4-reasoning-vision-15B Technical Report

Phi-4-reasoning-vision-15B 技术报告

Jyoti Aneja, Michael Harrison, Neel Joshi, Tyler LaBonte, John Langford, Eduardo Salinas

机构 * Microsoft Research(微软研究院)

专题命中 数学推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 Phi-4-reasoning-vision-15B 是一个紧凑型开放式权重多模态推理模型,通过系统数据处理和架构优化,在减少计算资源的同时实现高效推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03752 2026-03-05 cs.CL cs.AI 81%

Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning

置信度校准的小-大语言模型协作用于成本有效的推理

Chuang Zhang, Zizhen Zhu, Yihao Wei, Bing Tian, Junyi Liu, Henan Wang, Xavier Wang, Yaxiao Liu

机构 * Amazon Web Services(亚马逊网络服务) Tsinghua University(清华大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 COREA通过结合小型和大型语言模型,利用置信度校准提升推理效率,降低21.5%-16.8%成本,同时保持高准确率。

Comments Accepted to EACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10625 2026-03-05 cs.AI cs.CL 81%

To Think or Not To Think, That is The Question for Large Reasoning Models in Theory of Mind Tasks

思考还是不思考,这是大型推理模型在心智理论任务中的问题

Nanxu Gong, Haotian Li, Sixun Dong, Jianxun Lian, Yanjie Fu, Xing Xie

机构 * Arizona State University, Tempe, Arizona, United States(亚利桑那州立大学) Microsoft Research Asia, Beijing, China(微软亚洲研究院)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究了大型推理模型在心智理论任务中的表现,发现其并不总优于非推理模型,且依赖选项匹配而非真实推理,提出干预方法以缓解问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02504 2026-03-05 cs.AI 79%

NeuroProlog: Multi-Task Fine-Tuning for Neurosymbolic Mathematical Reasoning via the Cocktail Effect

NeuroProlog:通过鸡尾酒效应实现神经符号数学推理的多任务微调

Pratibha Zunjare, Michael Hsiao

机构 * Virginia Tech(弗吉尼亚理工大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.AI

AI总结 NeuroProlog通过鸡尾酒效应实现神经符号数学推理的多任务微调,提升数学推理准确率并改进程序修复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21668 2026-03-05 cs.AI cs.CL cs.SC 73%

R1-Code-Interpreter: LLMs Reason with Code via Supervised and Multi-stage Reinforcement Learning

R1-Code-Interpreter: LLMs通过监督学习和多阶段强化学习进行代码推理

Yongchao Chen, Yueying Liu, Junwei Zhou, Yilun Hao, Jingquan Wang, Yang Zhang, Na Li, Chuchu Fan

机构 * MIT / Harvard(麻省理工学院/哈佛大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Michigan(密歇根大学) MIT(麻省理工学院) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室) Harvard(哈佛大学)

专题命中 数学推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 R1-Code-Interpreter通过监督学习和多阶段强化学习提升LLM的代码推理能力,实现对多样化任务的高效处理,显著提升模型性能。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04135 2026-03-05 cs.LG cs.AI 62%

Unbiased Dynamic Pruning for Efficient Group-Based Policy Optimization

无偏动态剪枝用于高效基于群体的策略优化

Haodong Zhu, Yangyang Ren, Yanjing Li, Mingbao Lin, Linlin Yang, Xuhui Liu, Xiantong Zhen, Haiguang Liu, Baochang Zhang

机构 * Beihang University(北航大学) Zhongguancun Academy(中关村学院) Communication University of China(中国通信大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 DPPO通过动态剪枝和重要性采样修正,实现高效基于群体的策略优化,提升训练速度并提高准确率。

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03112 2026-03-05 cs.CL cs.AI cs.CY 62%

RLVER: Reinforcement Learning with Verifiable Emotion Rewards for Empathetic Agents

RLVER: 通过可验证情绪奖励的强化学习实现共情代理

Peisong Wang, Ruotian Ma, Bang Zhang, Xingyu Chen, Zhiwei He, Kang Luo, Qingsong Lv, Qingxuan Jiang, Zheng Xie, Shanyi Wang, Yuan Li, Fanghua Ye, Jian Li, Yifan Yang, Zhaopeng Tu, Xiaolong Li

机构 * Tencent(腾讯)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 RLVER通过可验证情绪奖励提升LLM的共情能力,实验显示其在对话任务中显著提升表现,尤其在情感理解和洞察力方面成效显著。

Comments Code: https://github.com/Tencent/DigitalHuman/tree/main/RLVER

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09669 2026-03-05 cs.CL 57%

Query-Level Uncertainty in Large Language Models

查询级不确定性在大语言模型中

Lihu Chen, Gerard de Melo, Fabian M. Suchanek, Gaël Varoquaux

机构 * Imperial College London(伦敦帝国学院) Hasso Plattner Institute / University of Potsdam(霍普夫纳研究所/波茨坦大学) Telecom Paris, Institut Polytechnique de Paris(电信巴黎学院,巴黎理工学院) Soda, Inria Saclay(Soda,法国国家信息与自动化技术研究院萨克利实验室)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究提出了一种无需训练的内部置信度方法,用于检测大语言模型的知识边界,通过查询级不确定性提高回答质量并降低计算成本。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04975 2026-03-05 cs.CE 50%

Sentiment-Aware Stock Price Prediction with Transformer and LLM-Generated Formulaic Alpha

具有Transformer和LLM生成公式性阿尔法的情感感知股价预测

Qizhao Chen, Hiroaki Kawashima

专题命中 数学推理 :reasoning(abstract)

AI总结 本文提出一种结合Transformer和LLM的股价预测框架,利用LLM生成情感感知的公式性阿尔法以提升预测准确性并增强可解释性。

Comments This paper has been accepted by the journal Digital Finance

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码与定理证明 2 篇

2603.01896 2026-03-05 cs.SE cs.AI cs.PL 83%

Agentic Code Reasoning

代理代码推理

Shubham Ugare, Satish Chandra

机构 * Meta, USA(Meta公司)

专题命中 代码与定理证明 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出半形式推理方法,通过结构化提示提升代理在代码补丁验证、故障定位和问答任务中的准确性,实现无需执行的代码语义分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21648 2026-03-05 cs.AI 57%

Leveraging Imperfection with MEDLEY A Multi-Model Approach Harnessing Bias in Medical AI

利用不完美性:MEDLEY:一种多模型方法,利用医学AI中的偏差

Farhad Abtahi, Mehdi Astaraki, Fernando Seoane

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 MEDLEY提出了一种多模型框架,通过保留模型多样性而非压缩共识,利用医学AI中的偏差提升诊断准确性与透明度。

Journal ref Front. Artif. Intell., Volume 9 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 逻辑推理 4 篇

2508.11538 2026-03-05 cs.CV 85%

Reinforcing Video Reasoning Segmentation to Think Before It Segments

强化视频推理分割以在分割前思考

Sitong Gong, Lu Zhang, Yunzhi Zhuge, Xu Jia, Pingping Zhang, Huchuan Lu

专题命中 逻辑推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 Veason-R1通过组相对策略优化和链式思维初始化,提升视频推理分割的结构化推理能力,实现更准确的时空定位和鲁棒性。

Comments 12 pages

Journal ref CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04124 2026-03-05 cs.AI cond-mat.mtrl-sci cs.CL cs.LG 82%

BeamPERL: Parameter-Efficient RL with Verifiable Rewards Specializes Compact LLMs for Structured Beam Mechanics Reasoning

BeamPERL: 参数高效强化学习与可验证奖励用于结构梁力学推理

Tarjei Paule Hage, Markus J. Buehler

机构 * Department of Mechanical Engineering(机械工程系) Massachusetts Institute of Technology(麻省理工学院) Department of Civil and Environmental Engineering(土木与环境工程系) Schwarzman College of Computing(施瓦茨曼计算学院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 BeamPERL通过参数高效强化学习与可验证奖励,提升紧凑语言模型在结构梁力学推理中的能力,发现精确奖励无法保证可转移的物理推理,需结合结构化推理支架以实现稳健科学推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07885 2026-03-05 cs.RO cs.AI 77%

Safety Guardrails for LLM-Enabled Robots

LLM赋能机器人中的安全护栏

Zachary Ravichandran, Alexander Robey, Vijay Kumar, George J. Pappas, Hamed Hassani

机构 * University of Pennsylvania(宾夕法尼亚大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 RoboGuard通过两阶段护栏架构,利用根信任LLM和链式推理生成上下文安全规范,有效降低LLM赋能机器人在对抗攻击下的不安全计划执行率,提升系统安全性与可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21281 2026-03-05 cs.AI 57%

RLJP: Legal Judgment Prediction via First-Order Logic Rule-enhanced with Large Language Models

通过一阶逻辑规则增强的大语言模型进行法律判决预测

Yue Zhang, Zhiliang Tian, Shicheng Zhou, Haiyang Wang, Wenqing Hou, Yuying Liu, Xuechen Zhao, Minlie Huang, Ye Wang, Bin Zhou

机构 * College of Computer Science and Technology, National University of Defense and Technology(国防科技大学计算机科学与技术学院) College of Electronic Engineering, National University of Defense Technology(国防科技大学电子工程学院) School of Data and Computer Science, Shandong Women’s University(山东女子大学数据与计算机科学学院) Institute for Artificial Intelligence, Tsinghua University(清华大学人工智能研究院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于一阶逻辑和对比学习的规则增强方法,通过三阶段流程提升法律判决预测的适应性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 规划推理 18 篇

2603.04158 2026-03-05 cs.RO cs.AI 83%

GarmentPile++: Affordance-Driven Cluttered Garments Retrieval with Vision-Language Reasoning

GarmentPile++: 基于视觉-语言推理的基于 affordance 的杂乱衣物检索

Mingleyang Li, Yuran Wang, Yue Chen, Tianxing Chen, Jiaqi Liang, Zishun Shen, Haoran Lu, Ruihai Wu, Hao Dong

专题命中 规划推理 :reasoning(title,abstract);planning(abstract);分类 cs.AI

AI总结 GarmentPile++通过结合视觉-语言推理和视觉affordance感知,实现基于语言指令的杂乱衣物安全检索,确保每次检索一件衣物,提升家庭助理机器人任务执行能力。

Comments ICRA2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19524 2026-03-05 cs.CV cs.MA 82%

VideoChat-M1: Collaborative Policy Planning for Video Understanding via Multi-Agent Reinforcement Learning

VideoChat-M1: 通过多智能体强化学习实现视频理解的协作策略规划

Boyu Chen, Zikang Wang, Zhengrong Yue, Kainan Yan, Chenyun Yu, Yi Huang, Zijun Liu, Yafei Wen, Xiaoxin Chen, Yang Liu, Peng Li, Yali Wang

机构 * Shenzhen Key Lab of Computer Vision and Pattern Recognition(深圳计算机视觉与模式识别重点实验室) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) VIVO AI Lab(VIVO人工智能实验室) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shenzhen Campus of Sun Yat-sen University(孙逸仙大学深圳校区) Shanghai Jiao Tong University(上海交通大学) Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院) Dept. of Comp. Sci. & Tech., Institute for AI, Tsinghua University(清华大学计算机科学与技术系,人工智能研究院)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 VideoChat-M1通过多智能体强化学习实现视频理解的协作策略规划,显著提升复杂视频任务的性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04289 2026-03-05 cs.LG cs.AI 81%

IPD: Boosting Sequential Policy with Imaginary Planning Distillation in Offline Reinforcement Learning

IPD: 通过离线规划蒸馏提升序列策略

Yihao Qin, Yuanfei Wang, Hang Zhou, Peiran Liu, Hao Dong, Yiding Ji

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Peking University(北京大学)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 IPD通过引入离线规划蒸馏技术,提升离线强化学习中序列策略的决策稳定性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03406 2026-03-05 cs.SE 79%

Review Beats Planning: Dual-Model Interaction Patterns for Code Synthesis

Review Beats Planning: 双模型交互模式用于代码合成

Jan Miller

专题命中 规划推理 :planning(title,comments);reasoning(abstract)

AI总结 通过双模型交互模式提升代码生成性能,审查优于规划,增强规范质量可进一步提高效果。

Comments 10 pages, 5 figures, 4 tables. Code and results: https://github.com/miller-itsec/review-beats-planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04265 2026-03-05 cs.CV 78%

ViterbiPlanNet: Injecting Procedural Knowledge via Differentiable Viterbi for Planning in Instructional Videos

ViterbiPlanNet: 通过可微Viterbi注入过程性知识以在教学视频中进行规划

Luigi Seminara, Davide Moltisanti, Antonino Furnari

机构 * University of Catania(卡塔尼亚大学) University of Bath(巴斯大学)

专题命中 规划推理 :planning(title,abstract)

AI总结 ViterbiPlanNet通过可微Viterbi层整合过程性知识,实现高效的教学视频规划,提升样本效率和鲁棒性。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03290 2026-03-05 cs.CL cs.AI cs.IR cs.LG 75%

AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents

AriadneMem: 为LLM代理梳理终身记忆的迷宫

Wenhui Zhu, Xiwen Chen, Zhipeng Wang, Jingjing Wang, Xuanzhao Dong, Minzhou Huang, Rui Cai, Hejian Sang, Hao Wang, Peijie Qiu, Yueyue Deng, Prayag Tiwari, Brendan Hogan Rappazzo, Yalin Wang

机构 * Arizona State University(亚利桑那州立大学) Morgan Stanley(摩根大通) Rice University(里奇大学) Clemson University(克莱姆森大学) Northwestern University(西北大学) UC Davis(加州大学戴维斯分校) Iowa State University(爱荷华州立大学) Washington University in St. Louis(圣路易斯华盛顿大学) Columbia University(哥伦比亚大学) Halmstad University(哈马格大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AriadneMem通过解耦的两阶段流程提升LLM代理在长期对话中的多跳和平均F1表现,同时减少运行时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26905 2026-03-05 cs.AI 70%

Cognition Envelopes for Bounded Decision Making in Autonomous UAS Operations

认知边界用于自主无人机操作中的有限决策

Pedro Antonio Alarcon Granadeno, Arturo Miguel Bernal Russell, Sofia Nelson, Demetrius Hernandez, Maureen Petterson, Michael Murphy, Walter J. Scheirer, Jane Cleland-Huang

机构 * University of Notre Dame(诺特大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出认知边界概念,用于约束自主无人机在搜索救援任务中的决策,结合概率推理和资源分析,以减少 AI 生成决策中的错误。

Comments 12 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00225 2026-03-05 cs.SE 67%

Large-scale, Independent and Comprehensive study of the power of LLMs for test case generation

大规模、独立和全面的LLM生成测试用例能力研究

Wendkûuni C. Ouédraogo, Kader Kaboré, Yinghua Li, Haoye Tian, Anil Koyuncu, Jacques Klein, David Lo, Tegawendé F. Bissyandé

专题命中 规划推理 :reasoning(abstract);CoT(abstract)

AI总结 本研究评估了LLM生成单元测试的可靠性与可维护性,发现基于推理的提示技术提升性能,但幻觉驱动的故障仍需混合方法解决。

Comments Accepted at Empirical Software Engineering (EMSE) journal on 3 March 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04257 2026-03-05 cs.CL cs.LG 62%

Memex(RL): Scaling Long-Horizon LLM Agents via Indexed Experience Memory

Memex(RL): 通过索引经验记忆扩展长周期LLM代理

Zhenting Wang, Huancheng Chen, Jiayun Wang, Wei Wei

机构 * Center for Advanced AI, Accenture(先进人工智能中心,埃森哲)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 Memex(RL)通过索引经验记忆机制,实现长周期LLM代理的高效记忆管理,减少信息损失并提升任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03677 2026-03-05 cs.CL cs.AI 62%

MIND: Unified Inquiry and Diagnosis RL with Criteria Grounded Clinical Supports for Psychiatric Consultation

MIND: 一种基于临床标准的统一探究与诊断强化学习框架用于精神病咨询

Guoyi Li, Shihao Xu, Jiatong Ma, Yunyun Han, Jianhua Chen, Yafeng Deng

机构 * EverMind AI Inc.(EverMind AI公司) EverMind AI Inc., Tianqiao and Chrissy Chen Institute(EverMind AI公司、田桥与克里斯西·陈研究所) Shanghai Mental Health Center, Shanghai Jiao Tong University School of Medicine(上海精神卫生中心、上海交通大学医学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 MIND通过基于临床标准的推理框架提升精神病咨询的诊断准确性和互动质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03296 2026-03-05 cs.CL cs.AI cs.IR 62%

PlugMem: A Task-Agnostic Plugin Memory Module for LLM Agents

PlugMem: 一种通用插件记忆模块用于LLM代理

Ke Yang, Zixi Chen, Xuan He, Jize Jiang, Michel Galley, Chenglong Wang, Jianfeng Gao, Jiawei Han, ChengXiang Zhai

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Tsinghua University(清华大学) Microsoft Research(微软研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 PlugMem是一种通用记忆模块,通过知识中心的记忆图结构提升LLM代理在复杂任务中的记忆检索与推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03655 2026-03-05 cs.AI 57%

Mozi: Governed Autonomy for Drug Discovery LLM Agents

Mozi:用于药物发现LLM代理的受控自主性

He Cao, Siyu Liu, Fan Zhang, Zijing Liu, Hao Li, Bin Feng, Shengyuan Bai, Leqing Chen, Kai Xie, Yu Li

机构 * International Digital Economy Academy (IDEA)(国际数字经济学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 Mozi通过双层架构实现药物发现LLM代理的受控自主性,提升科学推理的可靠性与可控性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22235 2026-03-05 cs.AI 57%

Training High-Level Schedulers with Execution-Feedback Reinforcement Learning for Long-Horizon GUI Automation

通过执行反馈强化学习训练高阶调度器以实现长周期GUI自动化

Zehao Deng, Tianjie Ju, Zheng Wu, Zhuosheng Zhang, Gongshen Liu

机构 * School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出CES多代理框架,通过训练高阶调度器解决GUI代理在长周期任务中的责任耦合和状态管理问题,提升任务规划与执行效率。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06427 2026-03-05 cs.CL cs.CY 57%

Dutch Metaphor Extraction from Cancer Patients' Interviews and Forum Data using LLMs and Human in the Loop

利用LLM和人机协同从癌症患者访谈和论坛数据中提取荷兰语隐喻

Lifeng Han, David Lindevelt, Sander Puts, Erik van Mulligen, Suzan Verberne

机构 * Biomedical Data Sciences, Leiden University Medical Center(莱顿大学医学中心生物医学数据科学) Leiden Institute of Advanced Computer Science (LIACS), Leiden University(莱顿大学先进计算机科学研究所) Department of Radiation Oncology (MAASTRO), GROW Research Institute for Oncology(肿瘤学研究与生殖学研究所放射肿瘤科)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究利用LLM和人机协同方法,从癌症患者访谈和论坛数据中提取荷兰语隐喻,构建HealthQuote.NL语料库,以支持患者护理和个性化医疗路径设计

Comments Ongoing project report, on behalf of 4D PICTURE https://4dpicture.eu/

详情

展开后加载摘要…

URL PDF HTML 收藏