arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-06-26 至 2026-06-26 共收录 73 信号源:cs.CL, cs.AI, cs.LG

1. 数学推理 7 篇

2606.25524 2026-06-26 cs.AI cs.CL 新提交 81%

Cliff Tokens: Identifying Single-Token Failure Triggers in LLM Mathematical Reasoning

Cliff Tokens: 识别大语言模型数学推理中的单Token失败触发点

Jaeyong Ko, Pilsung Kang, Yukyung Lee

机构 * Seoul National University(首尔大学) Boston University(波士顿大学)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.AI

AI总结 提出“悬崖token”概念,通过自适应阈值和单侧双比例z检验识别导致推理失败的单个token,删除并重采样可恢复pass@64至1.0,并基于贪心选择和token熵建立分类法,通过Cliff-DPO优化提升准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27103 2026-06-26 cs.CL 新提交 79%

The Riddle Riddle: Testing Flexible Reasoning in Large Language Models and Humans

谜语谜题:测试大型语言模型和人类的灵活推理

Bella Fascendini, Kathryn McGregor, Max D. Gupta, Thomas L. Griffiths

机构 * Department of Psychology, Princeton University(普林斯顿大学心理学系) Department of Computer Science, Princeton University(普林斯顿大学计算机科学系)

专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL

AI总结 通过谜语谜题范式,发现LLM在真实谜语上准确率高(84.9%),但在谜语谜题上表现差(50.7%),而人类相反;错误分析表明LLM更倾向于过度使用创造性推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26797 2026-06-26 cs.LG 新提交 79%

Reasoning Quality Emerges Early: Data Curation for Reasoning Models

推理质量早期涌现:推理模型的数据策展

Hongyi Henry Jin, Wenhan Yang, Meysam Ghaffari, Carlos Morato, Baharan Mirzasoleiman

专题命中 数学推理 :reasoning(title,abstract);分类 cs.LG

AI总结 提出仅利用初始推理token即可识别多样且具挑战性的推理样本,通过扰动检查点评估前100个token的损失检测难题,并证明前1k token的损失模式可预测梯度相似性,在Qwen2.5-7B和Llama3.1-8B上验证,性能提升达1.7%,token效率提升91%。

Comments Accepted by ICML 2026 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26744 2026-06-26 cs.LG cs.CL 新提交 73%

HyperDFlash: Hyper-Connection-Aligned Block Speculative Decoding with Gated Residual Reduction

HyperDFlash: 面向MHC架构的块级推测解码与门控残差缩减

Luxi Lin, Shuang Peng, Rui Ma, Junhao Hua, Shuwei Fan, Zhengda Qin, Qiang Wang, Hongjian Sun, Fangmin Chen, Songwei Liu

机构 * ByteDance(字节跳动)

专题命中 数学推理 :reasoning(abstract);math reasoning(abstract);分类 cs.CL、cs.LG

AI总结 针对DeepSeek-V4的多超连接架构,提出HyperDFlash框架,通过对齐残差流和轻量门控缩减器,解决推测解码中特征错位和误差累积问题,显著提升解码速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26917 2026-06-26 cs.LG cs.AI 新提交 62%

GEOALIGN: Geometric Rollout Curation for Robust LLM Reinforcement Learning

GEOALIGN: 用于鲁棒大语言模型强化学习的几何轨迹策展

Ting Zhou, Zhenqing Ling, Yiyang Zhao, Ying Shen, Daoyuan Chen

专题命中 数学推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 针对在线强化学习训练LLM时奖励噪声导致的不稳定性,提出GEOALIGN,通过检测并修正方向不一致的轨迹来稳定更新,提升最终性能并减少训练震荡。

Comments Accepted as a conference paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26472 2026-06-26 cs.LG cs.CL 新提交 62%

Epiphany-Aware KV Cache Eviction Without the Attention Matrix

无需注意力矩阵的顿悟感知KV缓存淘汰

Steven Kolawole, Virginia Smith

机构 * Language Technologies Institute Carnegie Mellon University(语言技术研究所卡内基梅隆大学) Machine Learning Department Carnegie Mellon University(机器学习系卡内基梅隆大学)

专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 提出EpiKV方法,通过模型内部表示变化(顿悟分数)而非注意力权重来淘汰KV缓存,无需训练或自定义内核,支持FlashAttention,在MATH-500上达到72%准确率,速度提升2.8倍。

Comments Preprint; in review

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26671 2026-06-26 cs.AI 新提交 57%

NebulaExp-8B: An Empirical Post-Training Pipeline via Full-Scale Ablation Research

NebulaExp-8B:基于全尺度消融研究的经验性后训练流程

Qiaobo Hao, Yangqian Wu, Shunyi Wang, Zhongjian Zhang, Ziqun Li, Yayin He, Muqing Li, Chen Zhong

机构 * ZTE NebulaL0 Post-Training Team(中兴通讯NebulaL0后训练团队)

专题命中 数学推理 :reasoning(abstract);分类 cs.AI

AI总结 提出NebulaExp透明后训练流程,基于Qwen3-8B-base,通过数据清洗、三阶段SFT和GRPO RL优化指令与推理分支,并探索OPD/MOPD替代RL,在8B模型上实现性能提升。

Comments 29 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 代码与定理证明 2 篇

2606.26857 2026-06-26 cs.AI 新提交 57%

LCAi: Life Cycle Assessment with big data fusion and retrieval-augmented generation-assisted interpretation

LCAi: 基于大数据融合与检索增强生成辅助解释的生命周期评估

Georgios Tsironis, Juan D. Medrano-Garcia, Gonzalo Guillen-Gosalbez

机构 * Institute for Chemical and Bioengineering, Department of Chemistry and Applied Biosciences, ETH Zürich(苏黎世联邦理工学院化学与应用生物科学系化学与生物工程研究所) NCCR Catalysis(瑞士国家研究能力中心催化研究所)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 提出一种视角条件检索增强生成框架,通过多视角检索与受控合成,在AI辅助生命周期评估中实现结构化解释,减少幻觉风险并保持跨领域多样性。

Comments 23 pages, 14 figures, 6 tables. Includes Supplementary Information

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26490 2026-06-26 cs.SE cs.AI cs.LO cs.PL 新提交 57%

An Empirical Study of LLM-Generated Specifications for VeriFast

LLM 生成的 VeriFast 规范实证研究

Wen Fan, Minh Tran, Sanya Dod, Xin Hu, Marilyn Rego, Danning Xie, Jenna DiVincenzo, Lin Tan

机构 * Purdue University(普渡大学) University of Michigan(密歇根大学) Meta Ann Arbor, Michigan, USA(美国密歇根州安阿伯) Menlo Park, California, USA(美国加州Menlo Park) West Lafayette, Indiana, USA(美国印第安纳州西拉法叶)

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI

AI总结 本研究评估了大型语言模型为分离逻辑验证器 VeriFast 生成规范的能力,发现虽然功能保持良好(>91%),但验证成功率仅31.4%,主要错误源于领域知识不足。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 逻辑推理 6 篇

2606.27281 2026-06-26 cs.LO 新提交 82%

Resource-Aware Neuro-Symbolic Reasoning for Local Small Language Models

资源感知的神经符号推理用于本地小型语言模型

Carlos Ramírez Ovalle, Abel Alvarez

专题命中 逻辑推理 :reasoning(title,abstract)

AI总结 提出VFR-LLM管道,将问题翻译为类型化有限域规则和约束,通过符号层验证一致性,用确定性求解器推理,在本地小模型上以单次调用达到高精度,替代重复采样。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07552 2026-06-26 cs.MA cs.AI cs.LG 新提交 81%

Symbolic Reasoning Frameworks Trigger Memory-Mediated Ecosystem Dynamics in Multi-Agent LLM Systems

符号推理框架在多智能体战略环境中调节大语言模型的风险规避

Augustin Chan

机构 * iterative.day

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究通过注入符号推理框架(如易经、塔罗牌)作为反思提示,发现其能差异化调节LLM的风险规避倾向,并在多智能体博弈中产生框架特定的胜者分布,且该效应源于反思过程而非内容遵循。

Comments 28 pages, 4 figures, 9 tables, 6 listings. Code and data: https://doi.org/10.5281/zenodo.20338937

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26108 2026-06-26 cs.CL 新提交 79%

Where Larger Models Excel: The Primacy of Constraint-Guided Reasoning

大模型何处更胜一筹:约束引导推理的首要性

Guan-Yi Lin, Hen-Hsen Huang

机构 * National Chengchi University(国立政治大学) Academia Sinica(中央研究院)

专题命中 逻辑推理 :reasoning(title,abstract);分类 cs.CL

AI总结 研究大语言模型在推理基准上性能差距的原因,提出AdvCluster框架自动识别大模型优势问题并提取细粒度优势描述,发现约束引导推理是大模型的核心优势。

Comments 10 pages, 3 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26387 2026-06-26 cs.CV cs.CL cs.LG 新提交 62%

Staying VIGILant: Mitigating Visual Laziness via Counterfactual Visual Alignment in MLLMs

保持VIGILant:通过多模态大语言模型中的反事实视觉对齐缓解视觉懒惰

Xi Xiao, Chen Liu, Chih-Ting Liao, Yunbei Zhang, Qizhen Lan, Yuxiang Wei, Lin Zhao, Janet Wang, Jianyang Gu, Muchao Ye, Tianyang Wang, Hao Xu

机构 * UAB(阿拉巴马大学伯明翰分校) Yale(耶鲁大学) UNSW(新南威尔士大学) Tulane(杜兰大学) Georgia Tech(佐治亚理工学院) NEU(东北大学) OSU(俄亥俄州立大学) UIowa(爱荷华大学) Harvard(哈佛大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 提出VIGIL框架,通过强化学习后训练最大化视觉输入与生成响应间的互信息,惩罚“盲目自信”实例,有效缓解MLLMs的视觉懒惰问题,在幻觉和推理基准上优于现有方法。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26585 2026-06-26 cs.AI astro-ph.IM 新提交 57%

A Multi-Level Validation and Traceability Framework for AI-Generated Telescope Scheduling Decisions

AI生成的望远镜调度决策的多级验证与可追溯性框架

Hengchu Xiao, Chuanjun Wang

机构 * Yunnan Observatories, Chinese Academy of Sciences(云南天文台,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of the Structure and Evolution of Celestial Objects, Chinese Academy of Sciences(中国科学院天文结构与演化重点实验室) Yunnan Key Laboratory of Solar Physics and Space Science(云南太阳物理与空间科学重点实验室) Center for Astronomical Mega-Science, Chinese Academy of Sciences(中国科学院天文大科学中心)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI

AI总结 提出多级验证与可追溯推理框架,通过数据引用验证、逻辑一致性检查和约束验证,提高AI调度决策的可执行性和可靠性,减少瞬态机会损失。

Comments 25 pages, 8 figures, Published in Universe

Journal ref Universe, Volume 12, Issue 6, 172 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26545 2026-06-26 cs.SE 新提交 50%

ConcoLixir: Reactive LLM Discovery Oracles for Python Concolic Testing

ConcoLixir:用于Python符号执行的响应式LLM发现预言

Dong Chen, Chih-Duo Hong, Fang Yu

专题命中 逻辑推理 :reasoning(abstract)

AI总结 针对Python符号执行中库调用降级、语义操作难解和路径覆盖停滞问题,提出ConcoLixir,利用LLM作为发现预言生成种子、输入并引导覆盖,平均行覆盖率提升8.6-17.0个百分点,成本仅$1.63。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 规划推理 15 篇

2606.27330 2026-06-26 cs.CL cs.AI cs.CV cs.LG 新提交 82%

Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning

通过自主经验探索与事后经验利用赋能GUI智能体任务规划

Tianyi Men, Zhuoran Jin, Pengfei Cao, Yubo Chen, Kang Liu, Jun Zhao

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出PEEU方法,通过自主探索环境发现经验并利用事后经验合成严格对齐的高层训练数据,提升小型多模态大语言模型在GUI任务中的规划与跨网站泛化能力。

Comments Accepted to ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25629 2026-06-26 cs.RO eess.SP 新提交 82%

Event-Adaptive Motion Planning with Distilled Vision-Language Model in Safety-Critical Situations

安全关键场景下基于蒸馏视觉语言模型的事件自适应运动规划

Zhenwei Huang, Changsheng You, Shuai Wang, Chao Zhou, Wei Xu, Yi Gong

机构 * Southern University of Science and Technology(南方科技大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Manifold Tech Limited(曼孚科技股份有限公司)

专题命中 规划推理 :planning(title,abstract);reasoning(abstract)

AI总结 提出事件自适应运动规划(EAMP)框架,通过可配置语义事件触发器、蒸馏视觉语言模型和语义模型预测控制,在安全关键场景中实现高层推理与底层控制的协同,提升动态安全裕度并保持实时性。

Comments 8 pages, 8 figures, 4 tables. Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26463 2026-06-26 cs.LG 新提交 79%

Finding the Time to Think: Learning Planning Budgets in Real-Time RL

寻找思考时间:在实时强化学习中学习规划预算

Aneesh Muppidi, Firas Darwish, Dylan Cope, João F. Henriques, Jakob Nicolaus Foerster

机构 * British Open-ended Learning and Discovery Lab (BOLD)(英国开放性学习与探索实验室(BOLD)) University of Oxford(牛津大学) VGG(视觉信息小组)

专题命中 规划推理 :planning(title,abstract);分类 cs.LG

AI总结 针对环境在决策期间持续运行的实时强化学习,提出一种轻量级门控策略,根据状态选择规划预算,在多个实时游戏中优于固定预算和启发式基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20657 2026-06-26 cs.AI cs.LG 新提交 73%

A-Evolve-Training: Autonomous Post-Training of a 30B Model

A-Evolve-Training: 30B模型的自主后训练

Zhan Shi, Bing He, Yisi Sang, Hanqing Lu, Benoit Dumoulin

机构 * A-EVO-Lab, Amazon(亚马逊A-EVO实验室)

专题命中 规划推理 :reasoning(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 提出一个无需人工干预的自主后训练系统,对30B参数模型进行多轮训练,在NVIDIA排行榜上接近人类最佳成绩,并展示了系统能自主发现并修正指标误导问题。

Comments 12 pages,

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26874 2026-06-26 cs.AI 新提交 70%

TAVR-VLM: Risk-Conditioned Causal Grounding for Hallucination-Resistant Report Generation

TAVR-VLM:面向抗幻觉报告生成的风险条件因果基础

Zhixiang Lu, Xiwei Liu, Sifan Song, Changkai Ji, Anh Nguyen, Jionglong Su, Imran Razzak, Jinfeng Wang

机构 * Xi’an Jiaotong-Liverpool University(西交利物浦大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Shanghai Jiao Tong University(上海交通大学) University of Liverpool(利物浦大学) Kunming University of Science and Technology(昆明理工大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 提出TAVR-VLM框架,通过风险条件因果注意力(R-CGA)建立“风险→区域→词”的结构化基础路径,在TAVR规划中减少诊断幻觉,实现新最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26298 2026-06-26 cs.AI cs.CR 新提交 70%

Governing Actions, Not Agents: Institutional Attestation as a Governance Model for Autonomous AI Systems

治理行动,而非智能体:机构证明作为自主AI系统的治理模型

Jakob Salfeld-Nebgen

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 针对自主AI系统可能执行不可逆高风险行动的问题,提出一种基于机构证明的计算治理模型,将执行权限与规划推理分离,通过独立权威源证明前提条件,并采用防篡改日志记录决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26969 2026-06-26 cs.AI cs.CL cs.CV 新提交 62%

Einstein World Models

爱因斯坦世界模型

Munachiso Samuel Nwadike, Zangir Iklassov, Ali Mekky, Zayd M. Kawakibi Zuhri, Kentaro Inui

机构 * MBZUAI(穆罕默德·本·扎耶德人工智能大学) RIKEN AIP, Japan(日本理化学研究所革新智能综合研究中心) Tohoku University(东北大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 提出爱因斯坦世界模型(EWM),通过将视觉时间展开嵌入推理轨迹,使LLM能利用视觉化反事实事件增强复杂推理能力。

Comments 12 pages (9 without references), 2 figures, 1 algorithm

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27188 2026-06-26 cs.AI 新提交 57%

A Process Harness for Uplifting Legacy Workflows to Agentic BPM: Design and Realization in CUGA FLO

一种将遗留工作流提升为智能体BPM的过程驾驭框架:在CUGA FLO中的设计与实现

Fabiana Fournier, Lior Limonad

机构 * IBM SIL, Israel(IBM 研究实验室,以色列) Department of Information Systems, Faculty of Computer & Information Sciences, University of Haifa(海法大学计算机与信息科学学院信息系统系)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出过程驾驭框架,通过策略驱动的智能体层在不替换工作流引擎的情况下将遗留工作流升级为智能体BPM,并基于TDF模型在CUGA FLO中实现,通过三种智能体类型和钩子机制实现指令性与规范性需求的统一。

Comments 24 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26981 2026-06-26 cs.RO cs.AI 新提交 57%

In-Context Model Predictive Generation: Open-Vocabulary Motion Synthesis from Language Models to Physics

上下文模型预测生成:从语言模型到物理的开放词汇运动合成

Xiaomeng Fu, Junfan Lin, Yang Liu, Yaowei Wang, Guanbin Li, Liang Lin, Ziliang Chen

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Department of Networked Intelligence, Peng Cheng Laboratory(鹏城实验室网络智能部) School of Computer Science and Engineering, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与工程学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出ICMPG框架,结合语言模型规划与推理时物理反馈,通过上下文感知运动生成和模型预测生成模块实现语义忠实且物理合理的开放词汇运动合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26700 2026-06-26 cs.RO cs.AI 新提交 57%

Learning Motion Feasibility from Point Clouds in Cluttered Environments

从杂乱环境中的点云学习运动可行性

Sajid Ansari, Arthi, Girish Varma, Antony Thomas

机构 * International Institute of Information Technology Hyderabad(国际信息技术学院海得拉巴)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出直接从RGB-D观测学习7自由度机械臂运动可行性预测的方法,构建包含270万抓取可行性标签的大规模基准,并评估三种分类器架构,最佳模型GRASPFC-PTX在新型物体上AUROC达0.996且预测速度远超基于采样的运动规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26590 2026-06-26 cs.LG cs.CR 新提交 57%

Empirical Software Engineering TerraProbe: A Layered-Oracle Framework for Detecting Deceptive Fixes in LLM-Assisted Terraform

实证软件工程 TerraProbe: 用于检测LLM辅助Terraform中欺骗性修复的分层Oracle框架

Manar Alsaid, Chimdumebi Nebolisa, Faris Abbas

机构 * East Texas A&M University(东德克萨斯农工大学) Texas Woman’s University(德克萨斯女子大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 提出TerraProbe五层Oracle框架,评估LLM辅助Terraform安全修复,发现71.4%的真实修复为欺骗性修复,并建立四维欺骗性修复分类法。

Comments 34 pages, 12 figures, 14 tables. Journal-first manuscript submitted to Empirical Software Engineering. Primary classification: cs.SE; cross-list: cs.CR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26346 2026-06-26 cs.AI 新提交 57%

How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks?

工具增强的LLM智能体在真实世界能源分析任务中的表现如何?

David Akinpelu, Akintonde Abbas, Rereloluwa Alimi, Ayodeji Lana

机构 * Independent Researcher(独立研究员) Tume AI

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 针对能源领域缺乏智能体评估基准的问题,构建了包含243个专家策划问题的测试环境,评估工具增强的LLM智能体在数据检索、知识解释和定量建模三类任务上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27123 2026-06-26 cs.RO cs.CV 新提交 50%

Proposal-Conditioned Latent Diffusion for Closed-Loop Traffic Scenario Generation

基于提议条件的闭环交通场景生成潜扩散模型

Shubham Vaijanath Phoolari, Aleyna Kara, Christoph Lauer, Steven Peters

机构 * CARIAD SE Technical University of Munich(慕尼黑工业大学) Institute of Automotive Engineering (FZD), TU Darmstadt(达姆施塔特工业大学汽车工程研究所(FZD))

专题命中 规划推理 :planning(abstract)

AI总结 提出一种基于实例场景上下文和多模态提议先验的扩散框架,通过紧凑动作潜表示和提议初始化提升采样效率,实现闭环交通场景的逼真、安全且可控生成。

Comments Accepted for publication at the IEEE International Conference on Intelligent Transportation Systems (ITSC), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26884 2026-06-26 cs.HC 新提交 50%

MedSWFlow: An Open-Source LLM Workflow for Drafting Medical Social Work Case Plans

MedSWFlow: 一个用于起草医务社会工作案例计划的开源LLM工作流

Yulin Mao, Shiyu Li, Shuping Song, Yuling Zhang, Yajun Song

专题命中 规划推理 :planning(abstract)

AI总结 提出开源、模型无关的LLM工作流MedSWFlow,将案例计划任务分解为六个阶段,通过结构化提示生成可审查的评估表和服务计划,旨在辅助从业者起草案例计划。

Comments 26pages, 8tables, 2figuers

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26122 2026-06-26 cs.CV 新提交 50%

DocArena: Turning Raw Documents into Controllable Training Environments for Document Search Agents

DocArena:将原始文档转化为可控的训练环境用于文档搜索代理

Jiamian Wang, Ruiyi Zhang, Tong Yu, Jing Shi, Samyadeep Basu, Rajiv Jain, Zhiqiang Tao, Tong Sun

机构 * Rochester Institute of Technology(罗切斯特理工学院) Adobe Research(Adobe研究院)

专题命中 规划推理 :reasoning(abstract)

AI总结 提出DocArena自动化流程,通过多模态文档结构化、推理型QA对构建和质量控制,生成可控训练环境,使基于文本LLM的搜索代理在多模态文档检索和问答中取得最佳性能。

Comments search agent for documents

详情

展开后加载摘要…

URL PDF HTML 收藏