arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-03-19 至 2026-03-19 共收录 48 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 48 篇

2506.21982 2026-03-19 cs.RO cs.SY eess.SY 91%

A MILP-Based Solution to Multi-Agent Motion Planning and Collision Avoidance in Constrained Environments

基于混合整数线性规划的多智能体运动规划与碰撞避障方法

Akshay Jaitly, Jack Cline, Siavash Farzan

机构 * Robotics Engineering Department, Worcester Polytechnic Institute(沃斯特理工学院机器人工程系) Electrical Engineering Department, California Polytechnic State University(加州州立大学弗雷斯诺分校电子工程系)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 本文提出一种基于混合整数线性规划的多智能体运动规划方法,通过将多凸多边形动作规划嵌入序列-求解流程,利用大M超平面模型实现智能体间分离,并通过L1路径长度加加速度成本生成平滑轨迹。

Comments Accepted to 2025 IEEE International Conference on Automation Science and Engineering (CASE 2025). This arXiv version adds a supplementary appendix with figures not in the IEEE proceedings

Journal ref IEEE 21st International Conference on Automation Science and Engineering (CASE), 2025, pp. 2200-2207

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17626 2026-03-19 cs.CV 91%

A Multi-Agent System for Building-Age Cohort Mapping to Support Urban Energy Planning

一种多智能体系统用于建筑年龄队列映射以支持城市能源规划

Kundan Thota, Thorsten Schlachter, Veit Hagenmeyer

机构 * Institute for Automation(自动化研究所) Applied Informatics (IAI)(应用信息学(IAI)) Karlsruhe Institute of Technology (KIT)(卡尔斯鲁厄理工学院(KIT)) Karlsruhe, Germany(德国卡尔斯鲁厄)

专题命中 规划决策 :agent(title,abstract);planning(title,abstract);multi-agent(title,abstract)

AI总结 本文提出多智能体系统融合异构数据,通过BuildingAgeCNN实现建筑年龄分类,提升城市能源规划的准确性与可持续性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20991 2026-03-19 cs.AI cs.MA 90%

FinAgent: An Agentic AI Framework Integrating Personal Finance and Nutrition Planning

FinAgent:整合个人财务与营养规划的智能框架

Toqeer Ali Syed, Abdulaziz Alshahrani, Ali Ullah, Ali Akarma, Sohail Khan, Muhammad Nauman, Salman Jan

机构 * Faculty of Computer and Information System, Islamic University of Madinah, Saudi Arabia(麦加伊斯兰大学计算机与信息学院) Department of Computer Science, Effat College of Engineering, Effat University, Saudi Arabia(Effat大学工程学院计算机科学系) Arab Open University, Bahrain(巴林开放大学)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);agent(abstract);multi-agent(abstract)

AI总结 本文提出一种价格敏感型智能系统,结合个人财务管理与饮食优化,通过模块化多智能体架构实现营养充足且价格合理的饮食计划,实验显示可减少12-18%的开支并提高营养充足率。

Comments This paper was presented at the IEEE International Conference on Computing and Applications (ICCA 2025), Bahrain

Journal ref Proceedings of the 2025 IEEE International Conference on Computing and Applications (ICCA), Bahrain, 2025, pp. 1-7

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17930 2026-03-19 cs.CV 82%

Interpretable Traffic Responsibility from Dashcam Video via Legal Multi Agent Reasoning

基于法律多智能体推理的可解释交通责任分析

Jingchun Yang, Jinchang Zhang

机构 * Northeast University(东北大学) SUNY Binghamton University(纽约州立大学布法罗分校)

专题命中 规划决策 :agent(title,abstract);multi-agent(abstract)

AI总结 本文提出C-TRAIL多模态数据集,结合视频与文本描述,通过两阶段框架实现交通责任判定,优于现有方法并提供透明法律推理过程。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17459 2026-03-19 cs.RO 82%

P$^{3}$Nav: End-to-End Perception, Prediction and Planning for Vision-and-Language Navigation

P$^{3}$Nav: 端到端感知、预测与规划用于视觉-语言导航

Tianfu Li, Wenbo Chen, Haoxuan Xu, Xinhu Zheng, Haoang Li

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 规划决策 :planning(title,abstract);agent(abstract)

AI总结 P$^{3}$Nav提出端到端框架,整合感知、预测与规划,提升视觉-语言导航agent的场景理解与导航成功率,实验显示在REVERIE、R2R-CE和RxR-CE基准上取得新状态-of-the-art性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14225 2026-03-19 cs.HC cs.AI cs.SE 81%

"I'm Not Reading All of That": Understanding Software Engineers' Level of Cognitive Engagement with Agentic Coding Assistants

我并非在读取所有内容:理解软件工程师对代理编码助手的认知参与度

Carlos Rafael Catalan, Lheane Marie Dizon, Patricia Nicole Monderin, Emily Kuang

机构 * York University(约克大学)

专题命中 规划决策 :agentic(title,abstract);分类 cs.AI、cs.SE

AI总结 研究探讨软件工程师在使用代理编码助手时的认知参与度变化,指出当前设计缺乏反思和验证机制,提出通过更丰富的交互方式和认知强制机制来提升深度思考。

Comments 7 pages, 5 figures, 2 tables, published and presented in CHI 2026 Workshop on Tools for Thought

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15797 2026-03-19 cs.LG cs.AI 81%

OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning

OMNIFLOW:一种基于物理的多模态代理用于通用科学推理

Hao Wu, Yongheng Zhang, Yuan Gao, Fan Xu, Fan Zhang, Ruobing Xie, Ruijian Gou, Yuxuan Liang, Xiaomeng Huang, Xian Wu

机构 * Tsinghua University(清华大学) Tencent(腾讯) Shenzhen Loop Area Institute(深圳河套学院) Ocean University of China(海洋大学) HKUST (Guangzhou)(香港科技大学(广州))

专题命中 规划决策 :agent(title);workflow(abstract);分类 cs.AI、cs.LG

AI总结 OMNIFLOW通过引入语义-符号对齐机制和物理引导的推理流程,实现了多模态模型在物理定律下的科学推理,显著提升了零样本泛化和少样本适应能力,提供透明且物理一致的推理报告。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10492 2026-03-19 cs.CL 79%

Human-AI Co-reasoning for Clinical Diagnosis with Evidence-Integrated Language Agent

人机协同推理用于临床诊断:证据整合语言代理

Zhongzhen Huang, Yan Ling, Hong Chen, Ye Feng, Li Wu, Linjie Mu, Shaoting Zhang, Xiaofan Zhang, Kun Qian, Xiaomu Li

专题命中 规划决策 :agent(title,abstract);分类 cs.CL

AI总结 本文提出PULSE,结合领域调优的大语言模型与文献检索,支持复杂病例的诊断决策。实验显示PULSE在专家级准确度上表现优异,且在罕见病病例中保持稳定性能,揭示了语言模型在临床诊断中的潜力与局限。

Comments After further evaluation, we have decided to withdraw the current version of this manuscript for further revision. We plan to add new experiments, improve the writing and overall presentation for greater clarity and coherence, and re-examine the dataset and related descriptions to ensure rigor and reliability before submitting an updated version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17583 2026-03-19 cs.CV cs.AI 79%

Edit-As-Act: Goal-Regressive Planning for Open-Vocabulary 3D Indoor Scene Editing

Edit-As-Act:面向开放词汇3D室内场景编辑的目标回归规划

Seongrae Noh, SeungWon Seo, Gyeong-Moon Park, HyeongYeop Kang

机构 * Korea University(韩国大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 本文提出Edit-As-Act框架,通过目标回归规划实现开放词汇3D室内场景编辑,解决传统方法在生成和物理一致性上的不足,实验表明其在多个编辑任务中表现优异。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16967 2026-03-19 cs.CV cs.AI 79%

MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing

MSRAMIE:多模态结构推理代理用于多指令图像编辑

Zhaoyuan Qiu, Ken Chen, Xiangwei Wang, Yu Xia, Sachith Seneviratne, Saman Halgamuge

机构 * University Of Melbourne(墨尔本大学)

专题命中 规划决策 :agent(title,abstract);分类 cs.AI

AI总结 MSRAMIE基于多模态大语言模型构建无需训练的代理框架,通过结构化多模态推理处理多指令图像编辑任务,提升复杂指令遵循度和完成概率,同时保持图像质量和一致性。

Comments 14 pages, 6 figures, 3 tables, appendix and references provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17895 2026-03-19 cs.CV 78%

A Creative Agent is Worth a 64-Token Template

一个创意代理值得一个64-token模板

Ruixiao Shi, Fu Feng, Yucheng Xie, Xu Yang, Jing Wang, Xin Geng

机构 * School of Computer Science and Engineering, Southeast University, Nanjing, China(1 南京大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education, China(2 教育部新一代人工智能技术及其跨学科应用关键实验室(东南大学))

专题命中 规划决策 :agent(title,abstract)

AI总结 本文提出CAT框架,通过创意令牌化提升文本到图像生成的创造力,实现3.7倍速度提升和4.8倍计算成本降低,生成图像更受人类偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15359 2026-03-19 cs.RO 78%

NavThinker: Action-Conditioned World Models for Coupled Prediction and Planning in Social Navigation

NavThinker: 用于社交导航中耦合预测与规划的行动条件世界模型

Tianshuai Hu, Zeying Gong, Lingdong Kong, XiaoDong Mei, Yiyi Ding, Qi Zeng, Ao Liang, Rong Li, Yangyi Zhong, Junwei Liang

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) National University of Singapore(新加坡国立大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 NavThinker通过结合行动条件世界模型与on-policy强化学习,解决社交导航中机器人动作与人类运动相互影响的耦合预测-规划问题,实现未来感知的导航状态对齐与路径规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14697 2026-03-19 cs.MA 78%

Forecast-Aware Cooperative Planning on Temporal Graphs under Stochastic Adversarial Risk

面向随机对抗风险的时序图上协作规划

Manshi Limbu, Xuan Wang, Gregory J. Stein, Daigo Shishika, Xuesu Xiao

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种面向随机对抗风险的时序图协作规划框架,通过整合随机风险预测与前瞻性支持分配,有效降低团队总预期成本,接近理想规划器性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10924 2026-03-19 cs.RO 78%

PAAMP: Polytopic Action-Set And Motion Planning for Long Horizon Dynamic Motion Planning via Mixed Integer Linear Programming

PAAMP:基于多边形动作集和混合整数线性规划的长时间动态运动规划

Akshay Jaitly, Siavash Farzan

机构 * Robotics Engineering Department, Worcester Polytechnic Institute(沃斯特理工学院机器人工程系) Electrical Engineering Department, California Polytechnic State University(加州州立大学弗雷斯诺分校电子工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出PAAMP方法,通过多边形动作集将长时间动态运动规划转化为混合整数线性规划问题,用于解决复杂动态系统中的运动规划与约束满足问题。

Comments Accepted to 2024 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2024). 8 pages, 10 figures

Journal ref IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024, pp. 7617-7624

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17236 2026-03-19 cs.RO cs.CV 78%

Neural Radiance Maps for Extraterrestrial Navigation and Path Planning

神经辐射图用于外星导航和路径规划

Adam Dai, Shubh Gupta, Grace Gao

机构 * Stanford University(斯坦福大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出利用神经辐射场构建地图,用于自主导航中的路径规划,通过整合局部和全局信息,实现更高效的路径规划。

Comments Published in the Proceedings of the ION GNSS+ 2023 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17232 2026-03-19 cs.RO 78%

Full Stack Navigation, Mapping, and Planning for the Lunar Autonomy Challenge

月球自主性挑战的全栈导航、制图与规划

Adam Dai, Asta Wu, Keidai Iiyama, Guillem Casadesus Vila, Kaila Coimbra, Thomas Deng, Grace Gao

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种模块化全栈自主系统,用于月球表面导航与制图,在GNSS拒止和视觉挑战环境下,结合语义分割、立体视觉里程计、位图SLAM与分层规划控制,实现了厘米级定位精度和高保真制图。

Comments Published in the Proceedings of the ION GNSS+ 2025 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17022 2026-03-19 cs.RO cs.SY eess.SY 78%

Contingency-Aware Planning via Certified Neural Hamilton-Jacobi Reachability

通过认证的神经哈密顿-雅可比可达性进行 contingency 意识规划

Kasidit Muenprasitivej, Derya Aksaray

机构 * Department of Electrical and Computer Engineering, Northeastern University(电气与计算机工程系,东北大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种结合学习可达性与采样规划的多目标导航框架,利用FNO近似解算器解决高维HJ方程,提供理论安全保证并验证在Webots仿真中实时部署的性能。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18945 2026-03-19 cs.CV cs.RO 78%

Echo Planning for Autonomous Driving: From Current Observations to Future Trajectories and Back

自动驾驶中的回声规划:从当前观测到未来轨迹及回溯

Jintao Sun, Hu Zhang, Gangyi Ding, Zhedong Zheng

机构 * School of Computer Science and Technology, Beijing Institute of Technology, China(北京理工大学计算机科学与技术学院) CSIRO DATA61, Australia(澳大利亚CSIRO DATA61) Faculty of Science and Technology and Institute of Collaborative Innovation, University of Macau, Macau SAR, China(澳门大学科学与技术学院及协同创新研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出EchoP框架,通过建立当前-未来-当前循环,使轨迹预测与场景一致性协调。实验表明,该方法在nuScenes上减少L2误差并降低碰撞率,且在闭环评估中表现优异,无需额外监督。

Comments 12 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17155 2026-03-19 cs.SI cs.SY eess.SY 75%

On Online Control of Opinion Dynamics

关于在线控制意见动态

Sheryl Paul, Leslie Cruz Juarez, Jyotirmoy V. Deshmukh, Ketan Savla

专题命中 规划决策 :agent(abstract);planning(abstract);multi-agent(abstract)

AI总结 本文研究了在个体对影响的易感性未知的情况下,如何通过在线算法估计该参数并驱动意见向目标收敛,分析了在预算或时间约束下稳定性与收敛性的条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17425 2026-03-19 cs.AI 74%

Proactive Knowledge Inquiry in Doctor-Patient Dialogue: Stateful Extraction, Belief Updating, and Path-Aware Action Planning

医生-患者对话中的主动知识探究:状态提取、信念更新与路径感知的动作规划

Zhenhai Pan, Yan Liu, Jia You

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 本文提出了一种基于部分可观测性的主动知识探究框架,通过状态提取、信念更新和路径感知动作规划,提升电子病历生成的覆盖性和准确性。

Comments 12 pages, 2 figures, 5 tables. Pilot concept demonstration under a controlled simulated setting

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17692 2026-03-19 cs.LG cs.AI q-fin.CP q-fin.PM 73%

Can Blindfolded LLMs Still Trade? An Anonymization-First Framework for Portfolio Optimization

盲folded LLMs仍能进行交易吗?一个以匿名化优先的资产组合优化框架

Joohyoung Jeon, Hongchul Lee

机构 * Korea University(韩国大学) Mirae Asset Securities(美亚证券)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种以匿名化为核心的资产组合优化框架,通过盲fold LLMs来验证市场信号的合法性,实验显示在2025年期间实现了1.40的夏普比率,并通过负控实验验证信号的有效性。

Comments Accepted at the ICLR 2026 Workshop on Advances in Financial AI (FinAI). 18 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17169 2026-03-19 cs.AI cs.CL 73%

How Clued up are LLMs? Evaluating Multi-Step Deductive Reasoning in a Text-Based Game Environment

LLMs有多好?在文本基于的游戏环境中评估多步骤演绎推理

Rebecca Ansell, Autumn Toney-Wails

机构 * Georgetown University(乔治城大学) Syntheos, Corp(Syntheos公司) UNU-Merit

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.CL

AI总结 本文通过文本多智能体版经典棋盘游戏Clue评估LLM的多步骤演绎推理能力,发现即使在结构化逻辑谜题微调后,推理一致性仍难以维持,且推理精度未显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16448 2026-03-19 cs.AI 70%

TRUST-SQL: Tool-Integrated Multi-Turn Reinforcement Learning for Text-to-SQL over Unknown Schemas

TRUST-SQL:基于工具的多轮强化学习用于未知模式下的文本到SQL

Ai Jian, Xiaoyun Zhang, Wanrou Du, Jingqing Ruan, Jiangbo Pei, Weipeng Zhang, Ke Zeng, Xunliang Cai

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Meituan(美团)

专题命中 规划决策 :agent(abstract);autonomous agent(abstract);分类 cs.AI

AI总结 本文提出TRUST-SQL,通过工具集成的多轮强化学习解决文本到SQL在未知模式下的问题,通过结构化四阶段协议和Dual-Track GRPO策略提升性能,实验表明在多个基准上取得显著改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10063 2026-03-19 cs.AI 70%

Chain of Mindset: Reasoning with Adaptive Cognitive Modes

思维链:具有适应性认知模式的推理

Tianyi Jiang, Arctanx An, Hengyi Feng, Naixin Zhai, Haodong Li, Xiaomin Yu, Jiahui Liu, Hanwen Du, Shuo Zhang, Zhi Yang, Jie Huang, Youhua Li, Yongxin Ni, Huacan Wang, Ronghao Chen

机构 * PKU(北京大学) BJTU(北京理工大学) StepFun SUFE(上海财经大学) NUS(新加坡国立大学) CityUHK(香港城市大学) QuantaAlpha(量子阿尔法)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 本文提出Chain of Mindset框架,通过动态选择不同认知模式提升推理效率,实验显示在多个基准测试中表现优异,准确率超越基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17339 2026-03-19 cs.DL 67%

citecheck: An MCP Server for Automated Bibliographic Verification and Repair in Scholarly Manuscripts

citecheck: 一种MCP服务器,用于学术手稿中的自动文献验证与修复

Junhyeok Lee

专题命中 规划决策 :planning(abstract);agentic(abstract)

AI总结 citecheck通过自动化验证和修复学术手稿中的文献错误,包括识别错误、元数据不完整、作者归属错误及预印本与发表版本不一致等问题,提供结构化修复建议和安全诊断。

Comments 6 pages, 1 figure. Software paper on bibliography verification and repair for scholarly manuscripts; includes MCP server implementation and evaluation on repository-backed tests

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20095 2026-03-19 cs.CV 67%

WPT: World-to-Policy Transfer via Online World Model Distillation

WPT: 通过在线世界模型蒸馏实现世界到策略的迁移

Guangfeng Jiang, Yueru Luo, Jun Liu, Yi Huang, Yiyao Zhu, Zhan Qu, Dave Zhenyu Chen, Bingbing Liu, Xu Yan

机构 * University of Science and Technology of China(科学技术大学) CUHK-SZ(香港中文大学(深圳)) HKUST(香港理工大学) Huawei Foundation Model Department(华为基金会模型部)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 本文提出WPT方法,通过在线世界模型蒸馏实现策略迁移,提升规划性能并保持实时部署能力,实验表明其在开放环和闭合环基准上表现优异。

Comments CVPR2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17544 2026-03-19 cs.AI cs.LG 62%

Per-Domain Generalizing Policies: On Learning Efficient and Robust Q-Value Functions (Extended Version with Technical Appendix)

领域特定泛化策略:关于学习高效且鲁棒的Q值函数(含技术附录的扩展版本)

Nicola J. Müller, Moritz Oster, Isabel Valera, Jörg Hoffmann, Timo P. Gros

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过学习Q值函数来实现领域特定泛化策略,相比传统状态值函数方法,Q值函数在多个领域中表现更优,且在规划器LAMA-first上具有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16969 2026-03-19 cs.CR cs.AI cs.LG 62%

DeepStage: Learning Autonomous Defense Policies Against Multi-Stage APT Campaigns

DeepStage: 通过多阶段APT攻击学习自主防御策略

Trung V. Phan, Tri Gia Nguyen, Thomas Bauschert

机构 * Department of Information Assurance, FPT University(信息保障系,FPT大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DeepStage框架,利用深度强化学习对抗多阶段APT攻击,通过融合主机溯源和网络 telemetry 构建统一溯源图,结合StageFinder进行攻击阶段估计,采用分层PPO算法实现自适应防御,实验显示其在真实企业环境中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16901 2026-03-19 cs.LG cs.AI 62%

From Language to Action in Arabic: Reliable Structured Tool Calling via Data-Centric Fine-Tuning

从阿拉伯语到行动:通过数据驱动的微调实现可靠的结构化工具调用

Omer Nacar, Deema Alquffari, Saleh Alsharideh, Adeem AlOtaibi, Abdulaziz Alabdulkarim, Leen Alhazmi, Nada Alomar, Wareef Alzubaidi, Nada Alsultan, Ahmed Alrabghi, Demah Alhoshan, Rana Alsayyari, Hamed Alruwaili, Albaraa Jaafar, Khaled Alusmani, Abdulaziz Alsohimy, Munirah Alsubaie, Shahd Aldukhayil, Arwa Alali, Yazeed BinShihah, Razan Alsulaymi, Nourah Alhumaid, Razan Abdulsalam, Reem Alamoudi, Mohammed Alkhalifa

机构 * Tuwaiq Academy(图瓦伊克学院) Tahakom(塔哈科姆) Wakeb Company(沃克公司) Qatmeer Co.(卡提迈尔公司) NCGR Vision Bank(视觉银行)

专题命中 规划决策 :agentic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出AISA-AR-FunctionCall框架,通过数据审计、模式修复和提示重构等方法,显著提升阿拉伯语函数调用模型的稳定性与准确性,减少解析失败率并提高功能名称识别精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17948 2026-03-19 cs.CV cs.AI 57%

VideoAtlas: Navigating Long-Form Video in Logarithmic Compute

VideoAtlas: 在对数计算中导航长视频

Mohamed Eltahir, Ali Habibullah, Yazan Alshoibi, Lama Ayash, Tanveer Hussain, Naeemullah Khan

机构 * King Abdullah University of Science and Technology (KAUST)(卡斯特大学) Department of Computer Science, King Khalid University (KKU)(国王 Khalid 大学计算机科学系) Department of Computer Science, Edge Hill University(Edge Hill 大学计算机科学系)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 VideoAtlas通过层次化网格结构实现长视频的无损表示,解决视频表示和长上下文问题,提出Video-RLM架构,展示对数计算增长、环境预算和自适应计算分配等贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏