arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-14 至 2026-04-14 共收录 47 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 47 篇

2604.10517 2026-04-14 cs.AI 91%

From Perception to Planning: Evolving Ego-Centric Task-Oriented Spatiotemporal Reasoning via Curriculum Learning

从感知到规划:通过课程学习进化自主任务导向的空间时间推理

Xiaoda Yang, Yuxiang Liu, Shenzhou Gao, Can Wang, Jingyang Xue, Lixin Yang, Yao Mu, Tao Jin, Shuicheng Yan, Zhimeng Zhang, Zhou Zhao

机构 * Zhejiang University(浙江大学) Tianjin University(天津大学) Qingdao University(青岛大学) Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 本文提出EgoTSR框架,通过课程学习提升任务导向的空间时间推理能力,解决静态感知和动态环境中的时空幻觉问题,实验显示其在长周期推理任务中准确率达92.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09580 2026-04-14 cs.AI cs.LG 91%

OOWM: Structuring Embodied Reasoning and Planning via Object-Oriented Programmatic World Modeling

OOWM: 通过面向对象的程序化世界建模结构化具身推理与规划

Hongyu Chen, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis and Processing(广东省大数据分析与处理重点实验室) X-Era AI Lab(X-Era AI实验室)

专题命中 规划推理 :reasoning(title,abstract);planning(title,abstract);chain-of-thought(abstract);CoT(abstract)

AI总结 OOWM通过软件工程形式化方法构建具身推理框架,利用UML类图和活动图实现环境状态与控制策略的显式建模,结合监督微调与分组相对策略优化提升规划效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10775 2026-04-14 cs.CL cs.GT cs.LG 90%

LLMs for Game Theory: Entropy-Guided In-Context Learning and Adaptive CoT Reasoning

大型语言模型用于博弈论:基于熵的上下文学习与自适应推理

Tommaso Felice Banfi, Sashenka Gamage

专题命中 规划推理 :reasoning(title,abstract);CoT(title,abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种基于LLM的框架,通过熵引导的链式推理和自适应上下文检索,提升离散博弈任务的推理能力,实验显示其显著提高决策质量。

Comments Published at the AAAI 2026 Bridge: Logical and Symbolic Reasoning in Language Models (OpenReview)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27484 2026-04-14 cs.LG cs.AI cs.CL 88%

Thought Branches: Interpreting LLM Reasoning Requires Resampling

思维分支:解释大语言模型推理需要重采样

Uzay Macar, Paul C. Bogdan, Senthooran Rajamanoharan, Neel Nanda

机构 * MATS

专题命中 规划推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);planning(abstract)

AI总结 本文通过重采样研究大语言模型推理过程中的因果影响,探讨了单个推理链的局限性,并提出了基于重采样的方法来分析模型决策和推理步骤的影响。

Comments Uzay Macar and Paul C. Bogdan contributed equally to this work, and their listed order was determined by coinflip

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22361 2026-04-14 cs.CL cs.AI cs.LG 82%

MERMAID: Memory-Enhanced Retrieval and Reasoning with Multi-Agent Iterative Knowledge Grounding for Veracity Assessment

MERMAID:基于多智能体迭代知识接地的记忆增强检索与推理用于真实性评估

Yupeng Cao, Chengyang He, Yangyang Yu, Ping Wang, K. P. Subbalakshmi

机构 * Stevens Institute of Technology(史蒂文斯理工学院)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 MERMAID通过整合智能体驱动搜索、结构化知识表示和持久记忆模块,提升事实核查和主张验证的效率与一致性,实现检索、推理与记忆的协同优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01692 2026-04-14 cs.LG cs.AI 81%

Reasoning as Gradient: Scaling MLE Agents Beyond Tree Search

推理作为梯度:超越树搜索的MLE代理扩展

Yifei Zhang, Xu Yang, Xiao Yang, Bowen Xian, Qizheng Li, Shikai Fang, Jingyuan Li, Jian Wang, Mingrui Xu, Weiqing Liu, Jiang Bian

机构 * Nanjing University(南京大学) Microsoft Research Asia(微软亚洲研究院) Peking University(北京大学) Zhejiang University(浙江大学) Wuhan University(武汉大学) Hong Kong University of Science and Technology(香港科技大学)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出Gome,一种基于梯度优化的MLE代理,通过将结构化诊断推理映射到梯度计算,实现更高效的优化。实验显示,随着模型能力增强,梯度优化在前沿模型中表现更优,且在受限预算下达到35.1%的任何奖牌率。

Comments 36 pages, 6 figures, 17 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10917 2026-04-14 cs.CL 79%

HTAA: Enhancing LLM Planning via Hybrid Toolset Agentization & Adaptation

HTAA:通过混合工具集代理化与适应增强大语言模型规划

Chengrui Huang, Junshuo Zhang, Zhiyuan Ma, Xikun Wang, Ximeng Wang, Menghua Jiang, Gang Zeng, Zhaobing Han, Shen Gao, Shuo Shang

机构 * University of Electronic Science and Technology of China(电子科技大学) DiDi Global Inc.(滴滴全球股份有限公司)

专题命中 规划推理 :planning(title,abstract);分类 cs.CL

AI总结 本文提出HTAA框架,通过混合工具集代理化与适应方法,提升大语言模型在复杂任务中的规划效率与可靠性,实验表明其在任务成功率、工具调用轨迹长度及上下文开销方面均优于基线模型。

Comments 22 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10420 2026-04-14 cs.LG 79%

CARE-ECG: Causal Agent-based Reasoning for Explainable and Counterfactual ECG Interpretation

CARE-ECG:基于因果代理的可解释与反事实ECG解读

Elahe Khatibi, Ziyu Wang, Ankita Sharma, Krishnendu Chakrabarty, Sanaz Rahimi Moosavi, Farshad Firouzi, Amir Rahmani

机构 * University of California, Irvine(加州大学尔湾分校) Arizona State University(亚利桑那州立大学) California State University, Dominguez Hills(加州州立大学多明格斯山分校)

专题命中 规划推理 :reasoning(title,abstract);分类 cs.LG

AI总结 CARE-ECG通过统一的表示学习、诊断和解释流程,提升ECG解读的准确性与可信度,减少幻觉,适用于多基准和专家问答场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09750 2026-04-14 cs.CR cs.AI 79%

Conflicts Make Large Reasoning Models Vulnerable to Attacks

冲突使大型推理模型容易受到攻击

Honghao Liu, Chengjin Xu, Xuhui Jiang, Cehao Yang, Shengming Yin, Zhengwu Ma, Lionel Ni, Jian Guo

机构 * International Digital Economy Academy(国际数字经济学院) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The City University of Hong Kong(香港城市大学) DataArc Tech

专题命中 规划推理 :reasoning(title,abstract);分类 cs.AI

AI总结 研究探讨了冲突如何影响大型推理模型的安全性,发现冲突显著增加攻击成功率,揭示了安全表示在冲突下的变化,强调需更深入的对齐策略以确保模型的鲁棒性和可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09578 2026-04-14 cs.AI 79%

Explainable Planning for Hybrid Systems

混合系统的可解释规划

Mir Md Sajid Sarwar

机构 * School of Mathematical and Computational Sciences, Indian Association for the Cultivation of Science, Kolkata(印度科学培育协会数学与计算科学学院,加尔各答)

专题命中 规划推理 :planning(title,abstract);分类 cs.AI

AI总结 研究针对混合系统中的可解释人工智能规划,探讨生成AI系统解释的方法,以应对自动化规划在复杂安全领域中的应用需求。

Comments PhD thesis

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10883 2026-04-14 cs.HC 78%

Towards Designing for Resilience: Community-Centered Deployment of an AI Business Planning Tool in a Small Business Center

迈向韧性设计:在小型企业中心部署一个AI业务规划工具的社区中心化方法

Quentin Romero Lauro, Aakash Gautam, Yasmine Kotturi

专题命中 规划推理 :planning(title,abstract)

AI总结 本文探讨了在资源有限社区中,通过社区中心化设计部署AI业务规划工具BizChat,研究创业者如何通过集体AI素养发展建立韧性,发现AI工具在降低融资门槛的同时也引发了对规划本质的质疑。

Comments 17 pages, accepted to CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10587 2026-04-14 cs.HC 78%

CogInstrument: Modeling Cognitive Processes for Bidirectional Human-LLM Alignment in Planning Tasks

CogInstrument: 为规划任务中的双向人-大语言模型对齐建模认知过程

Anqi Wang, Dongyijie Pan, Xin Tong, Pan Hui

专题命中 规划推理 :planning(title);reasoning(abstract)

AI总结 CogInstrument通过认知动机建模实现人与大语言模型在规划任务中的双向对齐,通过可编辑的图形结构揭示隐含推理过程,提升用户对协作的控制力和信任度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10134 2026-04-14 cs.CR 78%

PlanGuard: Defending Agents against Indirect Prompt Injection via Planning-based Consistency Verification

PlanGuard:通过基于规划的一致性验证防御代理 against 间接提示注入

Guangyu Gong, Zizhuang Deng

专题命中 规划推理 :planning(title);verifier(abstract)

AI总结 本文提出PlanGuard,一种基于上下文隔离的无训练防御框架,通过规划器生成有效动作集和分层验证机制,有效防御间接提示注入攻击,实验显示攻击成功率从72.8%降至0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10734 2026-04-14 cs.CL 77%

Self-Correcting RAG: Enhancing Faithfulness via MMKP Context Selection and NLI-Guided MCTS

自校正RAG:通过MMKP上下文选择和NLI引导的MCTS增强忠实性

Shijia Xu, Zhou Wu, Xiaolong Jia, Yu Wang, Kai Liu, April Xiaowen Dong

机构 * Chongqing University(重庆大学) Queen Mary University of London(伦敦玛丽女王大学) Chongqing Key Laboratory of Big Data Intelligence and Privacy Computing(重庆市大数据智能与隐私计算重点实验室) Fangda Partners(方达律师事务所)

专题命中 规划推理 :reasoning(abstract);planning(abstract);test-time compute(abstract);分类 cs.CL

AI总结 本研究提出Self-Correcting RAG框架,通过MMKP上下文选择和NLI引导的MCTS机制,提升复杂推理任务中的准确性和减少幻觉。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20868 2026-04-14 cs.LG cs.AI cs.CL 75%

StyleBench: Evaluating thinking styles in Large Language Models

StyleBench: 评估大型语言模型中的思维风格

Junyu Guo, Shangding Gu, Ming Jin, Costas Spanos, Javad Lavaei

机构 * University of California, Berkeley(加州大学伯克利分校) Virginia Tech(弗吉尼亚理工大学)

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过StyleBench评估不同推理风格在大型语言模型中的表现,发现结构复杂度在特定任务和模型容量下提升准确性,同时探讨了推理策略选择的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11751 2026-04-14 cs.RO cs.AI 74%

Grounded World Model for Semantically Generalizable Planning

基于语义泛化的世界模型用于规划

Quanyi Li, Lan Feng, Haonan Zhang, Wuyang Li, Letian Wang, Alexandre Alahi, Harold Soh

机构 * Independent(独立) EPFL(瑞士联邦理工学院洛桑) Beihang University(北京航空航天大学) University of Toronto(多伦多大学) NUS(新加坡国立大学)

专题命中 规划推理 :planning(title);分类 cs.AI

AI总结 本文提出基于视觉-语言对齐潜在空间的世界模型,用于改进视觉-运动模型控制,实现更广泛的语义泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10502 2026-04-14 cs.AI 74%

CHAIRO: Contextual Hierarchical Analogical Induction and Reasoning Optimization for LLMs

CHAIRO:面向LLMs的上下文分层类比归纳与推理优化

Haotian Lu, Yuchen Mou, Bingzhe Wu

机构 * National Engineering Laboratory for Big Data System Computing Technology(国家大数据系统计算技术工程实验室) Shenzhen University(深圳大学) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(title);分类 cs.AI

AI总结 本文提出CHAIRO框架,通过类比示例提升规则归纳和决策可靠性,在内容审核中实现更准确和可解释的规则生成。

Comments Accepted to ACL 2026 main conference; under official publication process

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11540 2026-04-14 cs.AI 70%

A collaborative agent with two lightweight synergistic models for autonomous crystal materials research

一种用于自主晶体材料研究的双轻量协同模型协作代理

Tongyu Shi, Yutang Li, Zhanyuan Li, Qian Liu, Jie Zhou, Wenhe Xu, Yang Li, Dawei Dai, Rui He, Wenhua Zhou, Jiahong Wang, Xue-Feng Yu

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) University of Chinese Academy of Sciences(中国科学院大学) Institute for Advanced Study, Chengdu University(成都大学高等研究院) Key Laboratory of Cyberspace Big Data Intelligent Security, Ministry of Education, Chongqing University of Posts and Telecommunications(重庆邮电大学教育部网络空间大数据智能安全重点实验室)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出MatBrain,一种轻量级协作代理系统,通过双协同模型提升材料研究效率,显著优于大模型,减少硬件部署成本,并在催化剂设计中实现100倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11041 2026-04-14 cs.AI 70%

From Topology to Trajectory: LLM-Driven World Models For Supply Chain Resilience

从拓扑到轨迹:LLM驱动的世界模型用于供应链韧性

Jia Luo

机构 * Huazhong University and Science and Technology(华中科技大学)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出ReflectiChain框架,通过生成世界模型和回顾代理强化学习,提升供应链韧性,实验显示在极端场景下性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09596 2026-04-14 cs.AI cs.MA 70%

DERM-3R: A Resource-Efficient Multimodal Agents Framework for Dermatologic Diagnosis and Treatment in Real-World Clinical Settings

DERM-3R:一种资源高效的多模态代理框架,用于皮肤病诊断和治疗的现实世界临床应用

Ziwen Chen, Zhendong Wang, Chongjing Wang, Yurui Dong, Luozhijie Jin, Jihao Gu, Kui Chen, Jiaxi Yang, Bingjie Lu, Zhou Zhang, Jirui Dai, Changyong Luo, Xiameng Gai, Haibing Lan, Zhi Liu

机构 * School of Pharmacy, Nanjing University of Chinese Medicine(南京中医药大学药学院) Department of Dermatology, the Gulou Hospital of Traditional Chinese Medicine of Beijing(北京鼓楼中医医院皮肤科) Infectious disease department, Dongfang Hospital, Beijing University of Chinese Medicine(北京中医药大学东方医院感染科) College of Art and Science, university of Washington(华盛顿大学文理学院) Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系) Fudan Unversity(复旦大学) Zhejiang Lab(之江实验室) University College London(伦敦大学学院) Department of Dermatology, Inner Mongolia Hospital of Traditional Chinese Medicine(内蒙古自治区中医医院皮肤科) International Campus of Zhejiang University(浙江大学国际校区)

专题命中 规划推理 :reasoning(abstract);planning(abstract);分类 cs.AI

AI总结 本文提出DERM-3R框架,通过三个协作代理解决皮肤病诊断中的细粒度病变识别、多视角病变表示和综合推理问题,展示了其在资源受限下的高效性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28653 2026-04-14 cs.NE cs.SE 67%

BACE: LLM-based Code Generation through Bayesian Anchored Co-Evolution of Code and Test Populations

BACE:基于大语言模型的代码生成:通过贝叶斯锚定的代码与测试种群共演化

Kaushitha Silva, Srinath Perera

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 BACE通过贝叶斯锚定的共演化方法,改进代码生成中的测试反馈机制,提升代码与测试种群的协同进化性能。

Comments 10 Pages, 3 Figures. To appear in Proceedings of the 2026 Genetic and Evolutionary Computation Conference (GECCO '26), July 13-17, 2026, San Jose, Costa Rica

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17516 2026-04-14 cs.CL cs.AI cs.CY cs.LG 67%

SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors

SimBench:大型语言模型模拟人类行为能力的基准测试

Tiancheng Hu, Joachim Baumann, Lorenzo Lupo, Nigel Collier, Dirk Hovy, Paul Röttger

机构 * University of Cambridge(剑桥大学) Stanford University(斯坦福大学) Bocconi University(博科尼大学) University of Oxford(牛津大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 SimBench通过统一20个多样化的数据集,评估大型语言模型模拟人类行为的 fidelity,发现模型性能与模型大小呈对数线性关系,但与计算资源无关,且存在指令微调与模拟准确性之间的权衡。

Comments Accepted at ICLR 2026. Project Website: http://simbench.tiancheng.hu/ Data: https://huggingface.co/datasets/pitehu/SimBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09823 2026-04-14 eess.SY cs.SY 67%

Agentic Workflows for Resolving Conflict Over Shared Resources: A Power Grid Application

代理工作流用于解决共享资源上的冲突:一个电力网格应用

Shiva Poudel, Thiagarajan Ramachandran, Orestis Vasios, Andrew P. Reiman

专题命中 规划推理 :reasoning(abstract);chain-of-thought(abstract)

AI总结 本文提出一种协调多个代理的冲突解决框架,通过双边谈判、结构化调解和程序性(确定性)冲突解决模式,解决共享资源上的冲突,并在电力分配场景中验证了其性能。

Comments 6 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22942 2026-04-14 cs.MA 67%

ClawMobile: Rethinking Smartphone-Native Agentic Systems

ClawMobile:重新思考原生智能手机代理系统

Hongchao Du, Shangyu Wu, Qiao Li, Riwei Pan, Jinheng Li, Youcheng Sun, Chun Jason Xue

专题命中 规划推理 :reasoning(abstract);planning(abstract)

AI总结 本文提出ClawMobile,一种针对智能手机环境的代理系统架构,通过分层设计提升执行稳定性与可重复性,并探讨移动LLM运行时的关键挑战。

Comments Accepted at EuroMLSys 2026, 7 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17596 2026-04-14 cs.CV cs.AI cs.LG cs.RO 62%

PRIX: Learning to Plan from Raw Pixels for End-to-End Autonomous Driving

PRIX:从原始像素学习计划以实现端到端自动驾驶

Maciej K. Wozniak, Lianhang Liu, Yixi Cai, Patric Jensfelt

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) SCANIA(斯堪尼亚)

专题命中 规划推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 PRIX通过使用仅需摄像头数据的端到端驾驶架构,无需BEV表示和LiDAR,直接从原始像素预测安全轨迹,实现了高效且实用的自动驾驶解决方案。

Comments Accepted for Robotics and Automation Letters (RA-L) and will be presented at iROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07512 2026-04-14 cs.AI cs.LG 62%

Rhizome OS-1: Rhizome's Semi-Autonomous Operating System for Small Molecule Drug Discovery

Rhizome OS-1:Rhizome的半自主操作系统用于小分子药物发现

Yiwen Wang, Gregory Sinenka, Xhuliano Brace

机构 * Rhizome Research Inc.

专题命中 规划推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Rhizome OS-1通过多模态AI代理实现小分子药物发现的半自动化,结合计算化学、医药化学和专利代理功能,生成新颖分子并评估专利自由度,利用图扩散模型生成化学物质。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06806 2026-04-14 cs.CL cs.AI 62%

MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining

MachineLearningLM: 通过持续预训练扩展多示例上下文学习

Haoyu Dong, Pengkun Zhang, Mingzhe Lu, Yanzhen Shen, Guolin Ke

机构 * UCAS(中国科学院大学) Microsoft(微软) SCUT(华南理工大学) Stanford(斯坦福大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 MachineLearningLM通过持续预训练赋予大语言模型强大的上下文机器学习能力,同时保持其通用知识和推理能力,提升多示例任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11703 2026-04-14 cs.AI 57%

DreamKG: A KG-Augmented Conversational System for People Experiencing Homelessness

DreamKG: 一种为经历住房无家可归的人群增强知识图谱的对话系统

Javad M Alizadeh, Genhui Zheng, Chiu C Tan, Yuzhou Chen, Omar Martinez, Philip McCallion, Ying Ding, Chenguang Yang, AnneMarie Tomosky, Huanmei Wu

机构 * Temple University(天普大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of California Riverside(加州大学河滨分校) University of Central Florida(中佛罗里达大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 DreamKG通过整合知识图谱提升对话系统,为住房无家可归者提供准确及时的服务信息,其结合Neo4j知识图谱与结构化查询,有效处理时空敏感查询,初步评估显示在相关查询上优于Google Search AI。

Comments This manuscript has been accepted at the 14th IEEE International Conference on Healthcare Informatics (ICHI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11548 2026-04-14 cs.AI 57%

SemaClaw: A Step Towards General-Purpose Personal AI Agents through Harness Engineering

SemaClaw:通过Harness工程迈向通用个人AI代理的一步

Ningyan Zhu, Huacan Wang, Jie Zhou, Feiyu Chen, Shuo Zhang, Ge Chen, Chen Liu, Jiarou Wu, Wangyi Chen, Xiaofeng Mou, Yi Xu

机构 * Midea AIRC(美的AIRC)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 SemaClaw通过Harness工程推动个人AI代理发展,提出DAG-based两阶段混合代理团队编排方法、PermissionBridge行为安全系统、三级上下文管理架构和代理维基技能,提升AI代理的可控性与可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06879 2026-04-14 cs.IR cs.AI 57%

WisPaper: Your AI Scholar Search Engine

WisPaper:你的AI学者搜索引擎

Li Ju, Jun Zhao, Mingxu Chai, Ziyu Shen, Xiangyang Wang, Yage Geng, Chunchun Ma, Hao Peng, Guangbin Li, Tao Li, Chengyong Liao, Fu Wang, Xiaolong Wang, Junshen Chen, Rui Gong, Shijia Liang, Feiyan Li, Ming Zhang, Kexin Tan, Junjie Ye, Zhiheng Xi, Shihan Dou, Tao Gui, Yuankai Ying, Yang Shi, Yue Zhang, Qi Zhang

机构 * Fudan University(复旦大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出WisPaper,一种端到端代理系统,通过整合模块解决学术文献搜索中的语义限制和工作流程碎片化问题,提升文献发现、组织和跟踪效率。

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏