arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3024 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3024 篇

2603.01455 2026-04-22 cs.CV cs.AI cs.CL cs.IR cs.MM 62%

From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents

从逐字到概要:基于语义信息瓶颈的金字塔多模态记忆压缩用于长视界视频智能体

Niu Lian, Yuting Wang, Hanshu Yao, Jinpeng Wang, Bin Chen, Yaowei Wang, Min Zhang, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳校区) Peng Cheng Laboratory(鹏城实验室)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出MM-Mem架构,通过金字塔多模态记忆压缩,结合语义信息瓶颈目标,实现长视界视频理解中的高效记忆组织与任务相关信息保留。

Comments Accepted by ACL 2026 Main. 17 pages, 7 figures, 8 tables. TL;DR: We propose MM-Mem, a cognition-inspired, dual-trace hierarchical memory framework for long-horizon video understanding grounded in Fuzzy-Trace Theory. It features adaptive memory compression via the Information Bottleneck and employs an entropy-driven top-down retrieval to access fine-grained details only when necessary

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18052 2026-04-21 cs.CR cs.AI cs.LG 62%

ExAI5G: A Logic-Based Explainable AI Framework for Intrusion Detection in 5G Networks

ExAI5G:一种用于5G网络入侵检测的基于逻辑的可解释人工智能框架

Saeid Sheikhi, Panos Kostakos, Lauri Loven

机构 * organization= Faculty of Information Technology Electrical Engineering, University of Oulu , addressline= , city= Oulu , postcode= 90570 , state= , country= Finland

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出ExAI5G框架,结合Transformer深度学习与逻辑可解释AI技术,实现高精度且透明的入侵检测,通过逻辑规则提取和解释评估方法,达到99.9%准确率和0.854宏F1分数,展示出模型推理的透明性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16871 2026-04-21 cs.AI cs.LG 62%

GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning

GRAIL:自主概念 grounding 用于神经符号强化学习

Hikaru Shindo, Henri Rößler, Quentin Delfosse, Kristian Kersting

机构 * Technical University of Darmstadt(达姆施塔特技术大学) Google Intrinsic(谷歌内在) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI)) Centre for Cognitive Science, TU Darmstadt(达姆施塔特技术大学认知科学中心)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 GRAIL通过环境交互自主 grounding 关系概念,利用大语言模型提供弱监督,提升在稀疏奖励和概念对齐问题中的性能,实验显示其在Atari游戏中表现优异。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20689 2026-04-20 cs.AI cs.CL 62%

WiseMind: a knowledge-guided multi-agent framework for accurate and empathetic psychiatric diagnosis

WiseMind: 一种基于知识的多智能体框架,用于准确且富有同理心的精神病诊断

Yuqi Wu, Guangya Wan, Jingjing Li, Shengming Zhao, Lingfeng Ma, Tianyi Ye, Ion Pop, Yanbo Zhang, Jie Chen

机构 * College of Biomedical Engineering(生物医学工程学院) Fudan University(复旦大学) Department of Electrical and Computer Engineering(电气与计算机工程系) University of Alberta(阿尔伯塔大学) University of Virginia(弗吉尼亚大学) McIntire School of Commerce(麦金尼商学院) School of Data Science(数据科学学院) Department of Psychiatry(精神病学系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 WiseMind通过整合理性与情感智能体,结合DSM-5知识图谱,提升了精神病诊断的准确性与同理心,其在1206次模拟对话和180次真实交互中达到85.6%的诊断准确率,超越了单智能体方法。

Comments Accepted at npj Digital Medicine (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15272 2026-04-17 cs.PL cs.AI cs.LG 62%

Prism: Symbolic Superoptimization of Tensor Programs

Prism: 张量程序的符号超优化

Mengdi Wu, Xiaoyu Jiang, Oded Padon, Zhihao Jia

机构 * Carnegie Mellon University(卡内基梅隆大学) Tsinghua University(清华大学) Weizmann Institute of Science(魏茨曼科学研究院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Prism通过符号化层级表示实现张量程序的符号超优化,结合符号推理与自动调优,提升效率并减少优化时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14749 2026-04-17 cs.CL cs.AI 62%

Which bird does not have wings: Negative-constrained KGQA with Schema-guided Semantic Matching and Self-directed Refinement

没有翅膀的鸟:带有模式引导语义匹配和自导向细化的负约束知识图谱问答

Midan Shim, Seokju Hwang, Kaehyun Um, Kyong-Ho Lee

机构 * Department of Computer Science, Yonsei University(延世大学计算机科学系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出负约束知识图谱问答任务NEST-KGQA,设计PyLF逻辑形式和CUCKOO框架,通过模式引导语义匹配和自导向细化提升负约束问题的解答能力。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11427 2026-04-17 cs.CL cs.AI 62%

METRO: Towards Strategy Induction from Expert Dialogue Transcripts for Non-collaborative Dialogues

METRO:面向非协作对话的专家对话 transcripts 中的策略诱导

Haofu Yang, Jiaji Liu, Chen Huang, Faguo Wu, Wenqiang Lei, See-Kiong Ng

机构 * National University of Singapore(新加坡国立大学) Nankai University(南开大学) Sichuan University(四川大学) School of Artificial Intelligence, Beihang University(北航人工智能学院) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算高级创新中心) Key Laboratory of Mathematics, Informatics and Behavioral Semantics (LMIB)(数学、信息学与行为语义学重点实验室(LMIB)) Engineering Research Center of Machine Learning and Industry Intelligence, Ministry of Education, China(教育部机器学习与工业智能工程研究中心,中国)

专题命中 逻辑推理 :planning(abstract);分类 cs.CL、cs.AI

AI总结 METRO 通过大规模语言模型从原始 transcripts 自动诱导策略动作和规划逻辑,提出策略森林结构,实验显示其在两个基准上性能优越,具有跨任务迁移能力。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13979 2026-04-16 cs.CL cs.AI cs.DB 62%

Leveraging LLM-GNN Integration for Open-World Question Answering over Knowledge Graphs

利用LLM-GNN集成进行知识图谱上的开放世界问答

Hussein Abdallah, Ibrahim Abdelaziz, Panos Kalnis, Essam Mansour

机构 * Concordia University(康科迪亚大学) IBM KAUST(科威特大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出GLOW系统,结合预训练GNN和LLM进行开放世界知识图谱问答,通过结构化提示引导LLM推理,提升多跳推理和缺失链接处理能力,在GLOW-BENCH基准上取得显著提升。

Comments 18 pages,6 figures,10 tables. https://aclanthology.org/2026.eacl-long.26/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13107 2026-04-16 cs.SE cs.AI cs.LG 62%

Can Coding Agents Be General Agents?

编码代理可以是通用代理吗?

Maksim Ivanov, Abhijay Rana, Gokul Prabhakaran

机构 * Agentic Labs

专题命中 逻辑推理 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨编码代理能否实现端到端业务流程自动化,发现其在简单任务上表现可靠,但在复杂任务上存在瓶颈,指出领域逻辑与代码执行的衔接是通用性关键障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12227 2026-04-15 cs.AI cs.CL 62%

Designing Reliable LLM-Assisted Rubric Scoring for Constructed Responses: Evidence from Physics Exams

设计可靠的LLM辅助评分系统用于构造响应:来自物理考试的证据

Xiuxiu Tang, G. Alex Ambrose, Ying Cheng

机构 * Department of Psychology, University of Notre Dame(诺特大学心理学系) Notre Dame Learning, University of Notre Dame(诺特大学学习中心)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了GPT-4o在物理考试构造响应评分中的可靠性,发现细粒度检查清单式评分优于整体评分,提示清晰的评分标准对AI辅助评分至关重要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10114 2026-04-14 cs.CL cs.AI 62%

CircuitSynth: Reliable Synthetic Data Generation

CircuitSynth:可靠的合成数据生成

Zehua Cheng, Wei Dai, Jiahao Sun, Thomas Lukasiewicz

机构 * University of Oxford(牛津大学) TU Wien(维也纳工业大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 CircuitSynth提出了一种新的神经符号框架,通过将语义推理与表层实现解耦,结合概率句法决策图和凸优化机制,实现高保真合成数据生成,确保逻辑约束和分布目标。

Comments 11 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08905 2026-04-13 cs.AI cs.LG 62%

StaRPO: Stability-Augmented Reinforcement Policy Optimization

StaRPO:稳定性增强的强化策略优化

Jinghan Zhang, Fengran Mo, Tharindu Cyril Weerasooriya, Ruimin Dai, Xiaoyan Han, Yanjie Fu, Dakuo Wang, Kunpeng Liu

机构 * Clemson University(克莱姆森大学) Université de Montréal(蒙特利尔大学) Accenture (United States)(埃森哲(美国)) Arizona State University(亚利桑那州立大学) Northeastern University(东北大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 StaRPO通过引入推理稳定性指标提升强化学习在复杂推理任务中的表现,通过ACF和PE指标增强逻辑稳定性和响应准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08468 2026-04-10 cs.LG cs.AI 62%

TTVS: Boosting Self-Exploring Reinforcement Learning via Test-time Variational Synthesis

TTVS: 通过测试时变分合成提升自我探索强化学习

Sikai Bai, Haoxi Li, Jie Zhang, Yongjiang Liu, Song Guo

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出TTVS框架,通过动态增强未标记测试查询流,使大推理模型自我进化,提升测试时适应性能,实验显示其在八种模型架构上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08284 2026-04-10 cs.CL cs.AI 62%

Distributed Multi-Layer Editing for Rule-Level Knowledge in Large Language Models

分布式多层编辑用于大语言模型中的规则级知识

Yating Wang, Wenting Zhao, Yaqi Zhao, Yongshun Gong, Yilong Yin, Haoliang Sun

机构 * School of Software, Shandong University(山东大学软件学院) Salesforce AI Research

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 研究针对规则级知识的编辑问题,提出分布式多层编辑方法,通过多层干预提升规则理解和实例可迁移性。

Comments 17 pages,3 figures. Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07897 2026-04-10 cs.AI cs.LG 62%

Visual Perceptual to Conceptual First-Order Rule Learning Networks

基于视觉感知的概念性一阶规则学习网络

Kun Gao, Davide Soldà, Thomas Eiter, Katsumi Inoue

机构 * Zhongguancun Academy(中关村学院) Vienna University of Technology (TU Wien)(维也纳技术大学) National Institute of Informatics(国立信息学研究所)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出γILP框架,通过图像常量替换到规则结构归纳的可微流程,解决图像数据中无标签学习规则及自动发明谓词的问题,实验证明其在符号关系数据和图像数据上均表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03925 2026-04-07 cs.CL cs.AI 62%

AdaptFuse: Training-Free Sequential Preference Learning via Externalized Bayesian Inference

AdaptFuse:通过外部化贝叶斯推断实现无需训练的序列偏好学习

Fangzhou Lin, Peiran Li, Shuo Xing, Siyuan Yang, Qianwen Ge, Kazunori Yamada, Ziming Zhang, Haichong Zhang, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯农工大学) Worcester Polytechnic Institute(伍斯特理工学院) Tohoku University(东北大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 AdaptFuse通过外部化贝叶斯推断实现无需训练的序列偏好学习,利用符号模块和冻结LLM结合熵自适应融合,提升推荐系统性能,无需敏感用户数据训练。

Comments 20 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05012 2026-04-07 cs.DB cs.AI cs.CL 62%

Making Prompts First-Class Citizens for Adaptive LLM Pipelines

使提示成为自适应大语言模型流水线中的第一公民

Ugur Cetintemel, Shu Chen, Alexander W. Lee, Deepti Raghavan, Duo Lu, Andrew Crotty

机构 * Brown University(布朗大学) Northwestern University(西北大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出SPEAR框架,通过结构化提示管理、动态提示细化和策略驱动控制,解决提示在流水线中的脆弱性和不透明性问题,提升重用性和运行时适应性。

Comments 6 pages, 2 figures, appears in CIDR'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00556 2026-04-02 cs.LG cs.AI cs.ET q-fin.CP q-fin.RM 62%

HabitatAgent: An End-to-End Multi-Agent System for Housing Consultation

HabitatAgent:一种端到端的多智能体系统用于住房咨询

Hongyang Yang, Yanxin Zhang, Yang She, Yue Xiao, Hao Wu, Yiyang Zhang, Jiapeng Hou, Rongshan Zhang

机构 * Fangdongdong(方东东) Tsinghua University(清华大学) Columbia University(哥伦比亚大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出HabitatAgent,一种基于LLM的多智能体系统,通过四个专业角色提供可审计且可靠的住房咨询流程,实现高准确率的住房选择支持。

Comments Accepted at the DMO-FinTech Workshop (PAKDD 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13191 2026-03-31 cs.CV cs.AI cs.CL 62%

CoPE-VideoLM: Leveraging Codec Primitives For Efficient Video Language Modeling

CoPE-VideoLM:利用编解码器原语实现高效的视频语言建模

Sayan Deb Sarkar, Rémi Pautrat, Ondrej Miksik, Marc Pollefeys, Iro Armeni, Mahdi Rad, Mihai Dusmanu

机构 * Microsoft Spatial AI Lab(微软空间人工智能实验室) Stanford University(斯坦福大学) ETH Zurich(苏黎世联邦理工学院)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CoPE-VideoLM,通过利用视频编解码器原语(如运动矢量和残差)减少计算开销,提升视频语言模型的效率和性能。

Comments Project Page: https://microsoft.github.io/CoPE

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28038 2026-03-31 cs.AI cs.LG 62%

Beyond the Answer: Decoding the Behavior of LLMs as Scientific Reasoners

超越答案:解码LLM作为科学推理者的行为

Rohan Pandey, Eric Ye, Michael Li

机构 * University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文通过定制遗传Pareto算法优化提示,研究提示对科学推理行为的影响,揭示模型特定的局部逻辑,并探讨其可迁移性和脆弱性。

Comments Accepted at the Post-AGI Science and Society Workshop at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27626 2026-03-31 cs.CL cs.AI 62%

Umwelt Engineering: Designing the Cognitive Worlds of Linguistic Agents

环境工程:设计语言代理的认知世界

Rodney Jehu-Appiah

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出Umwelt工程作为代理设计栈的第三层,通过两个实验探讨改变推理媒介对认知的影响,发现约束语言模型在伦理推理和分类任务中表现更优,且通过认知重构和多样化机制提升性能。

Comments 24 pages, 2 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15090 2026-03-27 cs.CL cs.AI 62%

Mapping the Course for Prompt-based Structured Prediction

基于提示的结构预测路径映射

Matt Pauk, Maria Leonor Pacheco

机构 * University of Colorado Boulder(科罗拉多大学博尔德分校)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出结合大语言模型与组合推理,提升结构预测的准确性和一致性,并通过实验验证符号推理在下游任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21542 2026-03-26 cs.RO cs.AI cs.CV cs.LG 62%

E0: Enhancing Generalization and Fine-Grained Control in VLA Models via Tweedie Discrete Diffusion

E0: 通过 Tweedie 离散扩散增强 VLA 模型的泛化能力与细粒度控制

Zhihao Zhan, Jiaying Zhou, Likui Zhang, Qinhan Lv, Hao Liu, Jusheng Zhang, Weizheng Li, Ziliang Chen, Tianshui Chen, Ruifeng Zhai, Keze Wang, Liang Lin, Guangrun Wang

机构 * Sun Yat-sen University(中山大学) Guangdong Key Laboratory of Big Data Analysis(广东大数据分析与处理重点实验室) X-Era AI Lab(X-Era人工智能实验室) Guangdong University of Technology(广东工业大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出 E0 框架,通过离散扩散方法提升 VLA 模型在多任务和多视角下的泛化能力,并实现精细可控的动作生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21145 2026-03-24 cs.DC cs.AI cs.LG cs.SC 62%

NeSy-Edge: Neuro-Symbolic Trustworthy Self-Healing in the Computing Continuum

NeSy-Edge:神经符号可信自愈在计算连续体中的应用

Peihan Ye, Alfreds Lapkovskis, Alaa Saleh, Qiyang Zhang, Praveen Kumar Donta

机构 * Department of Computer Systems and Sciences(计算机系统与科学系) University of Oulu(奥卢大学) Peking University(北京大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出NeSy-Edge框架,通过边缘优先设计,在资源受限的边缘节点进行本地感知与推理,结合云模型进行最终诊断,实现计算连续体中的可信自愈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20185 2026-03-23 cs.CV cs.AI cs.CL 62%

VideoSeek: Long-Horizon Video Agent with Tool-Guided Seeking

VideoSeek: 长时程视频代理与工具引导的搜索

Jingyang Lin, Jialian Wu, Jiang Liu, Ximeng Sun, Ze Wang, Xiaodong Yu, Jiebo Luo, Zicheng Liu, Emad Barsoum

机构 * AMD(AMD公司) University of Rochester(罗切斯特大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 VideoSeek通过视频逻辑流程主动寻找关键证据,减少帧数使用,提升视频理解能力,实验显示其在视频理解和推理任务中表现优异。

Comments Accepted at CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12797 2026-03-19 cs.LG cs.AI q-bio.GN 62%

Genomic Next-Token Predictors are In-Context Learners

基因组下一个标记预测器是上下文学习者

Nathan Breslow, Aayush Mishra, Mahler Revsine, Michael C. Schatz, Anqi Liu, Daniel Khashabi

机构 * Department of Computer Science, Johns Hopkins University(约翰霍普金斯大学计算机科学系)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨基因组序列中是否能像语言模型一样通过大规模预测训练自发产生上下文学习能力,发现基因组模型在模式归纳中表现出对数线性增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16733 2026-03-18 cs.AI cs.CL cs.SE 62%

IQuest-Coder-V1 Technical Report

IQuest-Coder-V1 技术报告

Jian Yang, Wei Zhang, Shawn Guo, Zhengmao Ye, Lin Jing, Shark Liu, Yizhi Li, Jiajun Wu, Cening Liu, X. Ma, Yuyang Song, Siwei Wu, Yuwen Li, L. Liao, T. Zheng, Ziling Huang, Zelong Huang, Che Liu, Yan Xing, Renyuan Li, Qingsong Cai, Hanxu Yan, Siyue Wang, Shikai Li, Jason Klein Liu, An Huang, Yongsheng Kang, Jinxing Zhang, Chuan Hao, Haowen Wang, Weicheng Gu, Ran Tao, Mingjie Tang, Peihao Wu, Jianzhou Wang, Xianglong Liu, Weifeng Lv, Bryan Dai

机构 * IQuest Coder Team(IQuest Coder团队)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文介绍IQuest-Coder-V1系列模型,通过代码流多阶段训练范式提升软件逻辑动态演化能力,结合预训练、中训练和后训练阶段,实现代码智能在代理软件工程、编程竞赛和复杂工具使用中的先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14221 2026-03-17 cs.RO cs.AI cs.LG 62%

A Real-Time Neuro-Symbolic Ethical Governor for Safe Decision Control in Autonomous Robotic Manipulation

面向自主机器人操作的安全决策控制实时神经符号伦理控制器

Aueaphum Aueawatthanaphisut, Kuepon Aueawatthanaphisut

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种实时神经符号伦理控制器,通过整合伦理推理与风险评估机制,提升自主机器人操作中的安全决策能力,实验验证了其在不同人类接近度和操作风险下的有效性。

Comments 6 pages, 6 figures, 5 equations

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13258 2026-03-17 cs.LG cs.AI cs.SE 62%

Your Code Agent Can Grow Alongside You with Structured Memory

你的代码代理可以与你一同成长,借助结构化记忆

Yi-Xuan Deng, Xiaoqin Liu, Yi Zhang, Guo-Wei Yang, Shuojin Yang

机构 * Tsinghua University(清华大学)

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出MemCoder框架,通过结构化记忆和实时反馈实现人类与AI的持续共进化,提升代码代理在复杂软件工程任务中的性能。

Comments Code Agent

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12305 2026-03-16 cs.LG cs.AI 62%

HCP-DCNet: A Hierarchical Causal Primitive Dynamic Composition Network for Self-Improving Causal Understanding

HCP-DCNet:一种用于自我改进因果理解的分层因果原语动态组合网络

Ming Lei, Shufan Wu, Christophe Baehr

专题命中 逻辑推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出HCP-DCNet,通过分层因果原语动态组合网络实现因果理解的自我改进,提升因果发现、反事实推理和组合泛化能力。

Comments 17 pages, 2 figures, submitted to a journal and under review

详情

展开后加载摘要…

URL PDF HTML 收藏