arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 486 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 486 篇

2607.07903 2026-07-10 cs.CR cs.AI 新提交 57%

Mechanistic Interpretability of LLM Jailbreaks via Internal Attribution Graphs

通过内部归因图对大语言模型越狱进行机制性可解释性研究

Anupam Wagle, Ifrat Ikhtear Uddin, Chaowei Zhang, Longwei Wang

机构 * Department of Computer Science, University of South Dakota(南达科他大学计算机科学系) School of Information and Artificial Intelligence, Yangzhou University(扬州大学信息与人工智能学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究大语言模型越狱漏洞,通过构建内部计算图揭示对抗攻击引发的内部推理转变,提出统一框架实现因果诊断,实验证明计算图偏差与不安全行为相关,干预可提升模型鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06101 2026-07-08 cs.SE cs.AI cs.CY cs.HC 新提交 57%

Agents That Teach: Towards Designing Incidental Learning Back into AI-Assisted Software Development

教学型智能体:将偶然学习重新融入人工智能辅助软件开发的设计探索

Rohit Mehra, Samdyuti Suri, Prithviraj K Tagadinamani, Kapil Singi, Vikrant Kaulgud, Adam P. Burden

机构 * Accenture Labs, India(Accenture实验室,印度) Accenture, USA(Accenture,美国)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 探讨人工智能编码智能体使开发者过度依赖而失去偶然学习机会并积累知识债务的问题,提出六项设计原则,展示基于“教学型智能体”概念的“SHIELD”系统,推动形成生产力与学习互补的学习感知开发环境。

Comments 5 pages. To be published in the proceedings of 41st International Conference on Automated Software Engineering (ASE '26), October 12-16, 2026, Munich, Germany (New Ideas and Emerging Results Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05790 2026-07-08 cs.AI 新提交 57%

Controlling Tool Use with Heading-Specific Activation Steering

通过特定标题激活控制工具使用

Yuqi Chen, Vincent Siu, Yang Liu, Dawn Song, Chenguang Wang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究工具增强大语言模型中工具使用决策的稳定内部表示,通过从标题锚点位置提取引导向量对工具调用行为进行双向因果控制,发现其因果有效性与线性结构不符,还区分了工具使用引导向量与参数化概念的引导向量,二者关系待解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05680 2026-07-08 cs.CY cs.AI cs.HC 新提交 57%

Beyond Accuracy: How Humans Evaluate Legally Correct but Socially Controversial Legal Advice from Machines

超越准确性:人类如何评估来自机器的法律正确但社会有争议的法律建议

Benjamin Minhao Chen, Zhiyu Li

机构 * University of Hong Kong(香港大学) Durham University(达灵顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究探讨人类如何评估机器给出的法律正确但有社会争议的建议。通过对3348名中国大陆成年人的调查实验发现,归因于人工智能系统对感知合理性无净影响,提供法律推理可提高合理性,公众反应受规范期望平衡影响,对相关理论和系统设计有启示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04562 2026-07-07 cs.AI cs.NE 新提交 57%

Heaviside Continuity of Rolling Coefficients for Eliminating Epistemic Entropy in Large Language Models

用于消除大语言模型认知熵的滚动系数的海维赛德连续性

MY Pitsane, Hope Mogale

机构 * North-West University, RSA(南非北开普大学) University of Pretoria, RSA(南非彼得里亚大学) Mankind Research Labs, Sandton(沙顿人类研究实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究大语言模型输出难检测错误的问题,提出海维赛德连续性的滚动系数框架,将推理重新表述为谓词门控状态转换,结合模型置信度与并行验证信号,防止无效状态传播,降低认知熵。

Comments A First draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04469 2026-07-07 cs.CL 新提交 57%

Don't Commit Alone: Joint Token Commitment in Diffusion Large Language Models

不要单独提交:扩散大语言模型中的联合令牌提交

Lin Yao

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院) Zhongguancun Academy(中关村科学城)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 研究扩散大语言模型中多令牌提交问题,提出CoCommit方法,通过标记门控协调步骤延迟提交,重新应用骨干网络最后n层使标记位置协调,近似联合模式解码,提高推理和精确答案任务准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03978 2026-07-07 cs.HC cs.AI cs.CV 新提交 57%

Scalable Semantic Steering of Embedding Projections

嵌入投影的可扩展语义引导

Wei Liu, Eric Krokos, Kirsten Whitley, Rebecca Faust, Chris North

机构 * Virginia Tech(弗吉尼亚理工学院) Department of Defense(国防部) Tulane University(路易斯安那州立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究高维数据嵌入的低维投影语义结构问题,提出可扩展语义引导方法,将语义计算从单个项目转移到用户定义组,通过单LLM调用为组生成结构化配置文件,减少LLM调用并在多模态嵌入中有效应用。

Comments Accepted as a short paper at IEEE VIS 2026. 5 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03350 2026-07-07 cs.CR cs.AI cs.SE 新提交 57%

LLM-Enhanced Hierarchical Heterogeneous Graph Representation Learning for Malicious Python Package Detection

用于恶意Python包检测的基于大语言模型增强的分层异构图表示学习

Hang Gao, Xiaoyu Chen, Baoquan Cui, Zhen Tang, Peng Qiao, Fengge Wu, Jian Zhang

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出用于恶意Python包检测的LLM增强分层异构图表示学习框架,构建分层异构代码图,利用LLMs推理功能语义角色,开发分层异构图神经网络并结合功能级归因机制,实验表明该框架性能优越。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02551 2026-07-07 cs.CV cs.AI 新提交 57%

DELTAVID: Enhancing Fine-Grained Spatiotemporal Perception with Cross-Video Differences

DELTAVID:利用跨视频差异增强细粒度时空感知

Yankai Yang, Yancheng Long, Bin Wen, Fan Yang, Tingting Gao, Han Li, Shuo Yang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Kuaishou Technology(快手科技)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 研究针对视频多模态大语言模型缺乏精确局部时空感知问题,提出DELTAVID框架,将跨视频找差异转化为可训练感知信号,还引入相关数据集,提升了跨视频差异理解性能并能迁移到通用视频理解基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01936 2026-07-03 cs.MA cs.AI 新提交 57%

CausalSteward: An Agentic Divide-Conquer-Combine Copilot for Causal Discovery

CausalSteward: 一种用于因果发现的智能分治-合并副驾驶

Nicholas Tagliapietra, Gian Lorenzo Marchioni, Moritz Willig, Juergen Luettin, Lavdim Halilaj, Kristian Kersting

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出CausalSteward多智能体框架,通过分治策略将高维变量迭代划分并分别分析,融合先验知识与数据驱动方法,解决因果可识别性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01287 2026-07-03 cs.RO cs.AI cs.SY eess.SY 新提交 57%

Adaptive Companionship for Group-Following Robots: Handling Dynamically Changing Group Formations

群体跟随机器人的自适应陪伴:处理动态变化的群体编队

Cong-Thanh Vu, Yen-Chen Liu

机构 * National Cheng Kung University(国立成功大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出基于视觉语言模型的自适应群体陪伴方法,通过语义推理推断同伴位置、维持社交距离并理解群体动态,结合MPPI控制器实现稳定安全跟随,在五个场景中成功率提升15%,碰撞率降低25%。

Comments Accepted to the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02329 2026-07-03 cs.AI cond-mat.mtrl-sci physics.comp-ph 新提交 57%

Grounded autonomous research: a fault-tolerant LLM pipeline from corpus to manuscript in frontier computational physics

基于语料库的前沿计算物理容错LLM流水线:从语料到论文的自主研究

Haonan Huang

机构 * Princeton University(普林斯顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出一个端到端LLM流水线,从11,083篇arXiv论文语料库出发,自主完成前沿计算物理研究,包括构思方向、复现文献、第一性原理计算和撰写论文,通过冗余设计实现容错。

Comments 39 pages, 5 figures. Accepted at the ICML 2026 AI for Science Workshop (https://openreview.net/forum?id=R5YXaPgUAx). Includes the pipeline-generated companion physics manuscript as an appendix. Data and scaffolding archive: https://doi.org/10.5281/zenodo.21126996

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00856 2026-07-02 q-fin.CP cs.LG 新提交 57%

Shapley in Context: Explaining Financial Language with Domain Expertise

语境中的Shapley:利用领域专业知识解释金融语言

Dangxing Chen, Pengzhan Guo

机构 * Zu Chongzhi Center, Duke Kunshan University(杜克昆山大学祖冲之中心) Digital Innovation Research Center, Duke Kunshan University(杜克昆山大学数字创新研究中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 研究Shapley值在大型语言模型金融文本解释中的适用性,通过理论分析和实验验证其与金融领域知识的一致性。

Comments European Journal of Finance

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01084 2026-07-02 cs.AI 新提交 57%

Can Agents Generalize to the Open World? Unveiling the Fragility of Static Training in Tool Use

智能体能否泛化到开放世界?揭示工具使用中静态训练的脆弱性

Song-Lin Lv, Weiming Wu, Rui Zhu, Zi-Jian Cheng, Lan-Zhe Guo

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 针对LLM智能体在真实场景中因查询、工具集和交互动态变化而性能下降的问题,形式化定义了开放世界工具使用问题,构建了四层层次的环境偏移框架,并通过实验揭示了监督微调和强化学习训练智能体在面对开放环境偏移时的脆弱性,提出了扰动增强微调策略以提升鲁棒性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00828 2026-07-02 cs.DB cs.AI 新提交 57%

Exploring the Semantic Gap in Agentic Data Systems: A Formative Study of Operationalization Failures in Analytical Workflows

探索智能体数据系统中的语义鸿沟:分析工作流中操作化失败的形成性研究

Jalal Mahmud, Eser Kandogan

机构 * Megagon Labs(Megagon实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本研究通过跨领域分析236个分析意图,识别出153种反复出现的操作化失败,归纳为五类语义鸿沟,揭示用户分析概念与系统可用信息之间的差距,并提出未来智能体数据系统需要更丰富的语义表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00048 2026-07-02 cs.SE cs.AI 新提交 57%

Comparing Large Language Models on Scrum Certification-Style Questions: Accuracy, Stability, and Error Patterns

在Scrum认证风格问题上比较大型语言模型:准确性、稳定性和错误模式

Robson Alves Vilar, Emanuel Dantas Filho, Ademar França de Sousa Neto, Mirko Perkusich, Danyllo Wagner Albuquerque, João Paiva, Kyller Gorgônio, Angelo Perkusich

专题命中 其他推理 :chain-of-thought(abstract);分类 cs.AI

AI总结 评估GPT-5 mini、Gemini 3 Flash和DeepSeek Chat 3.2在993个Scrum认证问题上的表现,发现模型间差异显著,Gemini 3 Flash准确率最高,错误模式具有系统性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01125 2026-07-02 cs.LG math.OC 新提交 57%

ZO-Act: Efficient Zeroth-Order Fine-Tuning via One-Shot Activation-Informed Low-Rank Subspaces

ZO-Act: 通过一次性激活信息低秩子空间实现高效零阶微调

Xun Dong, Yibo Xu, Naigang Wang, Xin Li, Penghang Yin, Zi Yang

机构 * University at Albany, SUNY(纽约州立大学奥尔巴尼分校) IBM T. J. Watson Research Center(IBM托马斯·J·沃森研究中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 提出ZO-Act方法,利用输入激活构建固定低秩子空间,仅优化系数矩阵,降低扰动维度并支持Adam优化器,实现高效零阶微调,在多个LLM上取得一致提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27382 2026-06-29 cs.AI 新提交 57%

AI-Model Network: Concept, Current State and Future

AI模型网络:概念、现状与未来

Li Zhetao, Zeng Xiyu, Wang Jianhui, Xiao Yong, Liu Zhongren, Wu Junru, Lai Junjie, Huang Jijun, Long Saiqin

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文借鉴互联网发展,提出全球AI模型网络(AI-ModelNet)概念,通过模型间通路实现互联、能力共享与协同推理,并验证了原型系统可行性。

Comments 31 pages, 14 figures

Journal ref Journal of Computer Research and Development, 2026, 63(5): 1305-1318

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27161 2026-06-26 cs.AI 新提交 57%

TOPS: First-Principles Visual Token Pruning via Constructing Token Optimal Preservation Sets for Efficient MLLM Inference

TOPS:通过构建令牌最优保留集实现高效多模态大语言模型推理的第一性原理视觉令牌剪枝

Tinghao Wang, Yichen Guo, Rui Huang, Zheng Lu, Qizhe Zhang, Chenxi Li, Yuan Zhang, Jiajun Cao, Zhirong Shen, Yaosong Du, Guangyan Gan, Wenya Wang, Lin William Cong, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) University of Electronic Science and Technology of China(电子科技大学) Nanyang Technological University(南洋理工大学) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出TOPS方法,基于信息论分析确立任务相关性、信息覆盖和语义多样性三大原则,无训练且模型无关地剪枝视觉令牌,在LLaVA-NeXT上剪除77.8%令牌仍保持甚至提升性能。

Comments 27 pages, 18 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26669 2026-06-26 cs.AI 新提交 57%

SKILL-DISCO: Distilling and Compiling Agent Traces into Reusable Procedural Skills

SKILL-DISCO:将智能体轨迹蒸馏和编译为可重用的程序性技能

Zhongxin Guo, Danrui Qi, Hanwen Gu, Peng Cheng, Yongqiang Xiong

机构 * Microsoft Research(微软研究院) Beijing Foreign Studies University(北京外国语大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出SkillDisCo框架,从成功轨迹中蒸馏可重用参数化控制流子图并编译为可调用、可执行、可验证的程序性技能,在ALFWorld和WebArena上提升成功率并减少智能体步数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25041 2026-06-26 cs.CV cs.AI cs.GR cs.SD 新提交 57%

Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models

Wan-Streamer v0.1: 端到端实时交互基础模型

Lianghua Huang, Zhi-Fan Wu, Wei Wang, Yupeng Shi, Mengyang Feng, Junjie He, Chen-Wei Xie, Yu Liu, Jingren Zhou, Ang Wang, Bang Zhang, Baole Ai, Chen Liang, Cheng Yu, Chongyang Zhong, Jinwei Qi, Kai Zhu, Pandeng Li, Peng Zhang, Wenyuan Zhang, Xinhua Cheng, Yitong Huang, Yun Zheng, Yuzheng Wang, Zoubin Bi

机构 * Alibaba Group(阿里巴巴集团)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Wan-Streamer,一种原生流式、端到端的交互基础模型,通过单一Transformer联合建模语言、音频和视频,实现低延迟全双工音视频交互,无需外部模块。

Comments Website: https://wan-streamer.com

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24369 2026-06-25 cs.AI cs.DC cs.NI cs.PF 新提交 57%

Accelerating Disaggregated RL for Visual Generative LLMs with Diffusion-Based Parallelism and Trainer-Assisted Generation

加速面向视觉生成式大语言模型的解耦强化学习:基于扩散并行与训练器辅助生成

Sijie Wang, Zhengyu Qing, Zhiqiang Tan, Yiming Yin, Yeqing Zhang, Yaoyuan Wang, Qiang Wang, Xiaowen Chu, Shaohuai Shi

机构 * School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与技术学院) Data Science and Analytics Thrust, The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)数据科学与分析学域) Huawei Technologies Ltd.(华为技术有限公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出解耦强化学习框架DigenRL,通过生成轴流水线、时间步并行和弹性训练器辅助生成,解决扩散生成式大语言模型中执行气泡问题,实现1.56-2.10倍吞吐提升。

Comments Withdrawn by the authors pending resolution of intellectual property and institutional disclosure requirements

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17945 2026-06-25 cs.AI 新提交 57%

Small Initialization Matters for Large Language Models

小初始化对大语言模型至关重要

Liangkai Hang, Junjie Yao, Zhiyu Li, Feiyu Xiong, Hongkang Yang, Zhi-Qin John Xu

机构 * School of Mathematical Sciences, Shanghai Jiao Tong University(上海交通大学数学科学学院) Institute of Natural Sciences, Shanghai Jiao Tong University(上海交通大学自然科学研究院) MemTensor (Shanghai) Technology Co., Ltd.(上海记忆张量科技有限公司) Institute for Advanced Algorithms Research(先进算法研究所)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文发现减小初始化尺度能持续改善大语言模型预训练,尤其在推理任务上提升显著,并揭示了小初始化驱动参数从低复杂度结构向丰富表示演化的机制。

Comments 26 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24616 2026-06-24 cs.AI cs.PF econ.GN q-fin.EC 新提交 57%

AI Tokenomics: The Economics of Tokens, Computation, and Pricing in Foundation Models

AI Tokenomics:基础模型中的代币、计算与定价经济学

Quanyan Zhu

机构 * New York University Tandon School of Engineering(纽约大学坦登工程学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出AI代币经济学框架,研究代币在AI系统中的生成、消耗、定价、分配与优化,揭示代币支出与经济价值的区别,并指出开放研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22486 2026-06-23 cs.CV cs.AI cs.HC 新提交 57%

Human and AI collaboration for pulmonary nodule segmentation

人类与AI协作进行肺结节分割

Hongqiao Dong, Wenhao Chi, Ruobing Liang, Xiaokui Yang, Wenhua Liang, Peng Hou, Wenjun Pu, Yipeng Zhao, Ping Chen, Haiping Liu, Jianxing He, Bo Liu

机构 * State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(数学科学国家重点实验室,数学与系统科学研究院,中国科学院) PET/CT Center, The First Affiliated Hospital of Guangzhou Medical University(广州医科大学第一附属医院PET/CT中心) Department of Thoracic Surgery and Oncology, The First Affiliated Hospital of Guangzhou Medical University(广州医科大学第一附属医院胸外科与肿瘤科) Department of Mathematical Science, Tsinghua University(清华大学数学科学系) Yau Mathematical Sciences Center, Tsinghua University(清华大学尤金数学科学中心) China State Key Laboratory of Respiratory Disease & National Clinical Research Centre for Respiratory Disease, Guangzhou, China(中国呼吸疾病国家重点实验室及呼吸疾病临床研究中心,广州,中国) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院) National Center for Respiratory Medicine, National Clinical Research Center for Respiratory Disease, Guangzhou Institute of Respiratory Health, The First Affiliated Hospital of Guangzhou Medical University(呼吸医学国家中心、呼吸疾病临床研究中心、广州呼吸健康研究院、广州医科大学第一附属医院)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Hi-Seg框架,基于SAM通过人类迭代优化提示实现肺结节分割,在12中心1179例CT上平均Dice达85%,优于多种深度学习模型,并降低标注时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22110 2026-06-23 cs.SE cs.AI cs.HC 新提交 57%

TraceView: Interactive Visualization of Agentic Program Repair Trajectories

TraceView: 智能体程序修复轨迹的交互式可视化

Amirali Sajadi, Tu Nguyen, Kimmie Huynh, Esteban Parra, Preetha Chatterjee

机构 * Belmont University(贝尔蒙特大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出TraceView工具,通过交互式可视化和语义关系标注,帮助开发者诊断LLM-based自动程序修复代理的失败原因,支持轨迹扫描与理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21822 2026-06-23 cs.PL cs.AI cs.SE 新提交 57%

CNnotator: LLM-Guided Memory Safety Annotation Synthesis

CNnotator: LLM引导的内存安全注释合成

Twain Byrnes, Mike Dodds

机构 * Carnegie Mellon University(卡内基梅隆大学) Galois, Inc.(Galois公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出CNnotator工具,利用大语言模型自动生成CN规范来标注C代码的内存使用模式,OpenAI o3模型首次尝试成功率达90%,表明AI辅助注释对实际C代码库可行。

Comments 6 pages. Published at ReCode 2026 (1st Workshop on Code Translation, Transformation, and Modernization), co-located with ICSE 2026. This version corrects the description of the property-based testing backend (Bennet, built on Fulminate) relative to the published version

Journal ref Proceedings of the 1st Workshop on Code Translation, Transformation, and Modernization (ReCode '26), April 12-18, 2026, Rio de Janeiro, Brazil. ACM, New York, NY, USA, 6 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21151 2026-06-23 cs.SE cs.AI cs.NI 新提交 57%

Context-Aware Generative AI for Automated Telecom Test Script Generation

上下文感知的生成式AI用于自动化电信测试脚本生成

Gautam Prasad, Chandramohan T. N., Joy Bose

机构 * Ericsson R&D Bangalore(爱立信印度班加罗尔研发中心)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出一种上下文感知的生成式AI框架,通过实时知识图谱和增量引擎检测变化,仅更新受影响的测试,减少人工并加速测试周期。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21048 2026-06-23 cs.CL 新提交 57%

Event Ontology Expansion via LLM-Based Conceptualization

基于LLM概念化的事件本体扩展

Weicheng Ren, Zixuan Li, Long Bai, Xiaolong Jin, Jiafeng Guo, Xueqi Cheng

机构 * State Key Laboratory of AI Safety(人工智能安全国家重点实验室) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 提出ConceptE框架,利用LLM从句子和触发词中提取概念级语义,增强事件聚类和层次扩展,在ACE、ERE和MAVEN上显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20768 2026-06-23 cs.CV cs.AI eess.IV 新提交 57%

UniSLAD: A Unified Framework for Structural and Logical Industrial Visual Anomaly Detection

UniSLAD: 面向结构与逻辑工业视觉异常检测的统一框架

Changyi Li, Chao Yang, Yu Xiao, Kari Tammi

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 提出UniSLAD统一框架,无需额外训练即可同时检测结构异常和逻辑异常,通过双特征提取器与双粒度特征表示模块,在工业基准上实现99.4%和93.1%的检测性能。

Comments This work has been accepted for publication in the Proceedings of the 2026 IEEE International Conference on Automation Science and Engineering (CASE)

详情

展开后加载摘要…

URL PDF HTML 收藏