arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

代码大模型 / AI 编程

代码生成、软件工程智能体、程序修复、测试生成和开发者工具。

共收录 159 信号源:cs.SE, cs.CL, cs.AI, cs.LG, cs.PL

1. 仓库级理解 159 篇

2606.14470 2026-06-23 cs.AI cs.CL cs.LG 新提交 67%

GitOfThoughts: Version-Controlled Reasoning and Agent Memory You Can Replay, Diff, and Merge

GitOfThoughts: 版本控制的推理与可回放、差异比较和合并的智能体记忆

Pavan C Shekar, Abhishek H S, Aswanth Krishnan

机构 * QpiAI

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 提出GitOfThoughts框架,将智能体推理树存储为git仓库,实现推理的可回放、审计和合并;实验表明,对于新问题,任何记忆格式均不能可靠提升准确率,仅当检索案例与当前问题高度相似(>0.8)时才有显著提升,且收益来自答案检索而非方法迁移。

Comments 10 pages, 1 figure, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09934 2026-08-12 cs.CL cs.AI 新提交 62%

LLM Agents Factory: Retrieval of Domain-Specific LLM Agents

LLM智能体工厂:领域特定大语言模型智能体的检索

Vitalii Belov, Artyom Sosedka, Andrey Sakhovskiy, Elizaveta Kovtun, Artyom Boyarskikh, Semen Budennyy

机构 * Sber AI Moscow Institute of Physics and Technology(莫斯科物理技术学院) National University of Science and Technology MISIS(莫斯科国立科学技术大学MISIS) Skolkovo Institute of Science and Technology(斯科尔科沃科学技术研究所) Artificial Intelligence Research Institute(人工智能研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI

AI总结 本研究提出LLM Agents Factory框架,通过检索2万余个预设智能体配置文件按需构建领域特定智能体,在多基准测试中实现高准确率与低推理成本,为工业应用提供动态智能体生成的替代方案。

Comments 7 pages, 1 figure, SIGIR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03263 2026-08-05 cs.LG cs.AI 新提交 62%

The Ignition Is Real, and It Lives at the Readout: Latent composition, difficulty-clocked ignition, and the interface-constituted commit in a recurrent-depth reasoner

激活是真实存在的,且存在于读出层:循环深度推理器中的潜在组成、难度驱动的激活以及由界面构成的提交

Simon Lam-Muir

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本研究验证潜在推理模型的“组成激活”为真实计算,复现30M参数循环深度推理器,发现激活存在于读出层,决策时边际跃升,隐藏状态方向突变后冻结,撤回早期速度低谷声明。

Comments 9 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00558 2026-08-04 cs.SE cs.AI 新提交 62%

AiFlow: Token-Native Reactive Orchestration with Bounded Backpressure for Streaming LLM Applications

AiFlow:面向流式大语言模型应用的带界背压令牌原生反应式编排框架

Qunhui Zhang

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 针对现有流式LLM工作流编排的背压等管理缺陷,提出AiFlow令牌原生反应式编排模型,经实验验证可降低应用TTFPT并控制队列深度。

Comments 24 pages, 5 figures, 12 tables, 1 algorithm, and 1 code listing. Public implementation: https://github.com/ModelEngine-Group/fit-framework

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00508 2026-08-04 cs.CV cs.AI cs.LG 新提交 62%

RadYOLO: Computationally Efficient 3D Object Detection and Segmentation in CT and MRI

RadYOLO:面向CT和MRI的计算高效型3D目标检测与分割方法

Kai Geissler, Laurens Müller-Groh, Hans Meine

机构 * Fraunhofer Institute for Digital Medicine MEVIS(弗劳恩霍夫数字医学MEVIS研究所)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本文提出针对医学图像的YOLO11 3D扩展模型RadYOLO,通过与nnU-Net、nnDetection在5个CT/MRI数据集上对比,证实其检测性能与推理速度均具优势,适配临床及边缘设备部署需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19096 2026-07-22 cs.AI cs.CL 新提交 62%

Supra Cognitive Modes: A Routed Architecture for Agent Memory

超认知模式:一种用于智能体记忆的路由架构

Joshua Tobkin, David Yang

机构 * Supra Research(超研)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI

AI总结 研究智能体记忆工作负载,提出超认知模式(SCM)架构,通过共享摄取底层及相关机制处理查询,在三个基准上进行表征,给出参考运行成绩等,展示了一种路由配置及故障模式,验证了相关设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18356 2026-07-22 cs.SE cs.AI 新提交 62%

CODENS: Transforming Code Changes into Living, Accessible, and Queryable Documentation

CODENS:将代码变更转化为生动、可访问且可查询的文档

Abdelhak Kelious, Chyrine Tahri, Eliot Bardet

机构 * CAPSENS

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究如何在快速发展代码库中维护文档,提出CODENS系统,它从拉取请求构建知识图,经语义提取等操作,通过三种检索模式展示知识,保留变更历史并集成评估指标,在项目中评估效果良好,但在文档综合方面有挑战。

Comments Accepted at the 26th ACM Symposium on Document Engineering (DocEng 2026). DOI: 10.1145/3820755.3832807

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18285 2026-07-22 cs.LG cs.AI 新提交 62%

Edge-Efficient Transformer for End-to-End RF Spectrum Monitoring

用于端到端射频频谱监测的边缘高效变压器

Zhifan Song, Haralampos-G. Stratigopoulos, Hassan Aboushady

机构 * Sorbonne Université, CNRS, LIP6(索邦大学、法国国家科学研究中心、巴黎第六大学信息与自动化实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 提出用于端到端射频频谱监测的E-SpecFormer,引入LiTAN注意力机制,有四种可扩展变体。在相关数据集测试中,Nano变体参数少、速度快,准确率高,以低成本超越现有边缘模型,是物联网设备实时频谱智能的高效解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14474 2026-07-17 cs.SD cs.AI cs.LG 新提交 62%

Can Tokens Compete? Token Representations against Supervised CNN Backbones for BirdCLEF+ 2026

令牌能竞争吗?针对BirdCLEF+ 2026的与监督式CNN主干竞争的令牌表示

Anthony Miyaguchi, Murilo Gustineli, Adrian Cheung

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 针对BirdCLEF+ 2026中动物发声多标签检测任务,先构建监督基线,后对比神经音频编解码器的编解码表示与基础嵌入的语义表示,比较两个生物声学专家模型和四个基于令牌的编码器,探究基于令牌的表示能否竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13069 2026-07-16 cs.AI cs.CL cs.LO 新提交 62%

Interventional Grounding Audits: Black-Box Premise-Dependency Tests for LLM Chain-of-Thought via Predicate Substitution

介入式基础审计:通过谓词替换对大语言模型思维链进行黑盒前提依赖性测试

Hironao Nakamura

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型思维链前提依赖性问题,提出介入式基础审计方法,通过谓词替换干预前提并重新运行模型,在ProntoQA基准测试中检测前提依赖性表现优异,还发现了“正确答案,错误推理”信号。

Comments Accepted at the ICLR 2026 Workshop on Logical Reasoning of Large Language Models (https://iclr.cc/virtual/2026/10017466)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08981 2026-07-13 cs.SE cs.AI 新提交 62%

The Patchwork Problem in LLM-Generated Code

大语言模型生成代码中的拼凑问题

Viraaji Mothukuri, Reza M. Parizi

机构 * Decentralized Science Lab, College of Computing and Software Engineering(分布式科学实验室,计算机与软件工程学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究大语言模型生成代码中的拼凑问题,将结构一致性形式化并引入故障分类法,提出混合验证框架,经实证评估和真实世界验证,揭示多数结构故障难被现有检查发现,模型间故障模式有别,此类故障普遍存在。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07740 2026-07-13 cs.LG cs.AI 新提交 62%

Jet-Long: Efficient Long-Context Extension with Dynamic Bifocal RoPE

Jet-Long:使用动态双焦点旋转位置编码的高效长上下文扩展

Haozhan Tang, Zerui Wang, Yuxian Gu, Song Han, Han Cai

机构 * NVIDIA(英伟达)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 研究针对现代语言模型长上下文应用中零样本上下文扩展问题,提出Jet-Long方法,通过动态双焦点RoPE及相关技术,在推理时开销小,在多种模型和基准测试中表现优异,还能推广到其他架构且超参数弹性强。

Comments added discussion of AdaGroPE and LaMPE (Findings of ACL 2026) with clarified contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07996 2026-07-10 eess.SP cs.AI cs.LG 新提交 62%

SpO$_2$ Predictor-Guided Stage-Wise Time-Frequency Reconstruction of Low-Quality Dual-Wavelength PPG for Oxygen Saturation Estimation

用于氧饱和度估计的 SpO₂ 预测器引导的低质量双波长 PPG 逐阶段时频重建

Zequan Liang, Elahe Hosseini, Ning Miao, Mahdi Pirayesh Shirazi Nejad, Wei Shao, Ehsan Kourkchi, Setareh Rafatirad, Houman Homayoun

机构 * Department of Computer Science, University of California, Davis, Davis, CA, U.S.A.(加州大学戴维斯分校计算机科学系) Department of Electrical and Computer Engineering, University of California, Davis, Davis, CA, U.S.A.(加州大学戴维斯分校电气与计算机工程系)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 研究针对低质量双波长 PPG 信号估计 SpO₂ 不准确的问题,提出 SpO₂ 预测器引导的逐阶段时频重建框架,结合时域与频域损失及 SpO₂ 预测器约束训练模型,实验表明该方法能降低受试者级平均绝对误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08331 2026-07-10 cs.LG cs.AI 新提交 62%

ArtMine: Discovering and Formalizing Artistic Processes

ArtMine:发现并形式化艺术创作过程

Kaustubh Kumar, Ashutosh Ranjan, Vivek Srivastava, Blessin Varkey, Shirish Karande

机构 * TCS Research(TCS研究)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 研究如何从异构历史证据发现并形式化艺术创作过程,核心方法是将证据合成存储库,由溯因智能体推断生产步骤并优化,主要贡献是迈向以过程为中心的人机协同创作系统,支持多方面研究。

Comments 47 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04579 2026-07-07 cs.SE cs.AI 新提交 62%

LLM-Driven CI-CD Workflow Intelligence for Cyber Systems Engineering

面向网络系统工程的由大语言模型驱动的持续集成与持续交付工作流智能

Bonan Shen, Jiazhou Gao, Tao Ning, Wei-Jung Huang, Xin Liu

机构 * Independent Researcher(独立研究者)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 研究面向网络系统工程的CI/CD工作流智能,通过基于大语言模型的分析管道,结合多种方法处理大量GitHub库数据,发现问题并得出结果,强调CI/CD可观测性应结合诊断、上下文和人工审查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31159 2026-07-01 cs.SE cs.CR cs.LG 新提交 62%

An Empirical Study of Security Calibration in Large Language Models for Code

面向代码的大型语言模型安全校准的实证研究

Mohammed Latif Siddiq, Md. Nafiu Rahman, Joanna C. S. Santos

机构 * University of Notre Dame(圣母大学) Brac University(布拉卡大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.LG

AI总结 本文首次大规模实证研究LLM生成代码的安全校准,发现过度自信普遍存在,安全校准优于功能校准,且校准引导的自动修复效果有限。

Comments Accepted at the 42nd International Conference on Software Maintenance and Evolution (ICSME 2026) Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28274 2026-06-29 cs.LG cs.AI 新提交 62%

Parameter Efficient Hybrid Transformer (PEHT) for Network Traffic Prediction via Dynamic Urban Congestion Integration

参数高效混合Transformer(PEHT)用于通过动态城市拥堵整合进行网络流量预测

Abdolazim Rezaei, Mehdi Sookhak, Mahboobeh Haghparast

机构 * National Science Foundation(国家科学基金会) U.S. Department of Transportation(美国交通部) University Transportation Center (UTC)(大学交通中心) Transportation Cybersecurity Center for Advanced Research and Education (CYBER-CARE)(交通网络安全高级研究与教育中心) NVIDIA Academic Grant Program(NVIDIA学术资助计划)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 提出参数高效混合Transformer(PEHT),通过低秩适应和多模态融合整合城市移动性与拥堵信息,在减少参数的同时提升网络流量预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26561 2026-06-26 cs.AI cs.LG 新提交 62%

Explainable Ensemble-Based Machine Learning Models for Detecting the Presence of Cirrhosis in Hepatitis C Patients

基于可解释集成机器学习模型检测丙型肝炎患者肝硬化的存在

Abrar Alotaibi, Lujain Alnajrani, Nawal Alsheikh, Alhatoon Alanazy, Salam Alshammasi, Meshael Almusairii, Shoog Alrassan, Aisha Alansari

专题命中 仓库级理解 :repository(abstract);分类 cs.AI、cs.LG

AI总结 本研究利用四种集成机器学习算法(随机森林、梯度提升机、极端梯度提升和极端随机树)检测丙型肝炎患者的肝硬化,其中极端随机树模型在仅使用16个特征时达到96.92%的准确率,优于其他模型。

Journal ref Computation 2023, 11, 104

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22330 2026-06-23 cs.AI cs.SE 新提交 62%

Hypothesis-Driven Skill Optimization for LLM Agents

假设驱动的技能优化用于LLM智能体

Fangxin Shang, Yehui Yang

机构 * AI Lab, Qifu Technology(奇富科技人工智能实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出HDSO框架,通过可证伪假设与验证机制从稀疏轨迹中提取可靠技能,无需训练,在ALFWorld上提升平均成功率6.9-7.1个百分点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20075 2026-06-19 cs.LG cs.CL 新提交 62%

What Makes Effective Supervision in Latent Chain-of-Thought: An Information-Theoretic Analysis

什么使得潜在思维链中的监督有效:一种信息论分析

Xinghao Chen, Chak Tou Leong, Wenjin Guo, Jian Wang, Wenjie Li, Xiaoyu Shen

机构 * Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究院,东方理工大学) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算学系)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.LG

AI总结 本文从信息论角度分析潜在思维链中的监督失效问题,提出轨迹监督和空间监督两个维度,并引入统一潜在探针(ULP)量化信息保真度,揭示了信息-性能绑定关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19911 2026-06-19 cs.AI cs.CL cs.IR 新提交 62%

Multi-Agent Transactive Memory

多智能体交互记忆

To Eun Kim, Xuhong He, Dishank Jain, Ambuj Agrawal, Negar Arabzadeh, Fernando Diaz

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL、cs.AI

AI总结 提出MATM框架,通过共享存储和检索智能体轨迹,实现异构智能体群体间的知识复用,提升下游任务性能并减少交互步骤。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17374 2026-06-17 cs.LO cs.PL cs.SE 新提交 62%

Verifying the Rust Standard Library

验证 Rust 标准库

Byron Cook, Remi Delmas, Zyad Hassan, Bart Jacobs, Ranjit Jhala, Rahul Kumar, Felipe R. Monteiro, Thanh Nguyen, Rebecca Rumbul, Michael Tautschnig, Celina Val, Carolyn Zech

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.PL

AI总结 通过众包方式集成多种验证工具,对 Rust 标准库中的不安全代码进行静态验证,发现并修复未定义行为,展示了大规模验证的可行性与挑战。

Comments Published at 18th NASA Formal Methods Symposium (NFM 2026)

Journal ref In: Deshmukh, J., Havelund, K., Pinto, A. (eds) NASA Formal Methods. NFM 2026. Lecture Notes in Computer Science, vol 16622. Springer, Cham, pp. 415-435

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14445 2026-06-15 cs.SE cs.AI cs.HC 新提交 62%

tap: A File-Based Protocol for Heterogeneous LLM Agent Collaboration

tap:一种用于异构LLM智能体协作的基于文件的协议

Minseo Kim

机构 * HUA Labs(HUA实验室)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 提出tap协议,通过文件优先设计实现不同厂商LLM智能体(如Claude和Codex)在共享代码库上的协作,无需共享内存或相同运行时,实验表明异构模型对审查缺陷发现率更高。

Comments Accepted to KCC 2026. English archival translation. 3 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14327 2026-06-15 cs.SE cs.AI cs.ET 新提交 62%

I'm Sorry Driver, I'm Afraid I Can't Do That: Appraising the Safety of LLMs within Automotive Contexts

抱歉,司机,恐怕我不能这么做:评估LLMs在汽车环境中的安全性

Shaun Feakins, Ibrahim Habli, Kim Littler, Robert Palin

机构 * UKRI AI Centre for Doctoral Training in Safe Artificial Intelligence Systems (SAINTS)(英国研究理事会安全人工智能系统博士培训中心(SAINTS)) University of York(约克大学) Jaguar Land Rover(捷克·陆罗恩)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 本文从安全保证角度评估了将LLMs集成到汽车控制任务中的现有框架,指出其面临概念和具体挑战,并通过案例研究提出未来保障机制。

Comments Accepted at the Dependable AI in Embedded Systems (DAIES) Workshop at SAFECOMP 2026; 15 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12231 2026-06-11 cs.SE cs.AI 新提交 62%

Rule Taxonomy and Evolution in AI IDEs: A Mining and Survey Study

AI IDE中的规则分类与演化:挖掘与调查研究

Guangzong Cai, Ruiyin Li, Peng Liang, Zengyang Li, Mojtaba Shahin

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Central China Normal University(中央师范大学计算机学院) School of Computing Technologies, RMIT University(皇家墨尔本理工大学计算技术学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.SE、cs.AI

AI总结 通过挖掘83个开源项目中的7310条规则和99份从业者调查,建立了包含5个主类和25个子类的规则分类法,发现开发者重视架构约束但实际配置多为低级工作流和代码格式规则,规则演化主要由建设性上下文扩展和丰富驱动,且更新规则可使工件合规率平均提升22.99%。

Comments 52 pages, 21 images, 8 tables, Manuscript submitted to a Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12610 2026-08-14 cs.AI 新提交 57%

@skills: Attention is all you have

@skills:你所需的全部注意力

Li Yin, Zhi Li, Zhan Shi, Haoran Zhang, Haebin Seong, Zhangyang, Wang

机构 * SylphAI(西尔菲人工智能公司) The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 针对当前智能体技能安装模式下触发槽位稀缺的问题,提出@skills开放协议,分离技能的内容、持久化与自动触发功能,无需安装即可使用技能,通过Git管理实现灵活适配,搭配免费技能 hub 提供搜索等功能,减少安装、提升使用效率。

Comments 7 pages main, 23 pages in total with appendix, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11755 2026-08-13 cs.SD cs.CL 新提交 57%

MuseCritic: Learning Multi-Aspect Song Rewards through Natural-Language Aesthetic Critiques

MuseCritic:通过自然语言审美评论学习多维度歌曲奖励

Jiabao Zhuang, Changhao Jiang, Hanchen Wang, Jiahao Chen, Zhixiong Yang, Zhenghao Xiang, Yifei Cao, Jiajun Sun, Hui Li, Ming Zhang, Tao Ji, Tao Gui, Qi Zhang, Xuanjing Huang

机构 * Fudan University(复旦大学)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本研究提出MUSECRITIC半标量奖励模型,通过两阶段训练生成多维度自然语言评论预测歌曲奖励,在SongEval、Music Arena等数据集上效果优于现有方法,结合GRPO还提升了Muse-0.6B的多项审美指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11036 2026-08-12 cs.CL 新提交 57%

myMediWhisper: Construction of Burmese Medical Speech Corpus and Whisper Fine-Tuning for Clinical Dialogue ASR

myMediWhisper:缅甸医疗语音语料库的构建及面向临床对话自动语音识别的Whisper微调

Ye Kyaw Thu, Ye Bhone Lin, Thura Aung, Htet Arkar, Myat Oo Swe, Thet Htet San, Min Thiha Tun, Thazin Myint Oo, Thepchai Supnithi

机构 * National Electronics and Computer Technology Center (NECTEC)(国家电子与计算机技术中心) King Mongkut’s University of Technology Thonburi(国王蒙固科技大学吞武里分校) King Mongkut’s Institute of Technology Ladkrabang(国王蒙固科技学院叻甲邦分校)

专题命中 仓库级理解 :repository(abstract);分类 cs.CL

AI总结 本研究构建28小时缅甸医疗语音语料库,通过全微调(FFT)和带LoRA的PEFT微调Whisper,提升其在医疗对话ASR中的性能,最优模型WER达23.44%,优于更大的通用领域微调模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09181 2026-08-11 cs.SE cs.CR 新提交 57%

Memoir: Learning, Verifying, and Evolving False-Positive Memories for Static Application Security Testing Tools

Memoir:针对静态应用安全测试工具的误报记忆学习、验证与演化

Shenyuan Guan, Qiaodan Hou, Yanjun Chen, Xincheng Wen, Jia Feng, Keke Lian, Cuiyun Gao

专题命中 仓库级理解 :repository(abstract);分类 cs.SE

AI总结 本研究针对SAST工具的误报问题,提出Memoir框架,通过构建与演化语义记忆实现误报识别,在CWE-Bench-Java上表现优异,且记忆库可跨工具泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08453 2026-08-11 cs.AI cs.CR 新提交 57%

What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files

是什么阻碍了智能体技能的可复用性?来自13.8万个SKILL.md文件的证据

Chi Zhang, Yimin Liu, Xinze Chen, Ping Ji

机构 * The Graduate Center, City University of New York(纽约城市大学研究生中心) The Ohio State University(俄亥俄州立大学) Hunter College, City University of New York(纽约城市大学亨特学院)

专题命中 仓库级理解 :repository(abstract);分类 cs.AI

AI总结 本研究通过分析13.8万个SKILL.md文件,发现91.8%的Agent Skills存在可复用性相关缺陷,主要为打包问题,验证了路由元数据对检索可靠性的影响,并提出了结合规范提示等的质量保证生成工作流。

Comments 11 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏