arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 1921 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 1921 篇

2607.21042 2026-07-24 cs.AI 新提交 81%

Faster IndexTTS-2: Accelerating and Streaming Autoregressive Zero-Shot Text-to-Speech Synthesis on GPUs

更快的IndexTTS-2:在GPU上加速和流式自回归零样本文本到语音合成

Muyang Du, Shuang Yu, Junjie Lai

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究旨在加速自回归文本到语音模型IndexTTS-2,利用NVIDIA TensorRT和TensorRT-LLM在GPU上实现生产部署,支持流式合成与批处理推理,实验表明在Seed-TTS基准测试中能显著加速且质量损失小,为加速类似模型提供参考。

Comments 4 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20814 2026-07-24 cs.AI 新提交 81%

Enhancing Explainable Cardiac Diagnosis with Guide-Grounded Multimodal LLMs

用指南引导的多模态语言模型增强可解释的心脏诊断

Hai-Nam Duy Vuong, Duy-Anh Bui, Trong-Nghia Nguyen, Kim-Ngan Thi Nguyen, Trang Mai Xuan, Tien-Cuong Nguyen, Van-Dem Pham, Thien Van Luong

机构 * Business AI Lab, College of Technology, National Economics University(商业人工智能实验室,技术学院,越南国家经济大学) A2I Lab, Phenikaa School of Computing, Phenikaa University(A2I实验室,费尼卡计算机学院,费尼卡大学) VNPT AI, VNPT Group(VNPT人工智能,VNPT集团) FPT University(FPT大学) Department of Pediatrics, Hospital of University Medicine and Pharmacy, Vietnam National University Hanoi(越南河内国家大学医学与药学院儿科学系)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究针对深度学习模型在心脏诊断中可解释性有限等问题,提出指南引导的多模态框架,通过卷积神经网络、Grad-CAM及结构化解释指南生成诊断报告,实验证明该方法能提升报告质量,增强临床合理性。

Comments 12 pages, 3 figures, accepted at CITA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20477 2026-07-24 cs.AI 新提交 81%

Semi-Supervised Text-Attributed Graph Distillation

半监督文本属性图蒸馏

Yurui Lai, Samir Moustafa, Renchi Yang, Tsz Nam Chan

机构 * Hong Kong Baptist University(香港浸会大学) CeMM Research Center for Molecular Medicine of the Austrian Academy of Sciences(奥地利科学院分子医学CeMM研究中心) Universität Vienna(维也纳大学) Shenzhen University(深圳大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对文本属性图表示学习的可扩展性瓶颈等问题,提出基于Wasserstein距离的半监督框架\algo{},通过图-文本协作编码模块等方法,在基准数据集实验中实现了高效的TAG学习及性能-压缩权衡。

Comments Technical report for the paper "Semi-Supervised Text-Attributed Graph Distillation" accepted KDD2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20450 2026-07-24 cs.CL 新提交 81%

ShriNep@EEUCA 2026: RAKSHAK - Multi-Task DeBERTa with Rationale Distillation and Jigsaw-Augmented Training for Toxic Intent Classification

ShriNep@EEUCA 2026:RAKSHAK - 用于毒性意图分类的具有原理蒸馏和拼图增强训练的多任务DeBERTa

Binayak Karki, Aryan Kafle, Pingala Ghimire

机构 * Mechi Multiple Campus(梅奇多校区) Northern Kentucky University(北肯塔基大学) Himalaya College of Engineering(喜马拉雅工程学院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对GameTox共享任务中《坦克世界》聊天话语毒性意图分类难题,提出多任务DeBERTa - v3 - base框架RAKSHAK,结合原理蒸馏等方法,通过跨域转移和LLM生成样本增强训练数据,相比另一系统表现更优,多任务架构和跨域转移贡献显著。

Comments 8 pages, 1 figure, EEUCA, ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19351 2026-07-23 cs.AI 新提交 81%

OpenEvoShield: Dual Non-Stationary Continual Defense for Open-World Multi-Agent System Attacks

OpenEvoShield:面向开放世界多智能体系统攻击的双重非平稳持续防御

Litian Zhang, Chaozhuo Li, Yuting Zhang, Zejian Chen, Bingyu Yan, Qiwei Ye

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Beihang University(北京航空航天大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对LLM-MAS中对手通过通信注入恶意指令的双重动态攻击,提出OpenEvoShield持续防御框架,含不对称速率控制器等组件,实验表明其在多基准和拓扑上优于基线,能检测多数未见攻击且误报率低。

Comments 29 pages, 5 figures, 14 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17538 2026-07-21 cs.AR cs.CL cs.DB cs.ET cs.IR 新提交 81%

D-NOVA: In-Storage Retrieval Accelerator via Dual-Bound 3D NAND-Optimized Similarity Search with Vector Adaptation

D-NOVA:通过具有向量适配的双边界3D NAND优化相似性搜索实现存储内检索加速器

Chang Eun Song, Sumukh Pinge, Tianqi Zhang, Sung Eun Kim, Tajana S. Rosing, Mingu Kang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究针对RAG密集向量检索性能瓶颈,提出软硬件协同设计的存储内检索加速器D-NOVA。通过深度嵌入搜索功能、采用新距离度量及引入适配器,实现高效检索,相比CPU和现有加速器有显著性能和能效提升,展现全存储向量搜索加速RAG的潜力。

Comments Accepted at the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026), Athens, Greece. Chang Eun Song and Sumukh Pinge are co-first authors and contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13594 2026-07-16 cs.AI 新提交 81%

SAFETY SENTRY: Context-Aware Human Intervention via EXECUTE-ASK-REFUSE Routing

安全哨兵:通过执行-询问-拒绝路由实现上下文感知的人工干预

Tianyu Chen, Chujia Hu, Wenjie Wang

机构 * ShanghaiTech University(上海科技大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究LLM智能体行动风险,将问题重构为三向路由决策,用安全哨兵实例化,其推理简化,单阈值可调整。该模型在准确率和召回率上优于多种基线,能同时控制错误率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13095 2026-07-16 cs.AR cs.AI 新提交 81%

Full-Pipeline Inference Optimization for MiMo-V2.5 Series: Pushing Hybrid SWA Efficiency to the Limit

MiMo-V2.5系列的全流程推理优化:将混合滑动窗口注意力效率推向极限

Xiaomi MiMo Team, Anqi Liu, Aoxin Ma, Bo Chen, Bo Yang, Chen Wang, Chen Zhang, Chengda Tang, Chengwei Wang, Chiheng Lou, Depeng Yan, Fuli Luo, Gang Wang, Hailin Zhang, Jiale Sun, Kang Zhou, Rui Huang, Shaohui Liu, Shen Huang, Shijie Cao, Shuaishuai Fan, Tianling Zhou, Xiangwei Deng, Xueyang Xie, Xuli Wang, Yingchun Lai, Yu Yang, Yuan Zhang, Zhen Tang, Zhonghua Deng, Zihan Jiang

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对MiMo-V2.5模型家族,结合Hybrid SWA、MoE和多模态编码器进行全流程推理优化。通过多种策略优化KVCache系统,构建GCache并开发路由器,还优化多模态输入,构成首个有效涵盖该复合架构的大规模LLM生产服务系统。

Comments technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08180 2026-07-10 cs.CR cs.AI 新提交 81%

Out of Sight: Compression-Aware Content Protection against Agentic Crawlers

视线之外:针对智能爬虫的压缩感知内容保护

Xuefei Wang

机构 * Beihang University(北航大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 研究基于LLM的智能体给在线内容带来的新威胁,提出CAPE框架,通过注入不可见扰动保护文本内容,在低查询预算下有效提升信息损失,实验证明其有效性与通用性,推动智能体时代内容保护研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07847 2026-07-10 cs.LG 新提交 81%

When Does Continual Learning Require Learning

持续学习何时需要学习

Anne Harrington, Nayan Saxena, Michael Murphy, Anastasia Borovykh, Zeyu Yun, Sridhar Kamath, Ara Eindra Kyi, Trevor Darrell, Jitendra Malik, Yutong Bai

机构 * UC Berkeley(加州大学伯克利分校) Capital Fund Management(资本基金管理公司)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 研究大语言模型持续学习问题,从空间和时间轴分解变化,通过重新设置基准和引入协议评估多种方法,发现持续学习非单一能力,不同环境变化需不同更新行为,为设计更强持续学习系统提供指导。

Comments Code: https://github.com/anneharrington/studying-cl. Project page: https://anneharrington.github.io/studying-cl/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24477 2026-07-10 cs.CV cs.AI cs.SD 新提交 81%

video-SALMONN-R$^3$: Learning to ReWatch, ReAsk, and ReAnswer for Efficient Video Understanding

video-SALMONN-R$^3$: 学习重看、重问和重答以实现高效视频理解

Yixuan Li, Guangzhi Sun, Yudong Yang, Chao Zhang

机构 * Tsinghua University(清华大学) ByteDance(字节跳动) University of Cambridge(剑桥大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

AI总结 提出video-SALMONN-R$^3$,首个通过强化学习实现重看机制的视频大语言模型,无需链式思维冷启动,采用重答和重问策略提升视频问答效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02416 2026-07-07 cs.CL 新提交 81%

The Future of NLP may not be at NLP Conferences: Scholarly Migration Patterns in Natural Language Processing

NLP的未来可能不在NLP会议上:自然语言处理领域的学术迁移模式

David Jurgens

机构 * School of Information, University of Michigan(信息学院,密歇根大学)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究通过分析2010-2026年NLP论文发表数据,发现NLP研究正从传统ACL会议向通用ML会议迁移,新作者在ML会议发表比例从5%升至21%,且ML会议带来显著引用优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01590 2026-07-07 cs.AI cs.SE 新提交 81%

Hawk: Harnessing Hardware-Aware Knowledge for High-Performance NPU Kernel Generation

Hawk:利用硬件感知知识生成高性能NPU内核

Junyi Wen, Ruiyan Zhuang, Yongjia Xu, Pengtu Li, Rui Zou, Hongyi Chen, Chingman Wan, Puxu Yang, Wuhui Chen, Yanlin Wang

机构 * Sun Yat-sen University(中山大学) Greater Bay Area National Technology Innovation Center(粤港澳大湾区国家技术创新中心) Peng Cheng Laboratory(鹏城实验室)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Hawk框架,通过运行时知识合成、瓶颈感知检索和效果驱动蒸馏三个模块,将NPU内核生成准确率从49.4%提升至80.0%,执行速度最高提升2.2倍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00224 2026-07-03 math.ST cs.IT cs.LG math.IT stat.ML stat.TH 新提交 81%

Sample Complexities of Estimating Gumbel--Max Watermark Proportions with and without Reduction to Pivotal Statistics

估计Gumbel-Max水印比例(含和不含降为枢轴统计量)的样本复杂度

Shuwen Chai, Qiaosen Wang

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究在Gumbel-max水印机制下,估计文档中水印文本比例的问题,比较了完整观测和降为枢轴统计量两种情形,提出了相应估计器并建立了匹配的样本复杂度下界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00015 2026-07-02 cs.CY cs.AI cs.CV cs.ET 新提交 81%

Towards an automated AI-based framework for floor plan compliance checks for residential buildings

面向住宅建筑平面图合规检查的自动化AI框架

Subash Gautam, Debaditya Acharya, Alexandra Kleeman, Sarah Foster

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种基于大语言模型和规则引擎的自动化框架,用于多单元住宅平面图的合规检查,解决手动检查效率低、可扩展性差的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31131 2026-07-01 cs.AI cs.RO 新提交 81%

Scenario Generation for Testing of Autonomous Driving Systems Using Real-World Failure Records

利用真实世界故障记录生成自动驾驶系统测试场景

Anjali Parashar, Chuchu Fan

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出一种基于LLM的场景生成流程,利用历史故障记录中的分类和上下文信息,生成多样化测试场景,在Metadrive模拟器上验证了方法的准确性和多样性。

Comments 9 pages, Appendix included. Paper accepted and presented at NeuS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30949 2026-07-01 cs.AI cs.AR 新提交 81%

AgRefactor: Self-Evolving Agentic Workflow for HLS Compatibility and Performance

AgRefactor:面向HLS兼容性与性能的自进化智能体工作流

Yang Zou, Zijian Ding, Yizhou Sun, Jason Cong

机构 * Carnegie Mellon University(卡内基梅隆大学) University of California, Los Angeles(加利福尼亚大学洛杉矶分校)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出基于LLM的多智能体工作流AgRefactor,通过自进化记忆系统和自动化重构工具,将软件代码重构为HLS兼容程序,在11个基准测试中9个超越现有方法,并实现6.51x几何平均加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26396 2026-06-26 cs.LG 新提交 81%

At the Edge of Understanding: Sparse Autoencoders Trace The Limits of Transformer Generalization

在理解的边缘:稀疏自编码器追踪Transformer泛化的极限

Praneet Suresh, Jack Stanley, Sonia Joseph, Luca Scimeca, Danilo Bzdok

机构 * Mila - Quebec AI Institute(魁北克AI研究所) Meta AI Sapient manifold-informed selection of samples for improved Intelligence

专题命中 效率与部署 :LLM(summary_cn,abstract_cn);language model(abstract);分类 cs.LG

AI总结 通过稀疏自编码器分析内部概念,发现OOD输入(如拼写错误和越狱提示)会激活更多错误概念,并据此提出一种基于机制的微调策略来增强LLM鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24286 2026-06-24 cs.CL cs.CV 新提交 81%

AVOC: Enhancing Hour-Level Audio-Video Understanding in Omni-Modal LLMs via Retrieval-Inspired Token Compression

AVOC:通过检索启发的令牌压缩增强全模态大语言模型中的小时级音视频理解

Yijing Chen, Wenhui Tan, Xiaoyi Yu, Yuyue Wang, Xin Cheng, Kaisi Guan, Hao Jiang, Xiangyang Li, Guojie Zhu, Ruihua Song

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Huawei Inc.(华为技术有限公司)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出AVOC框架,通过检索启发的令牌压缩模块,将多模态令牌压缩视为top-K检索问题,结合相关性、重要性和多样性三个标准,实现长时音视频理解,在小时级基准上取得最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21955 2026-06-23 cs.NI cs.AI 新提交 81%

From RAN Control to Agentic Intelligence: Architecture and Vision for Energy Efficient AI-RAN

从RAN控制到智能体智能:节能AI-RAN的架构与愿景

Sabrine Aroua, Alexis I. Aravanis, Ilias Chatzistefanidis, Hamza Abbar, Anh-Khoa Dang, Anastasios Giovanidis, Salah-Eddine El Ayoubi, Stephane Senecal, Martha Vlachou Konchylaki, Navid Nikaein

机构 * Ericsson Research(爱立信研究) Laboratory of Signals and Systems (L2S)(信号与系统实验室) Universite Paris-Saclay(巴黎-萨克雷大学) CentraleSupelec(中央超导大学) CNRS(国家科学研究中心) BubbleRAN Orange Innovation(Orange创新)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种智能体AI原生RAN架构,结合语义意图抽象和大语言模型驱动协调,实现异构工作负载的自适应编排和节能多目标优化,以降低6G网络能耗。

Comments preprint under review at IEEE Network Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20120 2026-06-19 cs.RO cs.AI 新提交 81%

Dual-Agent Framework for Cross-Model Verified Translation of Natural-Language Protocols into Robotic Laboratory Platform

用于将自然语言协议翻译为机器人实验室平台的双智能体跨模型验证框架

Hyeonna Choi, Jung Yup Kim, Hyuneui Lim, Seunggyu Jeon

机构 * Department of Bionic Machinery, Research Institute of AI Robot, Korea Institute of Machinery & Materials(生物机械系、人工智能机器人研究所、韩国机械材料研究院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出双智能体框架,通过解析器形式化协议、规则映射引擎生成控制命令、异构LLM验证器纠错,实现自然语言微孔板协议到机器人平台可执行命令的转换,并验证了端到端自主执行。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19660 2026-06-19 cs.CR cs.CL 新提交 81%

A Layered Security Framework Against Prompt Injection in RAG-Based Chatbots

基于RAG的聊天机器人中针对提示注入的分层安全框架

Gulshan Saleem, Nisar Ahmed, Muhammad Imran Zaman, Ali Hassan

机构 * ICCK Transactions on Information Security and Cryptography(信息安全与密码学国际会议交易)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出三层防御框架,通过输入过滤、上下文指令层级和输出审计,将提示注入攻击成功率从71.4%降至11.3%,误报率4.8%,延迟开销61.2毫秒。

Comments Submitted in ICCK Transactions on Information Security and Cryptography

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18508 2026-06-18 cs.CL cs.IR 新提交 81%

MCompassRAG: Topic Metadata as a Semantic Compass for Paragraph-Level Retrieval

MCompassRAG:主题元数据作为段落级检索的语义指南针

Amirhossein Abaskohi, Raymond Li, Gaetano Cimino, Peter West, Giuseppe Carenini, Issam H. Laradji

机构 * University of British Columbia(不列颠哥伦比亚大学) University of Salerno(萨莱诺大学) ServiceNow Research(ServiceNow研究院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出MCompassRAG框架,通过主题元数据增强段落表示,利用LLM蒸馏训练轻量检索器,实现主题感知检索,在六个基准上平均信息效率提升8.24%,延迟降低5倍以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18056 2026-06-17 cs.CL 新提交 81%

ConSA: Controllable Sparsity in Hybrid Attention via Learnable Allocation

ConSA: 通过可学习分配实现混合注意力中的可控稀疏性

Yao Chen, Yinqi Yang, Junyuan Shang, Xiangzhao Hao, Simeng Zhang, Yilong Chen, Tingwen Liu, Shuohuan Wang, Dianhai Yu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Baidu Inc.(百度公司)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出ConSA框架,通过L0正则化和增广拉格朗日约束学习全注意与滑动窗口注意的最优分配,实现用户指定的稀疏目标,在0.6B和1.7B规模LLM上优于规则基线,并发现底层SWA与中层FA的集中分配模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17637 2026-06-17 cs.AI 新提交 81%

Brick-DICL: Dynamic In-Context Learning for Automated Brick Schema Classification

Brick-DICL:用于自动化Brick模式分类的动态上下文学习

Yiyue Qian, Shinan Zhang, Huan Song, Negin Sokhandan, Hannah Marlowe, Diego Socolinsky

机构 * Amazon AWS Generative AI Innovation Center(亚马逊AWS生成式AI创新中心)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Brick-DICL两阶段动态上下文学习框架,通过元数据检索和类别检索增强大语言模型领域知识,结合多模型过滤机制,实现楼宇管理系统点位的自动化Brick分类,显著提升准确率并减少人工验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14945 2026-06-16 cs.LG 新提交 81%

Remember, Don't Re-read: Stateful ReAct Agents for Token-Efficient Autonomous Experimentation

记住,不要重读:用于令牌高效自主实验的有状态ReAct智能体

Faramarz Jabbarvaziri

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 效率与部署 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 提出基于LangGraph的有状态ReAct智能体,通过持久化状态和固定大小对话窗口,将自主实验的令牌成本从O(n²)降至O(1),在超参数调优和代码优化任务中分别减少90%和52%的令牌消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13949 2026-06-15 cs.AI 新提交 81%

Minim: Privacy-Aware Minimal View for Agents via Trusted Local Sanitization

Minim: 通过可信本地净化实现代理的隐私感知最小化视图

Hexuan Yu, Chaoyu Zhang, Heng Jin, Shanghao Shi, Ning Zhang, Y. Thomas Hou, Wenjing Lou

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 针对LLM代理传输完整UI状态导致隐私泄露的问题,提出MINIM框架,在客户端基于上下文完整性学习双重分数(敏感性和必要性),通过三元披露策略实现隐私感知的最小化视图,在减少敏感泄露的同时保留任务关键信息。

Comments Accepted at ICML 2026 (43rd International Conference on Machine Learning, Seoul, South Korea). Code available at https://github.com/yyyyhx/MINIM

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13731 2026-06-15 cs.AI cs.MA 新提交 81%

TwinBI: An Agentic Digital Twin for Efficient Augmented Interactions with Business Intelligence Dashboards

TwinBI:一种用于与商业智能仪表盘高效增强交互的智能数字孪生

Jisoo Jang Wen-Syan Li

机构 * Graduate School of Data Science, Seoul National University(首尔大学数据科学研究生院)

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出TwinBI框架,通过LLM代理与可执行仪表盘状态耦合,统一对话、操作、语义和溯源,提升多步分析中状态一致性,将精确匹配准确率从43.3%提升至63.3%,超时率从40%降至10%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12594 2026-06-12 cs.AI 新提交 81%

Pythagoras-Prover: Advancing Efficient Formal Proving via Augmented Lean Formalisation

Pythagoras-Prover: 通过增强型Lean形式化推进高效形式化证明

Joshua Ong Jun Leang, Zheng Zhao, Mihaela Cătălina Stoian, Qiyuan Xu, Haonan Li, Wenda Li, Shay B. Cohen, Eleonora Giunchiglia

机构 * Imperial College London(伦敦帝国学院) University of Edinburgh(爱丁堡大学) Nanyang Technological University(南洋理工大学) MBZUAI(穆罕默德·本·扎耶德人工智能大学)

专题命中 效率与部署 :SFT(summary_cn,abstract);分类 cs.AI

AI总结 提出Pythagoras-Prover系列,包括自回归和扩散模型,通过课程SFT、动态过滤和增强型Lean形式化(ALF)扩展验证数据,在MiniF2F-Test上以更少参数超越DeepSeek-Prover-V2。

Comments Pythagoras-Prover: Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12563 2026-06-12 cs.AI 新提交 81%

Arbor: Tree Search as a Cognition Layer for Autonomous Agents

Arbor:作为自主智能体认知层的树搜索

Neha Prakriya, Chaojun Hou, Zheng Gong, Huasha Zhao, Xi Zhao, Mou Li, Zhenyu Gu, Emad Barsoum

机构 * AMD

专题命中 效率与部署 :LLM(summary_cn,abstract);分类 cs.AI

AI总结 提出Arbor多智能体框架,通过结构化树搜索作为认知层,在大型有状态动作空间中实现自主优化,在LLM推理优化中实现高达193%的吞吐量-延迟帕累托改进。

详情

展开后加载摘要…

URL PDF HTML 收藏