arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 1933 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 1933 篇

2607.03803 2026-07-07 cs.CV cs.AI 新提交 57%

CineMobile: On-Device Image-to-Video Diffusion for Cinematic Camera Motion Generation

CineMobile:用于电影级相机运动生成的设备端图像到视频扩散

Xuyao Huang, Zelai Deng, Xu Wang, Xizhong Xiao, Zhijie Deng

机构 * Shanghai Jiao Tong University(上海交通大学) Nankai University(南开大学) Transsion(传音)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 针对移动设备图像到视频创作需求,提出CineMobile。采用蒸馏引导剪枝、扩散蒸馏与强化学习优化及混合后训练量化策略,在保持视觉质量的同时大幅加速生成,证明其在移动图像到视频创作中的实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03283 2026-07-07 cs.AI 新提交 57%

Embodied Operators and Benchmarking: Toward Reusable and Deployable Embodied Intelligence Systems

具身算子与基准测试:迈向可复用和可部署的具身智能系统

Junwu Xiong, Jiaxuan Gao, Wei Chai, Renxing Chen, Yuzhen Li, Yu Guo, Yucheng Guo, Mingxi Luo, Wenyang Ma, Yiyun Mou, Yifei Zhang, Chen Zhou, Yongjian Guo

机构 * JDT Tsinghua University(清华大学) Tianjin University(天津大学) Beihang University(北京航空航天大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 研究具身智能系统中可复用功能模块即具身算子,明确其定义边界、构建分类法,提出多维度基准框架,探讨加速及挑战,为具身智能系统提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03245 2026-07-07 cs.LG 新提交 57%

PhenoNEST: A Neuro-Symbolic Framework for Ontology-Aware Multimodal Plant Phenotyping and Trait Discovery

PhenoNEST:用于本体感知多模态植物表型分析和性状发现的神经符号框架

Jayant Ghadge, Soumyashree Kar, Surya S. Durbha

机构 * Centre of Studies in Resources Engineering (CSRE)(资源工程研究中心) Indian Institute of Technology Bombay(孟买印度理工学院)

专题命中 效率与部署 :language model(abstract);分类 cs.LG

AI总结 提出构建多模态粒状知识图谱框架,以弥合语义鸿沟,通过蒸馏野外记录提取实体和关系,结合模型与本体对齐,经视觉语言模型生成软图,引入节点连接多模态子图,成功映射野外观察,助力小麦育种。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02911 2026-07-07 cs.SE cs.AI 新提交 57%

CoACT: Action-Preserving Observation Compression for Coding Agents

CoACT:用于编码智能体的动作保持观测压缩

Haorui Chen, Yuancheng Zhu, Yitong Zhang, Jia Li

专题命中 效率与部署 :LLM(abstract);分类 cs.AI

AI总结 研究编码智能体观测压缩问题,提出基于动作保持的CoACT方法,通过检查智能体下一个动作来筛选压缩候选,训练时用两种奖励过滤并选择候选,实验表明该方法能降成本且保持任务解决有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02592 2026-07-07 cs.CV cs.LG 新提交 57%

H-OPD: Confidence Aware Heterogeneous Multi-Teacher Multimodal On-policy Distillation

H-OPD:置信感知异构多教师多模态在线策略蒸馏

Qixiang Yin, Huanjin Yao, Yuchen Cai, Jianghao Chen, Ziyi Wang, Min Yang, Fei Su, Zhicheng Zhao

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) ByteDance(字节跳动) USTC(中国科学技术大学) Beijing Key Laboratory of Network System and Network Culture(北京网络系统与网络文化重点实验室) Key Laboratory of Interactive Technology and Experience System, Ministry of Culture and Tourism(文化和旅游部互动技术与体验系统重点实验室) Zhongguancun Academy(中关村科学城)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 研究多模态推理的在线策略蒸馏问题,提出H-OPD框架,通过验证异构教师互补性,以令牌级教师仲裁取代任务或样本级路由,结合视觉与文本教师,在多基准测试中性能优越。

Comments Technical report(work-in-progress). Code will be available at \url{https://github.com/buptyqx/H-OPD}

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02119 2026-07-03 eess.AS cs.AI 新提交 57%

An Efficient vLLM-Based Inference Pipeline for Unified Audio Understanding and Generation

基于vLLM的高效统一音频理解与生成推理管线

Haoran Wang, Jinchuan Tian, Siddhant Arora, Shinji Watanabe

机构 * Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 提出基于vLLM的推理管线,通过扩展自回归解码支持多流采样和延迟模式解交织,并利用协同调度实现CFG下80%的非CFG吞吐量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01415 2026-07-03 cs.LG cs.DC 新提交 57%

The Rollout Infrastructure Tax in Coding-Agent Reinforcement Learning

编码智能体强化学习中的回滚基础设施开销

Daniel Thi Graviet, Lovre Pesut, Ivan Dagelic, Vedran Jukic, Ivan Burazin

机构 * Daytona

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 研究四种执行环境(单容器、托管沙箱、Kubernetes编排容器、云虚拟机)在编码智能体RL中的冷启动延迟和工人工时差异,发现优化执行基础设施可显著提升训练效率。

Comments Preprint. 6 pages, 6 figures, 2 tables. Submitted to ACM SoCC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08998 2026-07-03 cs.AI cs.CY econ.GN q-fin.EC 新提交 57%

The Token Not Taken: Sampling, State, and the Stochasticity of AI Agents

未被选取的令牌:采样、状态与AI智能体输出的变异性

Muhammad Zia Hydari, Raja Iqbal

机构 * University of Pittsburgh(匹兹堡大学) Ejento.ai

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 本文分析AI智能体系统输出变异性的来源,区分令牌采样的内在随机性与环境、数据等外在因素,并讨论在匹配条件下变异性的可复现性及确定性执行在部署中未必导致相同行为的原因。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22649 2026-06-29 cs.CV cs.LG eess.IV 新提交 57%

MaRS: Robust Out-of-Distribution Detection via Mahalanobis Residual Scoring

MaRS:通过马氏残差评分进行鲁棒的分布外检测

Francesco Di Salvo, Sebastian Doerrich, Christian Ledig

机构 * xAILab Bamberg, University of Bamberg, Germany(班贝格大学 xAILab 班贝格实验室,德国)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出MaRS方法,利用轻量自编码器学习分布内流形,通过马氏距离度量重建残差,实现方差感知的分布外检测,在多种医学影像模态和分布偏移下优于现有基线。

Comments Accepted to MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26922 2026-06-26 cs.RO cs.AI 新提交 57%

Risk-Aware Selective Multimodal Driver Monitoring with Driver-State World Modeling

风险感知的选择性多模态驾驶员监控与驾驶员状态世界建模

Daosheng Qiu, Haozhuang Chi, Hao Su, Shu Long, Xinyue Miao, Yongle Dong, Wei Zhang

机构 * Hubei University(湖北大学) Nanyang Technological University(南洋理工大学) Osaka University(大阪大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 提出成本感知的选择性推理框架,结合轻量级RGB-生理学生网络和门控机制,在低延迟下减少不安全决策,实现可部署的多模态驾驶员监控。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26790 2026-06-26 cs.CL 新提交 57%

OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning

OPID: 面向智能体强化学习的在策略技能蒸馏

Shuo Yang, Jinyang Wu, Zhengxi Lu, Yuhao Shen, Fan Zhang, Lang Feng, Shuai Zhang, Haoran Luo, Zheng Lian, Zhengqi Wen, Jianhua Tao

机构 * Tsinghua University(清华大学) Zhejiang University(浙江大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学) Tongji University(同济大学)

专题命中 效率与部署 :language agent(abstract);分类 cs.CL

AI总结 提出OPID框架,通过从在策略轨迹中提取层级技能(回合级和步骤级)提供密集标记级监督,结合结果优势进行策略优化,提升智能体性能、样本效率和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26421 2026-06-26 cs.LG cs.CE 新提交 57%

Otter Weather: Skillful and Computationally Efficient Medium-Range Weather Forecasting

Otter Weather:熟练且计算高效的中期天气预报

Cristiana Diaconu, Jonas Scholz, Aliaksandra Shysheya, Stratis Markou, Payel Mukhopadhyay, Miles Cranmer, Richard E. Turner

机构 * University of Cambridge(剑桥大学)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出Otter Weather模型,通过高效时空预测架构在1.5°分辨率ERA5数据上以极低训练成本超越传统数值天气预报和前沿AI模型,实现技能-计算帕累托前沿的显著推进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26095 2026-06-25 cs.RO cs.AI cs.CV 新提交 57%

Learning Action Priors for Cross-embodiment Robot Manipulation

跨具身机器人操作的动作先验学习

Dong Jing, Tianqi Zhang, Jiaqi Liu, Jinman Zhao, Zelong Sun, Li Erran Li, Zhiwu Lu, Mingyu Ding

机构 * Renmin University of China(中国人民大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Toronto(多伦多大学) Amazon(亚马逊)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 提出两阶段训练框架,先通过流匹配预训练动作模块学习跨具身时间运动结构,再迁移至VLA训练,提升数据效率与任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25838 2026-06-25 cs.CV cs.AI 新提交 57%

Edges Before Embeddings: A Confidence-Aware Blur Gate for Vision-Language Pipelines

边缘先于嵌入:面向视觉语言管线的置信感知模糊门控

Duy Tran Thanh

机构 * OneMount Group(OneMount集团)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 提出MagikaDocumentFromPixel轻量级图像质量门控,通过边缘先验模块和置信感知路由,在7ms内分类图像清晰度,F1达0.9803。

Comments 7 pages, 2 figures, 6 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25473 2026-06-25 cs.CV cs.LG 新提交 57%

Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models

Causal-rCM:一种用于流式视频生成和交互式世界模型中自回归扩散蒸馏的统一教师强制与自我强制开放配方

Kaiwen Zheng, Guande He, Min Zhao, Jintao Zhang, Huayu Chen, Jianfei Chen, Chen-Hsuan Lin, Ming-Yu Liu, Jun Zhu, Qianli Ma

机构 * Tsinghua University(清华大学) UT Austin(德克萨斯大学奥斯汀分校) NVIDIA(英伟达)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出Causal-rCM框架,将扩散蒸馏扩展到自回归视频扩散,通过教师强制(前向散度)与自我强制(反向散度)互补,实现流式视频生成和交互式世界模型,在帧级和块级设置中达到最先进性能。

Comments Technical Report

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25197 2026-06-25 cs.LG stat.ML 新提交 57%

Efficient Adaptive Data Acquisition via Pretrained Belief Representations

通过预训练信念表示的高效自适应数据获取

Daolang Huang, Zhuoyue Huang, Conor Hassan, Luigi Acerbi, Samuel Kaski, Tom Rainforth

机构 * ELLIS Institute Finland(芬兰ELLIS研究所) Department of Computer Science, Aalto University, Finland(芬兰阿尔托大学计算机科学系) Department of Computer Science, University of Helsinki, Finland(芬兰赫尔辛基大学计算机科学系) Department of Computer Science, University of Manchester, UK(英国曼彻斯特大学计算机科学系) Department of Statistics, University of Oxford, UK(英国牛津大学统计系)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出POLAR框架,利用预训练预测模型作为信念状态编码器,解耦表示学习与策略学习,在贝叶斯实验设计、贝叶斯优化和主动学习中实现高效自适应数据获取。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24773 2026-06-24 cs.CL 新提交 57%

Posterior Refinement: Fast Language Generation via Any-Order Flow Maps

后验精炼:通过任意阶流映射实现快速语言生成

Manan Agarwal, Sheel Shah, Chanhyuk Lee, Jaehoon Yoo, Jerry Huang, Seunghoon Hong, Aditi Raghunathan, Jinwoo Kim, Nicholas M. Boffi

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出FMLM+框架,结合掩码噪声调度实现单步生成,并利用后验评分进行自适应精炼,在32倍更少NFE下达到离散基线性能,改善速度-质量权衡。

Comments 24 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24396 2026-06-24 cs.LG 新提交 57%

Parallel Manifold Steering: Efficient Adaptation of Large Associative Memories via Residual Energy Shaping

并行流形引导:通过残差能量塑形实现大型联想记忆的高效适应

Kanishk Awadhiya

机构 * Independent Researcher(独立研究员)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出H-Res机制,通过残差能量塑形在不改变全局平衡或扩展序列长度的情况下调节Transformer的能量景观,实现高效任务适应,在联想检索任务上比全局权重修改提升26%并消除提示方法的计算开销。

Comments Accepted at ICLR Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23210 2026-06-23 cs.LG cs.DC eess.SP 新提交 57%

Efficient Network Inference via Hardware-Aware Architecture Search, Model Pruning & Quantization

通过硬件感知架构搜索、模型剪枝与量化实现高效网络推理

Lucas Heublein, Mark Deutel, Axel Plinge, Felix Ott

机构 * Fraunhofer Institute for Integrated Circuits IIS(弗劳恩霍夫集成电路研究所)

专题命中 效率与部署 :post-training(abstract);分类 cs.LG

AI总结 针对嵌入式GNSS干扰监测中资源受限与模型性能的矛盾,研究结合迭代结构化剪枝、训练后静态量化和硬件感知零样本神经架构搜索,在MCUNet基础上压缩模型并优化架构,实现实时干扰分类与表征。

Comments 7 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22462 2026-06-23 cs.LG 新提交 57%

Adaptive Recurrent Message Passing for Test Time Computing on Graphs

自适应递归消息传递用于图上的测试时计算

Junshu Sun, Wanxing Chang, Qingming Huang, Shuhui Wang

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 针对图数据与固定架构不匹配的问题,提出自适应递归图模型AdaR,通过理论推导步依赖作为自适应收敛的充要条件,并利用归一化步信息和梯度监督实现灵活测试时计算,在归纳和直推设置中优于强基线。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22400 2026-06-23 cs.CV cs.LG 新提交 57%

Multi-cancer detection using a computationally efficient CNN with transfer learning

使用计算高效的CNN与迁移学习进行多癌症检测

Vasileios E. Papageorgiou, Georgios Petmezas, Dimitrios-Panagiotis Papageorgiou, Leandros Stefanopoulos, Nicos Maglaveras

机构 * School of Medicine, Aristotle University of Thessaloniki(阿利卡大学索拉尔尼基医学院) Department of Mathematics, Aristotle University of Thessaloniki(阿利卡大学索拉尔尼基数学系) Department of Mathematics, National and Kapodistrian University of Athens(雅典国家与卡波迪斯蒂亚大学数学系) Department of Electrical and Computer Engineering, Northwestern University(西北大学电气与计算机工程系)

专题命中 效率与部署 :pretraining(abstract);分类 cs.LG

AI总结 提出一种轻量级CNN架构结合迁移学习,在脑、肺和肾癌数据集上分别达到90.85%、98.64%和99.92%的准确率,计算效率高且适合资源受限环境。

Journal ref Communications in Statistics - Simulation and Computation (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21968 2026-06-23 cs.CV cs.CL 新提交 57%

Look Before You Zoom: Adaptive Routing for the Resolution-Context Trade-off in Visual RAG

先看再缩放:视觉RAG中分辨率-上下文权衡的自适应路由

Oanh N. Tran, Thanh Quoc Hung Le, Oscar Chew, Kuan-Hao Huang, Khoa D. Doan

机构 * VinUni-Illinois Smart Health Center, VinUniversity(VinUni-Illinois智慧健康中心,VinUniversity) Texas A&M University(德克萨斯农工大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出ViRGo框架,通过自适应路由选择全局感知、基于补丁或注意力的检索,以平衡小目标细节和大目标上下文,提升视觉RAG的精度与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21947 2026-06-23 cs.CV cs.AI 新提交 57%

ScalePredictor: Instance-aware Scale Learning for Accurate Quantization of Vision Transformers

ScalePredictor:面向视觉Transformer精确量化的实例感知尺度学习

Changjun Li, Runqing Jiang, Lian Xu, Ye Zhang, Qingyong Hu, Yulan Guo

机构 * School of Electronics and Communication Engineering, Shenzhen Campus, Sun Yat-sen University(中山大学深圳校区电子与通信工程学院) Computer Science and Software Engineering, The University of Western Australia(西澳大学计算机科学与软件工程学院) University of Oxford(牛津大学)

专题命中 效率与部署 :post-training(abstract);分类 cs.AI

AI总结 提出动态量化框架ScalePredictor,通过浅层激活分布范围与深层最优尺度的隐藏关联,利用多项式尺度投影模块高效生成所有量化尺度,在ImageNet上取得更优精度-效率权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21851 2026-06-23 cs.CL 新提交 57%

TALAS: Teacher-Anchored Layer Alignment with Adaptive Sharpness-Aware Minimization for Embedding Distillation

TALAS:基于教师锚定的层对齐与自适应锐度感知最小化的嵌入蒸馏

Quoc Phong Dao, Hoang Son Nguyen, Pham Khanh Chi, Linh Ngo Van, Nguyen Thi Ngoc Diep, Thien Huu Nguyen, Trung Le

机构 * Hanoi University of Science and Technology(河内科技大学) VNU University of Engineering and Technology(越南国立大学工程与技术大学) University of Oregon(俄勒冈大学) Monash University(莫纳什大学)

专题命中 效率与部署 :language model(abstract);分类 cs.CL

AI总结 提出TALAS框架,通过教师锚定机制仅蒸馏最终句子嵌入到学生上层,结合层对齐自蒸馏和自适应锐度感知最小化,在降低计算成本的同时提升句子嵌入蒸馏性能。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21786 2026-06-23 cs.LG 新提交 57%

RocketPFN: Accurate Time Series Classification via In-Context Learning

RocketPFN:通过上下文学习实现精确时间序列分类

Franco Martino O'Rourke, Ana Trisovic, Dimitris Bertsimas

机构 * Prior Labs Team(Prior Labs)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出RocketPFN,结合随机卷积特征提取与预训练表格基础模型的上下文分类,在92个UCR数据集上达到与最强方法HC2相当的精度,无需目标数据训练。

Comments 10 pages main text, 4 figures; 15 pages including references and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21372 2026-06-23 cs.RO cs.LG 新提交 57%

NAC: Neural Action Codec for Vision-Language-Action Models

NAC: 面向视觉-语言-动作模型的神经动作编解码器

Ahad Jawaid, Yu Xiang

机构 * The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 效率与部署 :foundation model(abstract);分类 cs.LG

AI总结 提出神经动作编解码器(NAC),采用多尺度RVQGAN架构将短动作轨迹视为多通道1D信号进行压缩,以替代现有离散动作分词器,在LIBERO-10等任务中实现更低重建误差和更高成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20867 2026-06-23 cs.CV cs.AI 新提交 57%

FOCA: Future-Oriented Conditioning for Data-Efficient Vision-Language-Action Adaptation

FOCA: 面向未来的条件化用于数据高效的视觉-语言-动作适应

Duc Minh Nguyen, Nghiem Tuong Diep, Binh Gia Nguyen, Trong-Bao Ho, Doanh Le, Tan Q. Nguyen, Thien-Loc Ha, Nhiem Tran, Bao Thach, Nhat X. Tran, Tuan A. Tran, Artur Habuda, Philip Lund Møller, Tran Nguyen Le, Daniel Sonntag, Matthias Niepert, Khoa D. Doan, Vu Duong, Hung Ngo, Minh N. Vu, Duy M. H. Nguyen, An Thai Le, Ngo Anh Vien

机构 * Center for AI Research, VinUniversity, Vietnam University of Utah, USA German Research Center for Artificial Intelligence (DFKI) Technical University of Denmark, Denmark University of Oldenburg, Germany University of Stuttgart, Germany Max Planck Research School for Intelligent Systems (IMPRS-IS), Germany

专题命中 效率与部署 :pretraining(abstract);分类 cs.AI

AI总结 提出FOCA框架,结合未来交互嵌入预测与目标观测隐式对齐,实现数据高效的VLA少样本适应,在LIBERO、RoboCasa和真实机器人上取得新最优结果。

Comments Accepted at ICML 2026. Project page: https://focavla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20626 2026-06-23 cs.CY cs.AI 新提交 57%

Efficient Safety Benchmarking via Item Response Theory

通过项目反应理论实现高效安全基准测试

Fabio Spagliardi, Mírian Silva, Ayan Datta, Aiden Zhou, Vamshi Bonagiri, Diogo Cruz

机构 * Supervised Program for Alignment Research (SPAR)(对齐研究监督计划) Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(穆罕默德·本·扎耶德人工智能大学) Yale University(耶鲁大学)

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 针对安全基准测试中项目信息量不均的问题,利用项目反应理论(IRT)实现自适应项目选择,将评估成本降低至少80%,最高达99.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20583 2026-06-23 cs.NI cs.AI 新提交 57%

Physical-AI: From Channel Awareness to Environmental Intelligence in 6G Wireless Networks

Physical-AI: 从信道感知到6G无线网络中的环境智能

Farooque Hassan Kumbhar, Kapal Dev, Sunder Ali Khowaja, Alexandros-Apostolos A. Boulogeorgos, Mehdi Bennis, Yuanwei Liu

机构 * Augmented Cognition Meta-communications ERC Research Center, Korea University, Korea(增强认知元通信ERC研究中心,韩国大学,韩国) Department of Computer Science, Munster Technological University (MTU)(计算机科学系,穆斯特技术大学(MTU)) School of Computing, Faculty of Engineering and Computing, Dublin City University, Ireland(计算学院,工程与计算学院,都柏林城市大学,爱尔兰) Department of Electrical and Computer Engineering of the Democritus University, Greece(德米特里大学电气与计算机工程系,希腊) Department of Electrical and Computer Engineering, The University of Hong Kong, Hong Kong(电气与计算机工程系,香港大学,香港) Department of Electronic Engineering, Kyung Hee University, Yongin-si, Gyeonggi-do 17104, South Korea(电子工程系, Kyung Hee大学, Yongin-si, Gyeonggi-do 17104, 韩国)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI

AI总结 提出Physical-AI架构,利用自监督时空无线电基础模型将分布式观测转化为共享环境表征,通过多推理头估计阻塞、用户分布等环境属性,并基于神经决策层实现主动控制,降低中断概率和阻塞响应延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20274 2026-06-19 cs.AI 新提交 57%

Lagrange: An Open-Vocabulary, Energy-Based Sparse Framework for Generalized End-to-End Driving

Lagrange: 一种面向通用端到端驾驶的开放词汇、基于能量的稀疏框架

Shihao Ji, HongXi Li, Zihui Song, Mingyu Li

专题命中 效率与部署 :language model(abstract);分类 cs.AI

AI总结 提出Lagrange框架,利用掩码潜在场和视觉语言模型实现开放词汇、稀疏计算,通过拉格朗日动作最小化确保运动学约束,在nuScenes和CODA基准上验证了鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏