From Natural Language to Executable Properties for Property-based Testing of Mobile Apps
从自然语言到可执行属性:用于移动应用基于属性测试的可执行属性
专题命中 评测与基准 :LLM(abstract)
AI总结 本文提出了一种新的结构化属性合成方法,将自然语言属性描述自动转换为可执行属性,并通过iPBT工具验证,展示了其在提升测试效率和鲁棒性方面的贡献。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
从自然语言到可执行属性:用于移动应用基于属性测试的可执行属性
专题命中 评测与基准 :LLM(abstract)
AI总结 本文提出了一种新的结构化属性合成方法,将自然语言属性描述自动转换为可执行属性,并通过iPBT工具验证,展示了其在提升测试效率和鲁棒性方面的贡献。
一个大规模遥感数据集和基于视觉-语言的算法用于细粒度道路层级分类
机构 * School of Geospatial Engineering and Science(地理工程与科学学院) ; Laboratory of Intelligent Collaborative Computing(智能协同计算实验室) ; United Nations University Institute in Macau(联合国澳门研究所) ; Moganshan Geospatial Information Laboratory(莫干山地理信息实验室)
专题命中 评测与基准 :language model(abstract)
AI总结 本文提出SYSU-HiRoads数据集和RoadReasoner算法,用于从遥感图像中自动多级道路制图。数据集包含3631平方公里的GF-2影像,提供高精度道路掩码和层级标签,算法通过增强频率敏感特征和多尺度上下文,实现道路表面掩码、拓扑保持网络和语义一致的层级分配。
GOLDMARK:受控的成果关联诊断模型评估参考套件
机构 * Department of Pathology and Laboratory Medicine, Memorial Sloan Kettering Cancer Center(病理学与实验室医学部,纪念斯隆凯特琳癌症中心) ; Hasso Plattner Institute for Digital Health at Mount Sinai, Icahn School of Medicine at Mount Sinai(西蒙山医学院的数字健康研究所,西蒙山医学院)
专题命中 评测与基准 :foundation model(abstract)
AI总结 GOLDMARK通过标准化框架和临床可操作的生物标记物标签,为计算病理学提供可重复的基准测试和方法比较,提升模型在不同数据集和模型间的可比性。
加速补丁:学习一种插件式策略以加快具身操作
机构 * National Key Laboratory for Novel Software Technology, Nanjing University, China ; School of Artificial Intelligence, Nanjing University, China ; Mila-Quebec AI Institute \& Université de Montréal, Canada
专题命中 评测与基准 :foundation model(abstract)
AI总结 本文提出Speedup Patch,一种轻量且策略无关的框架,通过仅使用离线数据实现插件式加速,通过约束马尔可夫决策过程优化调度器,提升执行效率而不牺牲任务性能。
三路径DINO:用于遥感多类变化检测的特征互补学习
机构 * School of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) ; School of Instrumentation Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学仪器科学与工程学院) ; Harbin Institute of Technology Suzhou Research Institute(哈尔滨工业大学苏州研究院) ; Ningbo Haichuang Group Co., Ltd.(宁波海创集团有限公司) ; School of Software Technology, Zhejiang University(浙江大学软件学院) ; School of Information Engineering, North China University of Water Resources and Electric Power(中国北方水利电力大学信息工程学院) ; Department of Geo-spatial Information, Information Engineering University(信息工程大学地理信息学院) ; Innovation Center of Yangtze River Delta, Zhejiang University(长三角创新中心,浙江大学)
专题命中 评测与基准 :foundation model(abstract)
AI总结 本文提出Tripath DINO架构,通过三路径互补特征学习策略提升预训练模型在复杂垂直领域快速适应能力,实现了在Gaza和SECOND数据集上的多类变化检测最优性能。
AE-LLM:面向大语言模型的自适应效率优化
机构 * SANNO University(SANNO大学)
专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG
AI总结 本文提出AE-LLM框架,通过自适应选择和组合最优效率技术,提升大语言模型在不同部署场景下的效率,实验显示在15种模型和10种任务中,效率提升达2.8倍,精度保持在基线1.2%以内。
LUT-LLM: 通过FPGA上的基于内存的计算实现高效的大型语言模型推断
机构 * University of California, Los Angeles(加州大学洛杉矶分校)
专题命中 效率与部署 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI
AI总结 本文提出LUT-LLM,首个利用基于内存计算的FPGA加速器,通过向量量化部署10亿参数语言模型,提升FPGA效率以竞争GPU性能。
Comments Extended, 11 pages, FCCM 2026
任务特定效率分析:当小型语言模型超越大型语言模型
机构 * San Francisco State University - Department of Computer Science(旧金山州立大学-计算机科学系) ; Carnegie Mellon University - Department of Computer Science(卡内基梅隆大学-计算机科学系) ; Columbia University - Department of Computer Science(哥伦比亚大学-计算机科学系) ; Cornell University - Department of Computer Science(康奈尔大学-计算机科学系) ; Pennsylvania State University - Department of Biochemistry and Molecular Biology(宾夕法尼亚州立大学-生物化学与分子生物学系)
专题命中 效率与部署 :language model(title,abstract);large language model(title,abstract);small language model(title,comments);分类 cs.CL、cs.LG
AI总结 本文通过对比16个模型在五个NLP任务上的效率,提出PER指标,发现小型模型在效率上表现更优,为高效推理场景提供依据。
Comments Accepted for publication at ESANN 2025. This is a task-specific efficiency analysis comparing small language models
多模态生存分析与可本地部署的大语言模型
机构 * University of Oxford(牛津大学)
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG;foundation model(comments)
AI总结 本文提出利用可本地部署的大语言模型进行多模态生存分析,结合临床文本、表格数据和基因组数据,通过教师-学生蒸馏和原理化的多模态融合,实现校准的生存概率估计和简洁的诊断文本生成,优于标准基线并在隐私和准确性方面表现更优。
Comments NeurIPS 2025 Workshop on Multi-modal Foundation Models and Large Language Models for Life Sciences
ConsRoute:面向云-边-设备大语言模型的一致性感知自适应查询路由
机构 * Department of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术系) ; National Key Laboratory of Smart Farm Technologies and Systems(国家智能农业技术与系统重点实验室) ; Department of Computer Science and Technology, Harbin Institute of Technology (ShenZhen)(哈尔滨工业大学(深圳)计算机科学与技术系)
专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI
AI总结 本文提出ConsRoute框架,通过语义一致性评估和高效路由策略提升大语言模型推理效率,减少延迟和成本,实验表明其性能接近云端且优于现有方法。
SozKZ: 从头开始训练高效的哈萨克语小型语言模型
机构 * Independent Researcher(独立研究者)
专题命中 效率与部署 :language model(title,abstract);small language model(title);分类 cs.CL、cs.AI
AI总结 本文提出SozKZ,通过从头训练哈萨克语模型,在90亿个token上使用专用的50K BPE分词器,实现了在文化问答、阅读理解及主题分类任务上的高性能表现,证明了小型专用模型在低资源语言技术中的可行性。
Comments 12 pages, 3 figures, 2 tables
TIDE:基于令牌的深度执行用于每令牌早退的LLM推理
机构 * RightNow AI
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);post-training(abstract)
AI总结 TIDE通过在周期性检查点层添加小型学习路由器,在推理时为每个令牌选择最早收敛的隐藏状态层,实现令牌早退,提升推理效率。
Comments 9 pages, 5 tables, 2 figures. Code: https://github.com/RightNow-AI/TIDE
一种用于Pepper机器人低延迟LLM驱动多模态交互的框架
机构 * Institute for Information Systems(信息系统研究所) ; University of Applied Sciences and Arts Northwestern Switzerland(西北瑞士应用科学与艺术大学)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本文提出一个开源Android框架,通过端到端语音模型和功能调用能力,实现低延迟多模态交互,提升Pepper机器人的人机交互性能。
Comments 4 pages, 2 figures. To appear in Proceedings of the 21st ACM/IEEE International Conference on Human-Robot Interaction (HRI '26), Edinburgh, Scotland, March 2026
用于可扩展和高效大语言模型推理的键值缓存优化策略
机构 * Dell Technologies(戴尔技术)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本文系统回顾了键值缓存优化技术,探讨了缓存淘汰、压缩、混合内存方案等五个方向,分析了不同场景下的性能和部署权衡,指出适应性多阶段优化流程是未来研究方向。
Comments 24 pages, 14 figures
面向不确定性的多模态大语言模型知识蒸馏
机构 * NEC Laboratories America, Inc.(NEC美洲实验室) ; University at Buffalo, SUNY(布法罗大学) ; Rutgers University(罗格斯大学)
专题命中 效率与部署 :language model(title,abstract);large language model(title)
AI总结 本文提出Beta-KD框架,通过统一贝叶斯视角平衡数据与教师指导,提升多模态VQA任务性能。
Comments Accepted to CVPR 2026
LLM隐写术的柯尔莫哥洛夫复杂度界限及基于困惑度的检测代理
机构 * Northwestern University(西北大学)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 本文研究了LLM隐写术的信息理论成本,证明了隐写方案必须满足复杂度增加的界限,并提出基于困惑度的检测代理,通过实验验证了理论预测。
LLMServingSim 2.0:一种统一的异构和解耦LLM服务基础设施模拟器
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 本文提出LLMServingSim 2.0,通过统一运行时框架模拟异构和解耦LLM服务基础设施中的硬件软件交互,验证其在真实部署中具有高精度和高效能。
Comments 14 pages, 11 figures
多视角大语言模型注释用于主观任务中的有效分析
机构 * Johns Hopkins University(约翰霍普金斯大学) ; University of Washington(华盛顿大学)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL
AI总结 本文提出多视角注释方法,通过集中人力标注于LLM注释最不准确的群体,提升主观任务分析效果,同时保持覆盖范围。
不可见的安全威胁:通过隐写术对LLM进行恶意微调
机构 * National University of Singapore(新加坡国立大学)
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 本文揭示了LLM中隐藏的安全威胁,通过隐写术在看似无害的回复中嵌入恶意内容,展示了对GPT-4.1及多个开源模型的攻击效果,验证了该方法的广泛适用性。
Comments Accepted at ICLR 2026
Nemotron-Cascade 2:基于级联强化学习和多领域在线蒸馏的后训练大语言模型
专题命中 效率与部署 :post-training(title);LLM(abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 Nemotron-Cascade 2是一款30B MoE模型,通过级联强化学习和多领域在线蒸馏提升推理和智能体能力,在2025年国际数学奥林匹克竞赛、国际信息学奥林匹克竞赛和ICPC世界总决赛中达到金奖水平,参数更少性能更强。
Comments We release the model and data at https://huggingface.co/collections/nvidia/nemotron-cascade-2
AI-Wrapped:参与式、隐私保护的长期LLM使用情况实地测量
专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)
AI总结 本文提出AI-Wrapped系统,通过隐私保护的方式收集真实LLM聊天使用数据,并分析用户使用模式及主题,揭示用户在日常场景中对LLM的使用特点及潜在问题。
SpecTM:用于可信基础模型的频谱定向遮蔽
机构 * Department of Civil and Environmental Engineering(土木与环境工程系)
专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG
AI总结 本文提出SpecTM,一种结合物理约束的遮蔽设计,通过预训练时利用交叉频谱上下文重建目标波段,提升EO领域基础模型的可信度和可解释性。
Comments Accepted to IEEE IGARSS 2026
CurvZO:适应性曲率引导的稀疏零阶优化用于高效的LLM微调
机构 * Department of Computer Science and Engineering, Southern University of Science and Technology, Shenzhen, China.(计算机科学与工程系,南方科技大学,深圳,中国) ; Department of Mathematics, Southern University of Science and Technology, Shenzhen, China.(数学系,南方科技大学,深圳,中国)
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 CurvZO通过在线跟踪标量零阶反馈中的曲率信号,构建参数采样分布以减少稀疏零阶梯度估计的方差,从而提升LLM微调效率和性能。
开源LLM驱动的联邦Transformer用于预测智能交通管理
机构 * School of Computer Science and Technology, Algoma University, Canada(计算机科学与技术学院,阿尔戈马大学,加拿大) ; Faculty of Electrical Engineering, Czech Technical University in Prague, Czech Republic(电气工程系,布拉格捷克技术大学,捷克共和国)
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG
AI总结 本文提出FPoTT框架,利用开源LLM实现预测性智能交通管理,通过动态提示优化和联邦学习提升轨迹预测精度,验证了开源LLM在隐私保护和可扩展性方面的潜力。
Comments Preprint version; submitted for academic peer review
Power-SMC:低延迟序列级功率采样用于训练自由LLM推理
机构 * University of Southern California(南加州大学) ; Intel Labs(英特尔实验室)
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.LG
AI总结 本文提出Power-SMC,一种低延迟的序列级功率采样方法,用于训练自由的大语言模型推理,通过并行粒子集和重要权重修正提升推理效率。
通过虚拟节点诱导边预测增强的谣言检测
机构 * Department of Data Science and Artificial Intelligence(数据科学与人工智能系) ; Hong Kong Polytechnic University(香港理工大学) ; School of Mathematical Sciences(数学科学学院) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 效率与部署 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI
AI总结 本文提出一种整合大语言模型的谣言检测框架,通过引入虚拟节点捕捉文本连贯性,改进传统方法对文本连贯性与传播动态的建模能力。
语义自蒸馏用于语言模型不确定性
机构 * Department of Engineering Science University of Oxford(工程科学系牛津大学) ; University of Oxford(牛津大学) ; Oxford Suzhou Centre for Advanced Research University of Oxford Suzhou(牛津苏州先进研究中心)
专题命中 效率与部署 :language model(title,abstract);large language model(abstract);分类 cs.CL
AI总结 本文提出语义自蒸馏方法,通过蒸馏生成轻量模型以估计提示条件密度,提供提示级不确定性信号和答案级可靠性评估,在TriviaQA和MMLU实验中表现出竞争力。
Comments Added experiments on MMLU dataset, investigating utility of likelihood for multiple-choice answer selection
从基础模型学习:无需人工标注的水果检测模型
机构 * College of Biosystems Engineering and Food Science, Zhejiang University(浙江大学生物系统工程与食品科学学院) ; ZJU-Hangzhou Global Scientific and Technological Innovation Center, Zhejiang University(浙江大学杭州全球科技创新中心) ; Faculty of Science, National University of Singapore(新加坡国立大学科学学院)
专题命中 效率与部署 :foundation model(title,abstract);pretraining(abstract);分类 cs.LG
AI总结 本文提出SDM-D框架,通过SDM和知识蒸馏技术,在无标注数据下训练高效的小模型,实现水果检测的高精度与速度,超越现有开放集检测方法。
Comments 35 pages, 11figures, conference or other essential info
E-SocialNav: 基于语言模型的高效社交合规导航
机构 * Hokkaido University(北海道大学) ; George Mason University(乔治·马歇尔大学) ; The University of Tokyo(东京大学)
专题命中 效率与部署 :language model(title,abstract);preference optimization(abstract)
AI总结 本文提出E-SocialNav,通过两阶段训练流程实现高效社交合规导航,验证了GPT-4o和Claude在机器人导航中的社交合规性,并在文本语义和动作准确性上优于零样本基线。
Comments Accepted by 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing, to appear. Preprint version
迈向实时手术场景分割的脉冲驱动视频变换器及其基于脉冲的预训练
机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) ; University of Alberta(阿尔伯塔大学) ; School of Medicine, Yale University(耶鲁大学医学院) ; Southern University of Science and Technology(南方科技大学) ; Nanfang Hospital Southern Medical University(南方医科大学南华医院) ; School of Biomedical Engineering, Shenzhen University(深圳大学生物医学工程学院) ; Faculty of Computer Science and Control Engineering, Shenzhen University of Advanced Technology(深圳先进技术研究院计算机科学与控制工程学院)
专题命中 效率与部署 :pretraining(title,abstract);foundation model(abstract)
AI总结 本文提出SpikeSurgSeg,一种基于脉冲驱动的视频变换器,用于手术场景分割。通过引入基于MAE的脉冲感知预训练策略和多谱知识蒸馏,提升模型在数据稀缺场景下的性能,同时减少推理延迟并提高效率。