arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence

共收录 9569
2511.16972 2025-11-24 cs.LG

ToC: Tree-of-Claims Search with Multi-Agent Language Models

基于多智能体语言模型的树状主张搜索

Shuyang Yu, Jianan Liang, Hui Hu

机构 * AIGROW

AI总结 ToC通过结合多智能体系统和MCTS,提升专利主张优化的准确性和法律稳健性。

Comments Accepted by AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16845 2025-11-24 cs.LG

Provably Minimum-Length Conformal Prediction Sets for Ordinal Classification

可证明的最小长度符合预测集用于顺序分类

Zijian Zhang, Xinyu Chen, Yuanjie Shi, Liyuan Lillian Ma, Zifan Xu, Yan Yan

AI总结 本文提出了一种模型无关的顺序CP方法,通过最小长度覆盖问题实现实例级最优预测区间,提升了预测效率。

Comments Submitted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16743 2025-11-24 cs.CV cs.AI cs.LG

SafeR-CLIP: Mitigating NSFW Content in Vision-Language Models While Preserving Pre-Trained Knowledge

SafeR-CLIP: 通过保留预训练知识来缓解视觉-语言模型中的不适宜内容

Adeel Yousaf, Joseph Fioresi, James Beetham, Amrit Singh Bedi, Mubarak Shah

AI总结 SafeR-CLIP通过最小化干预策略,在保留预训练知识的同时提升视觉-语言模型的安全性,实现性能与安全性的平衡。

Comments AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15311 2025-11-24 cs.CV

Adapt-As-You-Walk Through the Clouds: Training-Free Online Test-Time Adaptation of 3D Vision-Language Foundation Models

在云中适应:无需训练的在线测试时适应3D视觉-语言基础模型

Mehran Tamjidi, Hamidreza Dastmalchi, Mohammadreza Alimoradijazi, Ali Cheraghian, Aijun An, Morteza Saberi

AI总结 Uni-Adapter通过动态原型学习和熵加权聚合,在无需重新训练的情况下提升3D VLFMs在不同基准测试中的性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15036 2025-11-24 cs.MA

Area-Optimal Control Strategies for Heterogeneous Multi-Agent Pursuit

面积最优的异构多智能体追捕策略

Kamal Mammadov, Damith C. Ranasinghe

AI总结 本文提出了一种基于面积最小化的多智能体追捕策略,通过几何区域分析和梯度控制实现高效捕获。

Comments Published as a conference paper at the Fortieth AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13049 2025-11-24 cs.LG stat.ML

Generalization Bounds for Semi-supervised Matrix Completion with Distributional Side Information

半监督矩阵补全的泛化界限:带有分布侧信息的情况

Antoine Ledent, Mun Chong Soo, Nong Minh Hieu

AI总结 该研究提出了一种半监督矩阵补全方法,通过结合分布侧信息,推导出低秩矩阵补全的泛化界限,验证了在推荐系统中显式与隐式反馈交互的有效性。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22300 2025-11-24 cs.CR cs.AI cs.CV

T2I-RiskyPrompt: A Benchmark for Safety Evaluation, Attack, and Defense on Text-to-Image Model

T2I-RiskyPrompt:用于评估、攻击和防御文本到图像模型安全性的基准

Chenyu Zhang, Tairen Zhang, Lanjun Wang, Ruidong Chen, Wenhui Li, Anan Liu

AI总结 T2I-RiskyPrompt提出了一种用于评估文本到图像模型安全性的综合基准,通过层次化风险分类和原因驱动的检测方法,全面评估了多种模型和防御策略的安全性能。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03135 2025-11-24 cs.CV cs.RO

Mask2IV: Interaction-Centric Video Generation via Mask Trajectories

Mask2IV: 通过遮罩轨迹实现以交互为中心的视频生成

Gen Li, Bo Zhao, Jianfei Yang, Laura Sevilla-Lara

AI总结 Mask2IV通过遮罩轨迹实现以交互为中心的视频生成,提供灵活的交互控制和高真实感的视频生成。

Comments AAAI 2026. Project page: https://reagan1311.github.io/mask2iv

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04270 2025-11-24 cs.NE cs.CV

TDSNNs: Competitive Topographic Deep Spiking Neural Networks for Visual Cortex Modeling

TDSNNs: 用于视觉皮层建模的竞争性拓扑深度脉冲神经网络

Deming Zhou, Yuetong Fang, Zhaorui Wang, Renjing Xu

机构 * Deming Zhou(周德明) Yuetong Fang(方岳通) Zhaorui Wang(王昭瑞) Renjing Xu(徐任静)

AI总结 TDSNNs通过引入拓扑约束损失函数,在视觉皮层建模中实现了高效且稳定的时序信息处理,表现出优于传统拓扑ANNs的性能和生物合理性。

Comments AAAI 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00783 2025-11-24 cs.GT

Promises Made, Promises Kept: Safe Pareto Improvements via Ex Post Verifiable Commitments

承诺已作出,承诺已履行:通过事后可验证的承诺实现安全的帕累托改进

Nathaniel Sauerberg, Caspar Oesterheld

AI总结 本文研究通过事后可验证的承诺实现安全的帕累托改进,探讨三种不同承诺类型下的复杂性分析与算法设计。

Comments Published at AAAI'26 (Oral). An earlier version was presented at GAIW'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16637 2025-11-21 cs.LO cs.AI

Faster Certified Symmetry Breaking Using Orders With Auxiliary Variables

更快的利用辅助变量的顺序进行认证对称性打破

Markus Anders, Bart Bogaerts, Benjamin Bogø, Arthur Gontier, Wietze Koops, Ciaran McCreesh, Magnus O. Myreen, Jakob Nordström, Andy Oertel, Adrian Rebola-Pardo, Yong Kiam Tan

AI总结 本文提出了一种利用辅助变量编码顺序的方法,以提高对称性打破的认证效率。

Comments 26 pages. Extended version (with appendix) of the paper to appear in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16590 2025-11-21 cs.AI cs.CL

D-GARA: A Dynamic Benchmarking Framework for GUI Agent Robustness in Real-World Anomalies

D-GARA:一种用于真实世界异常中GUI代理鲁棒性评估的动态基准框架

Sen Chen, Tong Zhao, Yi Bin, Fei Ma, Wenqi Shao, Zheng Wang

AI总结 D-GARA提出一种动态基准框架,用于评估Android GUI代理在真实世界异常中的鲁棒性,揭示了现有代理在异常环境下的性能下降问题。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16588 2025-11-21 cs.AI cs.LO

Formal Abductive Latent Explanations for Prototype-Based Networks

基于原型网络的正式归纳性隐式解释

Jules Soria, Zakaria Chihani, Julien Girard-Satabin, Alban Grastien, Romain Xu-Darme, Daniela Cancila

AI总结 本文提出基于原型网络的正式归纳性隐式解释方法,通过形式化方法提升模型可解释性,适用于图像分类任务。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16575 2025-11-21 cs.LG cs.AI math.OC stat.ML

ECPv2: Fast, Efficient, and Scalable Global Optimization of Lipschitz Functions

ECPv2: 快速、高效且可扩展的Lipschitz函数全局优化

Fares Fourati, Mohamed-Slim Alouini, Vaneet Aggarwal

AI总结 ECPv2通过引入自适应下界、Worst-m记忆机制和固定随机投影,实现高维非凸函数优化的高效且可扩展的全局优化方法。

Comments Accepted at AAAI 2026 (main technical track), extended version

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16566 2025-11-21 cs.CV cs.AI

NutriScreener: Retrieval-Augmented Multi-Pose Graph Attention Network for Malnourishment Screening

NutriScreener: 一种结合检索增强的多姿态图注意力网络用于营养不良筛查

Misaal Khan, Mayank Vatsa, Kuldeep Singh, Richa Singh

AI总结 NutriScreener通过结合检索增强的多姿态图注意力网络,实现儿童营养不良的高效检测与体格测量预测,适用于低资源环境。

Comments Accepted in AAAI 2026 Special Track on AI for Social Impact

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16483 2025-11-21 cs.LG cs.AI cs.MA

Large Language Model-Based Reward Design for Deep Reinforcement Learning-Driven Autonomous Cyber Defense

基于大型语言模型的深度强化学习驱动自主网络防御的奖励设计

Sayak Mukherjee, Samrat Chatterjee, Emilie Purvine, Ted Fujimoto, Tegan Emerson

AI总结 本文提出利用大型语言模型设计奖励,以提升深度强化学习在自主网络防御中的效果。

Comments Accepted in the AAAI-26 Workshop on Artificial Intelligence for Cyber Security (AICS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16454 2025-11-21 cs.CV

LLaVA$^3$: Representing 3D Scenes like a Cubist Painter to Boost 3D Scene Understanding of VLMs

LLaVA$^3$:像立体主义画家一样表示3D场景以提升VLM的3D场景理解

Doriand Petit, Steve Bourgeois, Vincent Gay-Bellile, Florian Chabot, Loïc Barthe

AI总结 LLaVA$^3$通过立体主义方法提升VLM对3D场景的理解能力,利用多视角2D图像无需微调实现更优的3D场景理解。

Comments Accepted at AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16423 2025-11-21 cs.AI cs.CL

TOFA: Training-Free One-Shot Federated Adaptation for Vision-Language Models

TOFA: 无需训练的一次性联邦适应用于视觉-语言模型

Li Zhang, Zhongxuan Han, XiaoHua Feng, Jiaming Zhang, Yuyuan Li, Linbo Jiang, Jianan Lin, Chaochao Chen

AI总结 TOFA提出一种无需训练的一次性联邦适应方法,通过视觉和文本管道提取任务相关表示,以高效适应视觉-语言模型在联邦学习中的应用。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16331 2025-11-21 cs.CL

Incorporating Self-Rewriting into Large Language Model Reasoning Reinforcement

将自我修正纳入大语言模型推理强化

Jiashu Yao, Heyan Huang, Shuang Zeng, Chuwei Luo, WangJie You, Jie Tang, Qingsong Liu, Yuhang Guo, Yangyang Kang

机构 * ByteDance China(字节跳动中国)

AI总结 本研究提出自我修正框架,通过重写推理文本提升大语言模型的内部推理质量,实验表明其在准确性与推理长度权衡上优于现有方法。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09540 2025-11-21 cs.CV

vMFCoOp: Towards Equilibrium on a Unified Hyperspherical Manifold for Prompting Biomedical VLMs

vMFCoOp:在统一超球面流形上实现平衡的提示生物医学VLMs

Minye Shao, Sihan Guo, Xinrun Li, Xingyu Miao, Haoran Duan, Yang Long

AI总结 vMFCoOp通过统一超球面流形上的vMF分布估计,实现LLM与CLIP主干间的语义对齐,提升生物医学VLMs的提示效果和少样本分类性能。

Comments Accepted as an Oral Presentation at AAAI 2026 Main Technical Track (this version is not peer-reviewed; it is the extended version)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06017 2025-11-21 cs.CL

AgentSwift: Efficient LLM Agent Design via Value-guided Hierarchical Search

AgentSwift: 通过价值引导的分层搜索高效设计LLM代理

Yu Li, Lehui Li, Zhihao Wu, Qingmin Liao, Jianye Hao, Kun Shao, Fengli Xu, Yong Li

AI总结 AgentSwift通过价值引导的分层搜索高效设计LLM代理,实现8.34%的性能提升。

Comments AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16245 2025-11-21 cs.HC

GazeInterpreter: Parsing Eye Gaze to Generate Eye-Body-Coordinated Narrations

GazeInterpreter: 解析眼动以生成眼-身体协调的叙述

Qing Chang, Zhiming Hu

AI总结 GazeInterpreter通过解析眼动数据生成眼-身体协调的叙述,提升人类行为理解的准确性与效率。

Comments Accepted to AAAI 2026. 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16233 2025-11-21 cs.RO

FT-NCFM: An Influence-Aware Data Distillation Framework for Efficient VLA Models

FT-NCFM: 一种面向影响的数据蒸馏框架用于高效VLA模型

Kewei Chen, Yayu Long, Shuai Li, Mingsheng Shang

AI总结 FT-NCFM通过智能数据蒸馏框架提升VLA模型效率,实现训练数据减少80%的同时成功率达85-90%

Comments Accepted at the AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16200 2025-11-21 cs.RO

PIPHEN: Physical Interaction Prediction with Hamiltonian Energy Networks

PIPHEN: 基于哈密顿能量网络的物理交互预测

Kewei Chen, Yayu Long, Mingsheng Shang

AI总结 PIPHEN通过物理交互预测网络和哈密顿能量网络,实现多机器人系统的高效协同控制,显著降低通信延迟并提高任务成功率。

Comments Accepted at the AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16194 2025-11-21 cs.LG

A Switching Framework for Online Interval Scheduling with Predictions

一种基于预测的在线区间调度切换框架

Antonios Antoniadis, Ali Shahheidar, Golnoosh Shahkarami, Abolfazl Soltani

机构 * University of Twente(特文特大学) Sharif University of Technology(谢赫大学) Max Planck Institut für Informatik, Universität des Saarlandes(马克斯·普朗克研究所,萨尔布吕克大学)

AI总结 本文提出SemiTrust-and-Switch框架,结合预测和经典算法,平衡一致性与鲁棒性,提升在线区间调度性能。

Comments This paper will appear in AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16170 2025-11-21 cs.CV

Target Refocusing via Attention Redistribution for Open-Vocabulary Semantic Segmentation: An Explainability Perspective

通过注意力重新分配的目标重聚焦实现开放词汇语义分割:可解释性视角

Jiahao Li, Yang Lu, Yachao Zhang, Yong Xie, Fangyong Wang, Yuan Xie, Yanyun Qu

AI总结 本文提出RF-CLIP方法,通过模拟人类注意力重聚焦行为,解决CLIP在开放词汇语义分割中的多模态对齐问题,提升密集预测性能。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16161 2025-11-21 cs.CV

Simba: Towards High-Fidelity and Geometrically-Consistent Point Cloud Completion via Transformation Diffusion

Simba: 通过变换扩散实现高保真的几何一致点云补全

Lirui Zhang, Zhengkai Zhao, Zhi Zuo, Pan Gao, Jie Qin

AI总结 Simba通过变换扩散方法,结合对称先验和扩散模型,实现高保真的点云补全,解决传统方法的过拟合和噪声敏感问题,取得最先进性能。

Comments Accepted for publication at the 40th AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16140 2025-11-21 cs.CV

Real-Time 3D Object Detection with Inference-Aligned Learning

基于推理对齐学习的实时3D物体检测

Chenyu Zhao, Xianwei Zheng, Zimin Xia, Linwei Yue, Nan Xue

AI总结 SR3D通过空间优先级最优传输分配和排名意识自适应自蒸馏方案,提升实时3D物体检测的准确性和效率

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16124 2025-11-21 cs.CV

VTinker: Guided Flow Upsampling and Texture Mapping for High-Resolution Video Frame Interpolation

VTinker: 用于高分辨率视频帧插值的引导流上采样与纹理映射

Chenyang Wu, Jiayi Fu, Chun-Le Guo, Shuhao Han, Chongyi Li

AI总结 VTinker通过引导流上采样和纹理映射技术,提升高分辨率视频帧插值的精度与质量。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16110 2025-11-21 cs.CR

Multi-Faceted Attack: Exposing Cross-Model Vulnerabilities in Defense-Equipped Vision-Language Models

多面攻击:揭示配备防御机制的视觉语言模型中的跨模型漏洞

Yijun Yang, Lichao Wang, Jianping Zhang, Chi Harold Liu, Lanqing Hong, Qiang Xu

AI总结 多面攻击揭示了配备防御机制的视觉语言模型中的跨模型安全漏洞,通过注意力转移攻击和轻量级转移增强算法,实现了58.5%的成功率。

Comments AAAI 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏