arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

AAAI Conference on Artificial Intelligence · 会议 · Artificial Intelligence

共收录 9569
2512.11421 2025-12-15 cs.AI

Towards Trustworthy Multi-Turn LLM Agents via Behavioral Guidance

通过行为指导实现可信的多轮大语言模型代理

Gonca Gürsun

机构 * Gonca Gürsun(独立研究者)

AI总结 本文提出一种框架,通过行为指导使大语言模型代理在多轮任务中实现可靠和可验证的行为。

Comments Accepted to AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11366 2025-12-15 cs.CL

qa-FLoRA: Data-free query-adaptive Fusion of LoRAs for LLMs

qa-FLoRA: 无数据查询自适应融合LoRAs用于大语言模型

Shreya Shukla, Aditya Sriram, Milinda Kuppur Narayanaswamy, Hiteshi Jain

AI总结 qa-FLoRA通过动态计算层级融合权重,无需数据和训练,实现LoRA的查询自适应融合,有效提升多领域任务性能。

Comments Accepted at AAAI 2026 (Main Technical Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11284 2025-12-15 cs.CV

RcAE: Recursive Reconstruction Framework for Unsupervised Industrial Anomaly Detection

RcAE:递归重建框架用于无监督工业异常检测

Rongcheng Wu, Hao Zhu, Shiying Zhang, Mingzhe Wang, Zhidong Li, Hui Li, Jianlong Zhou, Jiangtao Cui, Fang Chen, Pingyang Sun, Qiyu Liao, Ye Lin

AI总结 RcAE通过递归重建框架有效检测工业异常,结合CRD模块和DPN网络,在参数更少的情况下实现与扩散模型相当的性能。

Comments 19 pages, 7 figures, to be published in AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11274 2025-12-15 cs.CV

FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive Diffusion

FilmWeaver: 通过缓存引导自回归扩散编织一致的多镜头视频

Xiangyang Luo, Qingyu Li, Xiaokun Liu, Wenyu Qin, Miao Yang, Meng Wang, Pengfei Wan, Di Zhang, Kun Gai, Shao-Lun Huang

机构 * Kling Team, Kuaishou Technology(快手科技 Kling Team)

AI总结 FilmWeaver通过缓存引导自回归扩散模型实现多镜头视频的一致性生成,支持灵活交互和多任务应用。

Comments AAAI-2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09385 2025-12-15 cs.CR cs.AI cs.LG

BugSweeper: Function-Level Detection of Smart Contract Vulnerabilities Using Graph Neural Networks

BugSweeper: 使用图神经网络进行智能合约漏洞的函数级检测

Uisang Lee, Changhoon Chung, Junmo Lee, Soo-Mook Moon

AI总结 BugSweeper通过图神经网络实现智能合约漏洞的自动检测,无需人工规则,提升检测效率和适应性。

Comments This paper is accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11039 2025-12-15 cs.SD

Listening Between the Frames: Bridging Temporal Gaps in Large Audio-Language Models

在帧之间倾听:在大型音频-语言模型中弥合时间缺口

Hualei Wang, Yiming Li, Shuo Ma, Hong Liu, Xiangdong Wang

AI总结 TimeAudio通过引入时间标记和绝对时间编码,提升大型音频-语言模型在时间定位和长音频理解上的能力,有效解决时间戳表示、架构和数据限制问题。

Comments Accepted by The Fortieth AAAI Conference on Artificial Intelligence (AAAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.15368 2025-12-15 cs.CV cs.AI

Open-World Object Counting in Videos

视频中的开放世界物体计数

Niki Amini-Naieni, Andrew Zisserman

AI总结 本文提出CountVid模型,通过结合图像计数和可提示视频分割跟踪技术,实现视频中的开放世界物体计数,并引入VideoCount数据集验证其性能。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08518 2025-12-15 cs.CV

Visual-Friendly Concept Protection via Selective Adversarial Perturbations

通过选择性对抗扰动实现视觉友好的概念保护

Xiaoyue Mi, Fan Tang, You Wu, Juan Cao, Peng Li, Yang Liu

AI总结 本文提出VCPro框架,通过低感知性对抗扰动实现图像关键概念的保护,平衡扰动可见性与保护效果。

Comments AAAI AISI 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11167 2025-12-15 cs.CV cs.AI

Image Tiling for High-Resolution Reasoning: Balancing Local Detail with Global Context

图像分块用于高分辨率推理:在局部细节与全局上下文之间取得平衡

Anatole Jacquin de Margerie, Alexis Roger, Irina Rish

AI总结 本文通过图像分块技术实现高分辨率图像理解,验证了局部细节恢复的有效性,并探讨了全局上下文对模型性能的影响。

Comments Accepted in AAAI 2025 Workshop on Reproducible AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10892 2025-12-12 cs.GT

Designing Truthful Mechanisms for Asymptotic Fair Division

为渐近公平分配设计 truthful 机制

Jugal Garg, Vishnu V. Narayan, Yuang Eric Shen

AI总结 本文提出了一种在期望下 truthful 的随机机制,用于在渐近设定下实现公平分配。

Comments 34 pages. To appear at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10600 2025-12-12 cs.CR cs.LG

Authority Backdoor: A Certifiable Backdoor Mechanism for Authoring DNNs

权威后门:为作者撰写的DNNs的可证明后门机制

Han Yang, Shaofeng Li, Tian Dong, Xiangyu Xu, Guangchi Liu, Zhen Ling

AI总结 本文提出一种可证明的权威后门机制,通过嵌入访问限制和对抗鲁棒性,主动保护DNNs免受非法使用。

Comments Accepted to AAAI 2026 (Main Track). Code is available at: https://github.com/PlayerYangh/Authority-Trigger

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10573 2025-12-12 cs.LG

Is the Information Bottleneck Robust Enough? Towards Label-Noise Resistant Information Bottleneck Learning

信息瓶颈是否足够稳健?迈向抗标签噪声的信息瓶颈学习

Yi Huang, Qingyun Sun, Yisen Gao, Haonan Yuan, Xingcheng Fu, Jianxin Li

AI总结 LaT-IB通过引入'最小充分清洁'准则,提升信息瓶颈方法在标签噪声下的稳健性和效率。

Comments Accepted by the Main Technical Track of the 40th Annual AAAI Conference on Artificial Intelligence (AAAI-2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10433 2025-12-12 cs.AI

Targeted Data Protection for Diffusion Model by Matching Training Trajectory

通过匹配训练轨迹实现扩散模型的定向数据保护

Hojun Lee, Mijin Koo, Yeji Song, Nojun Kwak

AI总结 本文提出TAFAP方法,通过控制扩散模型的训练轨迹实现有效的定向数据保护,同时保持图像质量,解决了现有方法可控性差的问题。

Comments AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10376 2025-12-12 cs.CV

RaLiFlow: Scene Flow Estimation with 4D Radar and LiDAR Point Clouds

RaLiFlow: 基于4D雷达和激光雷达点云的场景流估计

Jingyun Fu, Zhiyu Xiang, Na Zhao

AI总结 RaLiFlow是首个联合4D雷达和激光雷达的场景流学习框架,通过动态感知双向跨模态融合模块和精心设计的损失函数实现高效的雷达-激光雷达融合。

Comments Accepted by AAAI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10348 2025-12-12 cs.AI

REMISVFU: Vertical Federated Unlearning via Representation Misdirection for Intermediate Output Feature

REMISVFU: 通过中间输出特征的表示误导实现垂直联邦遗忘

Wenhan Wu, Zhili He, Huanghuang Liang, Yili Gong, Jiawei Jiang, Chuang Hu, Dazhao Cheng

机构 * \equalcontrib(机构1) \corrds(机构3)

AI总结 REMISVFU通过表示误导方法实现垂直联邦学习中的高效客户端级遗忘,有效抑制后门攻击并保持模型效用。

Comments The 40th Annual AAAI Conference on Artificial Intelligence

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10305 2025-12-12 cs.AI

InfoCom: Kilobyte-Scale Communication-Efficient Collaborative Perception with Information Bottleneck

InfoCom: 千字级通信高效协作感知与信息瓶颈

Quanmin Wei, Penglin Dai, Wei Li, Bingyi Liu, Xiao Wu

AI总结 InfoCom通过信息瓶颈原理实现通信高效协作感知,显著降低通信开销,提升自动驾驶环境感知精度。

Comments Accepted by the 40th AAAI Conference on Artificial Intelligence (AAAI-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09492 2025-12-12 cs.CV

StateSpace-SSL: Linear-Time Self-supervised Learning for Plant Disease Detection

StateSpace-SSL: 用于植物疾病检测的线性时间自监督学习

Abdullah Al Mamun, Miaohua Zhang, David Ahmedt-Aristizabal, Zeeshan Hayder, Mohammad Awrangjeb

AI总结 StateSpace-SSL通过视觉Mamba状态空间编码器实现线性时间自监督学习,有效提升植物疾病检测的特征表示能力。

Comments Accepted to AAAI workshop (AgriAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06696 2025-12-12 cs.LG cs.AI

Magnitude-Modulated Equivariant Adapter for Parameter-Efficient Fine-Tuning of Equivariant Graph Neural Networks

幅度调制等价适配器:用于等价图神经网络参数高效微调的方法

Dian Jin, Yancheng Yuan, Xiaoming Tao

AI总结 MMEA是一种新颖的等价微调方法,通过轻量级标量门控调节特征幅度,在保持等价性的同时提升模型在多个基准上的能量和力预测性能。

Comments Accepted at AAAI 2026 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11840 2025-12-12 cs.NE cs.LG

GT-SNT: A Linear-Time Transformer for Large-Scale Graphs via Spiking Node Tokenization

GT-SNT: 一种通过脉冲节点令牌化实现大规模图的线性时间图变换器

Huizhe Zhang, Jintang Li, Yuchang Zhu, Huazhen Zhong, Liang Chen

AI总结 GT-SNT通过脉冲节点令牌化实现大规模图的线性时间图变换器,提升节点分类性能和推理速度。

Comments Accepted by AAAI 2026; Code is available at https://github.com/Zhhuizhe/GT-SNT

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03663 2025-12-12 cs.LG cs.AI cs.CL

Forest vs Tree: The $(N, K)$ Trade-off in Reproducible ML Evaluation

森林与树:可重复机器学习评估中的(N,K)权衡

Deepak Pandita, Flip Korn, Chris Welty, Christopher M. Homan

AI总结 本文研究了在可重复机器学习评估中N和K的权衡,发现考虑人类分歧时,N×K通常不超过1000,并探讨了不同评估指标对K和N的依赖关系。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09442 2025-12-11 cs.CR

Reference Recommendation based Membership Inference Attack against Hybrid-based Recommender Systems

基于混合推荐系统成员推断攻击的参考推荐

Xiaoxiao Chi, Xuyun Zhang, Yan Wang, Hongsheng Hu, Wanchun Dou

AI总结 本文提出了一种基于指标的成员推断攻击方法,用于检测混合推荐系统中用户数据的成员资格,通过个性化特征和参考推荐来提高攻击效果。

Comments This paper has been accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09364 2025-12-11 cs.CV

ASSIST-3D: Adapted Scene Synthesis for Class-Agnostic 3D Instance Segmentation

ASSIST-3D: 为无类别3D实例分割适应的场景合成

Shengchao Zhou, Jiehong Lin, Jiahui Liu, Shizhen Zhao, Chirui Chang, Xiaojuan Qi

AI总结 ASSIST-3D通过异构对象选择、场景布局生成和点云构建,提升无类别3D实例分割的泛化能力。

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09271 2025-12-11 cs.CV

LongT2IBench: A Benchmark for Evaluating Long Text-to-Image Generation with Graph-structured Annotations

LongT2IBench: 一个用于评估长文本到图像生成的基准,具有图结构注释

Zhichao Yang, Tianjiao Gu, Jianjie Wang, Feiyu Lin, Xiangfei Sheng, Pengfei Chen, Leida Li

AI总结 LongT2IBench通过图结构注释和LongT2IExpert提出,用于评估长文本到图像生成的对齐和解释能力。

Comments The paper has been accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07723 2025-12-11 cs.LG cs.AI

Enabling Delayed-Full Charging Through Transformer-Based Real-Time-to-Departure Modeling for EV Battery Longevity

通过基于Transformer的实时到出发建模实现延迟满充以延长电动汽车电池寿命

Yonggeon Lee, Jibin Hwang, Alfred Malengo Kondoro, Juhyun Song, Youngtae Noh

AI总结 本文提出基于Transformer的实时到出发建模方法,通过预测用户出发时间实现延迟满充,延长电动汽车电池寿命,提升可持续交通系统的实用性。

Comments 16 pages, 9 figures, AAAI'26 (accepted)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14256 2025-12-11 cs.AI cs.IR

PathMind: A Retrieve-Prioritize-Reason Framework for Knowledge Graph Reasoning with Large Language Models

PathMind: 一种基于大语言模型的知识图谱推理检索-优先-推理框架

Yu Liu, Xixun Lin, Yanmin Shang, Yangxi Li, Shi Wang, Yanan Cao

AI总结 PathMind通过检索-优先-推理框架,提升大语言模型在知识图谱推理中的准确性和可解释性,尤其在复杂推理任务中表现优异。

Comments AAAI 2026, Long Paper, Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14184 2025-12-11 cs.CV

GloTok: Global Perspective Tokenizer for Image Reconstruction and Generation

GloTok: 用于图像重建和生成的全局视角分词器

Xuan Zhao, Zhongyu Zhang, Yuge Huang, Yuxi Mi, Guodong Mu, Shouhong Ding, Jun Wang, Rizen Guo, Shuigeng Zhou

机构 * Tencent Youtu Lab(腾讯优图实验室)

AI总结 GloTok通过全局视角分词器利用全局关系信息,实现更均匀的语义分布,提升图像生成质量。

Comments Accepted at AAAI'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23359 2025-12-11 cs.HC

New Synthetic Goldmine: Hand Joint Angle-Driven EMG Data Generation Framework for Micro-Gesture Recognition

新的合成金矿:基于手关节角度驱动的EMG数据生成框架用于微手势识别

Nana Wang, Gen Li, Pengfei Ren, Hao Su, Suli Wang

AI总结 本文提出SeqEMG-GAN框架,通过手关节角度驱动生成高保真EMG数据,提升微手势识别性能和数据集多样性。

Comments Accepted at AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10287 2025-12-11 cs.SD cs.CV cs.GR eess.AS

MACS: Multi-source Audio-to-image Generation with Contextual Significance and Semantic Alignment

MACS:基于上下文意义和语义对齐的多源音频到图像生成

Hao Zhou, Xiaobao Guo, Yuzhe Zhu, Adams Wai-Kin Kong

AI总结 MACS通过分离多源音频并利用语义对齐提升音频到图像生成的质量和表现。

Comments Accepted at AAAI 2026. Code available at https://github.com/alxzzhou/MACS

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08860 2025-12-10 cs.CV

Tri-Bench: Stress-Testing VLM Reliability on Spatial Reasoning under Camera Tilt and Object Interference

Tri-Bench:在相机倾斜和物体干扰下测试VLM在空间推理中的可靠性

Amit Bendkhale

机构 * Amit Bendkhale(独立研究者)

AI总结 Tri-Bench通过测试VLM在相机倾斜和物体干扰下的空间推理可靠性,揭示了模型在几何推理中的不足。

Comments 6 pages, 3 figures. Code and data: https://github.com/Amiton7/Tri-Bench. Accepted to the AAAI 2026 Workshop on Trust and Control in Agentic AI (TrustAgent)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08536 2025-12-10 cs.AI

Principles2Plan: LLM-Guided System for Operationalising Ethical Principles into Plans

Principles2Plan: 伦理原则引导的计划系统

Tammy Zhong, Yang Song, Maurice Pagnucco

AI总结 Principles2Plan通过人机协作生成基于伦理原则的可操作规则,提升自动规划的伦理实用性

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏