arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

共收录 1952
2604.12461 2026-04-15 cs.AI

CIA: Inferring the Communication Topology from LLM-based Multi-Agent Systems

CIA:从基于大语言模型的多智能体系统推断通信拓扑

Yongxuan Wu, Xixun Lin, He Zhang, Nan Sun, Kun Wang, Chuan Zhou, Shirui Pan, Yanan Cao

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Griffith University(格里菲斯大学) Nanyang Technological University(南洋理工大学) Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院)

AI总结 研究探讨了基于大语言模型的多智能体系统通信拓扑在黑盒环境下被推断的隐私风险,提出CIA攻击方法,通过构建对抗性查询和全局偏差解耦技术,验证了攻击的有效性。

Comments ACL 2026, Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12356 2026-04-15 cs.CV

OmniFood8K: Single-Image Nutrition Estimation via Hierarchical Frequency-Aligned Fusion

OmniFood8K:通过层次化频率对齐融合实现单图像营养估计

Dongjian Yu, Weiqing Min, Qian Jiang, Xing Lin, Xin Jin, Shuqiang Jiang

机构 * School of Software, Yunnan University, China(云南大学软件学院,中国) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences, China(中国科学院人工智能安全国家重点实验室,计算技术研究所,中国) University of Chinese Academy of Sciences, China(中国科学院大学,中国)

AI总结 本文提出OmniFood8K数据集和端到端框架,通过频率对齐融合模块提升单图像营养预测精度,解决中餐营养估计不足和深度传感器限制问题。

Comments Accepted by CVPR 2026 (Highlight Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12292 2026-04-15 cs.SD cs.CV cs.MM

CoSyncDiT: Cognitive Synchronous Diffusion Transformer for Movie Dubbing

CoSyncDiT:认知同步扩散变换器用于电影配音

Gaoxiang Cong, Liang Li, Jiaxin Ye, Zhedong Zhang, Hongming Shan, Yuankai Qi, Qingming Huang

机构 * Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China(中国科学院计算技术研究所) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) Fudan University, Shanghai, China(复旦大学) Hangzhou Dianzi University, Hangzhou, China(杭州电子科技大学) Macquarie University, Sydney, Australia(麦考瑞大学)

AI总结 本文提出基于认知同步扩散变换器的电影配音框架,通过声学风格适应、细粒度视觉校准和时间感知上下文对齐,解决传统方法在唇同步和自然度上的不足,实验表明其在多个指标上达到最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12247 2026-04-15 cs.CL cs.AI cs.LG

SpecBound: Adaptive Bounded Self-Speculation with Layer-wise Confidence Calibration

SpecBound: 带层间置信度校准的自适应有界自我猜测

Zhuofan Wen, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences(智能信息处理重点实验室,计算技术研究所,中国科学院) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学,北京,中国)

AI总结 本文提出一种新型自适应自我猜测框架,通过层间温度退火抑制虚假置信,根据token解码难度动态限制猜测长度,提升大语言模型的自回归推理效率。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12162 2026-04-15 cs.CL

AlphaEval: Evaluating Agents in Production

AlphaEval:生产环境中的代理评估

Pengrui Lu, Bingyu Xu, Wenjun Zhang, Shengjia Hua, Xuanjian Gao, Ranxiang Ge, Lyumanshan Ye, Linxuan Wu, Yiran Li, Junfei Fish Yu, Yibo Zhang, Ruixin Li, Manxiang Li, Xiao Han, Xiaocong Zhou, Guangyao Chi, Zisheng Chen, Kaishen Chen, Kun Wang, Qihua Xu, Fengyue Meng, Yuchen Ni, Jiajun Li, Jinxiu Liu, Danfeng Zhang, Jingru Zhao, Pengfei Liu

机构 * SII MiraclePlus SJTU(上海交通大学) GAIR HIT(哈尔滨工业大学) UCAS(中国科学技术大学) LangCore Jiqizhixin HunterAI CinoCore KuaFuAI POET

AI总结 AlphaEval 是一个基于生产环境的评估基准,包含 94 个任务,涵盖六个职业领域,通过多种评估方法评估完整代理产品,提供可复现的构建框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08209 2026-04-15 cs.CL

Generation-Augmented Generation: A Plug-and-Play Framework for Private Knowledge Injection in Large Language Models

生成增强生成:一种用于大语言模型私有知识注入的即插即用框架

Rongji Li, Jian Xu, Yi Chen, Xueqing Chen, Yisheng Yang, Jiayi Wang, Xingyu Chen, Chunyu Xie, Dawei Leng, Xu-Yao Zhang

机构 * MAIS, Institute of Automation, Chinese Academy of Sciences(自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Zhongguancun Academy(中关村学院) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) AI Research(360人工智能研究院)

AI总结 本文提出GAG框架,通过将私有专业知识作为辅助模态注入冻结的基础模型,解决私有知识注入中的效率与效果平衡问题,在科学和通用领域问答中均表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11778 2026-04-14 cs.CL cs.AI

General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks

General365:在多样化和具有挑战性的任务中评估大语言模型的通用推理能力

Junlin Liu, Shengnan An, Shuang Zhou, Dan Ma, Shixiong Luo, Ying Xie, Yuan Zhang, Wenling Yuan, Yifan Zhou, Xiaoyu Li, Ziwen Wang, Xuezhi Cao, Xunliang Cai

机构 * University of Chinese Academy of Sciences(中国科学院大学) Meituan(美团)

AI总结 本文提出General365基准,通过限制背景知识至K-12水平,评估大语言模型在通用推理任务中的表现,揭示当前模型在非专业领域推理能力的不足。

Comments 17 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11637 2026-04-14 cs.CV

STS-Mixer: Spatio-Temporal-Spectral Mixer for 4D Point Cloud Video Understanding

STS-Mixer:用于4D点云视频理解的时空频混合器

Wenhao Li, Xueying Jiang, Gongjie Zhang, Xiaoqin Zhang, Ling Shao, Shijian Lu

机构 * Nanyang Technological University(南洋理工大学) Alibaba Group(阿里巴巴集团) Zhejiang University of Technology(浙江工业大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出STS-Mixer框架,通过将4D点云视频转换为图谱信号,结合时空与频域信息,提升对4D点云视频的几何结构和时间动态的理解。

Comments Accepted by CVPR 2026, Open Sourced

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11615 2026-04-14 cs.AR cs.AI cs.DC cs.LG

CUTEv2: Unified and Configurable Matrix Extension for Diverse CPU Architectures with Minimal Design Overhead

CUTEv2:面向多样化CPU架构的统一且可配置的矩阵扩展架构,具有最小的设计开销

Jinpeng Ye, Chongxi Wang, Wenqing Li, Bin Yuan, Shiyi Wang, Fenglu Zhang, Junyu Yue, Jianan Xie, Yunhao Ye, Haoyu Deng, Yingkun Zhou, Xin Cheng, Fuxin Zhang, Jian Wang

机构 * State Key Lab of Processors, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所处理器国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 CUTEv2通过解耦矩阵单元与CPU流水线,实现低开销的矩阵扩展架构,支持混合精度运算并提升AI模型性能,跨平台适应性强。

Comments Accepted to DAC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11540 2026-04-14 cs.AI

A collaborative agent with two lightweight synergistic models for autonomous crystal materials research

一种用于自主晶体材料研究的双轻量协同模型协作代理

Tongyu Shi, Yutang Li, Zhanyuan Li, Qian Liu, Jie Zhou, Wenhe Xu, Yang Li, Dawei Dai, Rui He, Wenhua Zhou, Jiahong Wang, Xue-Feng Yu

机构 * Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) University of Chinese Academy of Sciences(中国科学院大学) Institute for Advanced Study, Chengdu University(成都大学高等研究院) Key Laboratory of Cyberspace Big Data Intelligent Security, Ministry of Education, Chongqing University of Posts and Telecommunications(重庆邮电大学教育部网络空间大数据智能安全重点实验室)

AI总结 本文提出MatBrain,一种轻量级协作代理系统,通过双协同模型提升材料研究效率,显著优于大模型,减少硬件部署成本,并在催化剂设计中实现100倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11365 2026-04-14 cs.AI cs.CL

Learning from Contrasts: Synthesizing Reasoning Paths from Diverse Search Trajectories

从对比中学习:从多样的搜索轨迹中合成推理路径

Peiyang Liu, Zhirui Chen, Xi Wang, Di Liang, Youru Li, Zhi Cai, Wei Ye

机构 * National Engineering Research Center for Software Engineering, Peking University(北京大学软件工程国家工程研究中心) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) UCAS-Terminus AI Lab, University of Chinese Academy of Sciences(中国科学院大学UCAS-Terminus人工智能实验室) Tencent Technology(腾讯科技) College of Computer Science, Beijing University of Technology(北京工业大学计算机学院)

AI总结 本文提出CRPS框架,通过对比高质与低质搜索轨迹合成推理路径,减少数据集规模并提升泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11322 2026-04-14 cs.CL cs.AI

Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations

LLMs是否了解工具无关性?解密工具调用中的结构对齐偏差

Yilong Liu, Xixun Lin, Pengfei Cao, Ge Zhang, Fang Fang, Yanan Cao

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Computer Science and Technology, Donghua University(东华大学计算机科学与技术学院)

AI总结 本文研究LLMs在面对无关工具时的调用偏差,提出SABEval数据集和Contrastive Attention Attribution方法,揭示结构对齐偏差的成因并提出缓解策略。

Comments Accepted to ACL 2026 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11096 2026-04-14 cs.CL cs.AI cs.SD

Efficient Training for Cross-lingual Speech Language Models

多语言语音语言模型的高效训练

Yan Zhou, Qingkai Fang, Yun Hong, Yang Feng

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology, Chinese Academy of Sciences (ICT/CAS)(中国科学院计算技术研究所智能信息处理重点实验室) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出CSLM,通过离散语音标记实现多语言语音大模型的高效训练,采用持续预训练策略提升模态对齐质量,减少延迟,展现良好的语言扩展能力。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14968 2026-04-14 cs.CR cs.CL

Rethinking LLM Watermark Detection in Black-Box Settings: A Non-Intrusive Third-Party Framework

重新思考黑盒环境下的LLM水印检测:一种非侵入性的第三方框架

Zhuoshang Wang, Yubing Ren, Yanan Cao, Fang Fang, Xiaoxue Li, Li Guo

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) National Computer Network Emergency Response Technical Team, Coordination Center of China (CNCERT/CC)(国家计算机网络应急技术处理协调中心)

AI总结 本文提出TTP-Detect框架,通过解耦检测与注入,实现非侵入性的第三方水印验证,提升检测性能和抗攻击能力。

Comments Accepted to ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05505 2026-04-14 cs.CL

FlashMem: Distilling Intrinsic Latent Memory via Computation Reuse

FlashMem: 通过计算复用提炼内在潜在记忆

Yubo Hou, Zhisheng Chen, Tao Wan, Zengchang Qin

机构 * School of ASEE, Beihang University(北京航空航天大学ASEE学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) School of BME, Beijing Advanced Innovation Center for BME, Beihang University(北京航空航天大学生物医学工程学院/北京生物医学工程高精尖创新中心) CAIR and CECS, VinUniversity(VinUniversity计算与人工智能研究中心/计算机工程与计算机科学系)

AI总结 FlashMem通过计算复用直接从临时推理状态提炼内在记忆,消除冗余重参数化,提升推理效率和持久认知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19172 2026-04-14 cs.CV

MetroGS: Efficient and Stable Reconstruction of Geometrically Accurate High-Fidelity Large-Scale Scenes

MetroGS: 高精度大规模场景高效稳定重建

Kehua Chen, Tianlu Mao, Xinzhu Ma, Hao Jiang, Zehao Li, Zihan Liu, Shuqin Gao, Honglong Zhao, Feng Dai, Yucheng Zhang, Zhaoqi Wang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Beihang University(北京航空航天大学)

AI总结 本文提出MetroGS框架,通过分布式2D高斯点扩散表示和结构密集增强方案,结合单目与多视图优化策略,实现复杂城市环境中的高效高精度场景重建。

Comments Accepted by CVPR26; Project page: https://m3phist0.github.io/MetroGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10955 2026-04-14 cs.LG

Hypergraph Neural Diffusion: A PDE-Inspired Framework for Hypergraph Message Passing

超图神经扩散:一种受偏微分方程启发的超图信息传递框架

Zhiheng Zhou, Mengyao Zhou, Xixun Lin, Xingqin Qi, Guiying Yan

机构 * School of Mathematics and Statistics, Shandong University(山东大学数学与统计学院) Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)

AI总结 本文提出Hypergraph Neural Diffusion框架,通过结合非线性扩散方程与超图信息传递,解决现有超图神经网络在传播深度、过平滑和适应复杂超图结构方面的不足,理论分析和实验验证了其稳定性与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10717 2026-04-14 cs.CR cs.AI cs.CL

Detecting RAG Extraction Attack via Dual-Path Runtime Integrity Game

通过双路径运行时完整性游戏检测RAG提取攻击

Yuanbo Xie, Yingjie Zhang, Yulin Li, Shouyou Song, Xiaokun Chen, Zhihan Liu, Liya Su, Tingwen Liu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Beijing University of Post and Telecommunications(北京邮电大学) Stanford University(斯坦福大学) North China Electric Power University(华北电力大学) AI Sec Lab, Beijing Chaitin Technology Co.,Ltd(北京长亭科技有限公司AI安全实验室)

AI总结 本文提出CanaryRAG,一种基于栈canary的运行时防御机制,通过双路径完整性游戏实时检测RAG知识库泄露,有效降低攻击成功率,不影响任务性能和延迟。

Comments Accepted by ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10674 2026-04-14 cs.LG cs.AI cs.CL

Skill-SD: Skill-Conditioned Self-Distillation for Multi-turn LLM Agents

Skill-SD:基于多轮LLM代理的技能条件自蒸馏

Hao Wang, Guozhi Wang, Han Xiao, Yufeng Zhou, Yue Pan, Jichao Wang, Ke Xu, Yafei Wen, Xiaohu Ruan, Xiaoxin Chen, Honggang Qi

机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院) The Chinese University of Hong Kong(香港中文大学) University of Science and Technology of China(中国科学技术大学) University of Chinese Academy of Sciences(中国科学院大学) vivo AI Lab(vivo AI实验室)

AI总结 Skill-SD通过将代理自身轨迹转化为动态训练监督,结合重要加权反KL损失稳定训练,提升多轮LLM代理性能,实验显示优于标准RL和OPD方法。

Comments Project page: https://k1xe.github.io/skill-sd/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10627 2026-04-14 cs.CL cs.AI cs.CE

Computational Lesions in Multilingual Language Models Separate Shared and Language-specific Brain Alignment

多语言语言模型中的计算病变分离共享和语言特定的脑对齐

Yang Cui, Jingyuan Sun, Yizheng Sun, Yifan Wang, Yunhao Zhang, Jixing Li, Shaonan Wang, Hongpeng Zhou, John Hale, Chengqing Zong, Goran Nenadic

机构 * The University of Manchester(曼彻斯特大学) City University of Hong Kong(香港城市大学) The Hong Kong Polytechnic University(香港理工大学) Institute of Automation, CAS(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Johns Hopkins University(约翰霍普金斯大学)

AI总结 研究通过多语言大语言模型创建计算病变,揭示语言处理的共享与特定机制,发现共享核心减少整体脑编码相关性,而语言特定病变保持跨语言分离但削弱匹配母语的脑预测性。

Comments 23 pages, 5 figures, Journal format

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05549 2026-04-14 cs.CL

Stop Fixating on Prompts: Reasoning Hijacking and Constraint Tightening for Red-Teaming LLM Agents

不要执着于提示:针对LLM代理的推理劫持与约束紧缩

Yanxu Mao, Peipei Liu, Tiehan Cui, Congying Liu, Mingzhe Xing, Datao You

机构 * School of Software, Henan University(河南大学软件学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Chinese Academy of Sciences(中国科学院大学) Peking University(北京大学)

AI总结 本文提出JailAgent框架,通过触发提取、推理劫持和约束紧缩三个阶段,避免修改用户提示,提升跨模型和跨场景的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04932 2026-04-14 cs.CL

GenProve: Learning to Generate Text with Fine-Grained Provenance

GenProve:学习生成文本的细粒度溯源

Jingxuan Wei, Xingyue Wang, Yanghaoyu Liao, Jie Dong, Yuchen Liu, Caijun Jia, Bihui Yu, Junnan Zhu

机构 * Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(计算能力网络与信息安全教育部重点实验室,山东省计算中心(国家超级计算济南中心),齐鲁工业大学(山东省科学院)) Shenyang Institute of Computing Technology, Chinese Academy of Sciences(中国科学院沈阳计算技术研究所) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统实验室) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出GenProve框架,通过结合监督微调与组相对策略优化,提升生成文本的准确性和细粒度溯源能力,优于14个强LLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12982 2026-04-14 cs.CV

Scaling Up AI-Generated Image Detection with Generator-Aware Prototypes

扩大AI生成图像检测的生成器感知原型

Ziheng Qin, Yuheng Ji, Renshuai Tao, Yuxuan Tian, Yuyang Liu, Yipu Wang, Xiaolong Zheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Institute of Information Science, Beijing Jiaotong University(北京交通大学信息科学研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学前沿交叉科学学院)

AI总结 本文提出Generator-Aware Prototype Learning框架,解决生成器多样性导致的检测性能下降问题,通过约束学习和低秩适应提升检测准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03447 2026-04-14 cs.CV

CoPS: Conditional Prompt Synthesis for Zero-Shot Anomaly Detection

CoPS:用于零样本异常检测的条件提示合成

Qiyu Chen, Zhen Qu, Wei Luo, Haiming Yao, Yunkang Cao, Yuxin Jiang, Yinan Duan, Huiyuan Luo, Chengkan Lv, Zhengtao Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) CASIVISION(中科视语) THU(清华大学) HNU(湖南大学) HUST(华中科技大学)

AI总结 本文提出CoPS框架,通过动态提示合成提升零样本异常检测性能,利用视觉特征生成适应性状态模型,并在13个工业和医疗数据集上取得分类AUROC和分割AUROC的提升。

Comments Accepted by CVPR 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10953 2026-04-14 cs.CL

A Multilingual Dataset and Empirical Validation for the Mutual Reinforcement Effect in Information Extraction

一种多语言数据集和信息提取中相互强化效应的实证验证

Chengguang Gan, Sunbowen Lee, Qingyu Yin, Yunhao Liang, Xinyang He, Hanjun Wei, Younghun Lim, Shijian Wang, Hexiang Huang, Qinghao Zhang, Shiwen Ni, Tatsunori Mori

机构 * Yokohama National University(横滨国立大学) Shenzhen University of Advanced Technology(深圳理工大学) Zhejiang University(浙江大学) University of Chinese Academy of Sciences(中国科学院大学) Chengdu Institute of Computer Applications, Chinese Academy of Sciences(中国科学院成都计算机应用研究所) Southeast University(东南大学) University of Tsukuba(筑波大学) Pusan National University(釜山大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

AI总结 本文提出多语言MRE混合数据集,通过LLM辅助框架减少标注工作,验证了多语言环境下信息提取中相互强化效应的普遍性。

Comments Accepted by ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10181 2026-04-14 cs.SD

Learning to Attend to Depression-Related Patterns: An Adaptive Cross-Modal Gating Network for Depression Detection

学习关注抑郁症相关模式:一种自适应跨模态门控网络用于抑郁症检测

Hangbin Yu, Yudong Yang, Rongfeng Su, Nan Yan, Lan Wang

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Biomedical Imaging Science and System, Chinese Academy of Sciences(中国科学院生物医学成像科学与系统重点实验室)

AI总结 本文提出自适应跨模态门控网络,通过动态分配帧权重来关注抑郁症相关段落,提升语音信号中抑郁症检测的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10179 2026-04-14 math.OC cs.LG

Byzantine-Robust Distributed SGD: A Unified Analysis and Tight Error Bounds

容错分布式随机梯度下降:统一分析与紧误差界

Boyuan Ruan, Xiaoyu Wang, Ya-Feng Liu

机构 * School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学前沿交叉科学学院) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院) Ministry of Education Key Laboratory of Mathematics and Information Networks, School of Mathematical Sciences, Beijing University of Posts and Telecommunications(北京邮电大学数学科学学院数学与信息网络教育部重点实验室)

AI总结 本文研究了容错分布式随机梯度下降,分析了带和不带局部动量的变体,推导了非凸光滑目标和满足Polyak-Lojasiewicz条件的收敛速率,并给出了匹配下界以证明上界是紧的。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09700 2026-04-14 cs.CV cs.AI

Attention-Guided Flow-Matching for Sparse 3D Geological Generation

基于注意力的流匹配用于稀疏3D地质生成

Zhixiang Lu, Mengqi Han, Peixin Guo, Tianming Bai, Jionglong Su, Fei Fang, Sifan Song

机构 * Xi’an Jiaotong-Liverpool University(西交利物浦大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出3D-GeoFlow框架,通过将离散类别生成转化为连续向量场回归,解决稀疏多模态地质建模中的非线性拓扑断点问题,实现稳定确定性最优传输路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09681 2026-04-14 cs.NI cs.CV cs.DC

R2E-VID: Two-Stage Robust Routing via Temporal Gating for Elastic Edge-Cloud Video Inference

R2E-VID:通过时间门控的两阶段鲁棒路由用于弹性边缘-云视频推理

Zheming Yang, Lulu Zuo, Shun Lu, Yangyu Zhang, Zhicheng Li, Xiangyang Li, Yang You

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Peng Cheng Laboratory(鹏城实验室) National University of Singapore(新加坡国立大学) Beijing Kuaishou Technology Co., Ltd.(北京快手科技有限公司)

AI总结 本文提出R2E-VID框架,通过时间门控机制实现边缘-云视频推理的两阶段鲁棒路由,提升路由效率并降低计算成本。

Comments 10 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06806 2026-04-14 cs.CL cs.AI

MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining

MachineLearningLM: 通过持续预训练扩展多示例上下文学习

Haoyu Dong, Pengkun Zhang, Mingzhe Lu, Yanzhen Shen, Guolin Ke

机构 * UCAS(中国科学院大学) Microsoft(微软) SCUT(华南理工大学) Stanford(斯坦福大学)

AI总结 MachineLearningLM通过持续预训练赋予大语言模型强大的上下文机器学习能力,同时保持其通用知识和推理能力,提升多示例任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏