arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

共收录 1960
2601.16125 2026-01-23 cs.CV cs.CL cs.IR

Rethinking Composed Image Retrieval Evaluation: A Fine-Grained Benchmark from Image Editing

重新思考组合图像检索评估:从图像编辑中获得的细粒度基准

Tingyu Song, Yanzhao Zhang, Mingxin Li, Zhuoning Guo, Dingkun Long, Pengjun Xie, Siyue Zhang, Yilun Zhao, Shu Wu

机构 * CASIA(中国科学院自动化研究所) Tongyi Lab, Alibaba Group(阿里云实验室) UCAS(中国科学院大学) HKUST(GZ)(香港科技大学(广州)) NTU(国立新加坡大学) Yale(耶鲁大学)

AI总结 本文提出EDIR细粒度CIR基准,通过图像编辑技术生成多样化查询,揭示现有模型在多模态任务中的能力差距与局限性。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15879 2026-01-23 cs.SE cs.CL

Evaluating and Achieving Controllable Code Completion in Code LLM

评估和实现可控的代码补全在代码LLM中

Jiajun Zhang, Zeyu Cui, Lei Zhang, Jian Yang, Jiaxi Yang, Qiang Liu, Zilei Wang, Binyuan Hui, Liang Wang, Junyang Lin

机构 * University of Science and Technology of China(中国科学技术大学) Alibaba Group(阿里巴巴集团) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出可控代码补全基准C3-Bench,评估了40种LLM在代码补全中的指令遵循能力,开发数据合成管道并推出Qwen2.5-Coder-C3模型,实现代码补全性能的突破。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15628 2026-01-23 cs.AI

CogToM: A Comprehensive Theory of Mind Benchmark inspired by Human Cognition for Large Language Models

CogToM:一种受人类认知启发的大型语言模型全面理论思维基准

Haibo Tong, Zeyang Yue, Feifei Zhao, Erliang Lin, Lu Jia, Ruolin Chen, Yinqian Sun, Qian Zhang, Yi Zeng

机构 * BrainCog Lab, Institute of Automation, Chinese Academy of Sciences(脑认知实验室,自动化研究所,中国科学院) Beijing Institute of AI Safety and Governance (Beijing-AISI)(北京人工智能安全与治理研究所) Beijing Key Laboratory of Safe AI and Superalignment(北京安全人工智能与超对齐重点实验室) School of Artificial Intelligence, UCAS(人工智能学院,中国科学院大学) Long-term AI(长期人工智能)

AI总结 CogToM通过8000个双语实例评估LLM的理论思维能力,揭示性能异质性和认知瓶颈,为研究LLM认知边界提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15572 2026-01-23 eess.IV cs.CE cs.CV

FUGC: Benchmarking Semi-Supervised Learning Methods for Cervical Segmentation

FUGC:用于宫颈分割的半监督学习方法基准测试

Jieyun Bai, Yitong Tang, Zihao Zhou, Mahdi Islam, Musarrat Tabassum, Enrique Almar-Munoz, Hongyu Liu, Hui Meng, Nianjiang Lv, Bo Deng, Yu Chen, Zilun Peng, Yusong Xiao, Li Xiao, Nam-Khanh Tran, Dac-Phu Phan-Le, Hai-Dang Nguyen, Xiao Liu, Jiale Hu, Mingxu Huang, Jitao Liang, Chaolu Feng, Xuezhi Zhang, Lyuyang Tong, Bo Du, Ha-Hieu Pham, Thanh-Huy Nguyen, Min Xu, Juntao Jiang, Jiangning Zhang, Yong Liu, Md. Kamrul Hasan, Jie Gan, Zhuonan Liang, Weidong Cai, Yuxin Huang, Gongning Luo, Mohammad Yaqub, Karim Lekadir

机构 * Department of Cardiovascular Surgery, The First Affiliated Hospital, Jinan University(心血管外科部,济南大学第一附属医院) Imperial College London(帝国理工学院伦敦分校) University of Sydney(悉尼大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Zhejiang University(浙江大学) Carnegie Mellon University(卡内基梅隆大学) Medical University of Innsbruck(因斯布鲁克医科大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 FUGC通过提供首个宫颈分割半监督学习基准测试,展示了在少量标记数据下半监督方法的有效性,并为早产风险评估提供了AI辅助的基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15120 2026-01-23 cs.AI

Emerging from Ground: Addressing Intent Deviation in Tool-Using Agents via Deriving Real Calls into Virtual Trajectories

从地面崛起:通过推导真实调用为虚拟轨迹来解决工具使用代理中的意图偏差

Qian Xiong, Yuekai Huang, Bo Yang, Yujia Zheng, Tianhao Li, Ziyou Jiang, Zhiyuan Chang, Zhaoyang Li, Huanxiang Feng, Mingyang Li

机构 * Beijing Forestry University(北京林业大学) State Key Laboratory of Complex System Modeling and Simulation Technology(复杂系统建模与仿真技术国家重点实验室) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Duke University(杜克大学)

AI总结 RISE通过推导真实调用为虚拟轨迹,解决工具使用代理中的意图偏差问题,提升任务完成和意图对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13273 2026-01-23 cs.SD cs.AI

AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs

AudioMotionBench: 评估音频大语言模型中的听觉运动感知

Zhe Sun, Yujun Cai, Jiayu Yao, Yiwei Wang

机构 * Wuhan University(武汉大学) University of Queensland(昆士兰大学) University of Chinese Academy of Sciences(中国科学院大学) University of California, Merced(加州大学默塞德分校)

AI总结 AudioMotionBench通过评估音频大语言模型对移动声源方向和轨迹的感知能力,揭示了当前模型在听觉空间推理方面的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15281 2026-01-22 cs.CV

StableWorld: Towards Stable and Consistent Long Interactive Video Generation

StableWorld: 向稳定和一致的长交互视频生成迈进

Ying Yang, Zhengyao Lv, Tianlin Pan, Haofan Wang, Binxin Yang, Hubery Yin, Chen Li, Ziwei Liu, Chenyang Si

机构 * PRLab, NJU(南京大学PRLab) HKU(香港大学) UCAS(中国科学技术大学) WeChat, Tencent Inc.(腾讯公司) NTU(国立清华大学)

AI总结 StableWorld通过动态帧淘汰机制提升长交互视频生成的稳定性和时间一致性,适用于多种生成框架。

Comments 17 pages, 21 figures,

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14955 2026-01-22 cs.AI

Multi-Behavior Sequential Modeling with Transition-Aware Graph Attention Network for E-Commerce Recommendation

多行为序列建模与过渡感知图注意力网络用于电子商务推荐

Hanqi Jin, Gaoming Yang, Zhangming Chan, Yapeng Yuan, Longbin Li, Fei Sun, Yeqiu Yang, Jian Wu, Yuning Jiang, Bo Zheng

机构 * Taobao \& Tmall Group of Alibaba Beijing China University of Chinese Academy of Sciences Beijing China Taobao \& Tmall Group of Alibaba University of Chinese Academy of Sciences

AI总结 TGA通过构建结构化稀疏图和过渡感知图注意力机制,实现多行为序列建模,提升电子商务推荐的准确性和效率。

Comments Accepted by WWW2026 short paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13569 2026-01-22 cs.LG cs.CR

DRGW: Learning Disentangled Representations for Robust Graph Watermarking

DRGW: 为鲁棒图水印的解耦表示学习

Jiasen Li, Yanwei Liu, Zhuoyi Shang, Xiaoyan Gu, Weiping Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) State Key Laboratory of Cyberspace Security Defense(网络空间安全防御国家重点实验室)

AI总结 DRGW通过解耦表示学习提出首个图水印框架,解决水印透明性和鲁棒性问题,采用对抗训练编码器、可逆神经网络和结构感知编辑器实现高效水印嵌入与提取。

Comments Published at The Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19774 2026-01-22 cs.LG cs.AI eess.SP

PPGFlowECG: Latent Rectified Flow with Cross-Modal Encoding for PPG-Guided ECG Generation and Cardiovascular Disease Detection

PPGFlowECG: 基于跨模态编码的潜在修正流用于PPG引导的ECG生成和心血管疾病检测

Xiaocheng Fang, Jiarui Jin, Haoyu Wang, Che Liu, Jieyi Cai, Yujie Xiao, Guangkun Nie, Bo Liu, Shun Huang, Hongyan Li, Shenda Hong

机构 * National Institute of Health Data Science, Peking University, China(北京大学国家健康数据科学研究院) School of Intelligence Science and Technology, Peking University, China(北京大学智能科学与技术学院) Data Science Institute, Imperial College London, UK(伦敦帝国理工学院数据科学研究院) University of Chinese Academy of Sciences, China(中国科学院大学)

AI总结 PPGFlowECG通过跨模态编码和潜在修正流,实现PPG引导的ECG生成,提升心血管疾病检测的可扩展性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17825 2026-01-22 cs.AI

FAIRGAMER: Evaluating Social Biases in LLM-Based Video Game NPCs

FAIRGAMER:评估基于LLM的视频游戏NPC中的社会偏见

Bingkang Shi, Jen-tse Huang, Long Luo, Tianyu Zong, Hongzhu Yi, Yuanxiang Wang, Songlin Hu, Xiaodan Zhang, Zhongjiang Yao

机构 * School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) Johns Hopkins University(约翰霍普金斯大学) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)

AI总结 FAIRGAMER通过评估三种交互模式中的社会偏见,揭示了基于LLM的视频游戏NPC在决策上的偏见问题,并指出更大模型可能加剧这些偏见。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14052 2026-01-21 cs.CV

Vision Also You Need: Navigating Out-of-Distribution Detection with Multimodal Large Language Model

视觉也需要:利用多模态大语言模型进行分布外检测导航

Haoran Xu, Yanlin Liu, Zizhao Tong, Jiaze Li, Kexue Fu, Yuyang Zhang, Longxiang Gao, Shuaiguang Li, Xingyu Li, Yanran Xu, Changwei Wang

机构 * Zhejiang University(浙江大学) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Computing Power Network and Information Security, Ministry of Education, Shandong Computer Science Center (National Supercomputer Center in Jinan), Qilu University of Technology (Shandong Academy of Sciences)(教育部计算电力网络与信息安全重点实验室,山东计算机科学中心(国家超算中心济南中心),齐鲁工业大学(山东科学院)) Shandong Provincial Key Laboratory of Computing Power Internet and Service Computing, Shandong Fundamental Research Center for Computer Science(山东省计算电力互联网与服务计算重点实验室,山东省计算机科学基础研究中心) University of Electronic Science and Technology of China(电子科技大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) RWTH Aachen University(亚琛工业大学)

AI总结 本文提出MM-OOD方法,利用多模态大语言模型的推理能力,通过多轮对话增强分布外检测,提升近远OOD任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14027 2026-01-21 cs.AI

Numina-Lean-Agent: An Open and General Agentic Reasoning System for Formal Mathematics

Numina-Lean-Agent: 一种面向形式数学的开放且通用的代理推理系统

Junqi Liu, Zihao Zhou, Zekai Zhu, Marco Dos Santos, Weikun He, Jiawei Liu, Ran Wang, Yunzhou Xie, Junqiao Zhao, Qiufeng Wang, Lihong Zhi, Jia Li, Wenda Li

机构 * Academy of Mathematics and Systems Science, University of Chinese Academy of Sciences(中国科学院数学与系统科学研究院) Tongji University(同济大学) University of Cambridge(剑桥大学) Imperial College London(伦敦帝国学院) University of Edinburgh(爱丁堡大学) University of Liverpool(利物浦大学) Xi'an Jiaotong-Liverpool University(西安交通大学利物浦大学)

AI总结 Numina-Lean-Agent通过通用编码代理实现形式数学推理,解决Putnam 2025全部问题并成功形式化Brascamp-Lieb定理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02438 2026-01-21 cs.SE cs.AI cs.CR

Focus on What Matters: Fisher-Guided Adaptive Multimodal Fusion for Vulnerability Detection

聚焦关键要素:基于Fisher信息的自适应多模态融合用于漏洞检测

Yun Bian, Yi Chen, HaiQuan Wang, ShiHao Li, Zhe Cui

机构 * University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出TaCCS-DFA框架,通过Fisher信息引导的自适应多模态融合,提升漏洞检测的F1分数,同时降低推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05134 2026-01-21 cs.AI

Structuring Reasoning for Complex Rules Beyond Flat Representations

为复杂规则构建推理结构超越平面表示

Zhihao Yang, Ancheng Xu, Jingpeng Li, Liang Yan, Jiehui Zhou, Zhen Qin, Hengyu Chang, Yukun Chen, Longze Chen, Ahmadreza Argha, Hamid Alinejad-Rokny, Minghuan Tan, Yujun Cai, Min Yang

机构 * Shenzhen Key Laboratory for High Performance Data Mining, Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳高性能数据挖掘重点实验室,深圳先进技术研究院,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) School of Biomedical Engineering, UNSW Sydney(悉尼大学生物医学工程学院) University of Queensland(昆士兰大学) Alibaba Group(阿里巴巴集团)

AI总结 本文提出DAT框架,通过分阶段处理复杂规则,提升LLM在复杂规则任务中的推理能力与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10646 2026-01-21 cs.LG cs.AI

SPHENIC: Topology-Aware Multi-View Clustering for Spatial Transcriptomics

SPHENIC:面向空间转录组学的拓扑感知多视图聚类

Chenkai Guo, Yikai Zhu, Renxiang Guan, Jinli Ma, Siwei Wang, Ke Liang, Guangdun Peng, Dayu Hu

机构 * College of Medicine and Biological Information Engineering, Northeastern University(医学与生物信息工程学院,东北大学) Guangzhou Institutes of Biomedicine and Health, Chinese Academy of Sciences(广州生物医学与健康研究院,中国科学院) College of Computer Science and Technology, National University of Defense Technology(计算机科学与技术学院,国防科技大学) Intelligent Game and Decision Lab, Academy of Military Sciences(智能游戏与决策实验室,军事科学院) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 SPHENIC通过整合拓扑持续同调和空间约束优化,提升空间转录组学中细胞聚类的鲁棒性和准确性。

Comments 9 pages, 5 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13948 2026-01-21 cs.CV

Light4GS: Lightweight Compact 4D Gaussian Splatting Generation via Context Model

Light4GS: 通过上下文模型实现轻量级紧凑的4D高斯点云生成

Mufan Liu, Qi Yang, He Huang, Wenjie Huang, Zhenlong Yuan, Zhu Li, Yiling Xu

机构 * School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(信息科学与电子工程学院,上海交通大学) School of Science and Engineering, University of Missouri–Kansas City(科学与工程学院,密苏里大学-堪萨斯城分校) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 Light4GS通过显著性剪枝和深度上下文模型实现轻量级4D高斯点云生成,提升压缩效率和渲染速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04345 2026-01-21 cs.CL cs.AI cs.LG

Jingfang: An LLM-Based Multi-Agent System for Precise Medical Consultation and Syndrome Differentiation in Traditional Chinese Medicine

Jingfang: 一种基于大语言模型的多智能体系统,用于精准中医诊疗和辨证论治

Yehan Yang, Tianhao Ma, Ruotai Li, Xinhan Zheng, Guodong Shan

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Southeast University(东南大学) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学)

AI总结 JingFang 是一种基于大语言模型的多智能体系统,旨在通过多智能体协作机制提升中医诊疗的准确性和个性化水平,尤其在辨证论治方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13133 2026-01-21 cs.CV

CLIP-Guided Adaptable Self-Supervised Learning for Human-Centric Visual Tasks

面向人类的视觉任务的CLIP引导自监督学习

Mingshuang Luo, Ruibing Hou, Bo Chao, Hong Chang, Zimo Liu, Yaowei Wang, Shiguang Shan

机构 * Key Laboratory of Intelligent Information Processing, Institute of Computing Technology (ICT), Chinese Academy of Sciences (CAS), and University of Chinese Academy of Sciences(智能信息处理重点实验室,计算技术研究所(ICT),中国科学院(CAS)及中国科学院大学)

AI总结 CLASP通过CLIP生成多级语义伪标签,并结合Prompt-Controlled MoE模块提升迁移性,实现人类中心视觉任务的高效预训练。

Comments Accepted by TMM (IEEE Transactions on Multimedia), 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12906 2026-01-21 cs.CL

Gated Differentiable Working Memory for Long-Context Language Modeling

具有门控可微工作记忆的长上下文语言模型

Lingrui Mei, Shenghua Liu, Yiwei Wang, Yuyao Ge, Baolong Bi, Jiayu Yao, Jun Wan, Ziling Yin, Jiafeng Guo, Xueqi Cheng

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) University of California, Merced(加州大学梅尔塞德斯分校) UBS AG(UBS集团)

AI总结 Gdwm通过门控可微工作记忆框架,在有限计算下优化长上下文语言模型的测试时间适应,提升效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16029 2026-01-21 cs.CR cs.AI

FDLLM: A Dedicated Detector for Black-Box LLMs Fingerprinting

FDLLM:一种专为黑盒LLM指纹识别设计的检测器

Zhiyuan Fu, Junfan Chen, Lan Zhang, Ting Yang, Jun Niu, Hongyu Sun, Ruidong Li, Peng Liu, Jice Wang, Fannv He, Qiuling Yue, Yuqing Zhang

机构 * College of Cyberspace Security, Hainan University(海南大学网络安全学院) National Computer Network Intrusion Protection Center, University of Chinese Academy of Sciences(中国科学院大学国家计算机网络入侵防护中心) Graduate School of Natural Science and Technology, Kanazawa University(北九州市立大学自然科学技术研究生院) School of Cyber Engineering, Xidian University(西安电子科技大学 cyber 工程学院) School of Informatics, Computing, and Cyber Systems, Northern Arizona University(北亚利桑那大学信息学、计算与网络系统学院) College of IST, Pennsylvania State University(宾夕法尼亚州立大学信息科技学院)

AI总结 FDLLM通过LoRA技术实现高效LLM指纹识别,具备高准确率和鲁棒性,有效提升模型识别与安全防护能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11683 2026-01-21 cs.CR cs.AI cs.SE

Attesting Model Lineage by Consisted Knowledge Evolution with Fine-Tuning Trajectory

通过细调轨迹与持续知识演化认证模型谱系

Zhuoyi Shang, Jiasen Li, Pengzhen Chen, Yanwei Liu, Xiaoyan Gu, Weiping Wang

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) State Key Laboratory of Cyberspace Security Defense(网络空间安全防御国家重点实验室)

AI总结 本文提出通过细调轨迹与持续知识演化认证模型谱系,利用模型编辑和知识向量化机制实现稳健的谱系验证。

Comments Accepted to the 35th USENIX Security Symposium (USENIX Security 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09949 2026-01-21 cs.CV

UVE: Are MLLMs Unified Evaluators for AI-Generated Videos?

UVE: MLLMs是否能作为AI生成视频的统一评估器?

Yuanxin Liu, Rui Zhu, Shuhuai Ren, Jiacong Wang, Haoyuan Guo, Xu Sun, Lu Jiang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学) ByteDance Seed(字节跳动种子) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)

AI总结 本文探讨使用多模态大语言模型作为AI生成视频的统一评估器的可行性,并通过UVE-Bench基准测试评估了18种MLLMs的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11222 2026-01-19 cs.LG

Operator learning on domain boundary through combining fundamental solution-based artificial data and boundary integral techniques

通过结合基于基本解的人工数据和边界积分技术实现领域边界的算子学习

Haochen Wu, Heng Wu, Benzhuo Lu

机构 * SKLMS, ICMSEC, NCMIS, Academy of Mathematics and Systems Science, Chinese Academy of Sciences(数学与系统科学研究院,中国科学院) School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院)

AI总结 本文提出MAD-BNO方法,通过结合基于基本解的人工数据和边界积分技术,实现领域边界的高效算子学习,提升求解精度并减少训练时间。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11164 2026-01-19 cs.CV

SoLA-Vision: Fine-grained Layer-wise Linear Softmax Hybrid Attention

SoLA-Vision:细粒度层间线性softmax混合注意力

Ruibang Li, Guan Luo, Yiwei Zhang, Jin Gao, Bing Li, Weiming Hu

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), CASIA(多模态人工智能系统国家重点实验室(MAIS),中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京多模信息超智能安防重点实验室) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

AI总结 SoLA-Vision通过细粒度层间混合线性与softmax注意力,实现准确率与计算成本的平衡,优于纯线性及混合注意力模型。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11147 2026-01-19 cs.AI

Do We Always Need Query-Level Workflows? Rethinking Agentic Workflow Generation for Multi-Agent Systems

我们是否总是需要查询级工作流?重新思考多智能体系统中的代理工作流生成

Zixu Wang, Bingbing Xu, Yige Yuan, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出SCALE框架,通过低成本任务级生成替代查询级生成,减少令牌消耗并保持性能。

Comments 17 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06024 2026-01-19 cs.CV

Towards Implicit Aggregation: Robust Image Representation for Place Recognition in the Transformer Era

迈向隐式聚合:Transformer时代用于地点识别的鲁棒图像表示

Feng Lu, Tong Jin, Canming Ye, Yunpeng Liu, Xiangyuan Lan, Chun Yuan

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Pengcheng Laboratory(鹏城实验室) Shenyang Institute of Automation, Chinese Academy of Sciences(沈阳自动化研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Pazhou Laboratory (Huangpu)(琶洲实验室(黄埔))

AI总结 本文提出通过隐式聚合方法,利用Transformer模型中的可学习标记实现鲁棒的图像表示,提升视觉地点识别的性能。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10986 2026-01-19 cs.LG

StellarF: A Physics-Informed LoRA Framework for Stellar Flare Forecasting with Historical & Statistical Data

StellarF:一种结合物理知识的LoRA框架,用于利用历史和统计数据进行恒星耀斑预测

Tianyu Su, Zhiqiang Zou, Qingyu Lu, Feng Zhang, Ali Luo, Xiao Kong, Min Li

机构 * School of Computer Science, Nanjing University of Posts and Telecommunications(南京邮电大学计算机科学学院) Jiangsu Key Laboratory of Big Data Security and Intelligent Processing(江苏大数据安全与智能处理重点实验室) University of Chinese Academy of Sciences(中国科学院大学) CAS Key Laboratory of Optical Astronomy, National Astronomical Observatories(中国科学院国家天文台光学天文重点实验室) School of Astronomy and Space Science, University of Chinese Academy of Sciences(中国科学院大学天文与空间科学学院)

AI总结 StellarF通过结合物理知识和LoRA框架,利用历史和统计数据提升恒星耀斑预测的准确性与物理可解释性。

Comments 12 pages, 8 figures (5 main, 3 appendix), 7 tables (2 main, 5 appendix)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.02367 2026-01-19 cond-mat.mtrl-sci cs.LG physics.comp-ph

Reinforcement Fine-Tuning for Materials Design

用于材料设计的强化微调

Zhendong Cao, Lei Wang

机构 * Beijing National Laboratory for Condensed Matter Physics(北京凝聚态物理国家实验室) School of Physical Sciences, University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学物理科学学院) Songshan Lake Materials Laboratory, Dongguan, Guangdong 523808, China(松山湖材料实验室)

AI总结 本研究通过强化微调提升材料生成模型的性能,实现基于属性的材料设计与检索,发现具有矛盾材料属性的新型晶体。

Comments 10 pages, 7 figures

Journal ref Phys. Rev. B 113, 024106 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10606 2026-01-16 cs.CV

RSATalker: Realistic Socially-Aware Talking Head Generation for Multi-Turn Conversation

RSATalker: 基于多轮对话的现实社交感知谈话头生成

Peng Chen, Xiaobao Wei, Yi Yang, Naiming Yao, Hui Chen, Feng Tian

机构 * Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 RSATalker通过3DGS技术实现多轮对话中社交感知的现实谈话头生成,结合网格驱动运动与高斯分布渲染,提升虚拟角色的真实感与社交互动能力。

详情

展开后加载摘要…

URL PDF HTML 收藏