arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

共收录 1960
2602.04290 2026-02-05 cs.CL

Guided Verifier: Collaborative Multimodal Reasoning via Dynamic Process Supervision

引导验证器:通过动态过程监督实现协作多模态推理

Lingzhuang Sun, Ruitong Liu, Yuxia Zhu, Xiaohan Xu, Jingxuan Wei, Xiangxiang Zhang, Bihui Yu, Wentao Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Peking University(北京大学) The University of Hong Kong(香港大学)

AI总结 本文提出引导验证器框架,通过动态过程监督实现多模态推理的协作优化,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04260 2026-02-05 cs.CV

Decoupled Hierarchical Distillation for Multimodal Emotion Recognition

解耦层次蒸馏用于多模态情感识别

Yong Li, Yuanzhi Wang, Yi Ding, Shiqing Zhang, Ke Lu, Cuntai Guan

机构 * School of Computer Science and Engineering, and the Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications, Southeast University(计算机科学与工程学院,新一代人工智能技术及跨学科应用重点实验室,东南大学) School of Computer Science and Engineering, Nanjing University of Science and Technology(计算机科学与工程学院,南京理工大学) Institute of Intelligent Information Processing, Taizhou University(智能信息处理研究院,台州大学) School of Engineering Science, University of Chinese Academy of Sciences(工程科学学院,中国科学院大学) Peng Cheng Laboratory(鹏城实验室) School of Computer Science and Engineering, Nanyang Technological University(计算机科学与工程学院,南洋理工大学)

AI总结 本文提出解耦层次多模态蒸馏框架,通过两阶段知识蒸馏提升跨模态特征对齐,有效提高多模态情感识别性能。

Comments arXiv admin note: text overlap with arXiv:2303.13802

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04228 2026-02-05 cs.RO

Reshaping Action Error Distributions for Reliable Vision-Language-Action Models

重塑动作误差分布以实现可靠的视觉-语言-动作模型

Shuanghao Bai, Dakai Wang, Cheng Chi, Wanqi Zhou, Jing Lyu, Xiaoguang Zhao, Pengwei Wang, Zhongyuan Wang, Lei Xing, Shanghang Zhang, Badong Chen

机构 * Institute of Artificial Intelligence and Robotics(人工智能与机器人研究所) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Institute of Automation(自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) School of Artificial Intelligence(人工智能学院) Peking University(北京大学)

AI总结 本研究通过重塑动作误差分布,提出基于最小误差熵的VLA模型训练方法,提升模型在不同任务中的成功率与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21436 2026-02-05 cs.LG cs.AI cs.CL cs.CV

From Consistency to Complementarity: Aligned and Disentangled Multi-modal Learning for Time Series Understanding and Reasoning

从一致性到互补性:面向时间序列理解和推理的对齐与解缠多模态学习

Hang Ni, Weijia Zhang, Fei Wang, Zezhi Shao, Hao Liu

机构 * The Hong Kong University of Science(香港科学与技术大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 MADI通过细粒度对齐和解缠交互提升多模态时间序列理解和推理能力,实现更精确的数值-视觉模态整合。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20347 2026-02-05 cs.CV

MMSF: Multitask and Multimodal Supervised Framework for WSI Classification and Survival Analysis

MMSF:多任务和多模态监督框架用于WSI分类和生存分析

Chengying She, Chengwei Chen, Xinran Zhang, Ben Wang, Lizhuang Liu, Chengwei Shao, Yun Bian

机构 * University of Chinese Academy of Sciences(中国科学院大学) Shanghai Advanced Research Institute, Chinese Academy of Sciences(中国科学院上海先进研究院) Department of Radiology, Changhai Hospital(昌海医院放射科)

AI总结 MMSF通过多任务和多模态监督框架,结合组织拓扑和临床数据,提升全滑片图像分类和生存分析的准确性和预后预测能力。

Comments Submitted to "Biomedical Signal Processing and Control"

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03793 2026-02-04 cs.RO cs.CV

BridgeV2W: Bridging Video Generation Models to Embodied World Models via Embodiment Masks

BridgeV2W: 通过具身遮罩将视频生成模型与具身世界模型 bridging

Yixiang Chen, Peiyan Li, Jiabing Yang, Keji He, Xiangnan Wu, Yuan Xu, Kai Wang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(模式识别新实验室(NLPR),自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Shandong University(山东大学)

AI总结 BridgeV2W 通过具身遮罩将视频生成模型与具身世界模型结合,解决坐标空间动作与像素空间视频的不匹配问题,并提升视频生成质量与跨具身统一性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03782 2026-02-04 cs.CV cs.RO

QVLA: Not All Channels Are Equal in Vision-Language-Action Model's Quantization

QVLA:视觉-语言-动作模型量化中并非所有通道都平等

Yuhao Xu, Yantai Yang, Zhenyang Fan, Yufan Liu, Yuming Li, Bing Li, Zhipeng Zhang

机构 * AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(自动化实验室,人工智能学院,上海交通大学) Anyverse Dynamics State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,自动化研究所,中国科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学) Terminal Technology Department, Alipay, Ant Group(终端技术部,蚂蚁集团)

AI总结 QVLA提出了一种动作导向的量化框架,通过按通道分配比特数来优化视觉-语言-动作模型的压缩,实现了更高的性能和效率。

Comments ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03635 2026-02-04 cs.CL cs.LG

TRE: Encouraging Exploration in the Trust Region

TRE: 在信任区域中鼓励探索

Chao Huang, Yujing Lu, Quangang Li, Shenghe Wang, Yan Wang, Yueyang Zhang, Long Xia, Jiashu Zhao, Zhiyuan Sun, Daiting Shi, Tingwen Liu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Baidu Inc.(百度公司) Wilfrid Laurier University(威尔弗里德·劳里埃大学)

AI总结 TRE通过在模型信任区域内鼓励探索,提升了大型语言模型在数学推理、组合搜索和偏好对齐任务中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03510 2026-02-04 cs.CV

Semantic Routing: Exploring Multi-Layer LLM Feature Weighting for Diffusion Transformers

语义路由:探索多层LLM特征加权用于扩散变换器

Bozhou Li, Yushuo Guan, Haolin Li, Bohan Zeng, Yiyan Ji, Yue Ding, Pengfei Wan, Kun Gai, Yuanxing Zhang, Wentao Zhang

机构 * Peking University(北京大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Nanjing University(南京大学) Fudan University(复旦大学)

AI总结 本文提出深度-wise语义路由方法,通过多层LLM特征加权提升文本到图像生成的准确性与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03495 2026-02-04 cs.DC cs.LG

DALI: A Workload-Aware Offloading Framework for Efficient MoE Inference on Local PCs

DALI:一种面向工作负载的高效MoE推理卸载框架

Zeyu Zhu, Gang Li, Peisong Wang, Zitao Mo, Minnan Pei, Zhuoran Song, Xiaoyao Liang, Jian Cheng

机构 * Institute of Automation, CAS(中国科学院自动化研究所) School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院) Shanghai Jiao Tong University(上海交通大学) AiRiA

AI总结 DALI通过动态分配和残差预取技术,提升本地PC上MoE推理效率,实现显著加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02636 2026-02-04 cs.CL cs.AI cs.IR

WideSeek: Advancing Wide Research via Multi-Agent Scaling

WideSeek: 通过多智能体扩展推进宽研究

Ziyang Huang, Haolin Ren, Xiaowei Yuan, Jiawei Wang, Zhongtao Jiang, Kun Xu, Shizhu He, Jun Zhao, Kang Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学)

AI总结 WideSeek通过多智能体扩展和统一训练框架,提升宽研究的效率与效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02593 2026-02-04 cs.LG cs.AI math.OC

Effective Frontiers: A Unification of Neural Scaling Laws

有效前沿:神经缩放定律的统一

Jiaxuan Zou, Zixuan Gong, Ye Su, Huayi Tang, Yong Liu

机构 * Department of Mathematics and Statistics, Xi'an Jiaotong University(西安交通大学数学与统计学系) Department of Artificial Intelligence, Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) University of Chinese Academy of Sciences(中国科学院大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)

AI总结 本文提出有效前沿框架,统一神经缩放定律,揭示容量、覆盖和优化瓶颈的相互作用,证明Kaplan和Chinchilla定律是同一问题的不同解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02590 2026-02-04 cs.RO

StepNav: Structured Trajectory Priors for Efficient and Multimodal Visual Navigation

StepNav: 为高效且多模态视觉导航引入结构化轨迹先验

Xubo Luo, Aodi Wu, Haodong Han, Xue Wan, Wei Zhang, Leizheng Shu, Ruisuo Wang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Technology and Engineering Center for Space Utilization, Chinese Academy of Sciences(中国科学院空间利用技术与工程中心)

AI总结 StepNav通过结构化多模态轨迹先验提升视觉导航的鲁棒性、效率和安全性。

Comments 8 pages, 7 figures; Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02542 2026-02-04 cs.LG cs.AI eess.SP

Auto-Augmentation Contrastive Learning for Wearable-based Human Activity Recognition

自适应增强对比学习用于基于可穿戴设备的人体活动识别

Qingyu Wu, Jianfei Shen, Feiyi Fan, Yang Gu, Chenyang Xu, Yiqiang Chen

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) The Beijing Key Laboratory of Mobile Computing and Pervasive Device(北京移动计算与普适设备重点实验室) Shandong Academy of Intelligent Computing Technology(山东省智能计算技术研究院) Peng Cheng Laboratory(鹏城实验室) Institute of Robotics and Autonomous Systems(机器人与自主系统研究所)

AI总结 本文提出了一种自适应增强对比学习方法,用于提升基于可穿戴设备的人体活动识别的识别准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02033 2026-02-04 cs.CV cs.AI cs.MM

One Size, Many Fits: Aligning Diverse Group-Wise Click Preferences in Large-Scale Advertising Image Generation

一个尺寸,多种适配:在大规模广告图像生成中对多样化群体点击偏好进行对齐

Shuo Lu, Haohan Wang, Wei Feng, Weizhen Wang, Shen Zhang, Yaoyu Li, Ao Ma, Zheng Zhang, Jingjing Lv, Junjie Shen, Ching Law, Bing Zhan, Yuan Xu, Huizai Yao, Yongcan Yu, Chenyang Si, Jian Liang

机构 * NLPR & MAIS, CASIA(中国科学院长春光学精密机械与物理研究所 & 中国科学院自动化所) School of AI, UCAS(中国科学院大学人工智能学院) HKUST(gz)(香港科技大学) PRLab, NJU(南京大学PRLab)

AI总结 本文提出OSMF框架,通过自适应分组和群组感知多模态模型,解决广告图像生成中用户群体点击偏好多样性的优化问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10915 2026-02-04 cs.LG cs.AI cs.ET

LPCVAE: A Conditional VAE with Long-Term Dependency and Probabilistic Time-Frequency Fusion for Time Series Anomaly Detection

LPCVAE:一种具有长期依赖性和概率时频融合的条件变分自编码器用于时间序列异常检测

Hanchang Cheng, Weimin Mu, Fan Liu, Weilin Zhu, Can Ma

机构 * Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences, Beijing, China(中国科学院大学网络安全学院)

AI总结 LPCVAE通过引入LSTM和Product-of-Experts机制,实现对时间序列异常检测中长期依赖和概率时频融合的高效整合,提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.03516 2026-02-04 cs.CV

DSKC: Domain Style Modeling with Adaptive Knowledge Consolidation for Exemplar-free Lifelong Person Re-Identification

DSKC: 域风格建模与自适应知识整合用于无示例的终身人物重识别

Shiben Liu, Mingyue Xu, Huijie Fan, Qiang Wang, Liangqiong Qu, Zhi Han

机构 * State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences(机器人与智能系统国家重点实验室,沈阳自动化研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学) Key Laboratory of Manufacturing Industrial Integrated Automation, Shenyang University(制造工业集成自动化重点实验室,沈阳大学) Department of Statistics and Actuarial Science and the Institute of Data Science, The University of Hong Kong(统计与精算系及数据科学研究所,香港大学)

AI总结 DSKC通过域风格编码器和统一知识整合机制,提升终身人物重识别的抗遗忘和泛化能力。

Comments 11 papges, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14103 2026-02-04 cs.CR cs.AI cs.LG cs.SD eess.AS

AudioJailbreak: Jailbreak Attacks against End-to-End Large Audio-Language Models

AudioJailbreak: 对端到端大音频-语言模型的攻击

Guangke Chen, Fu Song, Zhe Zhao, Xiaojun Jia, Yang Liu, Yanchen Qiao, Weizhe Zhang, Weiping Tu, Yuhong Yang, Bo Du

机构 * Wuhan University(武汉大学) Key Laboratory of System Software (Chinese Academy of Sciences)(中国科学院系统软件重点实验室) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) State Key Laboratory of Cryptology(密码学国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Nanjing Institute of Software Technology(南京软件技术研究所) Ant Group(蚂蚁集团) Nanyang Technological University(南洋理工大学) Zhejiang Lab(浙江实验室) Pengcheng Laboratory(鹏城实验室)

AI总结 AUDIOJAILBREAK 提出了一种针对端到端大音频-语言模型的新型音频攻击方法,具备非同步性、通用性、隐蔽性和空中鲁棒性,适用于弱攻击者场景。

Comments Accepted by IEEE Transactions on Dependable and Secure Computing (TDSC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02222 2026-02-03 cs.CV cs.CR

MIRROR: Manifold Ideal Reference ReconstructOR for Generalizable AI-Generated Image Detection

MIRROR:基于流形理想参考的通用AI生成图像检测器

Ruiqi Liu, Manni Cui, Ziheng Qin, Zhiyuan Yan, Ruoxin Chen, Yi Han, Zhiheng Li, Junkai Chen, ZhiJin Chen, Kaiqing Lin, Jialiang Shen, Lubin Weng, Jing Dong, Yan Wang, Shu Wu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, UCAS(北京大学交叉信息学院) Huazhong University of Science and Technology(华中科技大学) Tencent YouTu Lab(腾讯YouTu实验室) Southwest University(西南大学) Peking University(北京大学) The University of Sydney(悉尼大学) Shenzhen University(深圳大学) Tsinghua University(清华大学)

AI总结 MIRROR通过流形理想参考重建器,利用现实先验和残差信号,实现对AI生成图像的高效检测,超越现有方法并接近人类感知极限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02195 2026-02-03 cs.LG cs.AI

State Rank Dynamics in Linear Attention LLMs

线性注意力大语言模型中的状态排名动态

Ao Sun, Hongtao Zhang, Heng Zhou, Yixuan Ma, Yiran Qin, Tongrui Su, Yan Liu, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) University of Chinese Academy of Sciences(中国科学院大学) CAS Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院人工智能安全重点实验室) University of Science and Technology of China(中国科学技术大学) Harbin Institute of Technology(哈尔滨工业大学) University of Oxford(牛津大学) Tsinghua University(清华大学)

AI总结 本研究揭示了线性注意力模型中状态排名分层现象,提出联合秩-范数剪枝策略,有效降低KV缓存开销并维持模型准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02107 2026-02-03 cs.CV

Teacher-Guided Student Self-Knowledge Distillation Using Diffusion Model

教师引导的学生自知识蒸馏使用扩散模型

Yu Wang, Chuanguang Yang, Zhulin An, Weilun Feng, Jiarui Zhao, Chengqing Yu, Libo Huang, Boyu Diao, Yongjun Xu

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(人工智能安全国家重点实验室,计算技术研究所,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 教师引导的学生自知识蒸馏使用扩散模型,通过轻量级扩散模型和局部敏感哈希方法提升学生模型对教师知识的学习效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01966 2026-02-03 cs.LG

Self-Consolidation for Self-Evolving Agents

自组织式自进化代理

Hongzhuo Yu, Fei Zhu, Guo-Sen Xie, Ling Shao

机构 * UCAS-Terminus AI Lab, University of Chinese Academy of Sciences(中国科学院大学Terminus AI实验室,中国科学院大学) Centre for Artificial Intelligence and Robotics, HKISI-CAS(人工智能与机器人中心,中国科学院香港研究院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院)

AI总结 本文提出了一种自组织式自进化框架,通过对比反思和自组织机制,使LLM代理能有效利用历史经验实现长期进化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01917 2026-02-03 cs.CL

GuideWeb: A Benchmark for Automatic In-App Guide Generation on Real-World Web UIs

GuideWeb: 一个用于真实世界Web UI上的自动应用内引导生成的基准测试

Chengguang Gan, Yoshihiro Tsujii, Yunhao Liang, Tatsunori Mori, Shiwen Ni, Hiroki Itoh

机构 * Techtouch Inc.(Techtouch公司) University of Chinese Academy of Sciences(中国科学院大学) Shenzhen Institute of Advanced Technology Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Yokohama National University(Yokohama国立大学)

AI总结 GuideWeb提出一个用于真实世界Web UI的自动应用内引导生成基准测试,通过选择引导目标元素和生成用户意图文本,实验显示其在引导目标预测和生成质量上优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01723 2026-02-03 cs.CV

FastPhysGS: Accelerating Physics-based Dynamic 3DGS Simulation via Interior Completion and Adaptive Optimization

FastPhysGS: 通过内部补全与自适应优化加速基于物理的动态3DGS仿真

Yikun Ma, Yiqing Li, Jingwen Ye, Zhongkai Wu, Weidong Zhang, Lin Gao, Zhi Jin

机构 * School of Intelligent Systems Engineering, Shenzhen Campus of Sun Yat-sen University(中山大学智能系统工程学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Guangdong Provincial Key Laboratory of Fire Science(广东省消防科学与智能应急技术重点实验室) Guangdong Provincial Key Laboratory of Robotics(广东省机器人与数字智能制造技术重点实验室)

AI总结 FastPhysGS通过内部补全与自适应优化,实现了基于物理的动态3DGS仿真的高效与稳健,提升了仿真精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01630 2026-02-03 cs.CV

Research on World Models Is Not Merely Injecting World Knowledge into Specific Tasks

世界模型的研究并非仅仅是将世界知识注入特定任务

Bohan Zeng, Kaixin Zhu, Daili Hua, Bozhou Li, Chengzhuo Tong, Yuran Wang, Xinyi Huang, Yifan Dai, Zixiang Zhang, Yifan Yang, Zhou Liu, Hao Liang, Xiaochen Ma, Ruichuan An, Tianyi Bai, Hongcheng Gao, Junbo Niu, Yang Shi, Xinlong Chen, Yue Ding, Minglei Shi, Kai Zeng, Yiwen Tang, Yuanxing Zhang, Pengfei Wan, Xintao Wang, Wentao Zhang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 本文提出统一的世界模型设计规范,强调其应整合交互、感知、符号推理和空间表示,以实现更通用和稳健的世界模型。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00573 2026-02-03 cs.CL

Training a Utility-based Retriever Through Shared Context Attribution for Retrieval-Augmented Language Models

通过共享上下文归因训练基于效用的检索器以增强检索增强语言模型

Yilong Xu, Jinhua Gao, Xiaoming Yu, Yuanhai Xue, Baolong Bi, Huawei Shen, Xueqi Cheng

机构 * State Key Lab of AI Safety, Institute of Computing Technology, CAS(人工智能安全国家重点实验室,计算技术研究所,中国科学院) Key Lab of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 SCARLet通过共享上下文归因和多任务泛化提升检索增强语言模型的检索性能。

Comments EMNLP 2025 Main Conference (Long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13375 2026-02-03 cs.CL

ALiiCE: Evaluating Positional Fine-grained Citation Generation

ALiiCE:评估位置细粒度引用生成

Yilong Xu, Jinhua Gao, Xiaoming Yu, Baolong Bi, Huawei Shen, Xueqi Cheng

机构 * State Key Lab of AI Safety, Institute of Computing Technology, CAS(人工智能安全国家重点实验室,计算技术研究所,中国科学院) Key Lab of AI Safety, Chinese Academy of Sciences(人工智能安全重点实验室,中国科学院) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 ALiiCE提出了一种自动评估框架,用于评估位置细粒度引用生成,通过依赖树解析句子并引入三个指标评估引用质量。

Comments NAACL 2025 Main Conference (Long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01335 2026-02-03 cs.CV cs.AI

Beyond Pixels: Visual Metaphor Transfer via Schema-Driven Agentic Reasoning

超越像素:通过基于模式的代理推理实现视觉隐喻转移

Yu Xu, Yuxin Zhang, Juan Cao, Lin Gao, Chunyu Wang, Oliver Deussen, Tong-Yee Lee, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯文脉) University of Konstanz(康斯坦茨大学) National Cheng-Kung University(国立成功大学)

AI总结 本文提出基于模式的代理推理框架,实现视觉隐喻转移,通过多代理协作提升隐喻生成的抽象逻辑与视觉创造力。

Comments 11 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01278 2026-02-03 cs.CV

DSFC-Net: A Dual-Encoder Spatial and Frequency Co-Awareness Network for Rural Road Extraction

DSFC-Net:一种用于农村道路提取的双编码空间和频率协同网络

Zhengbo Zhang, Yihe Tian, Wanke Xia, Lin Chen, Yue Sun, Kun Ding, Ying Wang, Bing Xu, Shiming Xiang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) Department of Earth System Science, Tsinghua University(清华大学地球系统科学系) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) College of Information and Electrical Engineering, China Agricultural University(中国农业大学信息与电气工程学院)

AI总结 DSFC-Net通过双编码框架融合空间和频域信息,有效解决农村道路提取中的植被遮挡和狭窄道路连续性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01090 2026-02-03 cs.AI

Hard Constraints Meet Soft Generation: Guaranteed Feasibility for LLM-based Combinatorial Optimization

硬约束与软生成交汇:为基于LLM的组合优化保证可行性

Yang Liu, Chuan Zhou, Yancheng Chen, Shuai Zhang, Xixun Lin, Xiaoqing Wang

机构 * Academy of Mathematics and Systems Science, Chinese Academy of Sciences(中国科学院数学与系统科学研究院) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Alibaba Group(阿里巴巴集团)

AI总结 FALCON通过语法约束解码、可行性修复层和自适应Best-of-N采样,确保基于LLM的组合优化求解器的100%可行性并保持高质量解。

Comments 32 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏