arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3178
2510.03267 2026-02-02 cs.LG cs.AI

PT$^2$-LLM: Post-Training Ternarization for Large Language Models

PT²-LLM:大语言模型的后训练三元化

Xianglong Yan, Chengzhu Bao, Zhiteng Li, Tianao Zhang, Kaicheng Yang, Haotong Qin, Ruobing Xie, Xingwu Sun, Yulun Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) ETH Zürich(苏黎世联邦理工学院) Tencent Hunyuan(腾讯文言)

AI总结 PT²-LLM通过后训练三元化技术,在降低内存成本的同时提升大语言模型的推理速度和效率。

Comments Accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22055 2026-01-30 cs.CL

$G^2$-Reader: Dual Evolving Graphs for Multimodal Document QA

$G^2$-Reader: 双重演化图式用于多模态文档问答

Yaxin Du, Junru Song, Yifan Zhou, Cheng Wang, Jiahao Gu, Zimeng Chen, Menglan Chen, Wen Yao, Yang Yang, Ying Wen, Siheng Chen

机构 * Shanghai Jiao Tong University(上海交通大学) Intelligent Game and Decision Laboratory(智能游戏与决策实验室)

AI总结 $G^2$-Reader通过双重图式解决多模态文档问答中的结构破坏和检索失效问题,实现66.21%的高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22030 2026-01-30 cs.LG

Per-parameter Task Arithmetic for Unlearning in Large Language Models

针对大语言模型中遗忘的参数任务运算

Chengyi Cai, Zesheng Ye, Jiangchao Yao, Jianzhong Qi, Bo Han, Xiaolu Zhang, Feng Liu, Jun Zhou

机构 * The University of Melbourne(墨尔本大学) Shanghai Jiao Tong University(上海交通大学) Hong Kong Baptist University(香港 Baptist 大学) Ant Group(蚂蚁集团)

AI总结 PerTA通过参数级调整优化大语言模型的遗忘过程,提升遗忘效果和模型实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21925 2026-01-30 cs.SD

Localizing Speech Deepfakes Beyond Transitions via Segment-Aware Learning

通过段级感知学习实现超越过渡的语音深度伪造定位

Yuchen Mao, Wen Huang, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab(听觉认知与计算声学实验室) MoE Key Lab of Artificial Intelligence, AI Institute(人工智能MoE重点实验室) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) VUI Labs(VUI实验室)

AI总结 本文提出SAL框架,通过段级感知学习提升语音深度伪造的局部化性能,减少对边界伪影的依赖,增强非边界区域的识别能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21821 2026-01-30 cs.CV

MMFineReason: Closing the Multimodal Reasoning Gap via Open Data-Centric Methods

MMFineReason: 通过以开放数据为中心的方法缩小多模态推理差距

Honglin Lin, Zheng Liu, Yun Zhu, Chonghan Qin, Juekai Lin, Xiaoran Shang, Conghui He, Wentao Zhang, Lijun Wu

机构 * Shanghai Artificial Intelligence Laboratory, OpenDataLab(上海人工智能实验室、OpenDataLab) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) The University of Hong Kong(香港大学)

AI总结 MMFineReason通过大规模多模态推理数据集和基于难度的过滤策略,提升模型推理能力与参数效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19325 2026-01-30 cs.CV

PRISM: A Framework Harnessing Unsupervised Visual Representations and Textual Prompts for Explainable MACE Survival Prediction from Cardiac Cine MRI

PRISM:一种结合无监督视觉表示和文本提示的框架,用于从心脏 cine MRI 预测可解释的 MACE 生存率

Haoyang Su, Jin-Yi Xiang, Shaohao Rui, Yifan Gao, Xingyu Chen, Tingxuan Yin, Shaoting Zhang, Xiaosong Wang, Lian-Ming Wu

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) University of Science and Technology of China(中国科学技术大学)

AI总结 PRISM通过结合无监督视觉表示和文本提示,实现了从心脏 cine MRI 预测可解释的 MACE 生存率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.00570 2026-01-30 cs.CL cs.AI

FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension

FreqKV: 频域中的键值压缩用于上下文窗口扩展

Jushi Kai, Yixuan Wang, Boyi Zeng, Haoli Bai, Bo Jiang, Ziwei He, Zhouhan Lin

机构 * LUMIA Lab, Shanghai Jiao Tong University(上海交通大学LUMIA实验室) Huawei Noah’s Ark Lab(华为诺亚实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 FreqKV通过频域键值压缩技术,实现长上下文处理,使LLaMA-2-7B的上下文窗口扩展至256K个令牌,同时保持稳定的困惑度。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12915 2026-01-30 cs.LG math.PR

How Out-of-Distribution Detection Learning Theory Enhances Transformer: Learnability and Reliability

如何通过分布外检测学习理论增强Transformer:可学习性与可靠性

Yijin Zhou, Yutang Ge, Wenyuan Xie, Linqian Zeng, Xiaowen Dong, Yuguang Wang

机构 * Shanghai Jiao Tong University, China(上海交通大学) University of Oxford, UK(牛津大学) Shanghai AI Laboratory, China(上海人工智能实验室) University of New South Wales, Sydney, Australia(新南威尔士大学) Shanghai Innovation Institute, China(上海创新研究院)

AI总结 本文提出基于PAC理论的Transformer分布外检测方法,通过惩罚异常值误分类和生成软合成异常值,提升模型的可靠性和决策边界。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21612 2026-01-30 eess.AS cs.AI cs.SD

Representation-Regularized Convolutional Audio Transformer for Audio Understanding

基于表示正则化的卷积音频变换器用于音频理解

Bing Han, Chushu Zhou, Yifan Yang, Wei Wang, Chenda Li, Wangyou Zhang, Yanmin Qian

机构 * Auditory Cognition and Computational Acoustics Lab, Shanghai Jiao Tong University(上海交通大学听力认知与计算声学实验室)

AI总结 本文提出卷积音频变换器(CAT),通过多分辨率块和表示正则化目标,提升音频理解任务的性能与训练效率。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21589 2026-01-30 cs.LG

Heterogeneity-Aware Knowledge Sharing for Graph Federated Learning

面向异质性的知识共享图联邦学习

Wentao Yu, Sheng Wan, Shuo Chen, Bo Han, Chen Gong

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology, Nanjing, China(南京理工大学计算机科学与工程学院) College of Smart Agriculture, Nanjing Agricultural University, Nanjing, China(南京农业大学智能农业学院) School of Intelligence Science and Technology, Nanjing University, Suzhou, China(南京大学智能科学与技术学院) Department of Computer Science, Hong Kong Baptist University, Hong Kong, China(香港 Baptist 大学计算机科学系) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, China(上海交通大学自动化与智能感知学院)

AI总结 FedSSA通过语义和结构对齐方法,解决图联邦学习中的异质性问题,提升模型性能。

Comments 33 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21362 2026-01-30 cs.NI cs.CV cs.MM

ViTMAlis: Towards Latency-Critical Mobile Video Analytics with Vision Transformers

ViTMAlis:面向延迟敏感移动视频分析的视觉变换器

Miao Zhang, Guanzhen Wu, Hao Fang, Yifei Zhu, Fangxin Wang, Ruixiao Zhang, Jiangchuan Liu

机构 * School of Computing Science, Simon Fraser University(计算科学系,西蒙·弗雷泽大学) Global College, Shanghai Jiao Tong University(全球学院,上海交通大学) School of Science and Engineering (SSE) and The Future Network of Intelligence Institute (FNii), The Chinese University of Hong Kong, Shenzhen(科学与工程学院(SSE)和未来智能网络研究所(FNii),香港中文大学(深圳)) Computer Science Department, University of Illinois Urbana-Champaign(计算机科学系,伊利诺伊大学厄巴纳-香槟分校)

AI总结 ViTMAlis通过动态混合分辨率推理策略和设备到边缘卸载框架,降低移动视频分析的延迟并提升渲染精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21296 2026-01-30 cs.LG cs.AI

Grounding and Enhancing Informativeness and Utility in Dataset Distillation

基于信息性和效用的蒸馏数据集 grounding

Shaobo Wang, Yantai Yang, Guo Chen, Peiru Li, Kaixin Li, Yufa Zhou, Zhaorun Chen, Linfeng Zhang

机构 * EPIC Lab, SJTU(SJTU实验室) Shanghai Jiao Tong University(上海交通大学) National University of Singapore(新加坡国立大学) Duke University(杜克大学) The University of Chicago(芝加哥大学)

AI总结 本文提出InfoUtil框架,通过博弈论和梯度范数优化,提升数据集蒸馏的信息性和效用,实验显示在ImageNet-1K上性能提升6.1%。

Comments Accepted by ICLR 2026, 20 pages, 9 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21269 2026-01-30 cs.CV cs.AI

Lightweight High-Fidelity Low-Bitrate Talking Face Compression for 3D Video Conference

轻量级高保真低比特率说话人脸压缩用于3D视频会议

Jianglong Li, Jun Xu, Bingcong Lu, Zhengxue Cheng, Hongwei Hu, Ronghua Wu, Li Song

机构 * Shanghai Jiao Tong University(上海交通大学) AntGroup(蚂蚁集团)

AI总结 本文提出了一种轻量级高保真低比特率的3D说话人脸压缩框架,结合参数建模与神经渲染技术,实现高效高质量的3D视频会议应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17868 2026-01-30 cs.CV cs.AI

VidLaDA: Bidirectional Diffusion Large Language Models for Efficient Video Understanding

VidLaDA:双向扩散大型语言模型用于高效视频理解

Zhihao He, Tieyuan Chen, Kangyu Wang, Ziran Qin, Yang Shao, Chaofan Gan, Shijie Li, Zuxuan Wu, Weiyao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) ZhongguanCun Academy(中关村学院) Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

AI总结 VidLaDA通过双向注意力和MARS-Cache技术,提升视频理解效率,实现比现有方法更优的性能与速度

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25731 2026-01-30 cs.CV

LaTo: Landmark-tokenized Diffusion Transformer for Fine-grained Human Face Editing

LaTo:基于地标token化的扩散变换器用于精细的人脸编辑

Zhenghao Zhang, Ziying Zhang, Junchao Liao, Xiangyu Meng, Qiang Hu, Siyu Zhu, Xiaoyun Zhang, Long Qin, Weizhi Wang

机构 * Alibaba Cloud Computing(阿里云计算) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学)

AI总结 LaTo通过地标token化扩散变换器实现精细的人脸编辑,提升身份保持与语义一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05600 2026-01-30 cs.CV

Progressively Deformable 2D Gaussian Splatting for Video Representation at Arbitrary Resolutions

逐步变形的2D高斯点云用于任意分辨率的视频表示

Mufan Liu, Qi Yang, Miaoran Zhao, He Huang, Le Yang, Zhu Li, Yiling Xu

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) University of Missouri--Kansas City, Kansas City, MO, USA(密苏里大学-堪萨斯城分校) University of Canterbury, Christchurch, New Zealand(坎特伯雷大学)

AI总结 D2GV-AR通过可变形的2D高斯点云实现任意分辨率的视频表示,支持高效渐进编码和多尺度码率-质量适应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.06787 2026-01-30 cs.CL

FLAME: Empowering Frozen LLMs for Knowledge Graph Completion

FLAME:赋能冻结的大语言模型进行知识图谱补全

Bo Xue, Yi Xu, Bolei Ma, Yunchong Song, Jiaxin Ding, Luoyi Fu, Xinbing Wang

机构 * School of Computer Science, Shanghai Jiaotong University, China LMU Munich \& Munich Center for Machine Learning, Germany

AI总结 FLAME通过提取冻结LLM中间层的上下文感知隐藏状态,实现高效的知识图谱补全,取得47%的性能提升并达到微调效果,同时显著降低内存和计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.04969 2026-01-30 cs.CL

EVA-Score: Evaluating Abstractive Long-form Summarization on Informativeness through Extraction and Validation

EVA-Score:通过提取与验证评估抽象长形式摘要的信息性

Yuchen Fan, Yazhe Wan, Xin Zhong, Haonan Cheng, Ning Ding, Bowen Zhou

机构 * Shanghai Jiao Tong University(上海交通大学) Beijing University of Posts and Telecommunications(北京邮电大学) Tsinghua University(清华大学) Shanghai AI Lab(上海人工智能实验室)

AI总结 本文提出EVA-Score,通过提取和验证评估抽象长形式摘要的信息性,发现其与人类评价的关联性最高,揭示了LLM在长形式摘要任务中的不足。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2303.06558 2026-01-30 math.DG cs.LG math.FA math.ST stat.TH

Gaussian kernels on non-simply-connected closed Riemannian manifolds are never positive definite

非单连通闭黎曼流形上的高斯核绝非正定

Siran Li

机构 * Siran Li: School of Mathematical Sciences \& CMA-Shanghai, Shanghai Jiao Tong University, No. 6 Science Buildings, 800 Dongchuan Road, Minhang District, Shanghai, China (200240)

AI总结 研究证明非单连通闭黎曼流形上的高斯核不具有正定性,结合了经典比较定理和最近预印本的分析。

Comments 9 pages

Journal ref Bull. Lond. Math. Soc. 56 (2024), no. 1, 263-273

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20689 2026-01-29 cs.CV cs.AI

Decoupling Perception and Calibration: Label-Efficient Image Quality Assessment Framework

解耦感知与校准:一种标签高效的图像质量评估框架

Xinyue Li, Zhichao Zhang, Zhiming Xu, Shubo Xu, Xiongkuo Min, Yitong Chen, Guangtao Zhai

机构 * Shanghai Jiao Tong University(上海交通大学) Xi’an Jiaotong University(西安交通大学) Baidu(百度)

AI总结 LEAF通过蒸馏多模态大语言模型的感知先验,实现轻量级图像质量评估,减少对人类标注的依赖,同时保持与人类注释的一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20575 2026-01-29 eess.IV cs.CV

SegRap2025: A Benchmark of Gross Tumor Volume and Lymph Node Clinical Target Volume Segmentation for Radiotherapy Planning of Nasopharyngeal Carcinoma

SegRap2025:鼻咽癌放疗计划中GTV和淋巴结临床靶区体积分割的基准测试

Jia Fu, Litingyu Wang, He Li, Zihao Luo, Huamin Wang, Chenyuan Bian, Zijun Gao, Chunbin Gu, Xin Weng, Jianghao Wu, Yicheng Wu, Jin Ye, Linhao Li, Yiwen Ye, Yong Xia, Elias Tappeiner, Fei He, Abdul qayyum, Moona Mazher, Steven A Niederer, Junqiang Chen, Chuanyi Huang, Lisheng Wang, Zhaohu Xing, Hongqiu Wang, Lei Zhu, Shichuan Zhang, Shaoting Zhang, Wenjun Liao, Guotai Wang

机构 * School of Mechanical and Electrical Engineering, University of Electronic Science and Technology of China(电子科技大学机械与电子工程学院) Department of Radiation Oncology, Sichuan Cancer Center, Radiation Oncology Key Laboratory of Sichuan Province, Sichuan Clinical Research Center for Cancer, Sichuan Cancer Hospital and Institute, University of Electronic Science and Technology of China(四川省肿瘤医院放射肿瘤科) Shanghai AI Lab, Shanghai, China(上海人工智能实验室) The Affiliated Hospital of Qingdao University, Qingdao, China(青岛大学附属医院) Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong, China(香港中文大学计算机科学与工程系) Faculty of Information Technology, Monash University, Melbourne, Australia(墨尔本大学信息科技学院) Department of Computing and Department of Brain Sciences, Imperial College London, United Kingdom(伦敦帝国理工学院计算机系和脑科学系) School of Computer Science and Engineering, Northwestern Polytechnical University, Xi'an, China(西北工业大学计算机科学与工程学院) UMIT Tirol - Private University for Health Sciences and Health Technology, Austria(蒂罗尔大学(私人健康科学与健康技术大学)) School of Information and Communication Engineering, University of Electronic Science and Technology of China(电子科技大学信息与通信工程学院) National Heart and Lung Institute, Imperial College London, London, United Kingdom(伦敦帝国理工学院国家心脏和肺研究所) Hawkes Institute, Department of Computer Science, University College London, London, United Kingdom(伦敦大学学院霍克斯研究所) Shanghai MediWorks Precision Instruments Co., Ltd., China(上海 MediWorks 精密仪器有限公司) School of Automation and Intelligent Sensing, Shanghai Jiao Tong University, Shanghai, China(上海交通大学自动化与智能感知学院) Department of Systems Hub, Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China(香港科技大学(广州)系统中心)

AI总结 SegRap2025旨在通过多中心、多模态的基准测试提升鼻咽癌放疗计划中GTV和LN CTV分割的通用性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20520 2026-01-29 cs.CV

Context Tokens are Anchors: Understanding the Repetition Curse in dMLLMs from an Information Flow Perspective

上下文标记是锚点:从信息流的角度理解dMLLMs中的重复诅咒

Qiyan Zhao, Xiaofeng Zhang, Shuochen Chang, Qianyu Chen, Xiaosong Yuan, Xuhang Chen, Luoqi Liu, Jiajun Zhang, Xu-Yao Zhang, Da-Han Wang

机构 * SJTU(上海交通大学) CASIA(中国科学院自动化研究所) NTU(国立台湾大学) Meitu (China) Limited(美图公司) XMUT(新疆大学)

AI总结 CoTA通过增强上下文标记注意力和引入惩罚项缓解dMLLMs中的重复问题,提升解码性能。

Comments Accepted in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20422 2026-01-29 cs.GT cs.AI

Guiding the Recommender: Information-Aware Auto-Bidding for Content Promotion

引导推荐:面向内容推广的信息感知自动出价

Yumou Liu, Zhenzhe Zheng, Jiang Rong, Yao Hu, Fan Wu, Guihai Chen

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出了一种信息感知的自动出价方法,通过双目标优化平衡短期价值与长期模型改进,提升内容推广效果和长期推荐质量。

Comments Accepted by SIGMETRICS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20168 2026-01-29 cs.CV

Efficient Token Pruning for LLaDA-V

LLaDA-V的高效令牌修剪

Zhewen Wan, Tianchen Song, Chen Lin, Zhiyong Zhao, Xianpeng Lang

机构 * Li Auto Inc.(利自动公司) SJTU(上海交通大学)

AI总结 本文提出了一种针对LLaDA-V的结构化令牌修剪方法,通过在中层到后期层移除部分视觉令牌,减少计算开销并保持95%的任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23565 2026-01-29 cs.CV cs.AI

RxnBench: A Multimodal Benchmark for Evaluating Large Language Models on Chemical Reaction Understanding from Scientific Literature

RxnBench: 一个用于评估大语言模型在科学文献中理解化学反应的多模态基准

Hanzheng Li, Xi Fang, Yixuan Li, Chaozheng Huang, Junjie Wang, Xi Wang, Hongzhe Bai, Bojun Hao, Shenyu Lin, Huiqi Liang, Linfeng Zhang, Guolin Ke

机构 * DP Technology(DP技术公司) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Peking University(北京大学) New York University(纽约大学) Fudan University(复旦大学) Xiamen University(厦门大学) ShanghaiTech University(上海科技大学)

AI总结 RxnBench通过两个任务评估大语言模型在化学反应理解上的能力,揭示模型在深度化学逻辑和结构识别上的不足,强调需改进视觉编码和推理能力以推动AI化学发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20707 2026-01-29 cs.CV

Mixing Importance with Diversity: Joint Optimization for KV Cache Compression in Large Vision-Language Models

融合重要性与多样性:KV缓存压缩的联合优化

Xuyang Liu, Xiyan Gui, Yuchao Zhang, Linfeng Zhang

机构 * EPIC Lab, Shanghai Jiao Tong University(上海交通大学) Sichuan University(四川大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 MixKV通过融合重要性与多样性,优化KV缓存压缩,提升多模态模型的存储效率与推理性能。

Comments Accepted by ICLR 2026. Our code is available at https://github.com/xuyang-liu16/MixKV

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17100 2026-01-29 cs.CV

The SAGES Critical View of Safety Challenge: A Global Benchmark for AI-Assisted Surgical Quality Assessment

SAGES关键安全视角挑战:人工智能辅助手术质量评估的全球基准

Deepak Alapatt, Jennifer Eckhoff, Zhiliang Lyu, Yutong Ban, Jean-Paul Mazellier, Sarah Choksi, Kunyi Yang, Po-Hsing Chiang, Noemi Zorzetti, Samuele Cannas, Daniel Neimark, Omri Bar, Amine Yamlahi, Jakob Hennighausen, Xiaohan Wang, Rui Li, Long Liang, Yuxian Wang, Saurabh Koju, Binod Bhattarai, Tim Jaspers, Zhehua Mao, Anjana Wijekoon, Jun Ma, Yinan Xu, Zhilong Weng, Ammar M. Okran, Hatem A. Rashwan, Boyang Shen, Kaixiang Yang, Yutao Zhang, Hao Wang, 2024 CVS Challenge Consortium, Quanzheng Li, Filippo Filicori, Xiang Li, Pietro Mascagni, Daniel A. Hashimoto, Guy Rosman, Ozanan Meireles, Nicolas Padoy

机构 * University of Strasbourg(斯特拉斯堡大学) CNRS(法国国家科学研究中心) INSERM(法国国家医学研究院) ICube(ICube研究中心) UMR7357(法国国家科研机构(UMR7357)) Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) University Hospital Cologne(科隆大学医院) Global College(全球学院) Shanghai Jiao Tong University(上海交通大学) Chang Gung Memorial Hospital(长庚纪念医院) A. Costa Hospital(A. Costa医院) Maggiore Hospital - AUSL Bologna(马吉奥医院 - 玛格丽特医院) Institute for Research against Digestive Cancer (IRCAD)(消化道癌症研究机构(IRCAD)) Lenox Hill Hospital(Lenox Hill医院) Northwell Health(Northwell健康系统) Albany Medical Center(阿尔巴尼医疗中心) German Cancer Research Center (DKFZ)(德国癌症研究中心(DKFZ)) Stanford University(斯坦福大学) MultiModal Learning Lab(多模态学习实验室) NAAMII University of Aberdeen(阿伯丁大学) Eindhoven University of Technology(埃因霍温理工大学) UCL Hawkes Institute(UCL Hawkes研究所) Dept of Computer Science, University College London(计算机科学系,伦敦大学学院) University Health Network(大学健康网络) Institute for Biomedical Informatics(生物医学信息研究所) Rovira i Virgili University(罗维拉-维吉里大学) Huazhong University of Science(华中科技大学) Hefei University of Technology(合肥工业大学) University of Pennsylvania(宾夕法尼亚大学) Duke University(杜克大学)

AI总结 SAGES关键安全视角挑战通过全球协作和AI技术,提升手术质量评估的性能和鲁棒性,推动临床应用。

Comments 21 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13332 2026-01-29 cs.CL

The Imitation Game: Turing Machine Imitator is Length Generalizable Reasoner

模仿游戏:图灵机模仿器是长度可推广的推理机

Zhouqi Hua, Wenwei Zhang, Chengqi Lyu, Yuzhe Gu, Songyang Gao, Kuikun Liu, Dahua Lin, Kai Chen

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)

AI总结 本文提出TAIL方法,通过合成图灵机执行过程的链式思维数据,提升LLM的长度泛化能力,超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08477 2026-01-29 cs.CL

Read as You See: Guiding Unimodal LLMs for Low-Resource Explainable Harmful Meme Detection

读取即可见:引导单模LLM进行低资源可解释有害迷因检测

Fengjun Pan, Xiaobao Wu, Tho Quan, Anh Tuan Luu

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) Ho Chi Minh City University of Technology(胡志明市技术大学) VinUniversity(文大学)

AI总结 U-CoT+通过轻量级单模LLM和高保真迷因到文本管道,实现低资源、可解释的有害迷因检测,有效提升模型灵活性和适应性。

Comments Accepted to ACM Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19745 2026-01-28 cs.LG

GraphDLG: Exploring Deep Leakage from Gradients in Federated Graph Learning

GraphDLG: 探索联邦图学习中的深度梯度泄露

Shuyue Wei, Wantong Chen, Tongyu Wei, Chen Gong, Yongxin Tong, Lizhen Cui

机构 * C-FAIR \& School of Software Shandong University Jinan China SKLCCSE Lab Beihang University Beijing China Automation \& Intelligent Sensing Shanghai Jiao Tong University Shanghai China Shandong University Beihang University Shanghai Jiao Tong University

AI总结 GraphDLG通过解耦图结构和节点特征,有效从共享梯度中恢复原始图数据,提升了节点特征和图结构重建的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏