arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Shanghai Jiao Tong University(上海交通大学)

共收录 3178
2512.10619 2025-12-12 cs.CV

DOCR-Inspector: Fine-Grained and Automated Evaluation of Document Parsing with VLM

DOCR-Inspector: 基于VLM的文档解析细粒度与自动化评估

Qintong Zhang, Junyuan Zhang, Zhifei Ren, Linke Ouyang, Zichen Wen, Junbo Niu, Yuan Qu, Bin Wang, Ka-Ho Chow, Conghui He, Wentao Zhang

机构 * Peking University(北京大学) Shanghai AI Laboratory(上海人工智能实验室) The University of HongKong(香港大学) Shanghai Jiaotong University(上海交通大学)

AI总结 DOCR-Inspector通过细粒度错误检测和分析,提供文档解析质量的自动化评估,优于现有商业和开源模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10575 2025-12-12 cs.CL

RoleRMBench & RoleRM: Towards Reward Modeling for Profile-Based Role Play in Dialogue Systems

RoleRMBench & RoleRM:迈向基于角色扮演的对话系统奖励建模

Hang Ding, Qiming Feng, Dongqi Liu, Qi Zhao, Tao Yao, Shuo Wang, Dongsheng Chen, Jian Li, Zhenye Gan, Jiangning Zhang, Chengjie Wang, Yabiao Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Saarland University(萨尔兰州大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 RoleRMBench与RoleRM旨在通过连续隐式偏好训练提升角色扮演对话系统中奖励建模的准确性与连贯性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10450 2025-12-12 cs.CV

Error-Propagation-Free Learned Video Compression With Dual-Domain Progressive Temporal Alignment

无误差传播的学得视频压缩与双域渐进时间对齐

Han Li, Shaohui Li, Wenrui Dai, Chenglin Li, Xinlong Pan, Haipeng Wang, Junni Zou, Hongkai Xiong

机构 * Department of Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子工程系) Department of Computer Science and Engineering, Shanghai Jiao Tong University(上海交通大学计算机科学与工程系) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息科学与电子工程学院) Naval Aviation University(海军航空大学)

AI总结 本文提出一种无误差传播的学得视频压缩框架,通过双域渐进时间对齐和质量条件化的专家混合实现高质量的视频压缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09571 2025-12-12 cs.RO

Mastering Diverse, Unknown, and Cluttered Tracks for Robust Vision-Based Drone Racing

掌握多样化、未知和杂乱的赛道以实现基于视觉的无人机赛车稳健性

Feng Yu, Yu Hu, Yang Su, Yang Deng, Linzuo Zhang, Danping Zou

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出了一种两阶段学习框架,通过软碰撞训练和硬碰撞细化,提升无人机在多样化、未知和杂乱环境中的稳健性与泛化能力。

Comments 8 pages, 9 figures, accepted to Robotics and Automation Letters

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09383 2025-12-12 cs.CV

Perception-Inspired Color Space Design for Photo White Balance Editing

受感知启发的色彩空间设计用于照片白平衡编辑

Yang Cheng, Ziteng Cui, Shenghan Su, Lin Gu, Zenghui Zhang

机构 * Shanghai Jiao Tong University(上海交通大学) The University of Tokyo(东京大学) Tohoku University(东北大学)

AI总结 本文提出了一种基于受感知启发的可学习HSI色彩空间的白平衡校正框架,以解决传统加色模型在复杂光照条件下的局限性。

Comments Accepted to WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06982 2025-12-12 cs.LG cs.SY eess.SY

LLM-Driven Composite Neural Architecture Search for Multi-Source RL State Encoding

基于大语言模型的多源强化学习状态编码复合神经架构搜索

Yu Yu, Qian Xie, Nairen Cao, Li Jin

机构 * Shanghai Jiao Tong University(上海交通大学) Cornell University(康奈尔大学) New York University(纽约大学)

AI总结 本文提出基于大语言模型的复合神经架构搜索方法,用于多源强化学习状态编码,通过高效搜索发现更高性能的编码器架构。

Comments NeurIPS 2025 Workshop on Bridging Language, Agent, and World Models for Reasoning and Planning

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19980 2025-12-12 cs.LG

RAD: Towards Trustworthy Retrieval-Augmented Multi-modal Clinical Diagnosis

RAD:迈向可信的检索增强多模态临床诊断

Haolin Li, Tianjie Dai, Zhe Chen, Siyuan Du, Jiangchao Yao, Ya Zhang, Yanfeng Wang

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Shanghai AI Laboratory(上海人工智能实验室) CMIC, Shanghai Jiao Tong University(上海交通大学计算机学院) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) Institute of Artificial Intelligence for Medicine, Shanghai Jiao Tong University(上海交通大学医学人工智能研究所)

AI总结 RAD通过检索增强多模态模型,提升临床诊断的可信度与准确性,实现任务特定知识的显式注入。

Comments Accepted to NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07811 2025-12-12 cs.CV

Looking Beyond Visible Cues: Implicit Video Question Answering via Dual-Clue Reasoning

超越可见线索:通过双线索推理进行隐式视频问答

Tieyuan Chen, Huabin Liu, Yi Wang, Chaofan Gan, Mingxi Lyu, Ziran Qin, Shijie Li, Liquan Shen, Junhui Hou, Zheng Wang, Weiyao Lin

机构 * Shanghai Jiao Tong University(上海交通大学) ZhongguanCun Academy(中关村学院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai University(上海大学) City University of Hong Kong(香港城市大学) Wuhan University(武汉大学)

AI总结 本文提出隐式视频问答任务和IRM模型,通过双线索推理提升隐式问答性能,优于现有模型。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01113 2025-12-12 cs.IR cs.AI cs.CL

GFM-RAG: Graph Foundation Model for Retrieval Augmented Generation

基于图的检索增强生成模型:图基础模型

Linhao Luo, Zicheng Zhao, Gholamreza Haffari, Dinh Phung, Chen Gong, Shirui Pan

机构 * Monash University(墨尔本大学) Nanjing University of Science and Technology(南京理工大学) Shanghai Jiao Tong University(上海交通大学) Griffith University(格里菲斯大学)

AI总结 GFM-RAG是一种基于图的检索增强生成模型,通过创新的图神经网络捕捉复杂查询-知识关系,实现了在未见数据集上的高效性能和泛化能力。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09621 2025-12-11 cs.LG

Semantic-Aware Cooperative Communication and Computation Framework in Vehicular Networks

具有语义意识的车联网中协作通信与计算框架

Jingbo Zhang, Maoxin Ji, Qiong Wu, Pingyi Fan, Kezhi Wang, Wen Chen

机构 * School of Internet of Things Engineering, Jiangnan University(江南大学物联网工程学院) School of Information Engineering, Jiangxi Provincial Key Laboratory of Advanced Signal Processing and Intelligent Communications, Nanchang University(江西省级先进信号处理与智能通信重点实验室,南昌大学信息工程学院) Department of Electronic Engineering, State Key Laboratory of Space Network and Communications, and the Beijing National Research Center for Information Science and Technology, Tsinghua University(空间网络与通信国家重点实验室,北京信息科学与技术国家研究中心,清华大学电子工程系) Department of Computer Science, Brunel University(布鲁内尔大学计算机科学系) Department of Electronic Engineering, Shanghai Jiao Tong University(上海交通大学电子工程系)

AI总结 本文提出一种三元协作语义通信框架,通过多智能体近端策略优化和线性规划解决车联网中语义任务卸载问题,提升边缘计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09411 2025-12-11 cs.RO

D$^2$GSLAM: 4D Dynamic Gaussian Splatting SLAM

D$^2$GSLAM: 4D动态高斯点云SLAM

Siting Zhu, Yuxiang Huang, Wenhua Wu, Chaokang Jiang, Yongbo Chen, I-Ming Chen, Hesheng Wang

机构 * Department of Automation, Shanghai Jiao Tong University(自动化系,上海交通大学) School of Information Science and Electronic Engineering, Shanghai Jiao Tong University(信息科学与电子工程学院,上海交通大学) Bosch(博世) School of Mechanical and Aerospace Engineering, Nanyang Technological University(机械与航空航天工程学院,南洋理工大学) Department of Automation, Key Laboratory of System Control and Information Processing of Ministry of Education, State Key Laboratory of Avionics Integration and Aviation System-of-Systems Synthesis, Shanghai Key Laboratory of Navigation and Location Based Services, Shanghai Jiao Tong University(自动化系,教育部系统控制与信息处理重点实验室,航空系统集成与航空系统-of-系统综合国家重点实验室,导航与位置基于服务上海市重点实验室,上海交通大学)

AI总结 D$^2$GSLAM通过4D动态高斯点云实现动态环境中的精准SLAM建图与跟踪。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08485 2025-12-11 cs.LG

Optimal Perturbation Budget Allocation for Data Poisoning in Offline Reinforcement Learning

在线强化学习中数据污染攻击的最优扰动预算分配

Junnan Qiu, Yuanjie Zhao, Jie Li

机构 * SJTU Paris Elite Institute of Technology(上海交通大学巴黎精英理工学院) Shanghai Jiao Tong University(上海交通大学) Department of Computer Science(计算机科学系)

AI总结 本文提出一种基于TD误差的全局预算分配攻击策略,有效提升离线强化学习中数据污染攻击的效率与隐蔽性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08673 2025-12-10 cs.CV

Dual-Branch Center-Surrounding Contrast: Rethinking Contrastive Learning for 3D Point Clouds

双分支中心-周围对比:重新思考3D点云中的对比学习

Shaofeng Zhang, Xuanqi Chen, Xiangdong Zhang, Sitong Wu, Junchi Yan

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Jiao Tong University(上海交通大学) Chinese University of Hong Kong(香港中文大学)

AI总结 本文提出双分支中心-周围对比框架,通过双分支输入和补丁级对比损失,提升3D点云对比学习性能,达到SOTA效果。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08661 2025-12-10 cs.RO

Ergodic Trajectory Planning with Dynamic Sensor Footprints

具有动态传感器足迹的遍历轨迹规划

Ziyue Zheng, Yongce Liu, Hesheng Wang, Zhongqiang Ren

机构 * Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出了一种考虑动态传感器足迹的遍历轨迹规划方法,通过优化轨迹和传感器足迹提升信息采集效率。

Comments 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08500 2025-12-10 cs.GR cs.CV

Learning to Control Physically-simulated 3D Characters via Generating and Mimicking 2D Motions

通过生成和模仿2D动作来学习控制物理模拟的3D角色

Jianan Li, Xiao Chen, Tao Huang, Tien-Tsin Wong

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Monash University(墨尔本大学)

AI总结 Mimic2DM通过生成和模仿2D动作直接学习控制物理模拟的3D角色,无需依赖3D运动数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08478 2025-12-10 cs.CV cs.AI cs.GR

Visionary: The World Model Carrier Built on WebGPU-Powered Gaussian Splatting Platform

Visionary: 基于WebGPU驱动的高斯点云平台的世界模型载体

Yuning Gong, Yifei Liu, Yifan Zhan, Muyao Niu, Xueying Li, Yuanjun Liao, Jiaming Chen, Yuanyuan Gao, Jiaqi Chen, Minming Chen, Li Zhou, Yuning Zhang, Wei Wang, Xiaoqing Hou, Huaxi Huang, Shixiang Tang, Le Ma, Dingwen Zhang, Xue Yang, Junchi Yan, Yanchi Zhang, Yinqiang Zheng, Xiao Sun, Zhihang Zhong

机构 * Shanghai AI Laboratory(上海人工智能实验室) Sichuan University(四川大学) The University of Tokyo(东京大学) Shanghai Jiao Tong University(上海交通大学) Northwestern Polytechnical University(西北工业大学)

AI总结 Visionary是一款基于WebGPU的实时高斯点云渲染平台,通过高效推断和浏览器集成,提升3DGS方法的部署效率与多样性。

Comments Project page: https://visionary-laboratory.github.io/visionary

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08365 2025-12-10 cs.DC cs.LG

Magneton: Optimizing Energy Efficiency of ML Systems via Differential Energy Debugging

Magneton: 通过微分能量调试优化机器学习系统的能效

Yi Pan, Wenbo Qian, Dedong Xie, Ruiyan Hu, Yigong Hu, Baris Kasikci

机构 * University of Washington(华盛顿大学) Boston University(波士顿大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 Magneton 通过微分能量调试技术,识别并诊断 ML 系统中的能耗低效问题,发现多个已知和未知的能耗浪费案例。

Comments 12 pages, 10 fi

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23823 2025-12-10 cs.RO

Control Your Robot: A Unified System for Robot Control and Policy Deployment

掌控你的机器人:一种统一的机器人控制与策略部署系统

Tian Nian, Weijie Ke, Shaolong Zhu, Bingshan Hu

机构 * ScaleLab, Shanghai Jiao Tong University(上海交通大学ScaleLab) University of Shanghai for Science and Technology(上海科学技术大学)

AI总结 Control Your Robot提出了一种统一的机器人控制与策略部署框架,通过模块化设计和标准化流程,实现跨平台的数据收集与策略学习,提升机器人学习的可扩展性和可重复性。

Comments Code: https://github.com/Tian-Nian/control_your_robot

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15769 2025-12-10 cs.CV cs.AI

SceneGen: Single-Image 3D Scene Generation in One Feedforward Pass

SceneGen: 单图像3D场景生成在一次前馈传递中

Yanxu Meng, Haoning Wu, Ya Zhang, Weidi Xie

机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(人工智能学院,上海交通大学)

AI总结 SceneGen通过单图像输入在一次前馈传递中生成多个3D资产,无需额外优化或检索,提升3D内容生成的效率和鲁棒性。

Comments Accepted by 3DV 2026; Project Page: https://mengmouxu.github.io/SceneGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02242 2025-12-10 cs.CV cs.LG

Parameter-Efficient Fine-Tuning for Pre-Trained Vision Models: A Survey and Benchmark

预训练视觉模型的参数高效微调:调查与基准

Yi Xin, Jianjiang Yang, Siqi Luo, Yuntao Du, Qi Qin, Kangrui Cen, Yangfan He, Zhiwei Zhang, Bin Fu, Xiaokang Yang, Guangtao Zhai, Ming-Hsuan Yang, Xiaohong Liu

机构 * Nanjing University(南京大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) University of Bristol(布里斯托大学) Shandong University(山东大学) University of Sydney(悉尼大学) University of Minnesota Twin Cities(明尼苏达大学双城分校) The Pennsylvania State University(宾夕法尼亚州立大学) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究院,中国科学院) University of California at Merced(加州大学默塞德分校)

AI总结 本文调查了预训练视觉模型参数高效微调的最新进展,提出了V-PEFT Bench基准,并探讨了未来研究方向。

Comments Submitted to IJCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07599 2025-12-09 cs.CV

Online Segment Any 3D Thing as Instance Tracking

在线分割三维物体作为实例跟踪

Hanshi Wang, Zijian Cai, Jin Gao, Yiwei Zhang, Weiming Hu, Ke Wang, Zhipeng Zhang

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems (MAIS), CASIA(多模态人工智能系统国家重点实验室(MAIS),中国科学院自动化所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) AutoLab, School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院AutoLab) Anyverse Intelligence Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(北京超智能多模态信息安全重点实验室) School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

AI总结 将在线3D分割重新定义为实例跟踪问题,通过时间信息传播和空间一致性学习提升具身智能体对环境的理解能力。

Comments NeurIPS 2025, Code is at https://github.com/AutoLab-SAI-SJTU/AutoSeg3D

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07503 2025-12-09 cs.CV

SJD++: Improved Speculative Jacobi Decoding for Training-free Acceleration of Discrete Auto-regressive Text-to-Image Generation

SJD++: 改进的推测雅可比解码用于无训练加速离散自回归文本到图像生成

Yao Teng, Zhihuan Jiang, Han Shi, Xian Liu, Xuefei Ning, Guohao Dai, Yu Wang, Zhenguo Li, Xihui Liu

机构 * The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室) Peking University(北京大学) xAI Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 SJD++通过概率并行解码算法提升自回归文本到图像生成的效率,实现2-3倍的推理延迟降低和2-7倍的步骤压缩,同时保持图像质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07472 2025-12-09 cs.RO cs.LG

Affordance Field Intervention: Enabling VLAs to Escape Memory Traps in Robotic Manipulation

可及场干预:使VLAs在机器人操作中摆脱记忆陷阱

Siyu Xu, Zijian Wang, Yunke Wang, Chenghao Xia, Tao Huang, Chang Xu

机构 * School of Computer Science, The University of Sydney(悉尼大学计算机科学学院) John Hopcropt Center for Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学中心)

AI总结 本研究提出可及场干预(AFI)方法,通过引入3D空间可及场提升VLA在机器人操作中对分布变化的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07385 2025-12-09 cs.CV

How Far are Modern Trackers from UAV-Anti-UAV? A Million-Scale Benchmark and New Baseline

现代追踪器距离无人机-反无人机还有多远?一个百万级基准和新基线

Chunhui Zhang, Li Liu, Zhipeng Zhang, Yong Wang, Hao Wen, Xi Zhou, Shiming Ge, Yanfeng Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) CloudWalk Technology Co., Ltd(云walk科技有限公司) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) School of Aeronautics and Astronautics, Sun Yat-sen University(中山大学航空宇航学院) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)

AI总结 本文提出UAV-Anti-UAV多模态追踪任务及MambaSTS基线方法,通过百万级数据集验证了现有追踪算法在无人机反无人机领域的改进空间。

Comments https://github.com/983632847/Awesome-Multimodal-Object-Tracking

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07086 2025-12-09 cs.CR cs.AI cs.LG

ThinkTrap: Denial-of-Service Attacks against Black-box LLM Services via Infinite Thinking

ThinkTrap: 通过无限思考对黑盒LLM服务发起拒绝服务攻击

Yunzhe Li, Jianan Wang, Hongzi Zhu, James Lin, Shan Chang, Minyi Guo

机构 * Shanghai Jiao Tong University(上海交通大学) Donghua University(东华大学)

AI总结 ThinkTrap是一种针对黑盒LLM服务的新型拒绝服务攻击方法,通过优化输入空间诱导无限生成,以最小token开销降低服务吞吐量甚至导致服务失败。

Comments This version includes the final camera-ready manuscript accepted by NDSS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00975 2025-12-09 cs.CV cs.LG cs.RO

MM-ACT: Learn from Multimodal Parallel Generation to Act

MM-ACT: 从多模态并行生成中学习以行动

Haotian Liang, Xinyi Chen, Bin Wang, Mingkang Chen, Yitian Liu, Yuhao Zhang, Zanxin Chen, Tianshuo Yang, Yilun Chen, Jiangmiao Pang, Dong Liu, Xiaokang Yang, Yao Mu, Wenqi Shao, Ping Luo

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) The University of Hong Kong(香港大学) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) Zhejiang University(浙江大学)

AI总结 MM-ACT通过多模态并行生成提升机器人任务执行能力,实现96.3%的成功率。

Comments 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26360 2025-12-09 cs.CV cs.AI

TimeScope: Towards Task-Oriented Temporal Grounding In Long Videos

TimeScope: 向长视频中面向任务的时序定位迈进

Xiangrui Liu, Minghao Qin, Yan Shu, Zhengyang Liang, Yang Tian, Chen Jason Zhang, Bo Zhao, Zheng Liu

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) University of Trento(特伦多大学) Singapore Management University(新加坡管理大学)

AI总结 TimeScope通过逐步推理实现长视频中面向任务的时序定位,提升定位精度并增强下游任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00438 2025-12-09 cs.CV cs.AI

Suite-IN++: A FlexiWear BodyNet Integrating Global and Local Motion Features from Apple Suite for Robust Inertial Navigation

Suite-IN++: 一种整合Apple Suite全局和局部运动特征的FlexiWear BodyNet

Lan Sun, Songpengcheng Xia, Jiarui Yang, Ling Pei

机构 * Shanghai Key Laboratory of Navigation and Location-based Services, School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University(上海导航与位置服务重点实验室,电子信息与电气工程学院,上海交通大学)

AI总结 Suite-IN++通过整合Apple Suite的全局和局部运动特征,利用对比学习和注意力机制提升行人定位的准确性和鲁棒性。

Comments Accepted by TMC (Transactions on Mobile Computing) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06096 2025-12-09 cs.CL

A Systematic Assessment of Language Models with Linguistic Minimal Pairs in Chinese

对中文语言模型进行系统评估:基于语言最小配对的基准测试

Yikang Liu, Yeting Shen, Hongao Zhu, Lilong Xu, Zhiheng Qian, Siyuan Song, Kejia Zhang, Jialong Tang, Pei Zhang, Baosong Yang, Rui Wang, Hai Hu

机构 * Shanghai Jiao Tong University(上海交通大学) Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团) The University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Glasgow(格拉斯哥大学) University of California, San Diego(加州大学圣地亚哥分校) City University of Hong Kong(香港城市大学)

AI总结 本文提出ZhoBLiMP中文最小配对基准测试,并通过SLLN-LP度量标准评估不同中文语言模型在处理指代、量词和省略等任务上的性能。

Comments Accepted by TACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01341 2025-12-09 cs.CV

Enhancing Test Time Adaptation with Few-shot Guidance

通过少样本指导增强测试时间适应

Siqi Luo, Yi Xin, Yuntao Du, Tao Tan, Guangtao Zhai, Xiaohong Liu

机构 * Institute of Image Communication and Network Engineering, Shanghai Jiao Tong University(图像通信与网络工程研究所,上海交通大学) State Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学) School of Software & Joint SDU-NTU Centre for Artificial Intelligence Research, Shandong University(软件学院及SDU-NTU联合人工智能研究中心,山东大学) Macao Polytechnic University(澳门理工学院)

AI总结 本文提出少样本测试时间适应(FS-TTA)方法,通过结合少量样本支持集和原型记忆库指导,提升模型在跨领域场景下的适应性能和可靠性。

Comments Submitted to TCSVT

详情

展开后加载摘要…

URL PDF HTML 收藏