ClinHallu: A Benchmark for Diagnosing Stage-Wise Hallucinations in Medical MLLM Reasoning
ClinHallu: 用于诊断医学多模态大语言模型推理中阶段式幻觉的基准
Sicheng Yang, Hangjie Yuan, Wenjun Zhang, Jinwang Wang, Yichen Qian, Weihua Chen, Fan Wang, Lei Zhu
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
DAMO Academy, Alibaba Group(阿里巴巴达摩院)
;
Hupan Lab(湖畔实验室)
;
Zhejiang University(浙江大学)
Dense Coordinate-List Fine-Tuning Induces a Controllable Interference Surface in Vision-Language Models
密集坐标列表微调在视觉语言模型中诱导可控干扰面
Chenyu Zhou, Qiliang Jiang, Boguang Pan
机构
*
School of Engineering, Institute of Science Tokyo(东京科学大学工学院)
;
College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院)
;
Graduate School of Information, Production and Systems, Waseda University(早稻田大学信息生产系统研究生院)
机构
*
State Key Laboratory of Blockchain and Data Security, Zhejiang University(浙江大学区块链与数据安全全国重点实验室)
;
HangZhou High-Tech Zong (Binjiang) Institute of Blockchain and Data Security(杭州高新技术产业开发区(滨江)区块链与数据安全研究院)
;
College of Computer Science, Zhejiang University(浙江大学计算机科学与技术学院)
;
University at Buffalo, State University of New York(纽约州立大学布法罗分校)
CloudCons: A Comprehensive End-to-End Benchmark for Cloud Resource Consolidation
CloudCons:云资源整合的全面端到端基准测试
Xiaobin Zhang, Lefei Shen, Mouxiang Chen, Zhuo Li, Hongkai Li, Han Fu, Jianling Sun, Xiaoxue Ren, Chenghao Liu
机构
*
Zhejiang University(浙江大学)
;
State Street Technology (Zhejiang) Ltd.(道富科技(浙江)有限公司)
;
Richoo AI
;
Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新区(滨江)区块链与数据安全研究院)
;
Datadog AI Research
Otters++: A Time-to-first-spike Based Energy Efficient Optical Spiking Transformer
Otters++: 一种基于首次脉冲时间的高能效光学脉冲Transformer
Zhanglu Yan, Jiayi Mao, Kaiwen Tang, Fanfan Li, Gang Pan, Tao Luo, Bowen Zhu, Qianhui Liu, Weng-Fai Wong
机构
*
National University of Singapore(新加坡国立大学)
;
Westlake University(西湖大学)
;
Shandong University(山东大学)
;
Zhejiang University(浙江大学)
;
Agency for Science, Research and Technology(新加坡科技研究局)
CineDance: Towards Next-Generation Multi-Shot Long-Form Cinematic Audio-Video Generation
CineDance: 迈向下一代多镜头长片电影级音视频生成
Yuheng Chen, Teng Hu, Yuji Wang, Qingdong He, Zhucun Xue, Qianyu Zhou, Jason Li, Lizhuang Ma, Jiangning Zhang, Dacheng Tao
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Zhejiang University(浙江大学)
;
The University of Tokyo(东京大学)
;
Nanyang Technological University(南洋理工大学)
VIA-SD: Verification via Intra-Model Routing for Speculative Decoding
VIA-SD:通过模型内路由进行推测解码的验证
Yuchen Xian, Yang He, Yunqiu Xu, Yi Yang
机构
*
ReLER, The State Key Lab of Brain Machine Intelligence, Zhejiang University(脑机智能国家重点实验室,浙江大学)
;
College of Artificial Intelligence, Zhejiang University(人工智能学院,浙江大学)
;
CFAR, Agency for Science, Technology and Research, Singapore(科学与技术研究局,新加坡)
;
National University of Singapore(新加坡国立大学)
机构
*
Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院工业控制技术研究所)
;
Huzhou Institute, Zhejiang University, and Huzhou Key Laboratory of Autonomous System(浙江大学湖州研究院,湖州市自主系统重点实验室)
;
Zhejiang Zhongyan Industry Co., Ltd(浙江中烟工业有限责任公司)
;
Differential Robotics Technology Company(微分机器人技术有限公司)
Guikun Chen, Yuqian Chen, Yijie Li, Yogesh Rathi, Nikos Makris, Fan Zhang, Wenguan Wang, Lauren J. O'Donnell
机构
*
The State Key Lab of Brain-Machine Intelligence, Zhejiang University, Hangzhou(脑机智能国家重点实验室,浙江大学,杭州)
;
Department of Radiology, Brigham and Women’s Hospital, Mass General Brigham, Boston(放射科,布里洛妇女医院,马萨诸塞总医院,波士顿)
;
Harvard Medical School, Boston(哈佛医学院,波士顿)
;
Academy of Medical Engineering and Translational Medicine, Tianjin University, Tianjin(医学工程与转化医学研究院,天津大学,天津)
;
School of Information and Communication Engineering, University of Electronic Science and Technology of China, Chengdu(信息与通信工程学院,电子科技大学,成都)
;
Psychiatry Neuroimaging Laboratory, Brigham and Women’s Hospital, Mass General Brigham, Boston(精神病神经影像实验室,布里洛妇女医院,马萨诸塞总医院,波士顿)
;
Department of Psychiatry, Center for Morphometric Analysis, Massachusetts General Hospital, Boston(精神病科,形态分析中心,马萨诸塞总医院,波士顿)
GUIDE: Goal-Initialized Directional Understanding for End-to-End Visual Navigation
GUIDE: 目标初始化的定向理解用于端到端视觉导航
Liang Wang, Jin Jin, KanZhong Yao, YiBin Wu, Fangqiang Ding, Jin Wang, Jun Wu, Zhe Sun, Qiuguo Zhu
机构
*
Institute of Cyber-Systems and Control, Zhejiang University(浙江大学控制科学与工程学院)
;
Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院(TeleAI))
;
Oxford Robotics Institute, University of Oxford(牛津大学牛津机器人研究所)
;
Center for Robotics, University of Bonn(波恩大学机器人中心)
;
Department of Mechanical Engineering, Massachusetts Institute of Technology(麻省理工学院机械工程系)
AutoPDE: Reliable Agentic PDE Solving via Explicitly Represented Solver Strategies
AutoPDE: 通过显式表示的求解器策略实现可靠的智能体PDE求解
Huanshuo Dong, Keyao Zhang, Hong Wang, Zhezheng Hao, Zhiwei Zhuang, Ziyan Liu, Jiacong Wang, Gengyuan Liu, Xin Jin
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Zhejiang University(浙江大学)
;
University of the Chinese Academy of Sciences(中国科学院大学)
;
Tsinghua University(清华大学)
;
Eastern Institute of Technology, Ningbo(宁波东方理工大学)
5% > 100%: Flatness Preference is All You Need for Multimodal Parameter-Efficient Fine-Tuning
5% > 100%: 平坦性偏好是您进行多模态参数高效微调所需的一切
Yifan Zhu, Can Lin, Hangjie Yuan, Zixiang Zhao, Pengfei Zhang, Tao Feng, Zhonghong Ou
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Zhejiang University(浙江大学)
;
ETH Zürich(苏黎世联邦理工学院)
;
Anhui University of Science and Technology(安徽理工大学)
;
Tsinghua University(清华大学)
;
State Key Laboratory of Networking and Switching Technology(网络与交换技术国家重点实验室)