arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Zhejiang University(浙江大学)

2026-04-01 至 2026-04-01 共收录 7
2603.29902 2026-04-01 cs.AI

ATP-Bench: Towards Agentic Tool Planning for MLLM Interleaved Generation

ATP-Bench: 向多模态大语言模型交错生成的代理工具规划迈进

Yinuo Liu, Zi Qian, Heng Zhou, Jiahao Zhang, Yajie Zhang, Zhihang Li, Mengyu Zhou, Erchao Zhao, Xiaoxi Jiang, Guanjun Jiang

机构 * Qwen Large Model Application Team, Alibaba(阿里巴巴通义千问大模型应用团队) Huazhong University of Science and Technology(华中科技大学) Zhejiang University(浙江大学)

AI总结 针对多模态大语言模型交错生成中事实性与创造性难以统一的问题,提出ATP-Bench基准,包含7702个问题-答案对,评估代理工具规划能力,揭示模型在交错规划中的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29725 2026-04-01 stat.ML cs.LG

Unbounded Density Ratio Estimation and Its Application to Covariate Shift Adaptation

无界密度比估计及其在协变量移位适应中的应用

Ren-Rui Liu, Jun Fan, Lei Shi, Zheng-Chu Guo

机构 * School of Mathematical Sciences, Zhejiang University(浙江大学数学科学学院) Department of Mathematics, Hong Kong Baptist University(香港浸会大学数学系)

AI总结 本文研究无界密度比估计及其在协变量移位适应中的应用,提出三步估计方法,通过截断操作控制无界性,并建立非渐近收敛性保证。

Comments 48 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29689 2026-04-01 cs.HC cs.AI

KEditVis: A Visual Analytics System for Knowledge Editing of Large Language Models

KEditVis:一种用于大型语言模型知识编辑的可视化分析系统

Zhenning Chen, Hanbei Zhan, Yanwei Huang, Xin Wu, Dazhen Deng, Di Weng, Yingcai Wu

机构 * Zhejiang University(浙江大学) State Key Lab of CAD&CG, Zhejiang University(浙江大学CAD&CG国家重点实验室) Hong Kong University of Science and Technology(香港科技大学) School of Software Engineering, South China University of Technology(华南理工大学软件学院) School of Software Technology, Zhejiang University(浙江大学软件学院)

AI总结 本文提出KEditVis,通过交互式可视化帮助用户深入理解知识编辑,提升编辑效果并发现未来算法改进的洞察。

Comments Accepted by IEEE PacificVis 2026 (TVCG Journal Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09085 2026-04-01 cs.LG cs.AI

Not All News Is Equal: Topic- and Event-Conditional Sentiment from Finetuned LLMs for Aluminum Price Forecasting

并非所有新闻都同等重要:基于微调LLM的专题和事件条件情绪用于铝价预测

Alvaro Paredes Amorin, Andre Python, Christoph Weisser

机构 * International Business School, Zhejiang University(浙江大学国际商学院) Center for Data Science, Zhejiang University(浙江大学数据科学中心) Centre for Human Genetics, Nuffield Department of Medicine, Oxford University(牛津大学纳菲尔德医学部人类遗传学中心) School of Medicine, Zhejiang University(浙江大学医学院) Bielefeld School of Business, Hochschule Bielefeld (HSBI) - University of Applied Sciences and Arts(比勒费尔德应用科学大学比勒费尔德商学院)

AI总结 本文研究了微调LLM在铝价预测中的情绪提取效果,通过整合新闻数据与传统数据,发现LSTM模型在高波动时期表现更优,提升了预测性能和经济价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29224 2026-04-01 cs.LG cs.AI

Derived Fields Preserve Fine-Scale Detail in Budgeted Neural Simulators

导出场在预算神经模拟器中保留细尺度细节

Wenshuo Wang, Fan Zhang

机构 * School of Future Technology, South China University of Technology(华南理工大学未来技术学院) State Key Laboratory of Ocean Sensing & Ocean College, Zhejiang University(浙江大学海洋传感与海洋学院国家重点实验室) Kavli Institute for Astrophysics and Space Research, Massachusetts Institute of Technology(麻省理工学院卡弗里天体物理与空间研究所)

AI总结 本文提出DerivOpt框架,通过优化携带状态的设计,在预算限制下提升神经模拟器的细尺度精度,且在输入阶段即可观察到性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06753 2026-04-01 cs.CV

EarthBridge: A Solution for 4th Multi-modal Aerial View Image Challenge Translation Track

EarthBridge: 4th 多模态航空视图图像挑战翻译赛道的解决方案

Zhenyuan Chen, Guanyuan Shen, Feng Zhang

机构 * Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学)

AI总结 本文提出EarthBridge框架,通过Diffusion Bridge Implicit Models和Contrastive Unpaired Translation方法,实现EO、IR和SAR传感器间的高质量图像到图像翻译,解决了跨模态转换中的挑战,取得第二名成绩。

Comments accepted by CVPRW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00818 2026-04-01 cs.AI cs.CV

Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning

Med-CMR:一个整合视觉证据和临床逻辑的细粒度基准,用于医疗复杂多模态推理

Haozhen Gong, Xiaozhong Ji, Yuansen Liu, Wenbin Wu, Xiaoxiao Yan, Jingjing Liu, Kai Wu, Jiazhen Pan, Bailiang Jian, Jiangning Zhang, Xiaobin Hu, Hongwei Bran Li

机构 * National University of Singapore(新加坡国立大学) Nanjing University(南京大学) Tongji University(同济大学) Ruijin Hospital(瑞金医院) Technical University of Munich(慕尼黑工业大学) Zhejiang University(浙江大学)

AI总结 Med-CMR通过细粒度分解医疗多模态推理能力,设计挑战性任务并覆盖广泛高质量数据,评估18种先进大语言模型,发现GPT-5在多项选择题和开放性评分中表现最佳,但专业医疗大语言模型并不总能超越强通用模型,长尾泛化成为主要失败模式。

详情

展开后加载摘要…

URL PDF HTML 收藏