arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

共收录 1917
2607.25186 2026-08-06 cs.CL 版本更新

CardioBench: A Real-World Data Benchmark for Evaluating Large Language Models in Clinically Authentic Cardiovascular Care Scenarios

MyoCardBench:用于评估临床真实心血管护理场景中大型语言模型的真实世界数据基准

Xiao Li, Mouxiao Bian, Zhaodi Wu, Sijie Ren, Juechen Chen, Lu Lu, Jingru Ding, Yun Zhong, Jie Xu, Yixiu Liang, Junbo Ge

机构 * Shanghai Institute of Cardiovascular Diseases(上海市心血管病研究所) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Minhang Hospital, Fudan University(复旦大学附属闵行医院)

AI总结 该研究开发MyoCardBench真实世界基准评估大语言模型在心血管护理场景的性能,涵盖多任务数据集,经专家注释审核。7个模型在零样本设置下输出,GPT-5.4表现最佳。此基准为评估模型提供框架,助于发现优势与不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06337 2026-08-06 cs.CL cs.AI cs.LG 版本更新

Can Post-Training Transform LLMs into Causal Reasoners?

训练后能否将大语言模型转变为因果推理者?

Junqi Chen, Sirui Chen, Chaochao Lu

机构 * Shanghai Artificial Intelligence Library(上海人工智能图书馆) Fudan University(复旦大学) Tongji University(同济大学)

AI总结 本文通过CauGym数据集评估了训练后方法对LLM因果推理能力的提升,发现适当训练可使小型模型在因果推理任务中超越大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29718 2026-08-05 cs.IR cs.AI cs.CL 版本更新

Diagnosing and Mitigating Context Rot in Long-horizon Search

诊断和缓解长视野搜索中的上下文腐烂

Shijie Xia, Yikun Wang, Zhen Huang, Pengfei Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) SII GAIR

AI总结 本文研究大语言模型在长视野任务中因上下文过长导致的性能退化(上下文腐烂),通过实验揭示其普遍性,并提出上下文管理和拒绝采样两种缓解策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01168 2026-08-05 cs.LG cs.AI 版本更新

SphUnc: Hyperspherical Uncertainty Decomposition and Causal Identification via Information Geometry

SphUnc:通过信息几何的超球面不确定性分解与因果识别

Rong Fu, Chunlei Meng, Jinshuo Liu, Dianyu Zhao, Yongtai Liu, Yibo Meng, Xiaowen Ma, Wangyu Wu, Yangchen Zeng, Shuaishuai Cao, Simon Fong

机构 * University of Macau(澳门大学) Fudan University(复旦大学) Hangzhou Dianzi University(杭州电子科技大学) Renmin University of China(中国人民大学) Hanyang University(翰阳大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Liverpool(利物浦大学) Southeast University(东南大学) Central South University(中南大学)

AI总结 SphUnc结合超球面表示学习与结构因果建模,通过信息几何融合分解不确定性为epistemic和aleatoric成分,并通过样本模拟实现因果识别,提升多智能体系统中的预测准确性和不确定性校准能力。

Comments 22 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02181 2026-08-04 cs.LG 新提交

Start Classifying: Categorical Critics for LLM Reinforcement Learning

开始分类:用于大语言模型强化学习的分类式评判器

Zhijian Zhou, Long Li, Xuan Zhang, Zongkai Liu, Yulei Qin, Ke Li, Xing Sun, Xiaoyu Tan, Chao Qu, Yuan Qi

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Tencent YoutuLab(腾讯优图实验室) Griffith University(格里菲斯大学) Shanghai Academy of Artificial Intelligence for Science(上海科学人工智能研究院)

AI总结 该研究提出HL-Gauss PPO,将PPO的标量评判器改为分类式预测器,在多任务及Qwen2.5、Qwen3主干上均优于PPO、DAPO基线,可改进评判器信号与优势估计。

Comments Accepted at COLM 2026. 26 pages, 9 figures. Code: https://github.com/ZhijianZhou/HL-guass-ppo

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02110 2026-08-04 cs.CL cs.AI 新提交

IACM-RL: Intent-Aware Context Management and Reinforcement Learning for Complex Tool Invocation under Dynamic Intent Fluctuations

IACM-RL:动态意图波动下复杂工具调用的意图感知上下文管理与强化学习

Dingwei Zhu, Jiahan Li, Chengjun Pan, Yunxian Yang, Yunbin Zhao, Yunke Zhang, Zhonghang Lu, Zhuohui Sheng, Chenhao Huang, Jiahang Lin, Yajie Yang, Junlin Shang, Shichun Liu, Yuhui Wang, Honglin Guo, Junjie Ye, Xin Guo, Jiazheng Zhang, Ming Zhang, Shihan Dou, Zhiheng Xi, Tao Gui, Qi Zhang, Xipeng Qiu, Xuanjing Huang

机构 * Fudan University(复旦大学) Honor Device Co Ltd.(荣耀设备有限公司) Peking University(北京大学)

AI总结 针对动态意图波动下长程工具调用的意图偏差与无限API循环问题,提出IACM-RL框架,结合DynamicIntent流水线与BeliefState上下文管理器,在多基准上实现性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02091 2026-08-04 cs.LG 新提交

One QK Channel, Many Sources: Guarding Low-Precision Attention Collapse

一个QK通道,多个源:防范低精度注意力崩溃

Shuxiao Xie, Shuyang Xie, Yuan Cao, Dezhi Ran, Wei Yang, Tao Xie

机构 * Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)(北京通明湖信息技术应用创新中心(TLAIC)) Fudan University Institute of Systems for Advanced Computing(复旦大学先进计算系统研究所) Harbin Institute of Technology(哈尔滨工业大学) Peking University(北京大学) Shanghai Institute of Systems for Open Computing(上海开放计算系统研究所)

AI总结 本研究针对bfloat16变换器的低精度注意力崩溃问题,通过定位故障源与通道的分离关系,提出QK-Guard方法,可有效抑制注意力失控,支持在共享QK位点进行干预。

Comments 22 pages, 4 figures. Code and research artifacts: https://github.com/xieTwim/one-qk-channel-artifact

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01334 2026-08-04 cs.CV 新提交

SphereVideo: Prototype-anchored Hyperspherical Boundary for Continual AI-generated Video Detection

SphereVideo:用于持续AI生成视频检测的原型锚定超球面边界

Fei Li, Yue Yu, Yuran Wang, Xinghan Li, Jingjing Chen, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Peking University(北京大学)

AI总结 针对AI生成视频检测中持续学习框架不足的问题,提出SphereVideo框架,以超球面原型锚定与多尺度时序建模提升泛化性,在已见和未见数据上均优于现有方法

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00677 2026-08-04 cs.CL 新提交

OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution

OpenART:通过开放式环境演化扩展智能体红队演练规模

Yunhao Chen, Xin Wang, Yixu Wang, Yi Liu, Jie Li, Yan Teng, Xingjun Ma, Xia Hu, Yu-Gang Jiang

机构 * Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) XSafeAI

AI总结 本研究针对现有智能体安全基准无法捕捉累积风险的问题,推出开放式智能体红队演练平台OpenART,并提出EMHA攻击方法,在75种智能体模型配置上实现85.0%的汇总攻击成功率,为复杂环境下的智能体安全研究提供可扩展基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20266 2026-08-04 cs.SD 版本更新

A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook

大型音频语言模型综述:通用性、可信度与展望

Kaiwen Luo, Zhenhong Zhou, Leyan Wang, Liang Lin, Tianyu Shao, Yuanhe Zhang, Yang Xiao, Yuxuan Li, Miao Yu, Kailin Lyu, Jiaming Zhang, Li Sun, Songze Li, Yueming Wu, Ting Dang, Xiaojun Jia, Dongrui Liu, Kai Li, Rohan Kumar Das, Siyuan Liang, Xinfeng Li, Qiankun Li, Jing Chen, Xingjun Ma, Kun Wang, Junhao Dong, Deqing Zou, Yu Cheng, Xia Hu, Zhigang Zeng, Sen Su, Yang Liu, Yu-Gang Jiang, Philip S. Yu, Yew-Soon Ong

机构 * Nanyang Technological University(南洋理工大学) Independent Researcher(独立研究者) The University of Melbourne(墨尔本大学) North China Electric Power University(华北电力大学) Beijing University of Posts and Telecommunications(北京邮电大学) University of Chinese Academy of Sciences(中国科学院大学) University of Science and Technology of China(中国科学技术大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Shanghai AI Laboratory(上海人工智能实验室) Huazhong University of Science and Technology(华中科技大学) Tsinghua University(清华大学) Fortemedia Singapore(富媒体新加坡) Tencent(腾讯) Fudan University(复旦大学) Wuhan University(武汉大学) Chinese University of Hong Kong(香港中文大学) Chongqing University of Posts and Telecommunications(重庆邮电大学) University of Illinois Chicago(伊利诺伊大学芝加哥分校)

AI总结 本文综述了大型音频语言模型的通用性、可信度及未来发展方向,探讨了其架构创新、对齐算法及安全风险,并提出了防御深入、因果音频世界建模等策略以提升音频智能的可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12851 2026-08-04 cs.NI cs.AI cs.CR cs.LG 版本更新

Chimera: Neuro-Symbolic Attention Primitives for Trustworthy Dataplane Intelligence

Chimera:用于可信数据平面智能的神经符号注意力原语

Rong Fu, Xiaowen Ma, Kun Liu, Wangyu Wu, Ziyu Kong, Jia Yee Tan, Tailong Luo, Xianda Li, Yongtai Liu, Youjin Wang, Simon Fong

机构 * University of Macau(澳门大学) Zhejiang University(浙江大学) University of Southampton(南安普顿大学) University of Liverpool(利物浦大学) Fudan University(复旦大学) Renmin University of China(中国人民大学) New York Institute of Technology(纽约理工学院) University of Bologna(博洛尼亚大学) Minzu University of China(民族大学) Hanyang University(汉阳大学)

AI总结 Chimera提出了一种框架,将神经计算和符号约束映射到数据平面原语,实现可信推断,通过线性化注意力近似和层级键选择机制,在资源限制下实现高保真推理。

Comments 22 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15423 2026-08-04 cs.IR cs.LG 版本更新

GaiaFlow: Semantic-Guided Diffusion Tuning for Carbon-Frugal Search

GaiaFlow:基于语义的扩散调优用于碳节约搜索

Rong Fu, Jia Yee Tan, Chunlei Meng, Shuo Yin, Xiaowen Ma, Wangyu Wu, Simon Fong

机构 * University of Macau(澳门大学) Renmin University of China(中国人民大学) Fudan University(复旦大学) Tsinghua University(清华大学) Zhejiang University(浙江大学) University of Liverpool(利物浦大学) Peking University(北京大学) Northeast Normal University(东北师范大学) Minzu University of China(民族大学)

AI总结 GaiaFlow通过结合语义引导的扩散调优与硬件无关的性能建模策略,在保证检索精度的同时降低环境影响,实现了高效且可持续的神经搜索系统。

Comments 19 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16144 2026-08-04 cs.CL cs.LG 版本更新

Missing-by-Design: Certifiable Modality Deletion for Revocable Multimodal Sentiment Analysis

缺失-by-设计:可撤销多模态情感分析的可验证模态删除

Rong Fu, Ziming Wang, Chunlei Meng, Jiekai Wu, Kangan Qian, Hao Zhang, Simon Fong

机构 * University of Macau(澳门大学) Zhejiang University(浙江大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Juntendo University(立命馆大学) Tsinghua University(清华大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出MBD框架,通过结构化表示学习和可验证参数修改流程,实现可撤销多模态情感分析中的模态删除,实验表明其在不完整输入下具有强预测性能,并实现隐私与效用的平衡。

Comments 21 pages, 6 figures. In the previous version, Juntendo University was erroneously listed as the affiliation; we must clarify that this paper has absolutely no relation to Juntendo University. Therefore, we have replaced this affiliation in the new version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12255 2026-08-04 cs.CV cs.AI 版本更新

ARGen: Affect-Reinforced Generative Augmentation towards Vision-based Dynamic Emotion Perception

ARGen:基于情感强化的生成增强方法用于基于视觉的动态情绪感知

Huanzhen Wang, Ziheng Zhou, Jiaqi Song, Li He, Yunshi Lan, Yan Wang, Wenqiang Zhang

机构 * Fudan University(复旦大学) East China Normal University(华东师范大学)

AI总结 本文提出ARGen框架,通过情感语义注入和自适应强化扩散阶段,解决野外动态表情识别中的数据稀缺问题,提升情绪感知的生成质量和识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00933 2026-08-04 cs.CV 版本更新

EmoScene: A Dual-space Dataset for Controllable Affective Image Generation

EmoScene:用于可控情感图像生成的双空间数据集

Li He, Longtai Zhang, Wenqiang Zhang, Yan Wang, Lizhe Qi

机构 * Fudan University(复旦大学) East China Normal University(华东师范大学)

AI总结 本文提出EmoScene数据集,通过双空间编码情感维度与感知属性,提升文本到图像模型对场景语义和情感调制的控制能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07494 2026-08-04 cs.LG 版本更新

Hyperparameter Transfer Laws for Non-Recurrent Multi-Path Neural Networks

非递归多路径神经网络的超参数转移定律

Shenxi Wu, Haosong Zhang, Xingjian Ma, Shirui Bian, Yichi Zhang, Xi Chen, Wei Lin

机构 * Fudan University, Shanghai, China(复旦大学) New York University, New York, NY, USA(纽约大学)

AI总结 本文提出有效深度概念,揭示了非递归多路径神经网络中学习率衰减遵循-3/2幂律,实现超参数跨深度和宽度的可靠转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29613 2026-08-03 cs.RO cs.CL cs.CV 新提交

WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning

WCM:用于视觉-语言-动作强化学习的世界评论者模型

Senyu Fei, Xiaopeng Yu, Siyin Wang, Xianzhong Zhao, Jingjing Gong, Xipeng Qiu

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学)

AI总结 该研究针对视觉-语言-动作强化学习中评论者与机器人部分可观测性不匹配的问题,提出WCM模型,联合预测未来潜态与值估计,在149个仿真任务和7个真实任务上均实现最优性能与泛化性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29398 2026-08-03 cs.LG 新提交

OnlineCache: Learning Dynamic Caching Policies with Error Correction for Efficient Diffusion Inference

OnlineCache:用于高效扩散推理的带误差校正的动态缓存策略学习

Zhikang Xie, Xichen Ye, Yifan Wu, Haoshen Yu, Li chenan, Peizhu Gong, Weizhong Zhang, Cheng Jin

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) School of Data Science, Fudan University(复旦大学数据科学学院)

AI总结 本研究针对扩散模型推理延迟高的问题,提出动态缓存框架OnlineCache,结合策略梯度与可学习校正器,实现样本与时间步的自适应资源分配,在FLUX.1-dev等模型上实现加速且优于现有基线。

Comments Dynamic timestep-level cache method for diffusion acceleration via policy gradient

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29888 2026-08-03 cs.HC cs.AI 版本更新

Generative AI in Action: Field Experimental Evidence from Alibaba's Customer Service Operations

生成AI在行动:来自阿里巴巴客户服务中心的实地实验证据

Xiao Ni, Yiwei Wang, Tianjun Feng, Lauren Xiaoyan Lu, Yitong Wang, Congyi Zhou

机构 * Fudan University(复旦大学) Zhejiang University(浙江大学) Dartmouth College(达特茅斯学院) Alibaba Group Inc.(阿里巴巴集团)

AI总结 本研究通过大规模实地实验评估生成AI助手对电商售后客服人员绩效的影响,发现AI显著提升服务速度和服务质量,但对顶级员工产生负面影响,提示需定制化部署策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28466 2026-07-31 cs.AI 新提交

A report-grounded vision-language foundation model for colonoscopy from 280000 routine reports

基于28万份常规报告的肠镜报告驱动的视觉-语言基础模型

Jia Yu, Yan Zhu, Yili He, Zilong Wang, Xinyang Jiang, Peiyao Fu, Ruijie Yang, Tianyi Chen, Siyuan Li, Zhihua Wang, Fei Wu, Quanlin Li, Xian Yang, Pinghong Zhou, Shuo Wang

机构 * Digital Medical Research Center, School of Basic Medical Sciences, Fudan University(复旦大学基础医学院数字医学研究中心) Shanghai Collaborative Innovation Center of Endoscopy(上海内镜诊疗协同创新中心) Zhejiang University(浙江大学) Shanghai Institute for Advanced Study of Zhejiang University(浙江大学上海高等研究院) Alliance Manchester Business School, The University of Manchester(曼彻斯特大学联盟曼彻斯特商学院) Data Science Institute, Imperial College London(伦敦帝国理工学院数据科学研究所) Microsoft Research Asia(微软亚洲研究院)

AI总结 该研究开发了肠镜视觉-语言基础模型EndoCLIP,利用28万份常规肠镜记录恢复的图像-文本对训练,在多项任务中优于通用模型,良恶性分类性能接近专家,可实现临床目标的语言指定。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28405 2026-07-31 cs.AI cs.LG 新提交

QuantWAMs: Calibrating at the Right Granularity for World Action Models

QuantWAMs:为世界动作模型校准至合适粒度

Jiacheng Zhou, Jinfan Lv, Ruixuan Li, Longtai Zhang, Yan Wang, Wenqiang Zhang, Lizhe Qi

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) School of Data Science and Engineering, East China Normal University(华东师范大学数据科学与工程学院)

AI总结 本文提出QuantWAMs框架,通过三种校准策略优化后训练量化,在WAMs上实现内存大幅降低与速度提升,同时保持与FP16接近的性能,验证了部署可行性。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28367 2026-07-31 cs.AI 新提交

How Benchmarks Mis-Score Computer-Use Agents

基准测试如何错误评估计算机使用智能体

Zihan Dong, Zhiyuan Ma, Zekun Wang, Yunqing Li, Zirou Liu, Ruixuan Deng, Qishi Zhan, Rui Qian

机构 * Georgia Institute of Technology(佐治亚理工学院) North Carolina State University(北卡罗来纳州立大学) Lenovo AI Technology Center(联想人工智能技术中心) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Marquette University(马凯特大学) Fudan University(复旦大学)

AI总结 该研究指出计算机使用智能体的基准测试分数存在可靠性问题,审计150条轨迹发现15.3%的“失败”判定错误,进而推导了CUA评估各阶段的设计规则。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28421 2026-07-31 cs.AI 版本更新

DenoiseRL: Bootstrapping Reasoning Models to Recover from Noisy Prefixes

DenoiseRL:引导推理模型从噪声前缀中恢复

Caijun Xu, Changyi Xiao, Zhongyuan Peng, Yixin Cao

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 提出DenoiseRL框架,通过强化学习从弱模型的错误推理中学习,无需外部监督或强教师模型,提升推理性能和训练效率。

Comments 17 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20290 2026-07-31 cs.GR cs.CV 版本更新

PhysOmni: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction

TelePhysics: 从单张图像生成物理一致的多物体场景 with 实时交互

Xin Zhang, Yabo Chen, Yijie Fang, Wanying Qu, Haibin Huang, Chi Zhang, Feng Xu, Xuelong Li

机构 * Fudan University(复旦大学) Institute of Artificial Intelligence, China Telecom (TeleAI)(中国电信人工智能研究院(TeleAI))

AI总结 本文提出TelePhysics,一种无需训练的框架,通过整体场景级3D重建将单张图像转换为物理一致且可控的视频。该方法通过统一的空间坐标系统表示完整场景几何,解决物体穿透和对齐模糊问题,实现准确的多物体交互和更丰富的复杂控制类型,从而在保持逼真视觉保真度的同时实现实时物理交互预览。

Comments ACMMM 2026. Project page: https://physomni.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07861 2026-07-31 cs.CV 版本更新

From Synthetic to Real: Toward Identity-Consistent Makeup Transfer with Synthetic and Real Data

从合成到真实:迈向身份一致的化妆转移的合成与真实数据

Yue Yu, Jiayu Wang, Jiajia Shi, Zhiyu Tan, Hao Li, Jingjing Chen

机构 * College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) Institute of Trustworthy Embodied AI, Fudan University(复旦大学可信具身人工智能研究院)

AI总结 本文提出ConsistentBeauty和RealBeauty方法,通过合成数据筛选和强化学习提升化妆转移的逼真度与身份一致性,并建立多样化基准测试以评估模型在复杂真实场景中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21007 2026-07-31 cs.CV 版本更新

MetaRank: Task-Aware Metric Selection for Model Transferability Estimation

MetaRank: 为模型可迁移性估计的任务感知度量选择

Yuhang Liu, Wenjie Zhao, Xin Wang, Yunhui Guo

机构 * Fudan University(复旦大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

AI总结 MetaRank通过元学习框架实现任务感知的MTE度量选择,提升模型迁移性估计的准确性。

Comments 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26513 2026-07-30 cs.RO 新提交

Explicit Kinematic Guidance from Analytic Concepts for Vision-Language-Action Models

面向视觉-语言-动作模型的来自解析概念的显式运动学引导

Mingyang Sun, Jiude Wei, Xiujian Liang, Qichen He, Donglin Wang, Cewu Lu, Jianhua Sun

机构 * Zhejiang University(浙江大学) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学) Westlake University(西湖大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 该研究针对视觉-语言-动作模型忽略3D物体结构信息的缺陷,构建概念专家模块生成解析概念,通过双阶段机制提供显式引导,提升了模型的操作成功率与学习效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26292 2026-07-30 cs.CV 新提交

Eddeep: a deep-learning framework for fast eddy-current distortion correction in diffusion MRI

Eddeep:用于扩散MRI中快速涡流畸变校正的深度学习框架

Antoine Legouhy, Ross Callaghan, Yuchuan Qiao, Whitney Stee, Philippe Peigneux, Hojjat Azadbakht, Hui Zhang

机构 * Hawkes Institute(霍克斯研究所) University College London(伦敦大学学院) Institut Pasteur(巴斯德研究所) Université Paris Cité(巴黎西岱大学) AINOSTICS ltd.(AINOSTICS有限公司) Fudan University(复旦大学) Université Libre de Bruxelles (ULB)(布鲁塞尔自由大学) University of Liège (ULiège)(列日大学)

AI总结 本研究针对dMRI中涡流畸变校正方法计算成本高的问题,提出深度学习框架Eddeep,其通过两阶段网络实现与FSL Eddy相当的校正质量,同时大幅缩短推理时间,为大规模研究和临床部署提供支持。

Comments Associated GitHub repo: https://github.com/CIG-UCL/eddeep

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22663 2026-07-30 cs.AI 版本更新

Beyond Block Boundaries: Multi-Block Editing for Diffusion Large Language Models

超越块边界:扩散大语言模型的多块编辑

Xingyu Mou, Zijin Huang, Tianze Zhang, Yuxin Ma, Lanning Wei, Zengfeng Huang, Da Zheng, Lun Du

机构 * Ant Group(蚂蚁集团) Fudan University(复旦大学) Shanghai Innovation Institute(上海创新院)

AI总结 研究针对块扩散语言模型的块边界问题,提出多块编辑(MBE)方法。通过无需训练的解码算法编辑前序块令牌,引入监督微调策略,扩展SGLang提升效率。实验表明该方法在保持吞吐量时优于基线,在长程一致性任务上有显著性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13317 2026-07-30 cs.CL 版本更新

SkillCAT: Contrastive, Assessment-Augmented and Topology-AwareSkill Self-Evolution for LLM Agents

SkillCAT: 面向LLM智能体的对比评估与拓扑感知技能自进化

Kunfeng Chen, Qihuang Zhong, Juhua Liu, Bo Du

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Fudan University(复旦大学计算机学院)

AI总结 提出SkillCAT框架,通过对比因果提取、评估增强进化和拓扑感知任务执行三阶段,实现无需训练的LLM智能体技能自进化,在多个基准上平均提升高达40.40%。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏