arXivDaily arXiv每日学术速递 周一至周五更新
全部学科分类 1935
2608.13560 2026-08-14 cs.CV cs.AI cs.CL 新提交

AutoDesign: Meta-Harness Optimization for Long-Horizon Agentic Design

AutoDesign:面向长视距智能体设计的元工具优化

Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong Li

机构 * Meituan(美团) MBZUAI(Mohamed bin Zayed University of Artificial Intelligence) Huazhong University of Science and Technology(华中科技大学) Peking University(北京大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 AutoDesign是符合人类设计先验的元工具优化框架,以论文转海报生成任务为实例,在PosterBench上性能优于Claude Design,集成其学习的DesignHarness可提升代码智能体性能,且获人类最高偏好。

Comments Tech Report. Code at: this https URL (https://github.com/Yaxin9Luo/AutoDesign)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13558 2026-08-14 cs.AI cs.CL 新提交

OmniScientist: An Omni-Modal Omni-Discipline AI Scientist

OmniScientist:一种全模态全学科的AI科学家

Bobo Li, Hao Fei, Tianjie Ju, Mong-Li Lee, Wynne Hsu

机构 * National University of Singapore(新加坡国立大学) University of Oxford(牛津大学)

AI总结 本研究提出全模态AI科学家OmniScientist,通过端到端全模态流水线处理多学科异构原始证据,在36个真实案例中完成从原始数据到手稿的全流程,性能优于仅用预计算特征的系统,为通用AI科学家提供可行方案。

Comments 30 pages, 13 figures, 19 tables. Project page: this https URL (https://omni-scientist.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13556 2026-08-14 cs.CV 新提交

V-RAE: Rethinking Video Latent Spaces for Generation

V-RAE:重新思考用于生成的视频隐空间

Minghui Guo, Shengqiong Wu, Hao Fei

机构 * National University of Singapore(新加坡国立大学) University of Oxford(牛津大学)

AI总结 本研究提出V-RAE视频表示自动编码器,基于冻结视觉基础模型构建生成隐空间,在多项视频任务上优于现有模型,还引入tFVD指标,证明冻结语义表示可支持多种视频建模任务。

Comments 26 pages, 8 tables, 13 figures, project page: this https URL (https://v-rae.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13555 2026-08-14 cs.RO cs.AI cs.CV 新提交

HumanTracker: Towards Comprehensive and Human-Aligned Motion Tracking Benchmark

HumanTracker:面向全面且与人类对齐的运动跟踪基准

Dairu Liu, Zekun Qi, Jiayu Zeng, Ruixi Yu, Yu Guan, Yintianrun Zhang, Xuchuan Chen, Sikai Liang, Zekai Li, Chenghuai Lin, Xinqiang Yu, Wenyao Zhang, He Wang, Li Yi

机构 * Nankai University(南开大学) Tsinghua University(清华大学) Galbot Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Shanghai Qi Zhi Institute(上海启智研究院)

AI总结 针对人形运动跟踪评估与人类感知不符、基准多样性不足的问题,提出HumanTracker基准及偏好对齐指标HumanScore,该指标可更好预测人类偏好并揭示运动学指标遗漏的接触与稳定性故障。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13552 2026-08-14 cs.CV 新提交

PlayWorld: Benchmarking World Models with Agent Players over Long-Horizon Objectives

PlayWorld:基于智能体玩家的长程目标世界模型基准测试

Kaixin Ding, Xi Chen, Minghong Cai, Zhiyuan Xu, Yiyang Wang, Yuxiang Lu, Junyi Li, Shuyang Chen, Yuan Gao, Xin Tao, Pengfei Wan, Hengshuang Zhao

机构 * The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) Zhejiang University(浙江大学) Kuaishou Technology(快手科技)

AI总结 该研究针对现有世界模型跨模型公平比较的难题,推出含171个场景的PlayWorld基准,通过多模态智能体玩家从多维度评估9种先进世界模型,发现其长程交互式目标表现仍不可靠。

Comments project page: this https URL (https://kxding.github.io/project/PlayWorld/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13547 2026-08-14 cs.AI cs.SE 新提交

QuoteBench: How Matched Scores Can Hide Command-Path Failures

QuoteBench:匹配分数如何掩盖命令路径故障

Shangao Li, Yao Zhang, Volker Tresp, Yuanyuan Yang

机构 * Stony Brook University(石溪大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心)

AI总结 QuoteBench针对LLM编码智能体的命令路径故障,通过56个任务实验发现匹配分数掩盖执行缺陷,披露边界可恢复部分性能,提出评估需报告多维度配置而非仅匹配分数。

Comments 29 pages, 5 figures. Project page: this https URL (https://quotebench.lsamc.website/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13546 2026-08-14 cs.CV 新提交

Alaya-EVOKE: From Linear-Scaling Supervision to Endless World

Alaya-EVOKE:从线性缩放监督到无尽世界

Yuanyang Yin, Gongxuan Wang, Yifan Zhan, Chuanhao Li, Kaipeng Zhang, Feng Zhao

机构 * MoE Key Lab of BIPC(BIPC教育部重点实验室) USTC(中国科学技术大学) Shanghai Innovation Institute(上海创新研究院) Alaya Lab(Alaya实验室)

AI总结 Alaya-EVOKE将持久世界状态外部化并重新设计教师模型,解决交互式世界模型的冲突需求,在WBench等基准上实现最优性能,支持开放式长时序生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13545 2026-08-14 cs.CL cs.AI cs.LG 新提交

LittleLearner: Language Models Under Pedagogically Controlled Knowledge Exposure

LittleLearner:受教学可控知识暴露约束的语言模型

Fanfei Li, Jana Zeller, Manuel Prada-Corral, Thaddäus Wiedemer, Prasanna Mayilvahanan, Ryan Cotterell, Wieland Brendel

机构 * Ellis Institute(埃利斯研究所)

AI总结 本研究推出专为美国小学定制的LITTLECURRICULUM语料库,训练得到受知识边界约束的LittleLearner模型,构建沙盒用于研究模型知识习得,实验证实其注入新知识后不会提升超范围能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13541 2026-08-14 cs.CV cs.GR 新提交

SCULPT: Subtractive Composition for 3D Part Generation

SCULPT:用于3D部件生成的减法组合方法

Sikuang Li, Chen Yang, Jiemin Fang, Jiazhong Cen, Yuhe Wei, Jichen Pang, Wei Shen, Qi Tian

机构 * Shanghai Jiao Tong University(上海交通大学) Huawei(华为)

AI总结 SCULPT是一种3D部件生成框架,通过减法组合方式生成部件,解决了现有方法的边界问题,在PartObjaverse上实现了最优几何性能,还能完成细粒度纹理部件分解。

Comments Project page: this https URL (https://sculpt-part.github.io/) Code: this https URL (https://github.com/sculpt-part/SCULPT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13538 2026-08-14 cs.CL 新提交

SAEVerbalizer: Generating Explanations for Sparse Autoencoder Features via Representation Verbalization

SAEVerbalizer:通过表示 verbalization 为稀疏自编码器特征生成解释

Weihan Meng, Hongzhu Guo, Yi Jing, Dewen Liu, Zijun Yao, Xiaozhi Wang, Lei Hou, Juanzi Li

机构 * Tsinghua University(清华大学) Peking University(北京大学) Fudan University(复旦大学)

AI总结 该研究提出 SAEVerbalizer 框架,通过微调 LLM 下游层生成 SAE 特征的自然语言解释,解决了传统解释方法的表面性与低效率问题,其 verbalization 能力可泛化、迁移并扩展到不同 LLM 的 SAE 特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13522 2026-08-14 cs.LG cs.AI cs.LO cs.PL cs.SE 新提交

Vero: Can AI Agents Build Formally Verified Software Repositories?

Vero:AI智能体能否构建形式化验证的软件仓库?

Zhe Ye, Hantao Lou, Yuechun Sun, Peiyang Song, Zhengxu Yan, Timothe Kasriel, Qingyang Zhang, Kaiyu Yang, Soonho Kong, Jingxuan He, Dawn Song

机构 * University of Chicago(芝加哥大学) California Institute of Technology(加州理工学院) Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校) Amazon Web Services(亚马逊云计算服务) Apodex

AI总结 研究推出首个仓库级验证软件综合基准Vero,含43个多模块实例,评估发现前沿智能体仅解决27个实例,为相关研究提供测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13518 2026-08-14 cs.LG cs.CV 新提交

Intervention-Aware Clinical World Model for Post-Op Outcome Forecasting in Cardiology

面向心脏病术后结局预测的干预感知临床世界模型

Yunsung Chung, Yingshuo Liu, Abboud F. Hassan, Han Feng, Mary M. Maleckar, Nassir Marrouche, Jihun Hamm

机构 * Tulane University(杜兰大学) Simula Research Laboratory(Simula研究实验室)

AI总结 本研究针对心脏病术后结局预测的不规则轨迹问题,提出干预感知临床世界模型,在DECAAF-II数据集上实现心房颤动消融后复发预测及疤痕范围估计的良好性能。

Comments Medical World Models (MWM) Workshop at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13515 2026-08-14 cs.CL 新提交

Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining

测量语言模型预训练中与任务无关的训练数据影响

Yuto Nishida, Hirokazu Kiyomaru, Yusuke Oda, Takashi Kodama, Chaoran Liu, Daisuke Kawahara, Yusuke Miyao, Max Müller-Eberstein, Masaru Isonuma

机构 * Nara Institute of Science and Technology(奈良科学技术研究所) Waseda University(早稻田大学) The University of Tokyo(东京大学) IT University of Copenhagen(哥本哈根信息技术大学) Tohoku University(东北大学)

AI总结 本文提出无需依赖下游任务或验证集的训练数据影响度量方法,经实验发现预训练中有影响力的数据存在时间变化,早期文献相关数据、后期STEM数据与最终参数轨迹的一致性更强。

Comments Accepted to COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13513 2026-08-14 cs.CV cs.LG 新提交

TabSOM: A tabular-to-image encoding method based on self-organizing maps

TabSOM:一种基于自组织映射的表格转图像编码方法

David Chushig-Muzo, María Ángeles Rodríguez de Cara, Eva Milara, Francisco J. Lara-Abelenda, Luis Zhinin-Vera, Diego H. Peluffo-Ordóñez

机构 * Rey Juan Carlos University (URJC)(雷胡安·卡洛斯大学) Universidad Francisco de Vitoria(弗朗西斯科·德·维多利亚大学) University of Castilla-La Mancha(卡斯蒂利亚-拉曼恰大学) Yachay Tech University(亚奇理工大学)

AI总结 研究针对现有表格转图像方法丢失特征关系的问题,提出基于自组织映射的TabSOM方法,其在二分类数据集基准测试中表现优异且可解释性良好,缩小了表格数据深度学习的性能与可解释性差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13511 2026-08-14 cs.RO 新提交

A Browser-Native Digital Test Range for Benchmarking 4D Ocean-Glider Planning Algorithms

用于基准测试4D水下滑翔机规划算法的浏览器原生数字测试场

Edward Holmberg, Elias Ioup, Mahdi Abdelguerfi

机构 * LSU(路易斯安那州立大学) U.S. Naval Research Lab(美国海军研究实验室)

AI总结 本研究提出一种浏览器原生数字测试场,用于基准测试4D水下滑翔机规划算法,通过OSSE实验评估了五种经典规划器,为水下滑翔机预部署实验提供了可复现的科学追溯操作空间。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13505 2026-08-14 cs.LG cs.CL cs.CV 新提交

Intern-S2-Preview: Scientific Agentic Foundation Model

Intern-S2-Preview:科学智能体基础模型

Lei Bai, Jiaqi Cao, Chiyu Chen, Guanzhou Chen, Kai Chen, Guangran Cheng, Erfei Cui, Xuanlang Dai, Shengyuan Ding, Shangheng Du, Yanhui Duan, Yue Fan, Youqing Fang, Quan Gan, Yuanyuan Gao, Jiaye Ge, Lixin Gu, Yuzhe Gu, Qipeng Guo, Junjun He, Xin Hong, Ming Hu, Zhouqi Hua, Haian Huang, Junhao Huang, Zixian Huang, Minxi Jin, Lingkai Kong, Alexander Lam, Zehao Li, Zonglin Li, Tianhao Liang, Dahua Lin, Junyao Lin, Tianyang Lin, Zhouhan Lin, Jiangning Liu, Jin Liu, Kuikun Liu, Wenran Liu, Yifei Liu, Yuhong Liu, Yuhong Liu, Zhoumianze Liu, Ziyan Liu, Ziyu Liu, Haijun Lv, Han Lv, Chengqi Lyu, Le Ma, Ningsheng Ma, Zerun Ma, Haoyang Peng, Runyu Peng, Jifei Shan, Zixin Shang, Kou Shi, Xiang Shi, Qisheng Su, Xuerui Su, Hao Sun, Xiao Sun, Yanan Sun, Yu Sun, Huanze Tang, Yinghao Tang, Wenhui Tian, Zhongbo Tian, Bingli Wang, Haomin Wang, Jiarui Wang, Jingzhi Wang, Rui Wang, Xiquan Wang, Yi Wang, Zhecan Wang, Ziyi Wang, Zun Wang, Rubin Wei, Lianyi Wu, Wen Wu, Yue Wu, Yuhan Wu, Zhenyu Wu, Zijian Wu, Shuhao Xing, Jun Xu, Xingle Xu, Xuenan Xu, Xiangchao Yan, Ziang Yan, Bowen Yang, Danni Yang, Lin Yang, Zhiqi Yang, Qian Yao, Haochen Ye, Peng Ye, Jinhui Yin, Jiashuo Yu

机构 * Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本研究提出Intern-S2-Preview系列科学智能体基础模型,通过多阶段训练与架构优化,在多类基准上取得领先结果,相关模块可提升科学任务表现且无需修改主干模型。

Comments 35 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13504 2026-08-14 cs.LG 新提交

Sparse Orthogonal Regression Technique: A Spectral Framework for Equation Discovery, Approximation, and Integration

稀疏正交回归技术:用于方程发现、近似与积分的谱框架

Sabin Roman, Ljupco Todorovski, Saso Dzeroski

机构 * Jožef Stefan Institute(约热夫·斯泰凡研究所) University of Ljubljana(卢布尔雅那大学)

AI总结 本文提出SORT稀疏正交回归技术,作为从含噪不规则采样数据学习正交基展开的稀疏谱框架,可用于方程发现、近似与积分,在动力系统实验中表现优于基线方法,性能下降更稳定。

Comments 15 pages, 4 figures. Accepted for oral presentation at the 29th International Conference on Discovery Science (DS 2026), Mainz, Germany, October 5-9, 2026. To appear in Springer Lecture Notes in Computer Science (LNCS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13502 2026-08-14 cs.CV 新提交

GS$^{2}$CI: Robust Gaussian Splatting For Snapshot Compressive Imaging via Large Vision Model Priors

GS²CI:基于大视觉模型先验的快照压缩成像鲁棒高斯溅射方法

Yanming Yang, Chenxi Song, Ping Wang, Xin Yuan, Chi Zhang

机构 * Westlake University(西湖大学)

AI总结 该研究针对快照压缩成像的三维重建难题,提出结合三维高斯溅射与大视觉模型先验的框架,引入专属致密化策略提升稳定性,在多基准实验中实现了最优整体性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13495 2026-08-14 cs.CV cs.LG 新提交

TraVEL: Trajectory-Guided Video Embedding Learning for Driving-Video Retrieval

TraVEL:面向驾驶视频检索的轨迹引导视频嵌入学习

Yi-Chung Chen, Philip Jacobson, Tom Lampo, Yiren Lu, Jin Yao, David I. Inouye, Jing Gao, Danhua Guo, Burhan Yaman

机构 * Uber AV Labs(优步自动驾驶实验室) Purdue University(普渡大学)

AI总结 本研究提出TraVEL框架,将通用多模态嵌入模型适配到驾驶视频检索,结合轨迹监督与Group Relative Policy Optimization,在nuReasoning基准上提升了不同规模模型的运动相关检索性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13492 2026-08-14 cs.AI 新提交

AlayaWorld: Interactive Long-Horizon World Modeling - Full Technical Report (v1.1)

AlayaWorld:交互式长时世界建模——完整技术报告(v1.1)

AlayaWorld Team: Kaipeng Zhang, Chuanhao Li, Yifan Zhan, Yongtao Ge, Yuanyang Yin, Jiaming Tan, Kang He, Liaoyuan Fan, Mingliang Zhai, Ruicong Liu, Xiaojie Xu, Xuangeng Chu, Zhen Li, Zhengyuan Lin, Zhixiang Wang, Zian Meng, Zihui Gao

机构 * Alaya Lab(Alaya实验室)

AI总结 本报告改进AlayaWorld,通过调整条件信号设计等六项修改优化交互式长时世界建模,保留原有架构等核心部分。

Comments Authors are listed alphabetically by the first name and their role. See the contribution section for details

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13489 2026-08-14 cs.CV cs.RO 新提交

DreamX-Phi 1.0: Action-Conditioned Video World Model for Robotic Manipulation

DreamX-Phi 1.0:面向机器人操控的动作条件视频世界模型

DreamX Team, Rui Chen, Xiangxiang Chu, Geng Li, Jifan Li, Qingfeng Shi, Datao Tang, Jing Tang, Jun Wang, Pengfei Zhang

机构 * DreamX

AI总结 DreamX-Phi 1.0是面向机器人操控的动作条件视频世界模型,通过几何编码、深度分支等优化,在WorldArena 2.0挑战赛获Track1第一、Track2第二,模型与代码将公开。

Comments Code: this https URL (https://github.com/AMAP-ML/DreamX-Phi)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13484 2026-08-14 cs.CL cs.AI 新提交

Toward a Gricean Retreat: Probing LLMs for Knowledge Boundaries and Referent Specificity

走向格赖斯式退却:探究大型语言模型的知识边界与指称特异性

Dananjay Srinivas, Saksham Khatwani, Maria Pacheco

机构 * University of Colorado, Boulder(科罗拉多大学博尔德分校)

AI总结 该研究探究LLMs是否具备格赖斯式退却的要素,发现其激活可编码知识边界与指称特异性信号,但生成时未协调,为格赖斯式对齐提供了基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13482 2026-08-14 cs.LG cs.AI cs.CL 新提交

Synthetic Persona Pretraining: Alignment from Token Zero

合成角色预训练:从零开始的对齐

Julian Minder, Viktor Moskvoretskii, Raghav Singhal, Difan Jiao, Andy Arditi, Shaobo Cui, Yiderigun Borjigin, Kartik Bali, Stefan Krsteski, Harsh Raj, Huu Nguyen, Jannik Brinkmann, Ashton Anderson, Roland Aydin, Robert West

机构 * EPFL(洛桑联邦理工学院) University of Toronto(多伦多大学) Northeastern University(东北大学) SJTU(上海交通大学) Saarland University(萨尔大学) Hereon(亥姆霍兹极地与海洋研究中心) TUHH(汉堡工业大学) Ontocord AI(Ontocord人工智能公司) TUC(德累斯顿工业大学) DFKI(德国人工智能研究中心)

AI总结 该研究提出合成角色预训练(SPP),在预训练token零阶段植入助手角色,通过标注反思、预训练及角色绑定,提升模型价值构成遵循度与鲁棒性,降低对齐错误率,证明预训练时角色干预是对齐的有效方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13478 2026-08-14 cs.CV 新提交

MapRoute++: Surrogate-Guided Semantic Routing for Visual Concept Unlearning

MapRoute++:用于视觉概念遗忘的代理引导语义路由

Ashok Urlana, L. D. M. S. Sai Teja, Vivek Hruday Kavuri, Ponnurangam Kumaraguru

机构 * IIIT Hyderabad(印度信息技术学院海得拉巴分校) TCS Research(塔塔咨询服务公司研究院) NIT Silchar(锡尔卡尔国家理工学院)

AI总结 本研究针对Genμ 2.0挑战视觉概念遗忘任务,在MapRoute基础上引入新训练目标、概念表示及语义路由,使模型在保留相关概念的同时提升概念移除效果,在官方基准上超越SOTA基线12.1%

Comments Accepted at Unlearning and Model Editing Workshop, ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13474 2026-08-14 cs.RO 新提交

Decoding Task Progress from VLA Representations

从视觉-语言-动作模型(VLA)表征中解码任务进度

Atiksh Bhardwaj, Edward Weiyi Duan, Prithwish Dan, Wei-Chiu Ma, Preston Culbertson

机构 * Cornell University(康奈尔大学)

AI总结 该研究利用机制可解释性探究VLA的π₀.₅残差流,发现任务进度可从激活值线性读取,基于此构建的探测器可作为无标签OOD检测器,性能接近最先进方法,为监控部署的视觉运动策略提供轻量可解释路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13467 2026-08-14 cs.LG 新提交

Active-Trace Complexity Bounds for Moreau--Yosida Unadjusted Langevin Sampling

Moreau-Yosida未校正朗之万采样的活动迹复杂度界

Yuchen Xin, Zhihua Zhang

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院)

AI总结 该研究针对非光滑复合目标的MYULA,推导其离散化误差由参考活动迹控制,证明Moreau偏差界,给出迭代次数复杂度,针对结构化惩罚得到更优的精度依赖关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13465 2026-08-14 cs.LG cs.AI cs.CR 新提交

Concept Drift Detection and Adaptive Retraining of Malware Classification Models

恶意软件分类模型的概念漂移检测与自适应重训练

Christofer Washington Berruz Chungata, Martin Jurecek, Katerina Potika, William B. Andreopoulos, Mark Stamp

机构 * San Jose State University(圣何塞州立大学) Czech Technical University in Prague(布拉格捷克技术大学)

AI总结 本研究针对恶意软件分类模型,提出基于OCSVM等的概念漂移检测方法,结合漂移感知重训练策略,可在保持准确率的同时提升训练效率,且OCSVM方法表现更优。

Comments To appear as a chapter in the book "Artificial Intelligence for Cyber Defense in Emerging Threats", to be published by Springer by early 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13463 2026-08-14 cs.CV cs.AI cs.CL cs.LG 新提交

MLLM-Routed Heterogeneous Ensembles for Robust Cross-Dataset Image Classification

用于鲁棒跨数据集图像分类的MLLM路由异质集成模型

Daniel Perkins, John Squires, Janou Milligan, Chandra Raskoti, Linda Ungerboeck

机构 * The Bredesen Center for Interdisciplinary Research and Graduate Education(布雷德森跨学科研究与研究生教育中心) University of Tennessee Knoxville(田纳西大学诺克斯维尔分校)

AI总结 该研究针对跨数据集图像分类泛化难题,提出ARMDIL模型,通过MLLM智能体动态路由图像到适配的视觉骨干,兼具竞争力、高适应性与可解释性,为通用视觉系统奠定基础。

Comments 8 pages, 4 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13461 2026-08-14 cs.LG 新提交

Doubly Robust Estimation of Causal Effect on CVR with Targeted Regularization

基于目标正则化的CVR因果效应双重鲁棒估计

Jiayi Dan, Bo Li, Lu Deng, Yong Wang

机构 * Tsinghua University(清华大学) Tencent Inc.(腾讯公司)

AI总结 本文针对CVR因果估计的样本选择偏差问题,提出带理论保障的双重鲁棒估计量,结合目标正则化提升稳定性,实验验证其优于简单去偏结合的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13460 2026-08-14 cs.CV 新提交

SNM-VFI: Symmetric Nonlinear Motion-Guided Generative Video Frame Interpolation

SNM-VFI:对称非线性运动引导的生成式视频帧插值

Jisoo Jeong, Hong Cai, Jamie Menjay Lin, Hanno Ackermann, Hyeonjun Sim, Yinhao Zhu, Yunxiao Shi, Fatih Porikli

机构 * Qualcomm(高通公司)

AI总结 提出无需训练的SNM-VFI框架,结合预训练光流与视频扩散模型,用对称非线性运动模型引导生成过程,经多基准评估实现了优质视频帧插值效果。

Comments ECCVW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏