arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, San Diego(加州大学圣迭戈分校)

共收录 1275
2606.02664 2026-06-03 stat.ML cs.LG

State-Coupled Volatility in Latent Dynamical Systems: Recovery Under Partial Observation

潜变量动力系统中的状态耦合波动性:部分观测下的恢复

Imani Beckett

机构 * The Herbert Wertheim School of Public Health and Human Longevity Science(赫伯特·韦特海姆公共卫生与人类长寿科学学院) University of California San Diego(加州大学圣地亚哥分校)

AI总结 提出状态耦合随机波动框架,利用粒子期望最大化算法在部分观测下估计潜变量过程方差与平衡点位移的关系,并通过仿真验证了恢复与检测性能。

Comments 40 pages, 16 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03794 2026-06-03 cs.LG eess.SP

Limit Analysis of Graph Neural Networks with Wireless Conflict Graphs

基于无线冲突图的图神经网络极限分析

Romina Garcia Camargo, Zhiyang Wang, Alejandro Ribeiro

机构 * Department of Electrical and Systems Engineering, University of Pennsylvania(宾夕法尼亚大学电气与系统工程系) Halıcıoğlu Data Science Institute, UCSD(加州大学圣地亚哥分校Halıcıoğlu数据科学研究所)

AI总结 针对稀疏随机几何图上的图神经网络,通过分析其与确定性网格图的接近性,建立了跨尺度迁移性的理论界限,并在链路调度问题中验证了学习策略的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26774 2026-06-03 cs.CV

Cesarean Scar Defect Segmentation in Transvaginal Ultrasound Images: a Dataset and Benchmark

经阴道超声图像中的剖宫产瘢痕缺损分割:数据集与基准

Yuan Tian, Yue Li, Wei Xia, Tianyu Xu, Jian Zhang, Liye Shi, Jing Liu, Yang Wang, Ming Liu, Qing Xu, Yixuan Zhang, Maggie M. He, Xiangjian He

机构 * Department of Obstetrics and Gynecology, International Peace Maternity and Child Health Hospital affiliated to Shanghai Jiao Tong University School of Medicine(妇产科部门,上海交通大学医学院国际和平妇产儿童医院) School of Computer Science, University of Nottingham Ningbo China(Nottingham Ningbo中国大学计算机学院) School of Computer Science, University of Nottingham(Nottingham大学计算机学院) Department of Computer Science and Engineering, University of California, San Diego(加州大学圣地亚哥分校计算机科学与工程系) Department of Ultrasound, International Peace Maternity and Child Health Hospital affiliated to Shanghai Jiao Tong University School of Medicine(超声科,上海交通大学医学院国际和平妇产儿童医院) School of Electronic Information and Electrical Engineering, Shanghai Jiao Tong University(上海交通大学电子信息与电气工程学院) Department of Cardiology, Gold Coast University Hospital(心内科,Gold Coast大学医院)

AI总结 针对经阴道超声图像中剖宫产瘢痕缺损(CSD)分割缺乏公开数据集的问题,构建了包含1111张图像和16个视频的CSD数据集,提供像素级标注,并建立了基准以推动医学图像分割算法和临床创新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04942 2026-06-03 cs.AI cs.LO

Lemmanaid: Neuro-Symbolic Lemma Conjecturing

Lemmanaid: 神经符号引理猜想

Yousef Alhessi, Sólrún Halla Einarsdóttir, George Granberry, Emily First, Moa Johansson, Sorin Lerner, Nicholas Smallbone

机构 * Department of Computer Science and Engineering University of California, San Diego, USA(计算机科学与工程系,加州大学圣地亚哥分校) Department of Computer Science and Engineering Chalmers University of Technology & University of Gothenburg(计算机科学与工程系,查尔姆斯理工大学及哥德堡大学)

AI总结 提出首个神经符号引理猜想工具LEMMANAID,通过类比数学理论生成引理,结合微调LLM与符号方法,在Isabelle测试集上优于纯神经和纯符号方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13899 2026-06-03 q-bio.NC cs.CE cs.LG

A Factorized Low-Rank RNN Framework for Uncovering Independent Neural Latent Dynamics and Connectivity

一种分解低秩RNN框架用于揭示独立神经潜在动力学和连接性

Chengrui Li, Yunmiao Wang, Yule Wang, Weihan Li, Dieter Jaeger, Anqi Wu

机构 * University of California, San Diego(加州大学圣迭戈分校)

AI总结 提出FacRNN框架,通过组间独立假设和部分相关惩罚,在低秩循环神经网络中实现潜在动力学的解耦与可解释性提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02551 2026-06-02 cs.RO cs.CV

AFUN: Towards an Affordance Foundation Model for Functionality Understanding

AFUN:迈向用于功能理解的可供性基础模型

Zhaoning Wang, Yi Zhong, Jiawei Fu, Henrik I. Christensen, Jun Gao

机构 * University of Michigan(密歇根大学) University of California, San Diego(加州大学圣地亚哥分校) NVIDIA(英伟达)

AI总结 提出AFUN模型,从单张RGB-D图像和语言任务描述中预测任务条件功能掩码和3D接触后运动曲线,通过大规模标准化数据流水线实现开放世界泛化,在多项基准测试中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02179 2026-06-02 cs.LG cs.AI cs.CE

On the Generalization in Topology Optimization via Sensitivity-Conditioned Bernoulli Flow Matching

关于拓扑优化中通过敏感性条件伯努利流匹配的泛化性

Mohammad Rashed, Duarte F. Valoroso Madeira, Babak Gholami, Caglar Guerbuez, Yunjia Yang, Nils Thuerey

机构 * University of California, San Diego(加州大学圣地亚哥分校) Max Planck Institute for Informatics(马克斯·普朗克信息研究所)

AI总结 通过信息论分析,提出伪敏感性概念,并利用敏感性条件伯努利流匹配生成器在拓扑优化中实现最优的分布外泛化性能。

Comments ICML Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01816 2026-06-02 q-bio.BM cs.LG

Site4Drug: Predicting Drug-Binding Target Sites with an AI Agent

Site4Drug: 利用AI智能体预测药物结合靶点

Taehan Kim, Sarrah Rose Mikhail Leung, Bharat Mekala, Jeongbin Park

机构 * University of California, San Diego(加州大学圣地亚哥分校)

AI总结 提出Site4Drug,一种模态感知的靶点发现智能体,通过整合拓扑、亲水性、翻译后修饰等证据,输出带约束、风险标记和决策日志的可靶向区域排名列表,并自动推荐结合模态。

Comments Accepted to the ICML 2026 Workshop on Generative and Agentic AI for Biology (GenBio)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01667 2026-06-02 cs.LG

ATLAS: Agentic Test-time Learning-to-Allocate Scaling

ATLAS: 智能体测试时学习分配缩放

Peijia Qin, Qi Cao, Pengtao Xie

机构 * University of California, San Diego(加州大学圣迭戈分校)

AI总结 提出ATLAS框架,让LLM编排器通过单一

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01451 2026-06-02 cs.CL

Before and After Temperature: A Distributional View of Creative LLM Generation

温度前后:创造性LLM生成的分布视角

V. S. Raghu Parupudi, Harsha Ponnada, Aditi Kaushal, S. Shria Parupudi, Saiteja Dasari, Sahiti Bulusu

机构 * University of California, San Diego(加州大学圣地亚哥分校) Indian Institute of Technology, Kharagpur(印度理工学院克哈格布尔分校) Delhi Technological University(德里技术大学) Carnegie Mellon University(卡内基梅隆大学) Rutgers University(罗格斯大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 通过分析采样温度重塑token分布的特征,提出一种无需参考的创造力评估方法,在Llama-3.1-8B-Instruct上达到Spearman ρ=0.918(LLM评判)和ρ=0.870(人类多数评判),显著优于现有基线。

Comments Submitted to NGEN-AI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01412 2026-06-02 cs.LG cs.IT math.IT

GPTQ-intrinsic LoRA: A Near-optimal Algorithm for Low-precision Quantization with Low-rank Adaptation

GPTQ-intrinsic LoRA: 一种用于低秩自适应低精度量化的近最优算法

Shihao Zhang, Rayan Saab

机构 * Department of Mathematics, University of California San Diego(数学系,加州大学圣地亚哥分校) Department of Mathematics and Halıcıoğlu Data Science Institute, University of California San Diego(数学系和Halıcıoğlu数据科学研究所,加州大学圣地亚哥分校)

AI总结 本文提出GPTQ-intrinsic LoRA算法,通过将低秩校正直接融入GPTQ量化过程,并利用信息论下界证明其近最优性,在语言和视觉模型上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00746 2026-06-02 cs.CV cs.LG

Scaling Parallel Sequence Models to Foundation-Scale Vision Encoders

将并行序列模型扩展到基础规模的视觉编码器

Yitong Jiang, Hongjun Wang, Collin McCarthy, Hanrong Ye, David Wehr, Xinhao Li, Qi Dou, Tianfan Xue, Ka Chun Cheung, Simon See, Wonmin Byeon, Ke Chen, Kai Han, Jinwei Gu, Hongxu Yin, Pavlo Molchanov, Jan Kautz, Sifei Liu

机构 * NVIDIA The Chinese University of Hong Kong(香港中文大学) The University of Hong Kong(香港大学) University of California, San Diego(加州大学圣地亚哥分校)

AI总结 提出C-GSPN,一种基于2D空间传播的基础规模视觉编码器,通过快速CUDA内核、压缩潜在空间传播块和两阶段交叉算子蒸馏,在减少参数的同时提升性能并实现高效推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00640 2026-06-02 cs.CV

An Attribute-Based Measure of Video Complexity

基于属性的视频复杂度度量

Aditya Sarkar, Yi Li, Zihao Wang, Jiacheng Cheng, Sai Vidyaranya Nuthalapati, Aashu Singh, Shlok Kumar Mishra, David Jacobs, Nuno Vasconcelos

机构 * UMIACS-University of Maryland College Park(马里兰大学College Park分校UMIACS) University of California San Diego(加州大学圣地亚哥分校) Yale University(耶鲁大学) Meta AI

AI总结 提出VideoABC框架,通过属性空间量化估计视频-问题对在视频大语言模型上的失败概率,实现非参数复杂度度量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00408 2026-06-02 cs.CL cs.AI cs.IR

Masking Stale Observations Helps Search Agents -- Until It Doesn't: A Regime Map and Its Mechanism

掩盖过时观察帮助搜索智能体——直到适得其反:一个机制图谱及其机制

Haoxiang Zhang, Qixin Xu, Zhuofeng Li, Lei Zhang, Pengcheng Jiang, Yu Zhang, Julian McAuley

机构 * UC San Diego(加州大学圣地亚哥分校) UC Berkeley(加州大学伯克利分校) Texas A&M University(德克萨斯大学) UIUC(伊利诺伊大学厄巴纳-香槟分校)

AI总结 本文通过系统实验发现,在长时域搜索智能体中掩盖过时观察的效果呈现非对称倒U型曲线,取决于检索器召回率与模型隐式过滤能力的交互,并揭示了其背后的令牌-轮次权衡机制。

Comments 47 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26397 2026-06-02 cs.CL cs.AI

Algorithmic Fragility and Persona Bias in LLM-Generated Autistic Communication

LLM生成的自闭症交流中的算法脆弱性与人格偏见

Naba Rizvi, Mohammed Rizvi, Harper Strickland, Saleha Ahmedi, Nedjma Ousidhoum

机构 * University of California, San Diego(加州大学圣地亚哥分校) Georgia Institute of Technology(佐治亚理工学院) Cornell University(康奈尔大学) Cardiff University(卡迪夫大学)

AI总结 通过双人格改写范式,发现LLM在生成自闭症人格文本时存在词汇与情感偏离、输出坍塌等系统性失败,且对齐策略而非参数规模主导这些失败,表明当前对齐训练导致深层表征鸿沟。

Comments main paper: 9 pages; total: 19 pages; 2 figures; 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05412 2026-06-02 cs.CV cs.CL

Vision-Language Models Mistake Head Orientation for Gaze Direction: Nonverbal Conversation Cues

视觉-语言模型将头部方向误认为注视方向:非语言对话线索

Zory Zhang, Pinyuan Feng, Bingyang Wang, Tianwei Zhao, Suyang Yu, Qingying Gao, Hokin Deng, Ziqiao Ma, Yijiang Li, Dezhi Luo

机构 * Brown University(布朗大学) Columbia University(哥伦比亚大学) Emory University(埃默里大学) Johns Hopkins University(约翰霍普金斯大学) University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学) University of Michigan(密歇根大学) UC San Diego(圣地亚哥大学)

AI总结 本研究通过控制头部方向的实验发现,视觉-语言模型(VLMs)在推断注视目标时主要依赖头部方向而非眼睛外观,导致与人类存在显著性能差距,并指出数据偏差是主要原因。

Comments Accepted by ACL 2026. Project page at https://zoryzhang.github.io/gaze/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21806 2026-06-02 cs.LG

Towards Operational Automated Greenhouse Gas Plume Detection and Delineation

面向运营的自动化温室气体羽流检测与描绘

Brian D. Bue, Jake H. Lee, Andrew K. Thorpe, Philip G. Brodrick, Daniel Cusworth, Alana Ayasse, Vassiliki Mancoridis, Anagha Satish, Shujun Xiong, Riley Duren

机构 * University of California, San Diego(加州大学圣地亚哥分校) NASA Jet Propulsion Laboratory(美国国家航空航天局喷气推进实验室)

AI总结 针对高空间分辨率成像光谱仪,通过卷积神经网络和多任务学习解决数据质量、时空偏差和建模目标对齐等障碍,实现运营级温室气体羽流检测与分割。

Comments Main 19 pages 14 figures. Supplemental 19 pages 16 figures. In review

Journal ref Remote Sensing of Environment 343 (2026) 115506

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00133 2026-06-02 cs.CV cs.AI

You Don't Need All That Attention: Surgical Memorization Mitigation in Text-to-Image Diffusion Models

你不需要所有注意力:文本到图像扩散模型中的外科记忆缓解

Kairan Zhao, Eleni Triantafillou, Peter Triantafillou

机构 * University of California, San Diego(加州大学圣地亚哥分校)

AI总结 提出GUARD框架,通过吸引-排斥动力学调整去噪过程,结合交叉注意力衰减机制,在不损害图像质量的前提下有效缓解文本到图像扩散模型中的记忆问题。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13430 2026-06-02 cs.CV

Handling Supervision Scarcity in Chest X-ray Classification: Long-Tailed and Zero-Shot Learning

处理胸部X光分类中的监督稀缺性:长尾与零样本学习

Ha-Hieu Pham, Hai-Dang Nguyen, Thanh-Huy Nguyen, Min Xu, Ulas Bagci, Trung-Nghia Le, Huy-Hieu Pham

机构 * University of Technology, Vietnam(越南技术大学) National University of Singapore(新加坡国立大学) University of California, San Diego(加州大学圣地亚哥分校) University of Texas at Austin(德克萨斯大学奥斯汀分校)

AI总结 针对胸部X光分类中极端长尾多标签分布和罕见/未见发现缺失标注的问题,提出不平衡感知多标签学习(任务1)和无需监督标签的零样本预测方法(任务2),在CXR-LT 2026挑战赛中取得领先性能。

Journal ref 2026 IEEE 23rd International Symposium on Biomedical Imaging (ISBI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18195 2026-06-02 cs.LG cs.AI

LERD: Latent Event-Relational Dynamics for Neurodegenerative Classification

LERD: 用于神经退行性疾病分类的潜在事件-关系动力学

Yicheng Feng, Hairong Chen, Ziyu Jia, Samir Bhatt, Hengguan Huang

机构 * University of California, Berkeley(加州大学伯克利分校) Stanford University(斯坦福大学) University of Washington(华盛顿大学) University of California, San Diego(加州大学圣地亚哥分校) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 提出LERD,一种端到端贝叶斯潜在事件-关系动力系统,直接从多通道脑电图推断潜在神经事件及其关系结构,无需事件或交互标注,在阿尔茨海默病分类中优于基线方法并提供生理对齐的动力学摘要。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17045 2026-06-02 cs.CV cs.AI cs.LG

Video Reasoning without Training

无需训练的视频推理

Deepak Sridhar, Kartikeya Bhardwaj, Jeya Pradha Jeyaraj, Nuno Vasconcelos, Ankita Nayak, Harris Teague

机构 * Qualcomm AI Research(高通AI研究) University of California, San Diego(加州大学圣地亚哥分校)

AI总结 提出V-Reason方法,利用输出分布熵作为信号,通过轻量级控制器在推理时自适应调整值缓存,无需强化学习或微调即可提升视频推理性能。

Comments CVPR Findings 2026. Project Page https://deepaksridhar.github.io/vreason.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04074 2026-06-02 cs.RO

Feedback Matters: Augmenting Autonomous Dissection with Visual and Topological Feedback

反馈至关重要:利用视觉和拓扑反馈增强自主解剖

Chung-Pang Wang, Changwei Chen, Xiao Liang, Soofiyan Atar, Florian Richter, Michael Yip

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣迭戈分校电气与计算机工程系)

AI总结 提出一种反馈驱动的自主组织解剖框架,通过内窥镜图像推理拓扑变化、量化可见性并主动操控组织,结合规划与学习方法,显著提升手术自主性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01167 2026-06-02 cs.LG cs.AI cs.CL

Simultaneous Multi-objective Alignment Across Verifiable and Non-verifiable Rewards

同时多目标对齐:可验证与不可验证奖励

Yiran Shen, Yu Xia, Jonathan Chang, Prithviraj Ammanabrolu

机构 * ucsd(加州大学圣地亚哥分校)

AI总结 提出MAHALO框架,通过标准化PRM训练、多动作头DPO和PRM引导解码,实现大语言模型在可验证与不可验证奖励上的多目标对齐,减少目标冲突并支持推理时控制。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03644 2026-06-02 cs.LG cs.MA

MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment

MACCA: 离线多智能体强化学习中的因果信用分配

Ziyan Wang, Yali Du, Yudi Zhang, Meng Fang, Biwei Huang

机构 * King’s College London(伦敦国王学院) Eindhoven University of Technology(埃因霍温理工大学) University of Liverpool(利物浦大学) University of California San Diego(加州大学圣地亚哥分校)

AI总结 提出基于动态贝叶斯网络的因果信用分配框架MACCA,通过建模环境变量、状态、动作和奖励的因果关系,实现离线多智能体强化学习中准确且可解释的信用分配。

Comments 21 pages, 4 figures

Journal ref TMLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30997 2026-06-01 stat.ML cs.LG

Hedging on the Frontier: Learning New Tasks with Few Samples

前沿对冲:基于少量样本学习新任务

Tobias Wegel, Federico Di Gennaro, Geelon So, Fanny Yang

机构 * Department of Computer Science, ETH Zurich(苏黎世联邦理工学院计算机科学系) Department of Computer Science and Engineering, UC San Diego(南加州大学计算机科学与工程系)

AI总结 针对新任务样本少的问题,利用弱单调性假设,通过转移学习和模型选择聚合在模型前沿进行对冲,实现可证明的统计增益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30842 2026-06-01 cs.LG

CoMem: Context Management with A Decoupled Long-Context Model

CoMem: 基于解耦长上下文模型的上下文管理

Yuwei Zhang, Chengyu Dong, Shuowei Jin, Changlong Yu, Hejie Cui, Hongye Jin, Xinyang Zhang, Hamed Bonab, Colin Lockard, Jianshu Chen, Zhenyu Shi, Jingbo Shang, Xian Li, Bing Yin

机构 * Halıcıoğlu Data Science Institute, University of California, San Diego(哈里卡卢斯数据科学研究所,加州大学圣地亚哥分校) Amazon(亚马逊)

AI总结 提出CoMem框架,通过将记忆管理与智能体工作流解耦并采用k步偏移异步流水线,利用奖励驱动训练策略,在SWE-Bench-Verified上实现1.4倍延迟改进且保持大部分性能。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30826 2026-06-01 cs.CL cs.AI

Beyond Agreement: Scoring Panel-Surfaced Biomedical Entity Candidates for Curator Triage

超越一致性:为策展人分类对面板筛选的生物医学实体候选进行评分

Shuheng Cao, Ruiqi Chen, Renjie Cao, Zhenhao Zhang, Siyu Zhang, Tingting Dan

机构 * University of California, San Diego(加州大学圣地亚哥分校) University of Michigan, Ann Arbor(密歇根大学安娜堡分校) The Hong Kong University of Science and Technology, Guangzhou(香港科学与技术大学(广州)) ShanghaiTech University(上海科技大学) University of North Carolina, Chapel Hill(北卡罗来纳大学教堂山分校)

AI总结 提出BioConCal评分器,利用无金标准的一致性、提及、表面可用性和文档特征,对多LLM面板筛选的候选实体进行评分,显著提高候选筛选的精确率和召回率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30778 2026-06-01 cs.RO

Object-Informed Model Predictive Path Integral Control for Non-Prehensile Robot Manipulation

面向非抓取式机器人操作的对象感知模型预测路径积分控制

Nikola Raicevic, Bharath Raam Radhakrishnan, Chenbin Yu, Ki Myung Brian Lee, Nikolay Atanasov

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系)

AI总结 提出一种分层模型预测路径积分(MPPI)控制框架,通过对象级规划引导机器人级规划,实现非抓取式操作中的长时域高效规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10388 2026-06-01 cs.CL cs.AI

Less is Enough: Synthesizing Diverse Data in LLM Feature Space with Sparse Autoencoders

少即是多:利用稀疏自编码器在LLM特征空间中合成多样化数据

Zhongzhi Li, Xuansheng Wu, Yijiang Li, Lijie Hu, Ninghao Liu

机构 * Department of Computing, University of Georgia, Georgia, United States(佐治亚大学计算机系) Computer Engineering, University of California San Diego, California, United States(加州大学圣地亚哥分校计算机工程系) Machine Learning Department, Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, United Arab Emirates(Mohamed bin Zayed人工智能大学机器学习系) Department of Computing, Hong Kong Polytechnic University, Hong Kong, China(香港理工大学计算机系)

AI总结 提出基于稀疏自编码器的特征激活覆盖率(FAC)指标及数据合成框架FAC Synthesis,通过识别缺失特征并生成对应样本来提升数据多样性和下游任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01985 2026-06-01 cs.LG cs.AI cs.RO

World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry

World Action Verifier: 通过前向-反向不对称性自我改进世界模型

Yuejiang Liu, Fan Feng, Lingjing Kong, Weifeng Lu, Jinzhou Tang, Kun Zhang, Kevin Murphy, Chelsea Finn, Yilun Du

机构 * Stanford University(斯坦福大学) UC San Diego(加州大学圣地亚哥分校) Carnegie Mellon University(卡内基梅隆大学) Google DeepMind(谷歌DeepMind) Harvard University(哈佛大学)

AI总结 提出World Action Verifier (WAV)框架,利用状态合理性和动作可达性的独立验证以及前向-反向不对称性,通过视频语料库的多样子目标生成器和稀疏逆模型实现循环一致性,从而在欠探索区域自我改进世界模型,在多个任务中样本效率提升2倍且下游策略性能提升22%以上。

Comments Project Website: https://world-action-verifier.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏