arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

VLA / 视觉-语言-动作模型

视觉-语言-动作模型、机器人基础模型和语言条件机器人控制。

共收录 9819 信号源:cs.RO, cs.CV, cs.AI, cs.LG

1. VLA模型 9146 篇

2606.04130 2026-06-04 cs.RO 57%

CLAW: Learning Continuous Latent Action World Models via Adversarial Latent Regularization

CLAW: 通过对抗潜在正则化学习连续潜在动作世界模型

Tewodros Ayalew, Matthew Jeung, Samuel Wheeler, Xiao Zhang, Andre de la Cruz Arce, Kaylene Stocking, Michael Maire, Matthew R. Walter

机构 * University of Chicago(芝加哥大学) Toyota Technological Institute at Chicago(芝加哥丰田技术研究所) Argonne National Laboratory(阿贡国家实验室)

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 提出CLAW框架,利用对抗潜在正则化和扩散视频生成,从无动作视频中端到端学习世界模型与连续潜在动作表示,支持观察模仿学习和目标导向规划。

Comments 8 pages, 15 pages of supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.05423 2026-06-04 eess.SY cs.RO cs.SY 57%

Game-Theoretic Modeling of Multi-Vehicle Interactions at Uncontrolled Intersections

多车辆在无信号交叉口交互的博弈建模

Nan Li, Yu Yao, Ilya Kolmanovsky, Ella Atkins, Anouck Girard

机构 * Robotics Institute, University of Michigan(密歇根大学机器人研究所)

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 本文提出了一种基于博弈论的框架,用于建模自动驾驶和人工驾驶车辆在无信号交叉口的交互行为,通过参数化交叉口布局和几何结构,展示了模型在交通场景中的合理性和计算效率。

Comments 18 pages, 13 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01027 2026-06-02 cs.RO 57%

$τ_0$-WM: A Unified Video-Action World Model for Robotic Manipulation

$\tau_0$-WM:一种用于机器人操作的统一视频-动作世界模型

Pengfei Zhou, Shengcong Chen, Di Chen, Jiaxu Wang, Rongjun Jin, Bingwen Zhu, Yike Pan, Songen Gu, Kuanning Wang, Shufeng Nan, Xingyu Qiu, Chenhao Qiu, Pu Yang, Yunuo Cai, Jianxiong Gao, Yifan Li, Yanwei Fu, Xiangyu Yue, Zhi Chen, Jianlan Luo

机构 * Shanghai Innovation Institute(上海创新研究院) AGIBOT Finch

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 提出$\tau_0$-WM,一个统一视频-动作世界模型,通过共享视频扩散骨干集成策略学习、视频预测和动作评估,在长时域和精细操作任务上优于基线。

Comments Our project homepge: https://finch.agibot.com/research/tau0-wm

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00422 2026-06-02 cs.IR cs.LG 57%

UniPinRec: Unifying Generative Retrieval and Ranking at Pinterest Scale

UniPinRec:在Pinterest规模下统一生成式检索与排序

Hanyu Li, Yi-Ping Hsu, Aditya Mantha, Prabhat Agarwal, Laksh Bhasin, Jialu Wang, Hongtao Lin, Bella Huang, Yaxin Li, Xinyi Li, Chuxi Wang, Kousik Rajesh, Hooshmand Shokri Razaghi, Shunyao Li, Zongyue Qin, Jaewon Yang, James Li, Dhruvil Deven Badani, Jiajing Xu, Charles Rosenberg

机构 * Pinterest

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 提出UniPinRec,通过共享Transformer编码用户行为序列,结合掩码动作建模、混合训练样本和跨阶段KV缓存共享,在Pinterest生产系统中首次实现检索与排序的全栈统一,提升在线参与度并降低延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06182 2026-06-02 cs.RO cs.SY eess.SY 57%

Situation-Aware Interactive MPC Switching for Autonomous Driving

自动驾驶中的情境感知交互式MPC切换

Shuhao Qi, Qiling Aori, Luyao Zhang, Mircea Lazar, Sofie Haesaert

机构 * Eindhoven University of Technology(埃因霍温理工大学) Delft University of Technology(代尔夫特理工大学)

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 针对自动驾驶中交互场景的挑战,提出一种基于神经网络的分类器,根据情境需求在不同MPC控制器间切换,以平衡性能和计算开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13389 2026-05-26 cs.AI 57%

From Next Token Prediction to (STRIPS) World Models

从下一个词预测到(STRIPS)世界模型

Carlos Núñez-Molina, Vicenç Gómez, Hector Geffner

机构 * RWTH Aachen University, Germany(亚琛工业大学,德国) Universitat Pompeu Fabra, Spain(庞培法华大学,西班牙)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 研究下一个词预测能否产生支持规划的世界模型,提出STRIPS Transformer和标准Transformer两种架构,在五个经典规划领域评估训练准确率、泛化能力和规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22126 2026-05-22 cs.CV 57%

AesFormer: Transform Everyday Photos into Beautiful Memories

AesFormer: 将日常照片转化为美丽的记忆

Tianxiang Du, Hulingxiao He, Yuxin Peng

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文提出AesFormer框架,通过将审美规划与图像编辑解耦,改进照片的审美质量,同时保持主体身份和场景语义,构建了包含9071对严格对齐图像对的AesRecon基准数据集。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21853 2026-05-22 cs.IR cs.LG 57%

LEMUR: Learned Multi-Vector Retrieval

LEMUR: 学习多向量检索

Elias Jääsaari, Ville Hyvönen, Teemu Roos

机构 * Department of Computer Science, University of Helsinki, Helsinki, Finland(赫尔辛基大学计算机科学系)

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 LEMUR通过将多向量相似性搜索转化为监督学习问题,并利用现有单向量搜索索引加速检索,实现了高效的多向量相似性搜索,比现有方法快一个数量级。

Comments Accepted to ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10455 2026-05-21 cs.IR cs.LG 57%

Compute Only Once: UG-Separation for Efficient Large Recommendation Models

只计算一次:用于高效大规模推荐模型的UG分离

Hui Lu, Zheng Chai, Shipeng Bai, Hao Zhang, Zhifang Fan, Kunmin Bai, Ke Sun, Yingwen Wu, Bingzheng Wei, Xiang Sun, Ziyan Gong, Tianyi Liu, Hua Chen, Deping Xie, Zhongkai Chen, Zhiliang Guo, Qiwei Chen, Yuchao Zheng

机构 * ByteDance AML(字节跳动人工智能实验室)

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 本文提出UG分离方法,通过在TokenMixer密集交互模型中显式分离用户侧和物品侧的信息流,实现用户侧计算的重用,从而减少冗余推理成本,并通过信息补偿策略和权重量化技术提升效率。

Comments Large Recommender Model, Industrial Recommenders, Scaling Law

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20223 2026-05-21 cs.CV 57%

Why Latent Actions Fail, and How to Prevent It

为何潜在动作失效,以及如何防止它

Jung Min Lee, Taehyun Cho, Li Zhao, Jungwoo Lee

机构 * Seoul National University(首尔国立大学) Microsoft Research(微软研究院)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文研究了潜在动作模型中外部状态对动作学习的干扰问题,并提出通过聚焦内生成分来缓解噪声干扰的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09668 2026-05-19 cs.CV 57%

DiffWind: Physics-Informed Differentiable Modeling of Wind-Driven Object Dynamics

DiffWind: 基于物理的可微风驱物体动力学建模

Yuanhang Lei, Boming Zhao, Zesong Yang, Xingxuan Li, Tao Cheng, Haocheng Peng, Ru Zhang, Yang Yang, Siyuan Huang, Yujun Shen, Ruizhen Hu, Hujun Bao, Zhaopeng Cui

机构 * State Key Laboratory of CAD & CG(CAD与计算机图形学国家重点实验室) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) Ant Group(蚂蚁集团) Shenzhen University(深圳大学)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文提出DiffWind,一种基于物理的可微框架,统一了风-物体相互作用建模、基于视频的重建和正向模拟。通过将风表示为基于网格的物理场,物体表示为从3D高斯点散布派生的粒子系统,并利用材料点方法(MPM)建模其相互作用,从而实现了对风驱物体动力学的重建。此外,本文还引入了WD-Objects数据集,通过大量实验证明了该方法在重建精度和模拟保真度方面显著优于现有动态场景建模方法。

Comments Accepted by ICLR 2026. Project page: https://zju3dv.github.io/DiffWind/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16175 2026-05-18 cs.LG 57%

Imitation learning for clinical decision support in pediatric ECMO

儿童ECMO临床决策支持中的模仿学习

Fateme Golivand, Michael Skinner, Saurabh Mathur, Ameet Soni, Phillip Reeder, Kristian Kersting, Lakshmi Raman, Sriraam Natarajan

机构 * University of Texas at Dallas(德克萨斯大学达拉斯分校) Technische Universität Darmstadt(德累斯顿技术大学) Swarthmore College(斯沃斯里学院) University of Texas Southwestern Medical Center(德克萨斯西南医学中心)

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 本文通过模仿学习方法,利用TabPFN等模型在儿科ECMO数据上学习行动模型,优于传统基线方法,为临床决策支持提供有效支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11550 2026-05-13 cs.CV 57%

The DAWN of World-Action Interactive Models

世界-动作交互模型的黎明

Hongbo Lu, Liang Yao, Chenghao He, Haoyu Wang, Xiang Gu, Xianfei Li, Wenlong Liao, Tao He, Pai Peng

机构 * COWARobot Co. Ltd(COWARobot有限公司) Shanghai Jiao Tong University(上海交通大学) Hohai University(河海大学)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文提出WAIMs,通过DAWN模型在语义潜在空间中实现世界预测与动作生成的交互,提升自动驾驶中的规划性能与安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10108 2026-05-12 cs.CL cs.LG 57%

GLiNER-Relex: A Unified Framework for Joint Named Entity Recognition and Relation Extraction

GLiNER-Relex:联合命名实体识别与关系抽取的统一框架

Ihor Stepanov, Oleksandr Lukashov, Mykhailo Shtopko, Vivek Kalyanarangan

机构 * Knowledgator Engineering(Knowledgator工程公司) Baldor Technologies Pvt. Ltd. (IDfy)(Baldor技术私人有限公司(IDfy))

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 GLiNER-Relex通过统一架构实现命名实体识别与关系抽取,利用共享的双向Transformer编码器联合表示文本、实体类型和关系类型标签,支持零样本提取任意实体和关系类型,且在四个基准数据集上表现优异。

Comments 19 pages, 1 figure, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09350 2026-05-12 cs.AI 57%

CHAINTRIX: A multi-pipeline LLM-augmented framework for automated smart-contract security auditing

CHAINTRIX:一个多管道LLM增强框架用于自动化智能合约安全审计

Gabriela Dobrita, Simona-Vasilica Oprea, Adela Bara

机构 * Bucharest University of Economic Studies(布加勒斯特经济大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 CHAINTRIX通过结合LLM与确定性结构表示,提升智能合约审计效率,检测86/120高危漏洞,召回率71.7%,优于现有基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00623 2026-05-12 cs.RO 57%

Recovering Hidden Reward in Diffusion-Based Policies

从扩散策略中恢复隐藏奖励

Yanbiao Ji, Qiuchang Li, Yuting Hu, Shaokai Wu, Wenyuan Xie, Guodong Zhang, Qicheng He, Deyi Ji, Yue Ding, Hongtao Lu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 本文提出EnergyFlow框架,通过参数化标量能量函数的梯度作为去噪场,统一生成动作建模与逆强化学习,证明在最大熵最优性下,去噪分数匹配学习的分数函数能恢复专家的软Q函数梯度,无需对抗训练即可提取奖励。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19923 2026-05-12 cs.CV 57%

UniCon3R: Unified Contact-aware 4D Human-Scene Reconstruction from Monocular Video

UniCon3R:基于单目视频的统一接触感知4D人体-场景重建

Tanuj Sur, Shashank Tripathi, Nikos Athanasiou, Ha Linh Nguyen, Kai Xu, Michael J. Black, Angela Yao

机构 * National University of Singapore(国立新加坡大学) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 UniCon3R通过建模人体与环境的接触关系,提升4D人体-场景重建的物理合理性与全局运动估计,同时保持高效的前馈推理速度。

Comments Project page: https://surtantheta.github.io/UniCon3R

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07859 2026-05-11 cs.CV 57%

EyeCue: Driver Cognitive Distraction Detection via Gaze-Empowered Egocentric Video Understanding

EyeCue:通过眼动增强的视点视频理解进行驾驶员认知分心检测

Lang Zhang, JinYi Yoon, Matthew Corbett, Abhijit Sarkar, Bo Ji

机构 * Virginia Tech(弗吉尼亚理工大学) Inha University(inha大学) Army Cyber Institute at West Point(西点军营陆军网络学院)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文提出EyeCue框架,通过眼动与视觉上下文的交互建模,实现驾驶员认知分心检测,利用CogDrive数据集验证其在多种驾驶场景下的高准确率和泛化能力。

Comments Accepted to the 35th International Joint Conference on Artificial Intelligence (IJCAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07213 2026-05-11 cs.CV 57%

LoHGNet: Infrared Small Target Detection through Lorentz Geometric Encoding with High-Order Relation Learning

LoHGNet:通过洛伦兹几何编码与高阶关系学习进行红外小目标检测

Qianwen Ma, Yang Xu, Shangwei Deng, Xiaobo Li, Haofeng Hu

机构 * School of Marine Science and Technology, Tianjin University(天津大学海洋科学与技术学院) Jiangxi Key Laboratory of Advanced Electronic Materials and Device, Jiangxi Science and Technology Normal University(江西省先进电子材料与器件重点实验室,江西科技师范大学)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 LoHGNet通过洛伦兹几何编码和高阶关系学习提升红外小目标检测性能,改进弱目标特征表示和背景关系建模,实验证明其在检测精度和复杂场景适应性上的竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06219 2026-05-08 cs.AI 57%

Joint Consistency: A Unified Test-Time Aggregation Framework via Energy Minimization

联合一致性:通过能量最小化实现的统一测试时间聚合框架

Yunzhen Yao, Hongye Wang, Yahong Wang, Michael C. Gastpar, Bo Jiang, Lie He

机构 * EPFL(苏黎世联邦理工学院) SUFE(上海财经大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 本文提出联合一致性框架,通过能量最小化统一测试时间聚合,整合现有投票和加权聚合方法,利用LLM作为裁判进行交互矩阵构建,并在大规模测试中实现高效近似策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.10468 2026-05-05 cs.IR cs.AI cs.CL 57%

Learning Decomposed Contextual Token Representations from Pretrained and Collaborative Signals for Generative Recommendation

从预训练和协作信号中学习分解的上下文令牌表示以生成推荐

Yifan Liu, Yaokun Liu, Zelin Li, Zhenrui Yue, Gyuseok Lee, Ruichen Yao, Yang Zhang, Dong Wang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Miami University(迈阿密大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 本文提出DECOR框架,通过上下文化令牌组成和分解嵌入融合,提升推荐性能,实验证明其优于现有方法。

Comments Accepted to SIGIR 2026. Full author version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26318 2026-04-30 cs.CV 57%

Point Cloud Registration via Probabilistic Self-Update Local Correspondence and Line Vector Sets

点云配准 via 概率自更新局部对应与线向量集

Kuo-Liang Chung, Yu-Cheng Lin, Wu-Chi Chen

机构 * Department of Computer Science and Information Engineering, National Taiwan University of Science and Technology(资讯工程系,国立台湾科技大学)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文提出一种快速有效的点云配准算法,结合概率自更新局部对应与线向量集,通过双RANSAC模型提升精度与效率,实现更优的配准性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24796 2026-04-29 q-bio.OT cs.LG 57%

A multi-stage soft computing framework for complex disease modelling and decision support: A liver cirrhosis case study

一种多阶段软计算框架用于复杂疾病建模和决策支持:肝硬化案例研究

Xueyuan Huang, Yuheng Wang, Yuanzhi He, Siqi Gou, Lu Bai, Wenqian Wu, Peifeng Liu, Aijia Wang, Tianhui Fan, Ze Zhou, Jiayu Xu

机构 * organization= Department of Hepatobiliary Surgery, the Second Affiliated Hospital of Chongqing Medical University , city= Chongqing , postcode= 400010 , country= China organization= State Key Laboratory of Respiratory Health Multimorbidity, Institute of Basic Medical Sciences \& School of Basic Medicine, Chinese Academy of Medical Sciences \& Peking Union Medical College , city= Beijing , postcode= 100005 , country= China organization= School of Computer Science Informatics, Cardiff University , city= Wales , postcode= CF24 0DE , country= United Kingdom organization= Department of Medical Oncology, the First Hospital of China Medical University , city= Shenyang , postcode= 110001 , country= China organization= Institute for Innovation Development, Tsinghua University , city= Beijing , postcode= 100086 , country= China organization= Department of Liver Surgery, Peking Union Medical College Hospital, Chinese Academy of Medical Sciences \& Peking Union Medical College , city= Beijing , country= China

专题命中 VLA模型 :action model(abstract);分类 cs.LG

AI总结 本文提出一种多阶段软计算框架,用于复杂疾病建模与治疗探索,通过整合单细胞转录组数据、高维网络特征稳定化、多模型学习和深度表征学习,提升肝硬化等复杂疾病的诊断与治疗决策能力。

Comments 20 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08475 2026-04-22 cs.CV 57%

LAMP: Lift Image-Editing as General 3D Priors for Open-world Manipulation

LAMP:将图像编辑提升为通用3D先验以实现开放世界操控

Jingjing Wang, Zhengdong Hong, Chong Bao, Yuke Zhu, Junhan Sun, Guofeng Zhang

机构 * State Key Lab of CAD&CG(计算机辅助设计与图形学国家重点实验室)

专题命中 VLA模型 :vision-language-action(abstract);分类 cs.CV

AI总结 LAMP通过将图像编辑作为3D先验,提取物体间连续的几何表示,提升开放世界操控的泛化能力与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17830 2026-04-21 cs.RO 57%

SYMBOLIZER: Symbolic Model-free Task Planning with VLMs

SYMBOLIZER:基于VLMs的符号模型无关任务规划

Sami Azirar, Zlatan Ajanovic, Hermann Blum

机构 * RWTH Aachen(亚琛理工大学) University of Bonn(波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔人工智能与机器学习研究院)

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 本文提出SYMBOLIZER框架,利用VLMs将图像转化为符号状态,结合启发式搜索实现跨领域任务规划,优于直接VLM规划并可与基于启发式的传统方法媲美。

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17749 2026-04-21 cs.CV 57%

Ego-InBetween: Generating Object State Transitions in Ego-Centric Videos

Ego-InBetween: 生成以自我为中心视频中的物体状态转换

Mengmeng Ge, Takashi Isobe, Xu Jia, Yanan Sun, Zetong Yang, Weinong Wang, Dong Zhou, Dong Li, Huchuan Lu, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司) Dalian University of Technology(大连理工大学) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学) Xi’an Jiaotong University(西安交通大学)

专题命中 VLA模型 :action model(abstract);分类 cs.CV

AI总结 本文提出EgoIn框架,通过TransitionVLM和Object-aware Auxiliary Supervision生成物体状态转换序列,实现以自我为中心视角下的视觉状态迁移。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00789 2026-04-21 cs.CV 57%

CogDriver: Integrating Cognitive Inertia for Temporally Coherent Planning in Autonomous Driving

CogDriver:通过整合认知惯性实现自动驾驶中的时间一致规划

Pei Liu, Qingtian Ning, Xinyan Lu, Haipeng Liu, Weiliang Ma, Dangen She, Peng Jia, Xianpeng Lang, Jun Ma

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) The Hong Kong University of Science and Technology(香港科学与技术大学) Li Auto Inc.(利汽车公司)

专题命中 VLA模型 :vision-language-action(abstract);分类 cs.CV

AI总结 本文提出CogDriver框架,通过引入认知惯性提升自动驾驶中的时间一致性规划能力,通过大规模视觉-语言-动作数据集和稀疏时间记忆架构,显著提升了闭环驾驶得分和模仿准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07303 2026-04-20 cs.DB cs.AI cs.SE 57%

KRONE: Scalable LLM-Augmented Log Anomaly Detection via Hierarchical Abstraction

KRONE:通过层次抽象实现可扩展的LLM增强日志异常检测

Lei Ma, Jinyang Liu, Tieying Zhang, Peter M. VanNostrand, Dennis M. Hofmann, Lei Cao, Elke A. Rundensteiner, Jianjun Chen

机构 * Worcester Polytechnic Institute(沃斯特理工学院) ByteDance Inc.(字节跳动公司) University of Arizona(亚利桑那大学)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 KRONE通过自动从扁平日志中推导执行层次结构,实现模块化多级异常检测,提升准确率、F1分数和资源效率。

Comments Accepted at ICDE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13737 2026-04-16 cs.IR cs.AI 57%

TokenFormer: Unify the Multi-Field and Sequential Recommendation Worlds

TokenFormer:统一多字段和序列推荐领域

Yifeng Zhou, Yuehong Hu, Zhixiang Feng, Junwei Pan, Kaihui Wu, Hanyong Li, Shangyu Zhang, Shudong Huang, Zhangbin Zhu, Chengguo Yin, Haijie Gu, Jie Jiang

机构 * Tencent Inc.(腾讯公司)

专题命中 VLA模型 :action model(abstract);分类 cs.AI

AI总结 TokenFormer通过引入BFTS注意力机制和NLIR,解决多字段与序列推荐的融合问题,提升模型鲁棒性和表征能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11981 2026-04-15 cs.RO 57%

Bipedal-Walking-Dynamics Model on Granular Terrains

颗粒地形上的双足行走动力学模型

Xunjie Chen, Xinyan Huang, Peter Shan, Jingang Yi, Tao Liu

机构 * Department of Mechanical and Aerospace Engineering, Rutgers University(罗格斯大学机械与航空航天工程系) Bridgewater Raritan High School(布里奇沃特-拉里坦高中) State Key Lab of Fluid Power Transmission and Control and the School of Mechanical Engineering, Zhejiang University(浙江大学流体动力传动与控制国家重点实验室和机械工程学院)

专题命中 VLA模型 :action model(abstract);分类 cs.RO

AI总结 本文提出一种新的双足行走动力学模型,用于预测在颗粒介质上行走的运动。模型通过动态足部-地形交互模型计算地面反作用力,并引入三个额外自由度以估计足部下沉和滑动,从而改进机器人行走的运动学和动力学分析。

Comments Accepted paper in ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏