arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Huazhong University of Science and Technology(华中科技大学)

共收录 702
2602.10575 2026-02-12 cs.CV cs.AI cs.CY

MetaphorStar: Image Metaphor Understanding and Reasoning with End-to-End Visual Reinforcement Learning

MetaphorStar: 基于端到端视觉强化学习的图像隐喻理解与推理

Chenhao Zhang, Yazhe Niu, Hongsheng Li

机构 * Shanghai AI Laboratory(上海人工智能实验室) Huazhong University of Science and Technology(华中科技大学) The Chinese University of Hong Kong MMLab(香港中文大学MMLab)

AI总结 MetaphorStar通过端到端视觉强化学习框架提升图像隐喻理解与推理能力,显著优于现有模型。

Comments 14 pages, 4 figures, 11 tables; Code: https://github.com/MING-ZCH/MetaphorStar, Model & Dataset: https://huggingface.co/collections/MING-ZCH/metaphorstar

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00891 2026-02-12 cs.CV

Accelerating Streaming Video Large Language Models via Hierarchical Token Compression

通过分层令牌压缩加速流式视频大型语言模型

Yiyu Wang, Xuyang Liu, Xiyan Gui, Xinying Lin, Boxue Yang, Chenfei Liao, Tailai Chen, Linfeng Zhang

机构 * EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Sichuan University(四川大学) Huazhong University of Science and Technology(华中科技大学) Sun Yat-sen University(中山大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 STC通过分层令牌压缩技术,显著降低流式视频大语言模型的处理延迟,同时保持高精度。

Comments Code is avaliable at \url{https://github.com/lern-to-write/STC}

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09221 2026-02-12 cs.HC cs.LG

CMCRD: Cross-Modal Contrastive Representation Distillation for Emotion Recognition

CMCRD:跨模态对比表示蒸馏用于情绪识别

Siyuan Kan, Huanyu Wu, Zhenyao Cui, Fan Huang, Xiaolong Xu, Dongrui Wu

机构 * Key Laboratory of Image Processing and Intelligent Control, Ministry of Education, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(图像处理与智能控制重点实验室、教育部、自动化学院、华中科技大学) Wuhan Institute of Digital Engineering(武汉数字工程研究所) Shanghai Jiao Tong University(上海交通大学)

AI总结 CMCRD通过跨模态对比表示蒸馏提升情绪识别准确性,减少多模态数据需求,实验表明在EEG和眼动数据间相互辅助训练可提高分类准确率约6.2%。

Journal ref IEEE Trans. on Affective Computing, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.09578 2026-02-11 cs.LG

Rollout-Training Co-Design for Efficient LLM-Based Multi-Agent Reinforcement Learning

为高效的大规模基于LLM的多智能体强化学习设计rollout训练

Zhida Jiang, Zhaolong Xing, Jiawei Lu, Yipei Niu, Qingyuan Sang, Liangxu Zhang, Wenquan Dai, Junhua Shu, Jiaxing Wang, Qiangyu Pei, Qiong Chen, Xinyu Liu, Fangming Liu, Ai Han, Zhen Chen, Ke Zhang

机构 * Huawei(华为公司) Huazhong University of Science and Technology(华中科技大学)

AI总结 FlexMARL通过端到端训练框架优化rollout与训练协调,实现大规模基于LLM的多智能体强化学习的高效训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08855 2026-02-10 cs.LG

Rethinking Graph Generalization through the Lens of Sharpness-Aware Minimization

通过尖锐性感知最小化重新思考图泛化

Yang Qiu, Yixiong Zou, Jun Wang

机构 * School of Computer Science and Technology, Huazhong University of Science and Technology(计算机科学与技术学院,华中科技大学)

AI总结 本文提出E2A框架,通过能量引导的潜在扰动生成伪OoD样本,提升图神经网络对分布偏移的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08524 2026-02-10 cs.CV

GeoFocus: Blending Efficient Global-to-Local Perception for Multimodal Geometry Problem-Solving

GeoFocus:融合高效全局到局部感知的多模态几何问题求解

Linger Deng, Yuliang Liu, Wenwen Yu, Zujia Zhang, Jianzhong Ju, Zhenbo Luo, Xiang Bai

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学) MiLM Plus, Xiaomi Inc(小米公司)

AI总结 GeoFocus通过关键局部感知器和顶点语言提升多模态几何问题求解的准确性和效率

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13524 2026-02-10 cs.CV

GO-MLVTON: Garment Occlusion-Aware Multi-Layer Virtual Try-On with Diffusion Models

GO-MLVTON: 基于服装遮挡感知的多层虚拟试穿与扩散模型

Yang Yu, Yunze Deng, Yige Zhang, Yanjie Xiao, Youkun Ou, Wenhao Hu, Mingchao Li, Bin Feng, Wenyu Liu, Dandan Zheng, Jingdong Chen

机构 * School of EIC, Huazhong University of Science and Technology, Wuhan, China(华中科技大学电子信息学院) Inclusion AI, Ant Group, Beijing, China(蚂蚁集团 inclusion AI 北京)

AI总结 GO-MLVTON通过引入服装遮挡学习模块和基于扩散模型的服装变形适配模块,实现了多层服装的高精度虚拟试穿,同时提出了MLG数据集和LACD评估指标。

Comments Accepted at ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13261 2026-02-10 cs.CV

Building Egocentric Procedural AI Assistant: Methods, Benchmarks, and Challenges

构建第一人称程序化AI助手:方法、基准和挑战

Junlong Li, Huaiyuan Xu, Sijie Cheng, Kejun Wu, Kim-Hui Yap, Lap-Pui Chau, Yi Wang

机构 * Department of EEE(电子工程系) The Hong Kong Polytechnic University(香港理工大学) RayNeo Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出第一人称程序化AI助手,探讨其核心任务、赋能维度及挑战,通过实验评估现有方法并指明未来研究方向。

Comments Under peer-review

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07565 2026-02-10 cs.CV

Human Identification at a Distance: Challenges, Methods and Results on the Competition HID 2025

远程人类识别:挑战、方法与HID 2025竞赛结果

Jingzhe Ma, Meng Zhang, Jianlong Yu, Kun Liu, Zunxiao Xu, Xue Cheng, Junjie Zhou, Yanfei Wang, Jiahang Li, Zepeng Wang, Kazuki Osamura, Rujie Liu, Narishige Abe, Jingjie Wang, Shunli Zhang, Haojun Xie, Jiajun Wu, Weiming Wu, Wenxiong Kang, Qingshuo Gao, Jiaming Xiong, Xianye Ben, Lei Chen, Lichen Song, Junjian Cui, Haijun Xiong, Junhao Lu, Bin Feng, Mengyuan Liu, Ji Zhou, Baoquan Zhao, Ke Xu, Yongzhen Huang, Liang Wang, Manuel J Marin-Jimenez, Md Atiqur Rahman Ahad, Shiqi Yu

机构 * Shenzhen Polytechnic University(深圳职业技术大学) Fujitsu Research and Development Center Company Ltd.(富士通研发有限公司) Beijing Jiaotong University(北京交通大学) South China University of Technology(华南理工大学) Shandong University(山东大学) EVERSPRY Wuhan University of Technology(武汉理工大学) Sun Yat-sen University(中山大学) Shanghai Jiao Tong University(上海交通大学) Fujitsu Ltd.(富士通株式会社) Huazhong University of Science and Technology(华中科技大学) Hefei University of Technology(合肥工业大学) Peking University, Shenzhen Graduate School(北京大学深圳研究生院) Beijing Normal University(北京师范大学) Watrix Technology Limited Co. Ltd.(华智科技有限公司) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Cordoba(科尔多瓦大学) University of East London(东伦敦大学) Southern University of Science and Technology(南方科技大学)

AI总结 HID 2025竞赛评估了步态识别在远程人类识别中的挑战与进展,通过SUSTech-Competition数据集验证了算法性能的提升,达到94.2%的准确率。

Comments Accepted by IJCB 2025(https://ijcb2025.ieee-biometrics.org/competitions/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18588 2026-02-10 cs.AI cs.CL cs.LG

Stability as a Liability:Systematic Breakdown of Linguistic Structure in LLMs

稳定性作为负债:在大语言模型中语言结构的系统性崩溃

Xianzhe Meng, Qiangsheng Zeng, Ling Luo, Qinghan Yang, Jiarui Hao, Wenbo Wu, Qinyu Wang, Rui Yin, Lin Qi, Renzhi Lu

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology, Wuhan, China(人工智能与自动化学院,华中科技大学,武汉,中国) National Institute for Data Science in Health and Medicine, Xiamen University, Xiamen, China(数据科学与医学研究院,厦门大学,厦门,中国) School of Mathematics and Statistics, Huazhong University of Science and Technology, Wuhan, China(数学与统计学院,华中科技大学,武汉,中国) School of Computer Science and Technology, Huazhong University of Science and Technology, Wuhan, China(计算机科学与技术学院,华中科技大学,武汉,中国) School of Electronic Information and Communications, Huazhong University of Science and Technology, Wuhan, China(电子信息与通信学院,华中科技大学,武汉,中国) School of Electrical and Electronic Engineering, Huazhong University of Science and Technology, Wuhan, China(电气与电子工程学院,华中科技大学,武汉,中国) School of Physics, Huazhong University of Science and Technology, Wuhan, China(物理学院,华中科技大学,武汉,中国)

AI总结 本研究揭示了大语言模型中训练稳定性与生成表达性之间的不一致性,指出稳定性可能带来系统性退化,而非保证生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05218 2026-02-10 cs.CV

MonkeyOCR: Document Parsing with a Structure-Recognition-Relation Triplet Paradigm

MonkeyOCR: 一种基于结构-识别-关系三元组范式的文档解析方法

Zhang Li, Yuliang Liu, Qiang Liu, Zhiyin Ma, Ziyang Zhang, Shuo Zhang, Biao Yang, Zidun Guo, Jiarui Zhang, Xinyu Wang, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Kingsoft Office(金山办公)

AI总结 MonkeyOCR通过结构-识别-关系三元组范式实现文档解析,提出MonkeyDoc数据集并训练30亿参数基础模型,提升性能并优化部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.17616 2026-02-10 cs.CV

Towards Stabilized and Efficient Diffusion Transformers through Long-Skip-Connections with Spectral Constraints

通过谱约束的长跳连接实现稳定高效的扩散变换器

Guanjie Chen, Xinyu Zhao, Yucheng Zhou, Xiaoye Qu, Tianlong Chen, Yu Cheng

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) The University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) SKL-IOTSC, CIS, University of Macau(澳门大学SKL-IOTSC、CIS) Huazhong University of Science and Technology(华中科技大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 通过引入长跳连接和谱约束,Skip-DiT实现了图像和视频生成中的稳定高效扩散变换器,显著提升了训练和推理效率。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04928 2026-02-09 cs.LG

Euphonium: Steering Video Flow Matching via Process Reward Gradient Guided Stochastic Dynamics

euphonium:通过过程奖励梯度引导的随机动态控制视频流匹配

Ruizhe Zhong, Jiesong Lian, Xiaoyue Mi, Zixiang Zhou, Yuan Zhou, Qinglin Lu, Junchi Yan

机构 * Huazhong University of Science and Technology(华中科技大学) Shanghai Jiao Tong University(上海交通大学) Tencent Hunyuan(腾讯混元) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 Euphonium通过过程奖励梯度引导动态,提升视频流匹配的生成效率和对齐性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.12014 2026-02-09 cs.CL cs.AI cs.LG cs.SE

code_transformed: The Influence of Large Language Models on Code

code_transformed: 大型语言模型对代码的影响

Yuliang Xu, Siming Huang, Mingmeng Geng, Yao Wan, Xuanhua Shi, Dongping Chen

机构 * Huazhong University of Science and Technology(华中科技大学) École normale supérieure - Université PSL(巴黎高等师范学院-巴黎大学) Laboratoire LATTICE(LATTICE实验室) International School for Advanced Studies (SISSA)(国际先进研究学院(SISSA))

AI总结 本文研究了大型语言模型对代码风格的影响,通过分析GitHub仓库中的代码,发现命名规范、复杂性等指标的变化,揭示LLMs对现实编程实践的深远影响。

Comments EACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06040 2026-02-06 cs.CV

SwimBird: Eliciting Switchable Reasoning Mode in Hybrid Autoregressive MLLMs

SwimBird: 在混合自回归大语言模型中实现可切换的推理模式

Jintao Tong, Shilin Yan, Hongwei Xue, Xiaojun Tang, Kunyu Shi, Guannan Zhang, Ruixuan Li, Yixiong Zou

机构 * Huazhong University of Science and Technology(华中科技大学) Accio Team, Alibaba Group(阿里集团Accio团队)

AI总结 SwimBird通过动态切换三种推理模式,提升多模态大语言模型在视觉密集任务中的性能,同时保持文本推理能力。

Comments Project Page: https://accio-lab.github.io/SwimBird

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05508 2026-02-06 cs.CV

VGGT-Motion: Motion-Aware Calibration-Free Monocular SLAM for Long-Range Consistency

VGGT-Motion:具有运动感知的校准自由单目SLAM用于长距离一致性

Zhuang Xiong, Chen Zhang, Qingshan Xu, Wenbing Tao

机构 * National Key Laboratory of Science and Technology on Multi-spectral Information Processing(科学与技术多光谱信息处理国家重点实验室) Huazhong University of Science and Technology(华中科技大学) College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

AI总结 VGGT-Motion通过运动感知子地图构造和锚点驱动的直接Sim(3)对齐策略,实现了高效且稳健的校准自由单目SLAM,提升了长距离轨迹的精度和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09643 2026-02-06 cs.LG

A Policy Gradient-Based Sequence-to-Sequence Method for Time Series Prediction

基于策略梯度的序列到序列方法用于时间序列预测

Qi Sima, Xinze Zhang, Yukun Bao, Siyue Yang, Liang Shen

机构 * School of Management, Huazhong University of Science and Technology(华中科技大学管理学院)

AI总结 本文提出基于策略梯度的序列到序列方法,通过自适应输入选择策略提升时间序列预测的准确性和稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16793 2026-02-05 cs.RO

PhysBrain: Human Egocentric Data as a Bridge from Vision Language Models to Physical Intelligence

PhysBrain: 人眼视角数据作为视觉语言模型到物理智能的桥梁

Xiaopeng Lin, Shijie Lian, Bin Yu, Ruoqi Yang, Zhaolong Shen, Changti Wu, Yuzhuo Miao, Yurun Jin, Yukun Shi, Jiyan He, Cong Huang, Bojun Cheng, Kai Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) Harbin Institute of Technology(哈尔滨工业大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 PhysBrain通过将人类眼动视频转化为多级具身监督,提升机器人在眼动感知和长期规划中的能力,实现从人类视角到机器人控制的有效迁移。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14265 2026-02-05 cs.LG

Unified Multimodal Vessel Trajectory Prediction with Explainable Navigation Intention

具有可解释导航意图的统一多模态船舶轨迹预测

Rui Zhang, Chao Li, Kezhong Liu, Chen Wang, Bolong Zheng, Hongbo Jiang

机构 * School of Computer Science and Artificial Intelligence, Wuhan University of Technology(武汉理工大学计算机科学与人工智能学院) School of Navigation, Wuhan University of Technology(武汉理工大学航海学院) Hubei Key Laboratory of Internet of Intelligence, School of Electronic Information and Communications, Huazhong University of Science and Technology(华中科技大学电子信息与通信学院智能互联网关键实验室) College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院)

AI总结 本文提出了一种整合可解释导航意图的统一多模态船舶轨迹预测框架,通过构建持续性意图树和动态瞬时意图模型,提升预测的准确性和可解释性。

Journal ref IEEE Transactions on Intelligent Transportation Systems, vol. 27, no. 1, pp. 258-269, Jan. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03477 2026-02-04 cs.LG cs.AI q-bio.GN

ScDiVa: Masked Discrete Diffusion for Joint Modeling of Single-Cell Identity and Expression

ScDiVa:用于单细胞身份和表达联合建模的掩码离散扩散

Mingxuan Wang, Cheng Chen, Gaoyang Jiang, Zijia Ren, Chuangxin Zhao, Lu Shi, Yanbiao Ma

机构 * Gaoling School of Artificial Intelligence, Renmin University of China, Beijing, China(中国人民大学人工智能学院) School of Statistics, Renmin University of China, Beijing, China(中国人民大学统计学院) CRE Life Institute, China(中国CRE生命科学研究院) School of Computer Science and Technology, Huazhong University of Science and Technology, Wuhan, China(华中科技大学计算机科学与技术学院) School of Mathematics, Jilin University, Changchun, China(吉林大学数学学院) Beijing Academy of Artificial Intelligence,Beijing,China(北京人工智能研究院)

AI总结 ScDiVa通过掩码离散扩散模型,联合建模单细胞身份与表达,实现高效去噪与高精度恢复。

Comments 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02222 2026-02-03 cs.CV cs.CR

MIRROR: Manifold Ideal Reference ReconstructOR for Generalizable AI-Generated Image Detection

MIRROR:基于流形理想参考的通用AI生成图像检测器

Ruiqi Liu, Manni Cui, Ziheng Qin, Zhiyuan Yan, Ruoxin Chen, Yi Han, Zhiheng Li, Junkai Chen, ZhiJin Chen, Kaiqing Lin, Jialiang Shen, Lubin Weng, Jing Dong, Yan Wang, Shu Wu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, UCAS(北京大学交叉信息学院) Huazhong University of Science and Technology(华中科技大学) Tencent YouTu Lab(腾讯YouTu实验室) Southwest University(西南大学) Peking University(北京大学) The University of Sydney(悉尼大学) Shenzhen University(深圳大学) Tsinghua University(清华大学)

AI总结 MIRROR通过流形理想参考重建器,利用现实先验和残差信号,实现对AI生成图像的高效检测,超越现有方法并接近人类感知极限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.13531 2026-02-03 cs.RO

A Three-Level Whole-Body Disturbance Rejection Control Framework for Dynamic Motions in Legged Robots

一种用于腿部机器人动态运动的三级整体扰动抑制控制框架

Bolin Li, Gewei Zuo, Zhixiang Wang, Xiaotian Ke, Lijun Zhu, Han Ding

机构 * School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(人工智能与自动化学院,华中科技大学) State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(智能制造装备与技术国家重点实验室,华中科技大学)

AI总结 本文提出了一种三级整体扰动抑制控制框架,用于提高腿部机器人在存在不确定性时的稳定性与鲁棒性,通过新颖的观测器和仿真实验验证其有效性。

Comments has been accepted for publication as a SPECIAL ISSUE paper in the IEEE Transactions on Automation Science and Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01126 2026-02-03 cs.LG

WinFLoRA: Incentivizing Client-Adaptive Aggregation in Federated LoRA under Privacy Heterogeneity

WinFLoRA: 在隐私异质性下的联邦LoRA中激励客户端自适应聚合

Mengsha Kou, Xiaoyu Xia, Ziqi Wang, Ibrahim Khalil, Runkun Luo, Jingwen Zhou, Minhui Xue

机构 * RMIT University(皇家墨尔本理工大学) Huazhong University of Science and Technology(华中科技大学) CSIRO’s Data61 and Responsible AI Research (RAIR) Centre(澳大利亚CSIRO数据61和负责任的人工智能研究(RAIR)中心)

AI总结 WinFLoRA通过利用聚合权重激励客户端自适应聚合,提升联邦LoRA在隐私异质性下的全局准确率和客户端效用。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01095 2026-02-03 cs.CV

PandaPose: 3D Human Pose Lifting from a Single Image via Propagating 2D Pose Prior to 3D Anchor Space

PandaPose: 通过将2D姿态先验传播到3D锚空间实现单张图像的3D人体姿态提升

Jinghong Zheng, Changlong Jiang, Yang Xiao, Jiaqi Li, Haohong Kuang, Hang Xu, Ran Wang, Zhiguo Cao, Min Du, Joey Tianyi Zhou

机构 * School of Journalism and Information Communication, Huazhong University of Science and Technology(华中科技大学新闻与信息传播学院) ByteDance Inc.(字节跳动公司) Institute of High Performance Computing, Agency for Science, Technology and Research, Singapore(科技研究局高性能计算研究所)

AI总结 PandaPose通过将2D姿态先验传播到3D锚空间,提升单张图像的3D人体姿态估计精度,有效缓解自遮挡问题并减少误差。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09751 2026-02-03 cs.LG cs.AI

Meta-Learning Reinforcement Learning for Crypto-Return Prediction

元学习强化学习用于加密货币收益预测

Junqiao Wang, Zhaoyang Guan, Guanyu Liu, Tianze Xia, Xianzhi Li, Shuo Yin, Xinyuan Song, Chuhan Cheng, Tianyu Shi, Alex Lee

机构 * Sichuan University(四川大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Northwestern University(西北大学) Huazhong University of Science and Technology(华中科技大学) Queen’s University(女王大学) University of Toronto(多伦多大学) TrueNorth Tsinghua University(清华大学) Emory University(埃默里大学) University of Macau(澳门大学)

AI总结 Meta-RL-Crypto通过结合元学习和强化学习,构建了一个自我改进的交易代理,有效提升加密货币收益预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10498 2026-02-03 cs.CV

The Role of World Models in Shaping Autonomous Driving: A Comprehensive Survey

世界模型在塑造自动驾驶中的作用:全面综述

Sifan Tu, Xin Zhou, Dingkang Liang, Xingyu Jiang, Yumeng Zhang, Xiaofan Li, Xiang Bai

机构 * Huazhong University of Science and Technology(华中科技大学) Baidu Inc(百度公司)

AI总结 本文综述了驾驶世界模型在自动驾驶中的作用,分析了其生态系统、分类方法及性能表现,探讨了当前研究的局限性与未来发展方向。

Comments For continuous updates, please follow the repository: https://github.com/LMD0311/Awesome-World-Model

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00143 2026-02-03 q-bio.QM cs.LG stat.ML

Early warning prediction: Onsager-Machlup vs Schrödinger

早期预警预测:Onsager-Machlup与Schrödinger

Xiaoai Xu, Yixuan Zhou, Xiang Zhou, Jingqiao Duan, Ting Gao

机构 * School of Mathematics and Information Science, Guangzhou University(广州大学数学与信息科学学院) School of Sciences, Great Bay University(大亚湾大学科学学院) Guangdong Provincial Key Laboratory of Mathematical and Neural Dynamical Systems, Great Bay University(广东省数学与神经动力系统重点实验室) School of Mathematics and Statistics, Huazhong University of Science and Technology(华中科技大学数学与统计学院) Center for Mathematical Science, Huazhong University of Science and Technology(华中科技大学数学科学中心) Department of Mathematics, City University of Hong Kong(香港城市大学数学系)

AI总结 本文提出一种结合流形学习与随机动力学系统建模的早期预警框架,通过Schrödinger桥理论定义新指标,提升癫痫预测的灵敏度和鲁棒性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22959 2026-02-02 cs.CV

Triage: Hierarchical Visual Budgeting for Efficient Video Reasoning in Vision-Language Models

Triage: 分层视觉预算机制用于视觉语言模型中的高效视频推理

Anmin Wang, Nan Zhang, Wei Tao, Xiaoyang Qu, Guokuan Li, Jiguang Wan, Jianzong Wang

机构 * Huazhong University of Science and Technology(华中科技大学) Ping An Technology (Shenzhen) Co., Ltd.(平安科技(深圳)有限公司)

AI总结 Triage通过分层视觉预算机制优化视频推理,提升效率并保持性能。

Comments Accepted to 2026 IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19967 2026-01-30 cs.LG cs.AI

Perturbation-Induced Linearization: Constructing Unlearnable Data with Solely Linear Classifiers

扰动诱导线性化:仅使用线性分类器构造不可学习数据

Jinlin Liu, Wei Chen, Xiaojin Zhang

机构 * Huazhong University of Science and Technology(华中科技大学)

AI总结 本文提出PIL方法,利用线性分类器生成扰动,以高效构建不可学习数据,减少计算成本并提升数据保护效果。

Comments This paper has been accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17357 2026-01-30 cs.DC cs.AI

Speeding up Local Optimization in Vehicle Routing with Tensor-based GPU Acceleration

加速车辆路径问题中的局部优化的张量基GPU加速

Zhenyu Lei, Jin-Kao Hao, Qinghua Wu

机构 * School of Management, Huazhong University of Science and Technology(华中科技大学管理学院)

AI总结 本文提出基于张量的GPU加速方法,用于加速车辆路径问题中的局部优化,通过高效计算提升计算效率和解质量。

详情

展开后加载摘要…

URL PDF HTML 收藏