arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3042
2602.20752 2026-02-25 cs.CV cs.AI

OrthoDiffusion: A Generalizable Multi-Task Diffusion Foundation Model for Musculoskeletal MRI Interpretation

OrthoDiffusion:一种通用的多任务扩散基础模型用于骨科MRI解释

Tian Lan, Lei Xu, Zimu Yuan, Shanggui Liu, Jiajun Liu, Jiaxin Liu, Weilai Xiang, Hongyu Yang, Dong Jiang, Jianxin Yin, Dingyu Wang

机构 * Center for Applied Statistics and School of Statistics(应用统计中心和统计学院) Renmin University of China(中国人民大学) Institute of Sports Medicine of Peking University(北京大学运动医学研究所) Beijing Key Laboratory of Research and Translation for Drugs and Medical Devices in Precision Diagnosis and Treatment of Sports Injuries(北京体育损伤精准诊断与治疗药物与医疗设备研究翻译重点实验室) State Key Laboratory of Virtual Reality Technology and Systems(虚拟现实技术与系统国家重点实验室)

AI总结 OrthoDiffusion是一种基于扩散的多任务基础模型,通过自监督学习在膝关节MRI上预训练,实现11种结构分割和8种异常检测,具有跨关节的高泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20720 2026-02-25 cs.CR cs.AI

AdapTools: Adaptive Tool-based Indirect Prompt Injection Attacks on Agentic LLMs

AdapTools: 面向代理LLM的自适应工具间接提示注入攻击

Che Wang, Jiaming Zhang, Ziqi Zhang, Zijie Wang, Yinghui Wang, Jianbo Gao, Tao Wei, Zhong Chen, Wei Yang Bryan Lim

机构 * College of Computing(计算学院) Data Science, Nanyang Technological University, Singapore(数据科学,南洋理工大学,新加坡) School of Computer Science, Peking University, China(计算机科学学院,北京大学,中国)

AI总结 AdapTools通过自适应工具和提示生成,提升间接提示注入攻击成功率2.13倍,同时降低系统效用1.78倍,有效应对现代AI代理的快速演变特性。

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20708 2026-02-25 cs.AI cs.CR

ICON: Indirect Prompt Injection Defense for Agents based on Inference-Time Correction

ICON:基于推理时校正的代理间接提示注入防御

Che Wang, Fuyao Zhang, Jiaming Zhang, Ziqi Zhang, Yinghui Wang, Longtao Huang, Jianbo Gao, Zhong Chen, Wei Yang Bryan Lim

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(计算与数据科学学院,南洋理工大学,新加坡) Alibaba(阿里巴巴) School of Computer Science, Peking University, China(计算机科学学院,北京大学,中国)

AI总结 ICON通过潜在空间轨迹探测和修正器实现对代理间接提示注入攻击的防御,有效提升任务连续性和安全性,同时保持高检测率和任务效用。

Comments 11 pages,

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20593 2026-02-25 cs.LG cs.CR

Is the Trigger Essential? A Feature-Based Triggerless Backdoor Attack in Vertical Federated Learning

触发器是否必要?一种基于特征的无触发后门攻击在垂直联邦学习中

Yige Liu, Yiwei Lou, Che Wang, Yongzhi Cao, Hanpin Wang

机构 * Key Laboratory of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术重点实验室(北京大学)) School of Computer Science, Peking University(北京大学计算机学院) Zhongguancun Laboratory(中关村实验室)

AI总结 本文提出了一种基于特征的无触发后门攻击,揭示了垂直联邦学习中新的攻击路径,优于现有方法并具备高鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12815 2026-02-25 cs.CL cs.AI cs.CY cs.MA

Multimodal Multi-Agent Empowered Legal Judgment Prediction

多模态多智能体赋能的法律判决预测

Zhaolu Kang, Junhao Gong, Qingxi Chen, Hao Zhang, Jiaxin Liu, Rong Fu, Zhiyuan Feng, Yuan Wang, Simon Fong, Kaiyue Zhou

机构 * Peking University(北京大学) Chengdu Minto Tech(成都Minto科技) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Macau(澳门大学) Tsinghua university(清华大学) Zhejiang University(浙江大学)

AI总结 本文提出JurisMMA框架,通过多模态多智能体技术提升法律判决预测的准确性,并构建了包含大量司法记录的JurisMM数据集,验证了其在法律领域应用的广泛有效性。

Comments Accepted to the IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17404 2026-02-25 cs.CV

MoSA: Motion-Coherent Human Video Generation via Structure-Appearance Decoupling

MoSA: 通过结构-外观解耦生成运动一致的人体视频

Haoyu Wang, Hao Tang, Donglin Di, Zhilu Zhang, Wangmeng Zuo, Feng Gao, Siwei Ma, Shiliang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机学院,北京大学) School of Arts(艺术学院) Li Auto(力汽车) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 MoSA通过结构-外观解耦生成运动一致的人体视频,引入Human-Aware Dynamic Control模块和接触约束,提升细粒度控制与人-环境交互建模,实现更逼真的人体视频生成。

Comments Accepted by ICLR 2026. Project: https://hywang2002.github.io/MoSA

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06690 2026-02-25 cs.RO cs.CV

SpikePingpong: Spike Vision-based Fast-Slow Pingpong Robot System

SpikePingpong: 基于尖峰视觉的快慢Pingpong机器人系统

Hao Wang, Chengkai Hou, Xianglong Li, Yankai Fu, Chenxuan Li, Ning Chen, Gaole Dai, Jiaming Liu, Tiejun Huang, Shanghang Zhang

机构 * Peking University(北京大学) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

AI总结 SpikePingpong系统结合尖峰视觉与模仿学习,实现高精度乒乓球机器人控制,达到92%的30厘米精度成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09126 2026-02-25 cs.CV

DreamBarbie: Text to Barbie-Style 3D Avatars

DreamBarbie: 通过文本生成Barbie风格的3D人像

Xiaokun Sun, Zhenyu Zhang, Ying Tai, Hao Tang, Zili Yi, Jian Yang

机构 * School of Intelligence Science and Technology, Nanjing University(智能科学与技术学院,南京大学) School of Computer Science, Peking University(计算机科学学院,北京大学)

AI总结 DreamBarbie通过文本生成Barbie风格的3D人像,结合表达性3D表示和专门优化模型,实现高保真度的可动画和模拟人像生成。

Comments Accepted by TVCG 2026; Project page: https://xiaokunsun.github.io/DreamBarbie.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10135 2026-02-24 cs.CV

$R^2$-Mesh: Reinforcement Learning Powered Mesh Reconstruction via Geometry and Appearance Refinement

$R^2$-Mesh:基于几何和外观细化的强化学习驱动网格重建

Haoyang Wang, Liming Liu, Xinggong Zhang

机构 * Peking University(北京大学)

AI总结 $R^2$-Mesh通过强化学习结合NeRF渲染和在线视角选择,提升网格重建的几何和外观精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.07543 2026-02-24 cs.CV cs.CL

MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts

MathScape:在现实数学情境中评估多模态大语言模型

Hao Liang, Linzhuang Sun, Minxuan Zhou, Zirong Chen, Meiyi Qiang, Mingan Lin, Tianpeng Li, Fan Yang, Zenan Zhou, Wentao Zhang

机构 * Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) Nankai University(南开大学) Beijing Institute of Technology(北京理工大学) Baichuan Inc.(百度文心)

AI总结 MathScape是一个评估多模态大语言模型在现实数学情境中推理能力的新基准,揭示了现有模型在现实任务中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19870 2026-02-24 cs.CV

ApET: Approximation-Error Guided Token Compression for Efficient VLMs

ApET:基于近似误差的令牌压缩用于高效的视觉语言模型

Qiankun Ma, Ziyao Zhang, Haofei Wang, Jie Chen, Zhen Song, Hairong Zheng

机构 * Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所) Peng Cheng Laboratory(鹏城实验室) University of Chinese Academy of Sciences(中国科学院大学) Harbin Institute of Technology(哈尔滨工业大学) Peking University(北京大学)

AI总结 ApET通过近似误差指导的令牌压缩,在不使用注意力机制的情况下高效压缩视觉语言模型的令牌预算,提升推理效率。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19585 2026-02-24 cs.MM cs.AI

Tri-Subspaces Disentanglement for Multimodal Sentiment Analysis

三子空间解耦用于多模态情感分析

Chunlei Meng, Jiabin Luo, Zhenglin Yan, Zhenyu Yu, Rong Fu, Zhongxue Gan, Chun Ouyang

机构 * Fudan University(复旦大学) Peking University(北京大学) University of Macau(澳门大学)

AI总结 本文提出三子空间解耦框架,通过分解多模态特征为公共、子模态共享和私人子空间,提升多模态情感分析的性能和鲁棒性。

Comments This study has been Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19225 2026-02-24 cs.AI

Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training

基于接近性的多轮优化:LLM代理训练中的实用信用分配

Yangyi Fang, Jiaye Lin, Xiaoliang Fu, Cong Qin, Haolin Shi, Chang Liu, Peilin Zhao

机构 * Tsinghua University(清华大学) Fudan University(复旦大学) Peking University(北京大学) Lanzhou University(兰州大学) Tencent Inc.(腾讯公司) Shanghai Jiao Tong University(上海交通大学)

AI总结 ProxMO通过动态调整梯度强度和连续语义加权,提升LLM代理在多轮训练中的信用分配效率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19208 2026-02-24 cs.LG cs.AI

How to Allocate, How to Learn? Dynamic Rollout Allocation and Advantage Modulation for Policy Optimization

如何分配,如何学习?动态回放分配与优势调节用于策略优化

Yangyi Fang, Jiaye Lin, Xiaoliang Fu, Cong Qin, Haolin Shi, Chaowen Hu, Lu Pan, Ke Zeng, Xunliang Cai

机构 * Meituan(美团) Tsinghua University(清华大学) Fudan University(复旦大学) Peking University(北京大学)

AI总结 DynaMO通过动态回放分配和梯度感知优势调节,优化策略学习中的资源分配与梯度更新稳定性,提升数学推理任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19138 2026-02-24 q-bio.NC cs.AI

CRCC: Contrast-Based Robust Cross-Subject and Cross-Site Representation Learning for EEG

CRCC: 基于对比的跨受试者和跨站点表示学习

Xiaobin Wong, Zhonghua Zhao, Haoran Guo, Zhengyi Liu, Yu Wu, Feng Yan, Zhiren Wang, Sen Song

机构 * Tsinghua Laboratory of Brain(清华大学脑科学实验室) School of Biomedical Engineering, Tsinghua University(清华大学生物医学工程学院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Weixian College, Tsinghua University(清华大学魏先学院) School of Artificial Intelligence, Beijing University of Posts(北京邮电大学人工智能学院) School of Computer Science(计算机科学学院) Technology, Northwestern Polytechnical University, Xi'an, China(技术,西北工业大学,西安,中国) Beijing Huilongguan Hospital, Capital Medical University(北京回龙观医院,首都医科大学) Peking University Huilongguan Clinical Medical School(北京大学回龙观临床医学院)

AI总结 CRCC通过对比学习和对抗优化提升跨站点EEG表示学习的泛化能力,实现10.7个百分点的准确率提升。

Comments First edition

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17690 2026-02-24 cs.GR cs.AI cs.CV cs.LG cs.MM

DesignAsCode: Bridging Structural Editability and Visual Fidelity in Graphic Design Generation

DesignAsCode:在图形设计生成中弥合结构可编辑性与视觉保真度

Ziyuan Liu, Shizhao Sun, Danqing Huang, Yingdong Shi, Meisheng Zhang, Ji Li, Jingsong Yu, Jiang Bian

机构 * School of Software and Microelectronics, Peking University, Beijing, China(软件与微电子学院,北京大学,北京,中国) Microsoft(微软公司) ShanghaiTech University, Shanghai, China(上海交通大学,上海,中国)

AI总结 DesignAsCode 通过 HTML/CSS 程序化合成方法,实现了图形设计生成中结构可编辑性与视觉保真度的平衡,提升了设计质量和生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14208 2026-02-24 cs.LG math.OC stat.ML

Fast Catch-Up, Late Switching: Optimal Batch Size Scheduling via Functional Scaling Laws

快速追上,后期切换:通过函数缩放定律进行最优批量大小调度

Jinbo Wang, Binghui Li, Zhanpeng Zhou, Mingze Wang, Yuxuan Sun, Jiaqi Zhang, Xunliang Cai, Lei Wu

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Center for Machine Learning Research, Peking University(北京大学机器学习研究中心) School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(中国科学技术大学认知智能国家重点实验室) Meituan, Beijing(美团(北京)) AI for Science Institute, Beijing(北京人工智能科学研究院)

AI总结 本文通过函数缩放定律揭示了大规模深度学习中最优批量大小调度的理论机制,表明在困难任务中后期切换大批次可提升效率并减少数据消耗。

Comments 34 pages, accepted by ICLR 2026 as a conference paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05016 2026-02-24 cs.CV

Generative Neural Video Compression via Video Diffusion Prior

基于视频扩散先验的生成神经视频压缩

Qi Mao, Hao Cheng, Tinghan Yang, Libiao Jin, Siwei Ma

机构 * School of Information and Communication Engineering, Communication University of China(信息与通信工程学院,通信大学) School of Computer Science, Peking University(计算机学院,北京大学)

AI总结 GNVC-VD通过结合视频扩散先验和序列级去噪,实现了高效的生成神经视频压缩,显著减少了闪烁伪影并提升了感知质量。

Comments accept by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15690 2026-02-24 cs.CV cs.CL

MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping

通过动态专家跳过加速混合专家多模态大语言模型

Yushi Huang, Zining Wang, Zhihang Yuan, Yifu Ding, Ruihao Gong, Jinyang Guo, Xianglong Liu, Jun Zhang

机构 * Hong Kong University of Science and Technology(香港科技大学) Beihang University(北航) Peking University(北京大学)

AI总结 MoDES通过动态专家跳过机制提升多模态大语言模型的推理效率和准确性。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21196 2026-02-24 eess.AS cs.SD

PhoenixCodec: Taming Neural Speech Coding for Extreme Low-Resource Scenarios

PhoenixCodec: 镇压神经语音编码以应对极端低资源场景

Zixiang Wan, Haoran Zhao, Guochang Zhang, Runqiang Han, Jianqiang Wei, Yuexian Zou

机构 * Audio Innovation Technology Department, Anker Inc(安ker公司音频创新技术部) Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东省超高清沉浸媒体技术重点实验室) Peking University(北京大学)

AI总结 PhoenixCodec通过优化架构和训练策略,在极端低资源条件下实现了高效的语音编码与解码,尤其在1 kbps速率下表现出色。

Comments Accepted by ICASSP 2026; 5 pages, 1 figure, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.19418 2026-02-24 cs.CV cs.AI eess.IV

DEFNet: Multitasks-based Deep Evidential Fusion Network for Blind Image Quality Assessment

DEFNet:基于多任务的深度证据融合网络用于盲图像质量评估

Yiwei Lou, Yuanpeng He, Rongchao Zhang, Yongzhi Cao, Hanpin Wang, Yu Huang

机构 * Key Laboratory of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术重点实验室(北京大学)教育部) School of Computer Science, Peking University(计算机学院(北京大学))

AI总结 DEFNet通过多任务优化和证据学习改进盲图像质量评估,提升鲁棒性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10065 2026-02-24 cs.CV

MoVieS: Motion-Aware 4D Dynamic View Synthesis in One Second

MoVieS: 一秒钟内基于运动感知的4D动态视角合成

Chenguo Lin, Yuchen Lin, Panwang Pan, Yifan Yu, Tao Hu, Honglei Yan, Katerina Fragkiadaki, Yadong Mu

机构 * Peking University(北京大学) ByteDance(字节跳动) Carnegie Mellon University(卡内基梅隆大学)

AI总结 MoVieS通过一秒钟内从单目视频重建4D动态场景,实现外观、几何和运动的统一建模,并支持多种零样本应用。

Comments Project page: https://chenguolin.github.io/projects/MoVieS; Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04638 2026-02-24 cs.CV cs.AI

Learning Street View Representations with Spatiotemporal Contrast

利用时空对比学习街道视图表示

Yong Li, Yingjing Huang, Gengchen Mai, Fan Zhang

机构 * Institute of Remote Sensing and Geographic Information System, School of Earth and Space Sciences, Peking University(遥感与地理信息系统研究所,地球与空间科学学院,北京大学) Department of Civil and Environmental Engineering, The Hong Kong University of Science and Technology(土木与环境工程系,香港科学与技术大学) SEAI Lab, Department of Geography and the Environment, University of Texas at Austin(SEAI实验室,地理与环境系,德克萨斯大学奥斯汀分校)

AI总结 本文提出一种基于时空对比学习的街道视图表示学习方法,以提升城市环境相关下游任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.13877 2026-02-24 cs.RO cs.AI

RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation

RoboMIND:机器人操作多躯体智能规范数据集基准

Kun Wu, Chengkai Hou, Jiaming Liu, Zhengping Che, Xiaozhu Ju, Zhuqin Yang, Meng Li, Yinuo Zhao, Zhiyuan Xu, Guang Yang, Shichao Fan, Xinhua Wang, Fei Liao, Zhen Zhao, Guangyu Li, Zhao Jin, Lecheng Wang, Jilei Mao, Ning Liu, Pei Ren, Qiang Zhang, Yaoxu Lyu, Mengzhen Liu, Jingyang He, Yulin Luo, Zeyu Gao, Chenxuan Li, Chenyang Gu, Yankai Fu, Di Wu, Xingyu Wang, Sixiang Chen, Zhenyu Wang, Pengju An, Siyuan Qian, Shanghang Zhang, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 RoboMIND是一个大规模多躯体机器人操作数据集,包含107万条演示轨迹和5000条失败示例,用于提升机器人模仿学习和多任务性能。

Comments 21 pages, 17 figures, Robotics: Science and Systems 2025

Journal ref Robotics: Science and Systems XXI (RSS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08957 2026-02-24 cs.RO cs.AI

Learning from Imperfect Demonstrations with Self-Supervision for Robotic Manipulation

通过自监督学习从不完美示范中学习用于机器人操作

Kun Wu, Ning Liu, Zhen Zhao, Di Qiu, Jinming Li, Zhengping Che, Zhiyuan Xu, Jian Tang

机构 * Syracuse University(苏利文大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心) Peking University(北京大学) Shanghai University(上海大学)

AI总结 本文提出SSDF框架,通过自监督学习利用不完美示范数据提升机器人操作任务的性能。

Comments 8 pages, 4 figures

Journal ref 2025 IEEE International Conference on Robotics and Automation (ICRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18830 2026-02-24 cs.CV

Spatial-Temporal State Propagation Autoregressive Model for 4D Object Generation

空间-时间状态传播自回归模型用于4D物体生成

Liying Yang, Jialun Liu, Jiakui Hu, Chenhao Guan, Haibin Huang, Fangqiu Yi, Chi Zhang, Yanyan Liang

机构 * Macau University of Science and Technology(澳门科技大学) TeleAI Peking University(北京大学)

AI总结 4DSTAR通过空间-时间状态传播自回归模型和4D VQ-VAE生成具有时间-空间一致性的4D物体,实现高质量的4D物体生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18758 2026-02-24 cs.CR cs.AI

UFO: Unlocking Ultra-Efficient Quantized Private Inference with Protocol and Algorithm Co-Optimization

UFO: 解锁超高效的量化隐私推理与协议和算法联合优化

Wenxuan Zeng, Chao Yang, Tianshi Xu, Bo Zhang, Changrui Ren, Jin Dong, Meng Li

机构 * Institute for Artificial Intelligence, Peking University, China(人工智能研究院,北京大学) School of Software and Microelectronics, Peking University, China(软件与微电子学院,北京大学) School of Integrated Circuits, Peking University, China(集成电路学院,北京大学) Beijing Academy of Blockchain and Edge Computing(北京区块链与边缘计算研究院)

AI总结 UFO通过联合优化协议和算法,解决了隐私推理中卷积层的通信和精度问题,实现高效量化推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18447 2026-02-24 cs.CL cs.AI

ConfSpec: Efficient Step-Level Speculative Reasoning via Confidence-Gated Verification

ConfSpec:通过置信度门控验证实现高效的步骤级推测推理

Siran Liu, Cyril Y. He

机构 * Peking University(北京大学) ScitiX AI

AI总结 ConfSpec通过置信度门控验证框架,在保持准确性的同时,实现高效步骤级推测推理,达到2.24倍的端到端加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10471 2026-02-24 cs.SE cs.CL

TestExplora: Benchmarking LLMs for Proactive Bug Discovery via Repository-Level Test Generation

TestExplora: 通过仓库级测试生成对LLMs进行主动bug发现的基准测试

Steven Liu, Jane Luo, Xin Zhang, Aofan Liu, Hao Liu, Jie Wu, Ziyang Huang, Yangyu Huang, Yu Kang, Scarlett Li

机构 * Microsoft(微软公司) School of ECE, Peking University(北京大学电子工程学院) Tsinghua University(清华大学) Chinese Academy of Sciences(中国科学院)

AI总结 TestExplora通过仓库级测试生成评估LLMs在主动bug发现中的能力,揭示了当前模型在复杂交互和代理探索方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07854 2026-02-24 cs.CV

Geometry-Aware Rotary Position Embedding for Consistent Video World Model

面向一致视频世界模型的几何感知旋转位置嵌入

Chendong Xiang, Jiajun Liu, Jintao Zhang, Xiao Yang, Zhengwei Fang, Shizun Wang, Zijun Wang, Yingtian Zou, Hang Su, Jun Zhu

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, BNRist Center, THBI Lab, Tsinghua-Bosch Joint ML Center, Tsinghua University(清华大学计算机科学与技术系、人工智能研究院、BNRist中心、THBI实验室、清华-博世联合机器学习中心、清华大学) Gaoling School of Artificial Intelligence, Renmin University of China(北京人民大学人工智能学院) National University of Singapore(新加坡国立大学) Peking University(北京大学) School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院)

AI总结 本文提出ViewRope和几何感知帧稀疏注意力,通过引入相机射线方向提升视频世界模型的长期一致性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏