arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Northeastern University(东北大学)

共收录 1238
2506.24119 2026-03-03 cs.AI cs.CL cs.LG

SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning

SPIRAL:通过多智能体多轮强化学习进行零和游戏的自我对战以促进推理

Bo Liu, Leon Guertler, Simon Yu, Zichen Liu, Penghui Qi, Daniel Balcells, Mickel Liu, Cheston Tan, Weiyan Shi, Min Lin, Wee Sun Lee, Natasha Jaques

机构 * National University of Singapore(新加坡国立大学) Northeastern University(东北大学) Sea AI Lab(Sea AI 实验室) Centre for Frontier AI Research (CFAR), A*STAR(前沿人工智能研究中心(CFAR),A*STAR) Plastic Labs University of Washington(华盛顿大学)

AI总结 SPIRAL通过多智能体多轮强化学习在零和游戏中促进推理,展示了模型在多个基准测试中的显著性能提升。

Comments Accepted at ICLR 2026. Code: https://github.com/spiral-rl/spiral

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01297 2026-03-03 cs.LG cs.CL

I Can't Believe It's Not Robust: Catastrophic Collapse of Safety Classifiers under Embedding Drift

我难以相信它不稳健:在嵌入漂移下安全分类器的灾难性崩溃

Subramanyam Sahoo, Vinija Jain, Divya Chaudhary, Aman Chadha

机构 * Independent(独立研究者) Meta AI AWS Generative AI Innovation Center, Amazon Web Services(AWS生成式AI创新中心,亚马逊网络服务) Northeastern University, Seattle, WA, USA(东北大学,西雅图,华盛顿州,美国) Stanford University(斯坦福大学)

AI总结 研究发现嵌入漂移导致安全分类器性能大幅下降,揭示了生产AI安全架构的脆弱性并挑战了安全机制的转移假设。

Comments Accepted at the ICBINB: Where LLMs Need to Improve workshop at ICLR 2026. 12 pages and 3 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15863 2026-03-03 cs.CL cs.AI

PolySkill: Learning Generalizable Skills Through Polymorphic Abstraction

PolySkill: 通过多态抽象学习通用技能

Simon Yu, Gang Li, Weiyan Shi, Peng Qi

机构 * Northeastern University(东北大学) Uniphore

AI总结 PolySkill通过多态抽象方法使智能体能学习通用且可组合的技能,提升技能重用性和成功率,减少步骤并增强自我探索能力。

Comments 29 pages, 6 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00846 2026-03-03 cs.IR cs.LG

Tiny-Critic RAG: Empowering Agentic Fallback with Parameter-Efficient Small Language Models

Tiny-Critic RAG:赋能代理回退的参数高效小型语言模型

Yichao Wu, Penghao Liang, Yafei Xiang, Mengwei Yuan, Jianan Liu, Jing Yang, Xianyou Li, Weiran Yan

机构 * Northeastern University(东北大学) Washington University in St. Louis(华盛顿大学圣路易斯分校) New York University(纽约大学)

AI总结 Tiny-Critic RAG通过参数高效的Small Language Model实现低延迟的二进制路由,有效降低代理部署成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00177 2026-03-03 cs.LG cs.CL

Can SAEs reveal and mitigate racial biases of LLMs in healthcare?

稀疏自编码器能否揭示并缓解LLM在医疗中的种族偏见?

Hiba Ahsan, Byron C. Wallace

机构 * Northeastern University(东北大学)

AI总结 本文研究了稀疏自编码器在揭示和缓解LLM医疗应用中种族偏见方面的作用,发现其在简单任务中有效,但在复杂任务中效果有限。

Comments camera-ready ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22339 2026-03-03 cs.CV

CircuitSense: A Hierarchical MLLM Benchmark Bridging Visual Comprehension and Symbolic Reasoning in Engineering Design Process

CircuitSense: 一种层次化的MLLM基准,连接视觉理解和符号推理在工程设计过程

Arman Akbari, Jian Gao, Yifei Zou, Mei Yang, Jinru Duan, Dmitrii Torbunov, Yanzhi Wang, Yihui Ren, Xuan Zhang

机构 * Northeastern University(东北大学) Brookhaven National Laboratory(布鲁克海文国家实验室)

AI总结 CircuitSense提出一个层次化基准,评估工程设计中视觉理解与符号推理的能力,揭示闭源模型在符号推导上的不足,强调数学理解对电路综合的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00024 2026-03-03 cs.CL cs.AI

Personalization Increases Affective Alignment but Has Role-Dependent Effects on Epistemic Independence in LLMs

个性化增强了情感一致性,但对LLM中的认知独立性有角色依赖性的影响

Sean W. Kelley, Christoph Riedl

机构 * Northeastern University, Boston, MA, USA(东北大学)

AI总结 本研究探讨了个性化对LLM情感一致性与认知独立性的影响,发现其效果依赖于角色设定,且通过实验验证了个性化条件对模型行为的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23898 2026-03-02 cs.CV cs.AI cs.CL

Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks

Ref-Adv:探索提及表达任务中的多模态大语言模型视觉推理

Qihua Dong, Kuo Yang, Lin Ju, Handong Zhao, Yitian Zhang, Yizhou Wang, Huimin Zeng, Jianglin Lu, Yun Fu

机构 * Northeastern University(东北大学)

AI总结 Ref-Adv 是一个旨在评估多模态大语言模型视觉推理能力的基准,通过增加表达复杂性和减少干扰项,揭示模型在视觉推理和 grounding 方面的不足。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01840 2026-03-02 cs.CL

Read As Human: Compressing Context via Parallelizable Close Reading and Skimming

读作人类:通过可并行的近读与略读压缩上下文

Jiwei Tang, Shilei Liu, Zhicheng Zhang, Qingsong Lv, Runsong Zhao, Tingwei Lu, Langming Liu, Haibin Chen, Yujin Yuan, Hai-Tao Zheng, Wenbo Su, Bo Zheng

机构 * Tsinghua University(清华大学) Future Living Lab of Alibaba(阿里巴巴未来生活实验室) Northeastern University, China(中国东北大学)

AI总结 RAM通过可并行的近读与略读策略,有效压缩上下文,提升长输入处理效率,实现性能与可解释性的双重优化。

Comments 13 pages,5 figures (Compared with v1, the author affiliations have been corrected.)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06940 2026-03-02 cs.DB cs.AI

VISTA: Knowledge-Driven Vessel Trajectory Imputation with Repair Provenance

VISTA: 基于知识的船舶轨迹补全与修复溯源

Hengyu Liu, Tianyi Li, Haoyu Wang, Kristian Torp, Tiancheng Zhang, Yushuai Li, Christian S. Jensen

机构 * Department of Computer Science, Aalborg University, Denmark(计算机科学系,奥胡斯大学,丹麦) School of Computer Science and Engineering, Northeastern University, Shenyang, China(计算机科学与工程学院,东北大学,沈阳,中国)

AI总结 VISTA通过基于知识的可解释方法实现船舶轨迹补全,生成修复溯源以提升下游决策的可信度和效率。

Comments 24 pages, 14 figures, 4 algorithms, 8 tables. Code available at https://github.com/hyLiu1994/VISTA

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23199 2026-02-27 cs.AI

SC-Arena: A Natural Language Benchmark for Single-Cell Reasoning with Knowledge-Augmented Evaluation

SC-Arena: 一种用于具有知识增强评估的单细胞推理的自然语言基准

Jiahao Zhao, Feng Jiang, Shaowei Qin, Zhonghui Zhang, Junhao Liu, Guibing Guo, Hamid Alinejad-Rokny, Min Yang

机构 * Software College, Northeastern University(东北大学软件学院) Shenzhen University of Advanced Technology(深圳大学先进技术学院) Shenzhen Key Laboratory for High Performance Data Mining(深圳高性能数据挖掘重点实验室) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院) University of California, Irvine(加州大学 Irvine 分校) School of Biomedical Engineering, UNSW Sydney(悉尼大学生物医学工程学院)

AI总结 SC-Arena通过知识增强评估框架,为单细胞生物学中的LLM提供统一且可解释的评估方法,提升生物正确性和推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22718 2026-02-27 cs.AI cs.DC

RLHFless: Serverless Computing for Efficient RLHF

RLHFless:用于高效RLHF的无服务器计算

Rui Wei, Hanfei Yu, Shubham Jain, Yogarajan Sivakumar, Devesh Tiwari, Jian Li, Seung-Jong Park, Hao Wang

机构 * Stevens Institute of Technology Northeastern University Stony Brook University Missouri University of Science \& Technology

AI总结 RLHFless通过无服务器计算环境实现高效同步RLHF训练,预计算共享前缀并采用成本感知的演员扩展策略,提升训练速度并降低计算成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21294 2026-02-27 cs.CL

UPDESH: Synthesizing Grounded Instruction Tuning Data for 13 Indic Languages

UPDESH: 为13种印地语系语言合成基于现实的指令微调数据

Pranjal A. Chitale, Varun Gumma, Sanchit Ahuja, Prashant Kodali, Manan Uppadhyay, Deepthi Sudharsan, Sunayana Sitaram

机构 * Microsoft Corporation(微软公司) Nanyang Technological University(南洋理工大学) Northeastern University(东北大学) Independent Researcher(独立研究者)

AI总结 UPDESH通过基于维基百科内容的自下而上方法,生成高质量的多语言指令数据,提升多语言AI系统的文化适应性与性能。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22841 2026-02-27 cs.CV

GmNet: Revisiting Gating Mechanisms From A Frequency View

GmNet:从频率视角重新审视门机制

Yifan Wang, Xu Ma, Yitian Zhang, Zhongruo Wang, Sung-Cheol Kim, Vahid Mirjalili, Vidya Renganathan, Yun Fu

机构 * Northeastern University(东北大学) UC Davis(加州大学戴维斯分校) FM-Global(FM-全球)

AI总结 GmNet从频率视角重新审视门机制,提出轻量模型以高效利用频率成分信息,减少低频偏见,提升图像分类性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22542 2026-02-27 cs.HC cs.RO

Relational Appliances: A Robot in the Refrigerator for Home-Based Health Promotion

关系型家电:用于家庭健康促进的冰箱中的机器人

Timothy Bickmore, Mehdi Arjmand, Yunus Terzioglu

机构 * Northeastern University(东北大学)

AI总结 本研究提出了一种冰箱中的拟人化机器人,通过个性化互动促进家庭健康,结果显示机器人能有效提升用户对健康零食选择的意识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22405 2026-02-27 cs.LG cs.CV

MolFM-Lite: Multi-Modal Molecular Property Prediction with Conformer Ensemble Attention and Cross-Modal Fusion

MolFM-Lite:基于构象集合注意力和跨模态融合的多模态分子性质预测

Syed Omer Shah, Mohammed Maqsood Ahmed, Danish Mohiuddin Mohammed, Shahnawaz Alam, Mohd Vahaj ur Rahman

机构 * Department of Computer Science and Engineering, University at Buffalo(布法罗大学计算机科学与工程系) Khoury College of Computer Sciences, Northeastern University(东北大学科赫里学院) Department of Computer Science, Muffakham Jah College of Engineering and Technology(穆法卡姆·贾赫工程与技术学院计算机科学系) Department of Computer Science and Artificial Intelligence, Muffakham Jah College of Engineering and Technology(穆法卡姆·贾赫工程与技术学院计算机科学与人工智能系)

AI总结 MolFM-Lite通过跨模态融合和构象集合注意力机制,提升多模态分子性质预测的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16902 2026-02-26 cs.CL cs.LG

In-Context Algebra

上下文中的代数

Eric Todd, Jannik Brinkmann, Rohit Gandikota, David Bau

机构 * Northeastern University(东北大学) TU Clausthal(图鲁姆大学)

AI总结 本研究探讨了transformer在上下文代数任务中学习的机制,发现模型能通过动态变量分配实现符号推理。

Comments ICLR 2026. 35 pages, 22 figures. Code and data at https://algebra.baulab.info

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06966 2026-02-26 cs.LG cs.AI cs.CY

Machine Unlearning Doesn't Do What You Think: Lessons for Generative AI Policy and Research

机器去学习并不如你所想:生成式AI政策与研究的启示

A. Feder Cooper, Christopher A. Choquette-Choo, Miranda Bogen, Kevin Klyman, Matthew Jagielski, Katja Filippova, Ken Liu, Alexandra Chouldechova, Jamie Hayes, Yangsibo Huang, Eleni Triantafillou, Peter Kairouz, Nicole Elyse Mitchell, Niloofar Mireshghallah, Abigail Z. Jacobs, James Grimmelmann, Vitaly Shmatikov, Christopher De Sa, Ilia Shumailov, Andreas Terzis, Solon Barocas, Jennifer Wortman Vaughan, danah boyd, Yejin Choi, Sanmi Koyejo, Fernando Delgado, Percy Liang, Daniel E. Ho, Pamela Samuelson, Miles Brundage, David Bau, Seth Neel, Hanna Wallach, Amy B. Cyphert, Mark A. Lemley, Nicolas Papernot, Katherine Lee

机构 * The GenLaw Center(GenLaw中心) Microsoft Research(微软研究院) Stanford University(斯坦福大学) Google DeepMind(谷歌DeepMind) Center for Democracy & Technology(民主与科技中心) Princeton(普林斯顿) Google(谷歌) University of Washington(华盛顿大学) University of Michigan(密歇根大学) Cornell Tech(康奈尔科技) Cornell Law School(康奈尔法学院) Cornell University(康奈尔大学) Lighthouse Stanford Law School(斯坦福法学院) UC Berkeley(伯克利大学) Independent(独立研究者) Northeastern University(东北大学) Harvard Business School(哈佛商学院) W. Virginia University College of Law(维珍尼亚大学法学院)

AI总结 本文指出机器去学习并非通用解决方案,揭示其在生成式AI政策与研究中的局限性。

Comments NeurIPS 2025 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21327 2026-02-26 cs.LG cs.AI cs.CY

Equitable Evaluation via Elicitation

通过 elicitation 实现公平评估

Elbert Du, Cynthia Dwork, Lunjia Hu, Reid McIlroy-Young, Han Shao, Linjun Zhang

机构 * Harvard University(哈佛大学) Northeastern University(东北大学) University of Maryland(马里兰大学) Rutgers University(罗格斯大学)

AI总结 本文提出了一种交互式AI系统,通过elicitation准确评估技能并减少自我报告偏见,提升公平性。

Comments 27 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21226 2026-02-26 cs.CL cs.AI

IslamicLegalBench: Evaluating LLMs Knowledge and Reasoning of Islamic Law Across 1,200 Years of Islamic Pluralist Legal Traditions

伊斯兰法律基准:评估LLMs在1200年伊斯兰多元法律传统中的知识和推理能力

Ezieddin Elmahjub, Junaid Qadir, Abdullah Mushtaq, Rafay Naeem, Ibrahim Ghaznavi, Waleed Iqbal

机构 * Qatar University(卡塔尔大学) Information Technology University(信息技术大学) Northeastern University(东北大学) Queen Mary University of London(伦敦女王学院)

AI总结 伊斯兰法律基准评估LLMs在伊斯兰法推理中的能力,揭示其在复杂任务中存在显著缺陷,强调基础知识缺失对AI性能的影响。

Comments This manuscript has been submitted for review to Artificial Intelligence \& Law

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26784 2026-02-26 cs.AI

LLMs Process Lists With General Filter Heads

LLMs 处理列表时使用通用过滤头

Arnab Sen Sharma, Giordano Rogers, Natalie Shapira, David Bau

机构 * Khoury College of Computer Sciences, Northeastern University(克劳利计算机科学学院,东北大学)

AI总结 本研究揭示了LLMs在处理列表任务时通过通用过滤头实现过滤操作的机制,展示了其与函数式编程中过滤策略的相似性。

Comments Code and data at https://filter.baulab.info/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21175 2026-02-25 cs.CV

Seeing Through Words: Controlling Visual Retrieval Quality with Language Models

通过文字看见:利用语言模型控制视觉检索质量

Jianglin Lu, Simon Jenni, Kushal Kafle, Jing Shi, Handong Zhao, Yun Fu

机构 * Adobe Research(Adobe研究部) Northeastern University(东北大学)

AI总结 通过生成语言模型扩展短查询并控制图像质量,提升视觉检索效果和可控性

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20159 2026-02-25 cs.CV cs.AI cs.LG cs.MM cs.RO

A Very Big Video Reasoning Suite

一个非常大的视频推理套件

Maijunxian Wang, Ruisi Wang, Juyi Lin, Ran Ji, Thaddäus Wiedemer, Qingying Gao, Dezhi Luo, Yaoyao Qian, Lianyu Huang, Zelong Hong, Jiahui Ge, Qianli Ma, Hang He, Yifan Zhou, Lingzi Guo, Lantao Mei, Jiachen Li, Hanwen Xing, Tianqi Zhao, Fengyuan Yu, Weihang Xiao, Yizheng Jiao, Jianheng Hou, Danyang Zhang, Pengcheng Xu, Boyang Zhong, Zehong Zhao, Gaoyun Fang, John Kitaoka, Yile Xu, Hua Xu, Kenton Blacutt, Tin Nguyen, Siyuan Song, Haoran Sun, Shaoyue Wen, Linyang He, Runming Wang, Yanzhi Wang, Mengyue Yang, Ziqiao Ma, Raphaël Millière, Freda Shi, Nuno Vasconcelos, Daniel Khashabi, Alan Yuille, Yilun Du, Ziming Liu, Bo Li, Dahua Lin, Ziwei Liu, Vikash Kumar, Yijiang Li, Lei Yang, Zhongang Cai, Hokin Deng

机构 * University of California, Berkeley(加州大学伯克利分校) Nanyang Technological University(南洋理工大学) Northeastern University(东北大学) University of Tübingen(图宾根大学) Johns Hopkins University(约翰霍普金斯大学) University of Michigan(密歇根大学) University of Southern California(南加州大学) Washington University in St. Louis(圣路易斯华盛顿大学) Shanghai Jiao Tong University(上海交通大学) East China Normal University(华东师范大学) Stanford University(斯坦福大学) University of Texas at Austin(得克萨斯大学奥斯汀分校) University of California, Los Angeles(加州大学洛杉矶分校) Cornell University(康奈尔大学) San Jose State University(圣何塞州立大学) University of California, Irvine(加州大学尔湾分校) Technical University of Munich(慕尼黑技术大学) University of California, San Diego(加州大学圣地亚哥分校) Imperial College London(伦敦帝国学院) University of Wisconsin--Madison(威斯康星大学麦迪逊分校) University of Edinburgh(爱丁堡大学) Hong Kong University of Science(香港科学大学) New York University(纽约大学) Auburn University(阿伯丁大学) Columbia University(哥伦比亚大学) University of Bristol(布里斯托大学) University of Waterloo(滑铁卢大学) The Chinese University of Hong Kong(香港中文大学) Carnegie Mellon University(卡内基梅隆大学) University of Oxford(牛津大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

AI总结 VBVR数据集和评估框架旨在解决视频推理能力研究中的大规模数据缺乏问题,通过大规模实验观察到对未见任务的泛化能力。

Comments Homepage: https://video-reason.com/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14685 2026-02-25 cs.CL

Language Models use Lookbacks to Track Beliefs

语言模型使用回溯来跟踪信念

Nikhil Prakash, Natalie Shapira, Arnab Sen Sharma, Christoph Riedl, Yonatan Belinkov, Tamar Rott Shaham, David Bau, Atticus Geiger

机构 * Northeastern University(东北大学) Technion(技术学院) MIT CSAIL(麻省理工学院计算机科学与人工智能实验室) Goodfire Pr(Ai) 2 R Group(Pr(Ai) 2 R集团)

AI总结 本研究揭示语言模型通过回溯机制跟踪角色信念的算法模式,通过构建CausalToM数据集,分析LM在因果中介和抽象中的推理能力,并探讨可见性对信念更新的影响。

Comments 38 pages, 50 figures. Code and data at https://belief.baulab.info/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20312 2026-02-25 cs.CV

N4MC: Neural 4D Mesh Compression

N4MC:神经4D网格压缩

Guodong Chen, Huanshuo Dong, Mallesham Dasari

机构 * Northeastern University(东北大学) University of Science and Technology of China(中国科学技术大学)

AI总结 N4MC通过神经4D压缩框架高效压缩时间变化网格序列,利用帧间压缩技术提升时间一致性,并在率失真性能上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20232 2026-02-25 cs.LG physics.chem-ph

Coupled Cluster con MōLe: Molecular Orbital Learning for Neural Wavefunctions

耦合簇与莫勒:用于神经波函数的分子轨道学习

Luca Thiede, Abdulrahman Aldossary, Andreas Burger, Jorge Arturo Campos-Gonzalez-Angulo, Ning Wang, Alexander Zook, Melisa Alkan, Kouhei Nakaji, Taylor Lee Patti, Jérôme Florian Gonthier, Mohammad Ghazi Vakili, Alán Aspuru-Guzik

机构 * Key Lab of Electromagnetic Processing of Materials, Ministry of Education, Northeastern University(电磁材料电磁加工重点实验室,教育部,东北大学)

AI总结 MōLe通过直接预测耦合簇的核心数学对象,实现高效分子轨道学习,提升量子化学计算的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23115 2026-02-25 cs.LG cs.AI cs.CL

RHYTHM: Reasoning with Hierarchical Temporal Tokenization for Human Mobility

RHYTHM:基于层次时间标记的人类移动推理

Haoyu He, Haozheng Luo, Yan Chen, Qi R. Wang

机构 * Northeastern University(东北大学) Northwestern University(西北大学)

AI总结 RHYTHM通过层次时间标记框架提升人类移动预测的准确性和效率,实现更高效的时空推理与预测。

Comments Advances in Neural Information Processing Systems 39 (NeurIPS) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17842 2026-02-24 cs.CL

Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning

Shop-R1: 通过强化学习奖励大语言模型模拟在线购物中的人类行为

Yimeng Zhang, Tian Wang, Jiri Gesi, Ziyi Wang, Yuxuan Lu, Jiacheng Lin, Sinong Zhan, Vianne Gao, Ruochen Jiao, Junze Liu, Kun Qian, Yuxin Tang, Ran Xue, Houyu Zhang, Qingjun Cui, Yufan Guo, Dakuo Wang

机构 * Michigan State University(密歇根州立大学) Amazon(亚马逊) Northeastern University(东北大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Northwestern University(西北大学)

AI总结 Shop-R1通过强化学习框架提升大语言模型在在线购物场景中模拟人类行为的推理能力,实现65%以上的性能提升。

Comments Accepted by ICLR 2026. The project page is available at https://damon-demon.github.io/shop-r1.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19611 2026-02-24 cs.CV

RAID: Retrieval-Augmented Anomaly Detection

RAID: 基于检索的异常检测

Mingxiu Cai, Zhe Zhang, Gaochang Wu, Tianyou Chai, Xiatian Zhu

机构 * State Key Laboratory of Synthetical Automation for Process Industries, Northeastern University(过程工业综合自动化 state key laboratory,东北大学)

AI总结 RAID提出了一种基于检索的无监督异常检测框架,通过利用检索到的正常样本指导噪声抑制,实现鲁棒的异常检测和定位。

Journal ref CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19038 2026-02-24 cs.RO cs.HC

A Checklist for Deploying Robots in Public: Articulating Tacit Knowledge in the HRI Community

公共部署机器人的一份清单:在人机交互社区中阐明隐性知识

Claire Liang, Franziska Babel, Hannah Pelikan, Sydney Thompson, Xiang Zhi Tan

机构 * Massachusetts Institute of Technology(麻省理工学院) Yale University(耶鲁大学) Northeastern University(东北大学)

AI总结 本文提出一份公开可用的机器人公共部署清单,旨在通过整合社区专业知识,帮助研究人员避免常见错误并提升部署效率。

详情

展开后加载摘要…

URL PDF HTML 收藏