arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Northeastern University(东北大学)

共收录 1238
2607.05645 2026-07-08 cs.LG physics.ao-ph 新提交

Domain-Adaptive Climate Downscaling Under Temporal Distribution Shift

时间分布变化下的域自适应气候降尺度

Shuochen Wang, Nishant Yadav, Auroop R. Ganguly

机构 * Northeastern University(东北大学) Microsoft(微软公司) The Institute for Experiential AI, Northeastern University(东北大学体验式人工智能研究所)

AI总结 研究针对美国大陆日温度降尺度的时间分布变化问题,提出时间域自适应降尺度框架,结合历史数据监督HR重建与域对齐,实验表明该模型优于其他方法,能提升HR气候预测稳健性,尤其在特定区域和条件下效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05315 2026-07-08 cs.RO 新提交

Socially-Aware Autonomous Doorway Traversal and Payload Delivery for Emergency Assistance

面向应急援助的具备社会感知能力的自主过门与物资递送机器人系统

Andrew Snowdy, Ananya Trivedi, Sarvesh Prajapati, Lorena Maria Genua, Taskin Padir

机构 * Department of Electrical and Computer Engineering, Northeastern University(美国东北大学电气与计算机工程系) Northeastern University(美国东北大学)

AI总结 针对机器人辅助应急疏散场景,以行为树为核心框架实现社会感知自主过门与救援物资递送功能,经多场景实验验证系统可靠性,为应急响应机器人提供实用基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00860 2026-07-08 cs.SI cs.AI cs.CL

GenPT: Beyond Self-Report for Reliable LLM Psychometrics via Generative Projective Testing

GenPT:通过生成式投射测试实现超越自我报告的可靠LLM心理测量

Ming Wang, Shuang Wu, Bixuan Wang, Lu Lin, Yuxin Chen, Xiaocui Yang, Daling Wang, Shi Feng, Yifei Zhang, Yufan Sun

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) School of Computing and Information Systems, Singapore Management University(新加坡管理学院计算机与信息学院) Mental Health Education Center, Northeastern University(东北大学心理健康教育中心) School of Psychology, Northeast Normal University(东北师范大学心理学系) Faculty of psychology, Southwest University(西南大学心理学系) School of Sociology and Psychology, Central University of Finance and Economics(中央财经大学社会学与心理学学院) College of Arts, Northeastern University(东北大学艺术学院)

AI总结 针对自我报告问卷在人格化智能体心理测量中存在的训练语料污染和方向性偏差问题,提出GenPT方法,通过改编投射测试范式并构建三阶段评估流程,实现了更可靠的心理状态测量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15600 2026-07-08 cs.RO cs.AI cs.CL cs.CV 版本更新

From Passive Observer to Active Critic: Reinforcement Learning Elicits Process Reasoning for Robotic Manipulation

从被动观察者到主动批评者:强化学习激发机器人操作的过程推理

Yibin Liu, Yaxing Lyu, Daqi Gao, Zhixuan Liang, Weiliang Tang, Shilong Mu, Xiaokang Yang, Yao Mu

机构 * Shanghai Jiao Tong University(上海交通大学) Northeastern University(东北大学) Xiamen University Malaysia(厦门大学马来西亚分校) The University of Hong Kong(香港大学) The Chinese University of Hong Kong(香港中文大学) Xspark AI

AI总结 本文提出PRIMO R1框架,通过强化学习使视频MLLMs成为主动批评者,提升机器人操作中长期任务的监督准确性,实验表明其在过程推理和零样本泛化方面表现优异。

Comments Accepted to ECCV 2026. 32 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09696 2026-07-08 cs.CV 版本更新

ZeroBench: An Impossible Visual Benchmark for Contemporary Large Multimodal Models

ZeroBench:当代大型多模态模型的一个不可能的视觉基准测试

Jonathan Roberts, Mohammad Reza Taesiri, Ansh Sharma, Akash Gupta, Samuel Roberts, Ioana Croitoru, Simion-Vlad Bogolin, Jialu Tang, Florian Langer, Vyas Raina, Vatsal Raina, Hanyi Xiong, Vishaal Udandarao, Jingyi Lu, Shiyang Chen, Sam Purkis, Tianshuo Yan, Wenye Lin, Gyungin Shin, Qiaochu Yang, Anh Totti Nguyen, David I. Atkinson, Aaditya Baranwal, Alexandru Coca, Mikah Dang, Sebastian Dziadzio, Jakob D. Kunz, Kaiqu Liang, Alexander Lo, Brian Pulfer, Steven Walton, Charig Yang, Kai Han, Samuel Albanie

机构 * University of Cambridge(剑桥大学) University of Alberta(阿尔伯塔大学) The University of Hong Kong(香港大学) University of Oxford(牛津大学) Northeastern University(东北大学) Astadeus College of Southern Maryland(马里兰州南部学院) University of Geneva(日内瓦大学) University of Oregon(俄勒冈大学)

AI总结 针对大型多模态模型在图像解释方面不足但在现有视觉基准测试中优势易逝的问题,引入通过对抗过滤策划的ZeroBench基准测试,评估多个模型,展现其潜力并公开测试内容,为模型视觉能力评估提供长期有效的新基准。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05292 2026-07-07 cs.LG cs.AI cs.CV 新提交

Air Quality Downscaling with Station-Guided Pseudo-Supervision

基于站点引导伪监督的空气质量降尺度方法

Guorun Wang, Simone Foti, Andreas D. Demou, Leonidas Kotoulas, Theodoros Christoudias, Alexandros Koliousis, Mihalis Nicolaou, Stefanos Zafeiriou

机构 * Imperial College London(伦敦帝国理工学院) The Cyprus Institute(塞浦路斯研究所) Northeastern University London(伦敦东北大学) University of Cyprus(塞浦路斯大学)

AI总结 针对粗粒度大气场超分PM₂.₅的空间支持失配问题,该研究结合多源侧信息,提出站点引导框架实现高分辨率PM₂.₅降尺度与偏差校正,有效还原细粒度空间结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02829 2026-07-07 cs.LG 新提交

Less Tokens, Better Forecasts: Sparse Residual Routing for Efficient Weather Prediction

更少令牌,更优预测:用于高效天气预报的稀疏残差路由

Janet Wang, Yunbei Zhang, Lin Zhao, Xi Xiao, Jihun Hamm, Xiao Wang

机构 * Tulane University(杜兰大学) Northeastern University(东北大学) University of Alabama at Birmingham(阿拉巴马大学伯明翰分校) Oak Ridge National Laboratory(橡树岭国家实验室)

AI总结 研究针对现有基于ViT的天气预报模型计算冗余问题,提出无参数插件路由模块Sparse-Reslim,通过稀疏令牌处理兼顾固定网格要求,提升预报精度并大幅降低成本。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.06667 2026-07-07 cs.CL 新提交

The Piggyback Hypothesis of Generalization: Explaining and Mitigating Emergent Misalignment

泛化的搭便车假说:解释和缓解涌现的错位

Jiachen Zhao, Zhengxuan Wu, Aryaman Arora, Yiyou Sun, David Bau, Weiyan Shi

机构 * Northeastern University(东北大学) Stanford University(斯坦福大学) University of California, Berkeley(加州大学伯克利分校)

AI总结 提出搭便车假说,认为聊天模板标记导致微调行为泛化到无关领域,并设计TReFT方法通过正则化标记表示缓解涌现错位,在多个数据集上有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11878 2026-07-07 cs.CL 版本更新

LLMs Encode Harmfulness and Refusal Separately

大语言模型分别编码有害性和拒绝性

Jiachen Zhao, Jing Huang, Zhengxuan Wu, David Bau, Weiyan Shi

机构 * Northeastern University(东北大学) Stanford University(斯坦福大学)

AI总结 研究大语言模型对有害性的理解,发现其有害性和拒绝性在模型内分别编码,有害性方向与拒绝方向不同,据此揭示越狱方法原理及对抗微调影响,提出潜在危害表示的安全应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.15135 2026-07-07 cs.CL 版本更新

TrendFact: A Benchmark Towards Hotspot Perception in Automatic Fact-Checking

TrendFact:自动事实核查中热点感知的基准

Xiaocheng Zhang, Xi Wang, Yifei Lu, Jianing Wang, Zhuangzhuang Ye, Mengjiao Bao, Peng Yan, Xiaohong Su

机构 * Harbin Institute of Technology(哈尔滨工业大学) National University of Defense Technology(国防科学技术大学) Northeastern University(东北大学) East China Normal University(华东师范大学) Beihang University(北京航空航天大学) Tsinghua University(清华大学)

AI总结 研究自动事实核查范式在资源受限环境下面临风险不对称挑战,引入TrendFact基准及评估热点感知能力的指标,提出FactISR框架提升热点感知能力和计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.13378 2026-07-07 cs.AI cs.CL cs.IR cs.LG q-bio.QM 版本更新

DrugAgent: Reliable Multi-Agent Integration of Conflicting Biomedical Evidence for Drug-Target Interaction Assessment

DrugAgent:用于药物-靶点相互作用评估的冲突生物医学证据的可靠多智能体整合

Yoshitaka Inoue, Tianci Song, Xinling Wang, Rui Kuang, Tianfan Fu, Augustin Luna

机构 * Department of Computer Science and Engineering, University of Minnesota(计算机科学与工程系,明尼苏达大学) Computational Biology Branch, National Library of Medicine(国家医学图书馆计算生物学分支) Khoury College of Computer Sciences, Northeastern University(东北大学计算机科学学院) State Key Laboratory for Novel Software Technology at Nanjing University, School of Computer Science, Nanjing University(南京大学新型软件技术国家重点实验室,南京大学计算机科学学院) Developmental Therapeutics Branch, National Cancer Institute(国家癌症研究所发育治疗分支)

AI总结 研究药物-靶点相互作用评估中整合异构数据问题,核心方法是基于大语言模型的多智能体系统DrugAgent,贡献是能进行异构证据支持的DTI评估,补充独立DTI预测,还提供相关策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02262 2026-07-03 cs.CL 新提交

CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning

CheckRLM: 检索增强推理中的有效知识-思维连贯性检查

Dingling Xu, Ruobing Wang, Qingfei Zhao, Yukun Yan, Zhichun Wang, Daren Zha, Shi Yu, Zhenghao Liu, Shuo Wang, Xu Han, Maosong Sun

机构 * School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院) Beijing Key Laboratory of Artificial Intelligence for Education(北京人工智能教育重点实验室) Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院) Department of Computer Science and Technology, Institute for AI, Tsinghua University(清华大学人工智能研究院计算机科学与技术系) Northeastern University(东北大学)

AI总结 提出CheckRLM框架,通过检索增强生成及时检查和纠正推理链中的事实错误,确保推理与知识一致,降低长程推理错误累积成本。

Comments 24 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01756 2026-07-03 cs.CV 新提交

ProSAC-CT: Progressive Spectral-Anatomical Co-Guided Multi-Stage Diffusion Model for Low-Dose CT Denoising

ProSAC-CT: 渐进式频谱-解剖协同引导的多阶段扩散模型用于低剂量CT去噪

Xuepeng Liu, Zetong Liu, Renyiming Li, Yan Li, Ruiyu Li, Ruili Li, Jiayi Ding, Eichi Takaya

机构 * College of Medicine and Biological Information Engineering, Northeastern University(东北大学医学与生物信息工程学院) Tohoku University School of Medicine(东北大学医学院) State Key Laboratory of Oncology in South China, Sun Yat-sen University Cancer Center(华南肿瘤学国家重点实验室,中山大学肿瘤防治中心) AI Lab, Tohoku University Hospital(东北大学医院人工智能实验室)

AI总结 提出ProSAC-CT,一种渐进式频谱-解剖协同引导的多阶段扩散模型,通过解剖先验引导、残差频域解耦和时间步解耦解码器,有效去除低剂量CT噪声并保留解剖细节。

Comments 14 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01571 2026-07-03 cs.LG 新提交

Geometric Signatures of Reasoning: A Spectral Perspective on Task Hardness

推理的几何特征:任务难度的谱视角

Aria Masoomi, Mahsa Bazzaz, Adel Javanmard, Vahab Mirrokni

机构 * Northeastern University(东北大学) University of Southern California(南加州大学) Google Research(谷歌研究院)

AI总结 通过分析Transformer隐藏状态空间中思维链轨迹的谱、位置和运动学几何特征,提出有效维度d_ρ衡量轨迹复杂度,发现平坦特征谱对应更难任务,并利用运动学特征在生成早期预测答案正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01535 2026-07-03 cs.CV 新提交

Hidden-Shot: Towards One-Shot Task Generalization for Low-Level Vision Generalist Models

Hidden-Shot: 迈向低级视觉通用模型的一次性任务泛化

Shao-Jun Xia, Xianzheng Ma, Zichong Meng

机构 * Pratt School of Engineering, Duke University(杜克大学普拉特工程学院) Department of Engineering Science, University of Oxford(牛津大学工程科学系) Khoury College of Computer Science, Northeastern University(东北大学库里计算机科学学院)

AI总结 提出隐式提示机制Hidden-Shot,通过提取隐含视觉任务信息并融合全局任务感知纹理提示,增强低级视觉通用模型在新任务上的一次性泛化能力,并引入C/U评估框架系统测试泛化性能。

Comments 34 pages, 5 figures, under submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00022 2026-07-03 cs.RO 新提交

When to Personalize Household Object Search: A Rigidity-Gated Hybrid Policy

何时个性化家庭物品搜索:一种刚性门控混合策略

Xianyao Li, Yuhai Wang, Hu Xiao, Kaleb Smith, Gilbert Yang Ye, Eric Jing Du

机构 * University of Florida(佛罗里达大学) Northeastern University(东北大学) NVIDIA(英伟达)

AI总结 提出刚性门控混合策略PerSim,仅在物品放置行为多变时个性化,结合特质条件先验与人口频率基线,通过人类校准仿真和五大人格向量预测,降低搜索成本。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14198 2026-07-03 cs.LG cs.AI stat.ML 版本更新

Efficient Federated Conformal Prediction with Group-Conditional Guarantee

高效联邦共形预测与组条件保证

Haifeng Wen, Osvaldo Simeone, Hong Xing

机构 * IoT Thrust(物联网 thrust) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Institute for Intelligent Networked Systems (INSI)(智能网络化系统研究所) Northeastern University London(伦敦东北大学) Department of ECE The Hong Kong University of Science and Technology HK SAR(电子工程系 香港科技大学香港特别行政区)

AI总结 提出GC-FCP方法,通过可合并的原子分层核心集实现联邦共形预测的组条件覆盖保证,在合成和真实数据集上验证了性能。

Comments 24 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17633 2026-07-03 cs.CL cs.AI cs.LG 版本更新

Introduction to Transformers: an NLP Perspective

Transformer入门:自然语言处理视角

Tong Xiao, Jingbo Zhu

机构 * NLP Lab., Northeastern University, Shenyang, China(东北大学沈阳分校自然语言处理实验室) NiuTrans Research, Shenyang, China(尼utrans研究院)

AI总结 本文从NLP视角介绍Transformer的基本概念、标准架构、模型改进及常见应用,总结影响该领域的关键思想,并探讨其优势与局限。

Comments 119 pages and 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00514 2026-07-02 cs.CV cs.AI 新提交

Cross4D-JEPA: Dense Cross-modal Correspondence Distillation for 4D Point Cloud Representation Learning

Cross4D-JEPA: 用于4D点云表示学习的密集跨模态对应蒸馏

Trung Thanh Nguyen, Hai Nguyen-Truong, Tu Vo, Hoang M. Truong, Tuan-Anh Vu

机构 * Nagoya University(名古屋大学) Northeastern University(东北大学) KC Machine Learning Lab(KC机器学习实验室) University of Science, Vietnam National University Ho Chi Minh City(胡志明市越南国立大学理科大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 提出Cross4D-JEPA,通过教师-学生框架将冻结的2D基础模型(如DINOv2或V-JEPA 2)的密集补丁特征蒸馏到4D点编码器,实现每点对应和潜在空间匹配,在四个基准上优于模态内和全局跨模态基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00509 2026-07-02 cs.CV 新提交

AnF-DiffPET: Anatomy- and Frequency-Guided Diffusion for PET/CT Denoising

AnF-DiffPET: 用于PET/CT去噪的解剖与频率引导扩散

Xuepeng Liu, Ruili Li, Zetong Liu, Renyiming Li, Yan Li, Yin Dai, Chao Li, Yueyang Teng

机构 * College of Medicine and Biological Information Engineering, Northeastern University(东北大学医学与生物信息工程学院) Tohoku University School of Medicine(东北大学医学院) Department of Clinical Neurosciences, University of Cambridge(剑桥大学临床神经科学系)

AI总结 提出AnF-DiffPET框架,通过解剖-频率引导、多尺度交叉变换重建和频率对比硬挖掘,解决低剂量PET去噪中的解剖引导不足、多尺度特征传播不稳定和频域恢复不确定性问题,在多个数据集上优于现有方法。

Comments 11 pages, 8 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00289 2026-07-02 cs.CV 新提交

OnPoint: Offline-to-Online Multi-Level Distillation for Point-Supervised Online Temporal Action Localization

OnPoint: 点监督在线时序动作定位的离线到在线多级蒸馏

Sakib Reza, Gauri Jagatap, Mohsen Moghaddam, Octavia Camps, Andrea Fanelli

机构 * Northeastern University(东北大学) Dolby Laboratories, Inc.(杜比实验室公司) Georgia Institute of Technology(佐治亚理工学院)

AI总结 提出点监督在线时序动作定位任务,并设计离线到在线多级蒸馏框架,通过伪段实例、类激活序列和窗口级蒸馏转移知识,结合点标签和注意力校准,在五个数据集上优于基线。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01034 2026-07-02 cs.CL cs.AI cs.HC 新提交

Behavior-Adaptive Conversational Agents: Toward a Fluid Personality Framework

行为自适应对话代理:迈向流动人格框架

Hasibur Rahman, Smit Desai

机构 * Northeastern University(东北大学)

AI总结 提出流动人格框架,根据任务上下文、用户目标和情境紧迫性,动态调整代理的隐喻角色和人格表达强度,以提升用户信任和体验。

Comments Presented at Bridging AI and Behavior Change, a Bridge Program organized at the AAAI Conference on Artificial Intelligence 2026 (AAAI-2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23884 2026-07-02 cs.CL cs.AI 新提交

One Year Later...The Harms Persist, But So Do We!

一年后...伤害持续,但我们仍在!

Annika Marie Schoene, Cansu Canca, Gautham Vijay Kumar, Anson Antony

机构 * Northeastern University(东北大学) Florida International University(佛罗里达国际大学)

AI总结 研究评估六种商用大语言模型在16种DSM-5条件下的安全性,发现除自杀和自伤外,其他精神障碍(如进食障碍、物质使用障碍、重度抑郁障碍)的防护失败率高达100%,呼吁按临床条件定义伤害类别并实施防护。

Comments 20 pages, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18367 2026-07-02 cs.LG 新提交

Do Time Series Foundation Model Benchmarks Hide Regime-Dependent Failures? Evidence from Traffic Speed Forecasting

时间序列基础模型基准是否隐藏了依赖于状态的失败?来自交通速度预测的证据

Yingshuo Wang, Xian Sun, Lingdong Kong, Wei Gao, Yanhang Li, Zhichao Fan, Zexin Zhuang

机构 * University of California, Berkeley(加州大学伯克利分校) Duke University(杜克大学) National University of Singapore(新加坡国立大学) Northeastern University(东北大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Southern Methodist University(南卫理公会大学)

AI总结 本文提出状态分层评估方法,发现时间序列基础模型在交通状态转换时准确率和预测区间覆盖率显著下降,并提出了双峰混合增强方法以改善转换状态覆盖。

Comments 5 pages, 2 figures. Accepted at the Workshop on Forecasting as a New Frontier of Intelligence, ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13971 2026-07-02 cs.CV 新提交

Prompt2Effect: Training-Free Image-to-Video Model Specialization via LoRA Generation

Prompt2Effect: 通过LoRA生成实现免训练图像到视频模型特化

Xiaomeng Yang, Yanyu Li, Gordon Guocheng Qian, Ivan Skorokhodov, Viacheslav Ivanov, Avalon Vinella, Xuan Zhang, Yanzhi Wang, Sergey Tulyakov, Anil Kag

机构 * Northeastern University(东北大学) Snap Inc.(Snap公司)

AI总结 提出Prompt2Effect,一种权重驱动超网络,通过单次前向传播直接合成效果特定的LoRA权重,无需训练,在保持视频质量的同时将计算成本从56 GPU小时降至3.3秒。

Comments Accepted to ECCV 2026, project page: https://xiaomeng-yang.github.io/Prompt2Effect

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31529 2026-07-02 cs.CV 版本更新

SVI-Bench: A Dynamic Microworld for Strategic Video Intelligence

SVI-Bench: 一个用于战略视频智能的动态微世界

Yulu Pan, Han Yi, Seongsu Ha, Md Mohaiminul Islam, Benjamin Zhang, Lorenzo Torresani, Gedas Bertasius

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Northeastern University(东北大学)

AI总结 本文提出SVI-Bench,一个基于团队体育动态微世界的大规模基准,通过四个层级(动态场景理解、因果推理、战略模拟、智能体合成)的9个任务评估视频智能从感知到战略规划的能力,发现模型在感知任务上表现良好但在认知层级上性能急剧下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06817 2026-07-02 cs.CL 版本更新

SemEval-2026 Task 9: Detecting Multilingual, Multicultural and Multievent Online Polarization

SemEval-2026任务9:多语言、多文化、多事件在线极化检测

Usman Naseem, Robert Geislinger, Juan Ren, Sarah Kohail, Rudy Garrido Veliz, P Sam Sahil, Yiran Zhang, Marco Antonio Stranisci, Idris Abdulmumin, Özge Alaçam, Cengiz Acartürk, Aisha Jabr, Saba Anwar, Abinew Ali Ayele, Elena Tutubalina, Aung Kyaw Htet, Xintong Wang, Surendrabikram Thapa, Tanmoy Chakraborty, Dheeraj Kodati, Sahar Moradizeyveh, Firoj Alam, Ye Kyaw Thu, Shantipriya Parida, Ihsan Ayyub Qazi, Lilian Wanzare, Nelson Odhiambo Onyango, Clemencia Siro, Ibrahim Said Ahmad, Adem Chanie Ali, Martin Semmann, Chris Biemann, Shamsuddeen Hassan Muhammad, Seid Muhie Yimam

机构 * Macquarie University(麦考瑞大学) University of Hamburg(汉堡大学) Zayed University(扎耶德大学) HKBK College of Engineering(HKBK工程学院) University of Turin(都灵大学) aequa-tech University of Pretoria(比勒陀利亚大学) Bielefeld University(比勒费尔德大学) Jagiellonian University(雅盖隆大学) Bahir Dar University(巴赫达尔大学) AIRI KFU(喀山联邦大学) HSE University(高等经济大学) Virginia Tech(弗吉尼亚理工大学) IIT Delhi(印度理工学院德里分校) ABV-IIITM(ABV-印度信息技术与管理学院) Qatar Computing Research Institute(卡塔尔计算研究所) Hamad Bin Khalifa University(哈马德·本·哈利法大学) Language Understanding Lab., Myanmar(缅甸语言理解实验室) AMD Silo AI Lahore University of Management Sciences(拉合尔管理科学大学) Maseno University(马塞诺大学) Centrum Wiskunde & Informatica(数学与计算机科学中心) Bayero University Kano(卡诺巴耶罗大学) Northeastern University(东北大学) Imperial College London(伦敦帝国学院)

AI总结 本文介绍了SemEval-2026任务9,旨在检测在线极化,涵盖22种语言,包含超过11万标注实例。任务包含三个子任务,吸引全球1000多参与者和10000多提交,最终有67支队伍提交了系统描述论文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31168 2026-07-01 cs.CR cs.LG 新提交

Probe Choice Changes Canary-Memorization Verdicts: Three Post-Hoc Disagreement Case Studies in a Text-Dominant LoRA-Tuned Autoregressive Testbed

探针选择改变金丝雀记忆判定:在文本主导的LoRA微调自回归测试平台上的三个事后分歧案例研究

Zhichao Fan, Zexin Zhuang, Yanhang Li

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Northeastern University(东北大学)

AI总结 研究在Qwen2.5-VL-7B金丝雀测试平台上,固定窗口均值NLL记忆探针与全跨度秘密NLL或贪婪精确召回之间的分歧,发现窗口截断、非秘密漂移和窗口内下降三种案例,建议报告全跨度秘密NLL、跨度局部分解、行为精确召回和诱饵探针。

Comments ICML 2026 FoGen Workshop camera-ready. 17 pages, 4 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22027 2026-07-01 cs.CL cs.AI cs.LG 版本更新

Shared Lexical Task Representations Explain Behavioral Variability In LLMs

共享的词汇任务表示解释了大语言模型中的行为变异

Zhuonan Yang, Jacob Xiaochen Li, Francisco Piedrahita Velez, Eric Todd, David Bau, Michael L. Littman, Stephen H. Bach, Ellie Pavlick

机构 * Brown University(布朗大学) MIT(麻省理工学院) Northeastern University(东北大学)

AI总结 研究通过比较指令式和示例式提示发现,大语言模型在不同提示下行为差异可由共享的词汇任务表示解释,揭示了任务特定注意力头在不同提示风格中的共同机制。

Comments Accepted to ICML 2026. Updated to the camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13748 2026-07-01 cs.RO cs.MA 版本更新

Multi-Robot Coordination for Planning under Context Uncertainty

上下文不确定性下的多机器人协调规划

Pulkit Rustagi, Kyle Hollins Wray, Sandhya Saisubramanian

机构 * Collaborative Robotics and Intelligent Systems (CoRIS) Institute, Oregon State University(俄勒冈州立大学协作机器人与智能系统研究所) Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院)

AI总结 提出多机器人上下文不确定随机最短路径问题,通过两阶段方法(CIMOP推断上下文,LCBS进行无碰撞路径规划)实现上下文未知时的协调与安全操作。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏