arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Northeastern University(东北大学)

2026-04-22 至 2026-04-22 共收录 7
2604.19710 2026-04-22 cs.CV

SpanVLA: Efficient Action Bridging and Learning from Negative-Recovery Samples for Vision-Language-Action Model

SpanVLA: 一种高效的视觉-语言-动作模型,通过负样本恢复学习实现动作桥接与学习

Zewei Zhou, Ruining Yang, Xuewei, Qi, Yiluan Guo, Sherry X. Chen, Tao Feng, Kateryna Pistunova, Yishan Shen, Lili Su, Jiaqi Ma

机构 * University of California, Los Angeles, USA(加州大学洛杉矶分校) Motional, USA(Motional公司) Northeastern University, USA(东北大学)

AI总结 本文提出SpanVLA,一种端到端自动驾驶框架,结合自回归推理与流匹配动作专家,通过高效桥接和负样本恢复学习提升推理效率和鲁棒性。

Comments Project page: https://spanvla.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18829 2026-04-22 cs.CV

DUALVISION: RGB-Infrared Multimodal Large Language Models for Robust Visual Reasoning

DUALVISION:用于鲁棒视觉推理的RGB-红外多模态大语言模型

Abrar Majeedi, Zhiyuan Ruan, Ziyi Zhao, Hongcheng Wang, Jianglin Lu, Yin Li

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Amazon(亚马逊) Northeastern University(东北大学)

AI总结 本文提出DUALVISION,通过局部化交叉注意力融合IR-RGB信息,提升多模态大语言模型在视觉退化条件下的性能,并引入DV-204K和DV-500数据集进行评估。

Comments Accepted at CVPR Findings 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10401 2026-04-22 cs.CL

NameBERT: Scaling Name-Based Nationality Classification with LLM-Augmented Open Academic Data

NameBERT: 通过LLM增强的开放学术数据扩展基于名称的国籍分类

Cong Ming, Ruixin Shi, Yifan Hu

机构 * Northeastern University, United States(美国东北大学)

AI总结 本文提出NameBERT,利用LLM增强开放学术数据构建大规模名称-国籍数据集,通过生成低资源国家名称提升分类性能,实现高效且准确的国籍分类。

Comments 12 pages, 3 figures, 8 tables; accepted at the 39th Canadian Conference on Artificial Intelligence (Canadian AI 2026)

Journal ref Proceedings of Machine Learning Research 318 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03476 2026-04-22 cs.CV cs.AI q-bio.BM

Fine-tuning DeepSeek-OCR-2 for Molecular Structure Recognition

为分子结构识别微调DeepSeek-OCR-2

Haocheng Tang, Xingyu Dang, Junmei Wang

机构 * Department of Computer Science, Princeton University, Princeton, NJ, USA(普林斯顿大学计算机科学系) School of Pharmacy, University of Pittsburgh, Pittsburgh, PA, USA(匹兹堡大学药学院) Khoury College of Computer Science, Northeastern University, Boston, MA, USA(东北大学Khoury计算机科学学院) Computational Chemical Genomics Screening Center, University of Pittsburgh, Pittsburgh, PA, USA(匹兹堡大学计算化学基因组筛选中心)

AI总结 本文提出通过图像条件生成SMILES的方法微调DeepSeek-OCR-2,采用分阶段监督微调策略提升稳定性,训练数据结合合成图像和专利图像,模型在精确匹配上表现良好但不如图结构模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08145 2026-04-22 cs.CL

Mitigating Judgment Preference Bias in Large Language Models through Group-Based Polling

通过基于群体的轮询缓解大语言模型中的判断偏好偏差

Shuliang Liu, Zhipeng Xu, Zhenghao Liu, Yukun Yan, Minghe Yu, Yu Gu, Chong Chen, Huiyuan Xie, Ge Yu

机构 * School of Computer Science and Engineering, Northeastern University, Shenyang, China(东北大学计算机科学与工程学院,中国沈阳) Department of Computer Science and Technology, Tsinghua University, Beijing, China(清华大学计算机科学与技术系,中国北京) Software College, Northeastern University, Shenyang, China(东北大学软件学院,中国沈阳) Huawei, China(华为,中国)

AI总结 本文提出Genii框架,通过多智能体协作优化缓解LLM判断偏好偏差,无需人工标注数据,提升评估性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18660 2026-04-22 econ.GN cs.AI cs.HC q-fin.EC

Who Benefits from AI? Self-Selection, Skill Gap, and the Hidden Costs of AI Feedback

谁从AI中受益?自我选择、技能差距和AI反馈的隐性成本

Christoph Riedl, Eric Bogert

机构 * D'Amore-McKim School of Business, Northeastern University(德阿莫-麦克金商学院,东北大学)

AI总结 研究探讨了个体在AI反馈中的自我选择行为如何影响学习效果和群体结果,发现高技能个体更倾向于使用AI反馈,导致技能差距扩大和智力多样性下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10865 2026-04-22 cs.CL

Will the Prince Get True Love's Kiss? On the Model Sensitivity to Gender Perturbation over Fairytale Texts

王子会得到真爱之吻吗?关于童话文本上性别扰动对模型敏感性的研究

Christina Chance, Da Yin, Dakuo Wang, Kai-Wei Chang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Northeastern University(东北大学)

AI总结 本文研究语言模型在理解故事时是否受习得的性别刻板印象影响,通过反事实数据增强探讨模型对性别刻板印象扰动的响应,发现模型在测试集上对性别扰动敏感,但经过反事实训练后更鲁棒。

详情

展开后加载摘要…

URL PDF HTML 收藏