arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Columbia University(哥伦比亚大学)

2026-06-09 至 2026-06-09 共收录 8
2606.09659 2026-06-09 cs.CL cs.AI cs.LG 新提交

End-to-End Context Compression at Scale

端到端上下文压缩的规模化

Ang Li, Sean McLeish, Haozhe Chen, Nimit Kalra, Zaiqian Chen, Artem Gazizov, Venkata Anoop Suhas Kumar Morisetty, Bhavya Kailkhura, Harshitha Menon, Zhuang Liu, Brian R. Bartoldson, Tom Goldstein, Sanae Lotfi, Micah Goldblum, Pavel Izmailov

机构 * New York University(纽约大学) Modal Labs(Modal实验室) University of Maryland(马里兰大学) Princeton University(普林斯顿大学) Columbia University(哥伦比亚大学) Harvard University(哈佛大学) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室) FAIR at Meta(Meta FAIR实验室)

AI总结 本研究通过架构搜索和持续预训练,提出潜在上下文语言模型(LCLMs),一种端到端编码器-解码器压缩器,在通用任务性能、压缩速度和峰值内存上改进帕累托前沿,并可作为长时智能体的高效骨干。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08610 2026-06-09 cs.RO cs.AI 新提交

HARBOR: A Harness Framework for Agentic Robot Reinforcement Learning

HARBOR:面向智能体机器人强化学习的框架

Zechu Li, Yufeng Jin, Xiaoyang Liu, Puze Liu, Vignesh Prasad, Carlo D'Eramo, Georgia Chalvatzaki

机构 * TU Darmstadt(达姆施塔特工业大学) Honda Research Institute Europe(本田欧洲研究所) Columbia University(哥伦比亚大学) Tongji University(同济大学) Shanghai Research Institute for Intelligent Autonomous Systems(上海智能自主系统研究院) University of Würzburg(维尔茨堡大学) Hessian.AI(黑森人工智能中心)

AI总结 提出HARBOR框架,通过将机器人强化学习自动化视为框架工程问题,利用专用智能体、标准化命令和可复用知识,在模拟中自动完成从环境搭建到策略训练的全流程,并在6个基准测试和16个任务中验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08311 2026-06-09 cs.AI 新提交

Curation of a Cardiology Interface Terminology for Highlighting Electronic Health Records using Machine Learning

利用机器学习构建心脏病学接口术语以突出电子健康记录

Mahshad Koohi Habibi Dehkordi, Shuxin Zhou, Yehoshua Perl, Fadi P. Deek, James Geller, Gai Elhanan, Andrew J. Einstein, Luke Lindemann, Vipina K. Keloth

机构 * Department of Computer Science, New Jersey Institute of Technology(新泽西理工学院计算机科学系) Department of Computer Science, St.Francis College(圣弗朗西斯学院计算机科学系) Department of Informatics, New Jersey Institute of Technology(新泽西理工学院信息学系) Department of Data Science, New Jersey Institute of Technology(新泽西理工学院数据科学系) Center for Genomic Medicine, School of Medicine, University of Nevada(内华达大学医学学院基因组医学中心) Department of Medicine, Cardiology Division, Columbia University Irving Medical Center(哥伦比亚大学伊万杰琳医学中心内科部(心内科)) Advanced Metrics Laboratory, School of Medicine and Health Sciences, George Washington University(乔治华盛顿大学医学院与健康科学学院高级指标实验室) Department of Biomedical Informatics and Data Science, Yale University(耶鲁大学生物医学信息学与数据科学系)

AI总结 提出基于机器学习的心脏病学接口术语(CIT)设计方法,通过半自动构建训练数据并训练模型,实现对电子健康记录中关键信息的高亮,覆盖率达74.21%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07688 2026-06-09 cs.IR cs.AI cs.CL cs.LG 新提交

TRACER: Token ReAssignment for Concept ERasure in Generative Recommendation

TRACER: 面向生成式推荐中概念擦除的令牌重分配

Ziheng Chen, Jiali Cheng, Zezhong Fan, Hadi Amiri, Diyuan Wu, Gabriele Tolomei, Yang Zhang

机构 * Stony Brook University(石英布鲁克大学) University of Massachusetts Lowell(马萨诸塞大学洛厄尔分校) Columbia University(哥伦比亚大学) Institute of Science and Technology Austria(奥地利科学技术研究院) Sapienza University of Rome(罗马大学 sapienza) National University of Singapore(新加坡国立大学)

AI总结 针对生成式推荐中概念遗忘与推荐效用冲突的问题,提出基于令牌重分配的概念遗忘框架TRACER,通过将概念相关物品重分配给替代令牌并引入一致性正则化,有效移除目标概念同时保持推荐效用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01616 2026-06-09 cs.LG cs.AI cs.CY cs.NI 版本更新

Learning Behavioral Signals from Encrypted Smartphone Network Traffic

从加密智能手机网络流量中学习行为信号

Rameen Mahmood, Omar El Shahawy, Souptik Barua, Zachary Beattie, Jeffrey Kaye, Xuhai "Orson'' Xu, Chao-Yi Wu, Danny Yuxing Huang

机构 * New York University(纽约大学) NYU Langone Health(NYU Langone健康) NYU Grossman School of Medicine(NYU Grossman医学院) Oregon Health & Science University(俄勒冈健康与科学大学) Columbia University(哥伦比亚大学) Harvard Medical School(哈佛医学院)

AI总结 本文利用基于Transformer的模型从加密网络流量中学习行为表征,结合用户特定适配器,并通过稀疏表示和广义估计方程分析,发现压力、孤独感和睡眠障碍分别与个体间差异、个体内波动及两者组合相关,且学习到的表征优于传统手工特征。

Comments 19 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16551 2026-06-09 cs.CL 版本更新

PQR: A Framework to Generate Diverse and Realistic User Queries that Elicit QA Agent Failures

PQR:一个生成多样化且逼真用户查询的框架,以引发问答代理失败

Yunan Lu, Luigi Liu, Omar Yahia, Arpit Sharma, Zhou Yu

机构 * Columbia University(哥伦比亚大学) University of California San Diego(加州大学圣地亚哥分校) Walmart(沃尔玛)

AI总结 PQR框架通过迭代交互生成多样化且逼真的用户查询,以发现问答代理的失败案例,其方法比现有方法更有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23066 2026-06-09 cs.CV 版本更新

Urban Flood Observations: A hand-labeled training and validation dataset of post-flood inundation

城市洪水观测:一个手标注的训练和验证数据集,用于洪水后淹没区域

Rohit Mukherjee, Hannah K. Friedrich, Beth Tellman, Ariful Islam, Zhijie Zhang, Jonathan Giezendanner, Upmanu Lall, Venkataraman Lakshmi

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室) University of Arizona(亚利桑那大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Utah State University(犹他州立大学) Massachusetts Institute of Technology(麻省理工学院) Columbia University(哥伦比亚大学) University of Virginia(弗吉尼亚大学)

AI总结 本文提出UFO数据集,用于复杂城市环境中从卫星图像中映射洪水淹没区域,通过手标注数据集验证了分割模型,达到77.3的平均IoU,并评估了两种常用水体产品。

Comments 15 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08922 2026-06-09 cs.LG stat.ML 版本更新

The Mirrored Influence Hypothesis: Efficient Data Influence Estimation by Harnessing Forward Passes

镜像影响假说:利用前向传播的高效数据影响估计

Myeongseob Ko, Feiyang Kang, Weiyan Shi, Ming Jin, Zhou Yu, Ruoxi Jia

机构 * Virginia Tech(弗吉尼亚理工大学) Columbia University(哥伦比亚大学)

AI总结 提出镜像影响假说,将训练数据对测试预测的影响转化为逆问题,通过测试样本梯度加训练样本前向传播高效估计数据影响,显著提升效率。

Comments The IEEE/CVF Conference on Computer Vision and Pattern Recognition 2024

Journal ref The IEEE/CVF Conference on Computer Vision and Pattern Recognition 2024

详情

展开后加载摘要…

URL PDF HTML 收藏