Fast Approximate Vector Joins via Offline-Online Co-Design
高效近似阈值向量连接的协作与卸载
专题命中 跨模态检索 :multimodal(abstract)
AI总结 本文提出统一框架提升向量连接效率,通过软协作复用遍历结果、构建合并索引加速图探索,并采用自适应混合搜索策略增强鲁棒性,实验显示在效率-召回率权衡上优于现有方法。
AI 大模型
跨文本、图像、视频、音频等模态的大模型与学习方法。
高效近似阈值向量连接的协作与卸载
专题命中 跨模态检索 :multimodal(abstract)
AI总结 本文提出统一框架提升向量连接效率,通过软协作复用遍历结果、构建合并索引加速图探索,并采用自适应混合搜索策略增强鲁棒性,实验显示在效率-召回率权衡上优于现有方法。
角度语义:余弦相似度何时有效及失效
机构 * Baruch College, City University of New York(纽约城市大学巴克莱学院)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 研究探讨余弦相似度在信息处理等领域的应用,围绕其有用性取决于学习表示等因素展开,推导几何恒等式,区分失效机制,回顾证据并描述替代方法,得出其正尺度不变性有条件合理的结论。
HCPG-Flow:用于流策略机器人操作的分层接触进展引导
机构 * State Key Laboratory of Robotics and Systems, Harbin Institute of Technology(机器人技术与系统国家重点实验室,哈尔滨工业大学)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 研究机器人操作流策略中动作选择问题,提出HCPG-Flow方法,通过分层、以对象为中心的接触进展引导增强SAC-Flow,在模拟和物理任务中提高成功率,减少完成时间。
GlyRAG:用于血糖预测的上下文感知检索增强框架
机构 * College of Health Solutions, Arizona State University(亚利桑那州立大学健康解决方案学院) ; School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 研究旨在利用连续血糖监测数据进行准确血糖预测,开发了GlyRAG框架,结合大语言模型提取上下文信息并通过检索增强预测,在OhioT1DM和AZT1D数据集上评估,显著提高长期预测的均方根误差,多数预测落在临床可接受区域。
超越Logit调整:一种用于长尾重排的残差分解框架
机构 * University of Pennsylvania(宾夕法尼亚大学) ; Children’s Hospital of Philadelphia(费城儿童医院)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 本文提出残差分解框架,用于解决长尾分类中频繁类与稀有类的排序问题,通过分析残差分解的类内和类间组件,提出REPAIR方法以提升重排性能。
Comments Accepted into COLM 2026
Journal ref CONFERENCE ON LANGUAGE MODELING CONFERENCE ON LANGUAGE MODELING Third Conference on Language Modeling (COLM 2026)
安全响应很重要:输出感知安全护栏减轻多模态大语言模型中的过度拒绝
机构 * Lanzhou University(兰州大学)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 研究多模态大语言模型安全机制权衡问题,提出输出感知安全护栏范式,通过在模型隐藏状态空间预测及多实例对比学习训练分类器,减少过度拒绝,匹配安全性能,保留模型效用与安全能力。
Comments Accepted to ECCV 2026!
PIT-SUN:一种可部署的经验边际变换框架,用于推荐系统中的回归,具有期望一致恢复
机构 * Kuaishou Technology(快手科技)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 针对推荐系统中估计原始空间条件期望的问题,提出PIT-SUN框架,通过经验边际表定义相关内容,应用乘法SUN恢复估计期望,实验表明该方法在多方面有提升且部署开销小。
GateSID: 语义协作对齐中的冷启动推荐自适应门控
专题命中 跨模态检索 :multimodal(abstract)
AI总结 本文提出GateSID框架,通过自适应门控网络动态平衡语义与协同信号,提升冷启动推荐性能,实验显示其在GMV、CTR和订单量上均有显著提升。
Sycamore:用于评估基因组可视化检索的合成身份表征
专题命中 跨模态检索 :multimodal(abstract)
AI总结 Sycamore通过三种条件探针设计评估基因组可视化检索系统,探讨合成身份在真实用户反馈中的表现及影响。
Comments 8 pages, 6 figures
Canopy:用于代谢工程的异构图基础模型
机构 * an in-house laboratory information management system (LIMS)(一个内部实验室信息管理系统(LIMS))
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 代谢工程中设计高产微生物菌株有挑战,Canopy异构图基础模型集成多数据源成知识图谱,用特定模型编码特征,经自监督目标预训练,在发酵滴度预测任务中表现优于基线。
Comments Accepted at ICML GenBio Workshop 2026 https://openreview.net/forum?id=H8bvgKoT7j
跟随我的眼睛:基于VLM的扫视路径预测的后门攻击
专题命中 跨模态检索 :multimodal(abstract)
AI总结 本文首次研究了针对基于VLM的扫视路径预测的后门攻击,通过设计两种可变输出攻击方法,展示了如何在不同触发模式下绕过检测,验证了边缘部署系统的实际威胁。
M2Note: 通过错误笔记本学习实现视觉语言模型的持续演化
专题命中 跨模态检索 :multimodal(abstract)
AI总结 提出M2Note,一种无需训练的持续演化框架,通过将失败轨迹转化为可编辑的笔记,利用多模态检索增强生成在推理时引导模型,避免重复错误,并在多个基准上提升性能。
可大规模训练的量子傅里叶生成模型
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 提出一种基于并行傅里叶特征映射和forrelation型量子电路的量子生成模型,利用基于Parseval恒等式的对数似然损失实现大规模训练,并通过逆量子傅里叶变换构建采样电路,在超过1000量子比特上验证了有效性。
Comments 12 pages, 6 figures; supplementary material 21 pages, 12 figures
木材热分析与预测的物理信息建模
机构 * Technical University of Denmark(丹麦技术大学) ; Pioneer Centre for AI(人工智能先锋中心) ; The Royal Danish Academy(丹麦皇家艺术学院)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 提出物理信息深度学习框架,集成偏微分方程预测木材像素级热响应,通过软惩罚和硬编码两种方式嵌入物理知识,在三种真实木材数据集上优于纯数据驱动方法。
反对单一无线世界模型:为什么NextG需要可组合和代理智能
专题命中 跨模态检索 :multimodal(abstract)
AI总结 本文指出无线领域缺乏等同于LLM的数据基础,主张采用可组合和代理智能架构以实现可部署的AI原生网络。
Journal ref ICML 2026 Workshop on AI and ML for NextG
TactSpace: 学习富含物理信息的共享潜在空间以实现触觉模拟到现实的迁移
机构 * Robotic Systems Lab, ETH Zürich(瑞士苏黎世联邦理工学院机器人系统实验室) ; Micro- and Nanosystems Lab, ETH Zürich(瑞士苏黎世联邦理工学院微纳系统实验室) ; ETH AI Center(苏黎世联邦理工学院人工智能中心) ; NVIDIA(NVIDIA公司)
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 提出多模态表示学习框架TactSpace,通过共享潜在空间对齐异构触觉模态,实现零样本模拟到现实迁移,在力预测和形状重建任务中分别降低误差16.7%和45.8%。
Comments 9 pages, 6 figures, 4 tables, accepted into IROS 2026
跨模态生物学语言模型的逻辑空间对比对齐
机构 * Biomedical Informatics and Data Science, Yale School of Medicine(耶鲁医学院生物医学信息学与数据科学)
专题命中 跨模态检索 :cross-modal(abstract)
AI总结 提出LOGICA框架,在输出逻辑空间进行对比学习,通过门控跨模态适配器保留预训练似然接口,实现跨不同词汇表模型的上下文条件预测,在蛋白质-配体结合、TCR-肽活性和药物耐药性预测任务上超越现有方法。
鲁棒神经Tucker分解:偏差校正与自适应初始化
机构 * School of Computer Science and Engineering, Chongqing University of Science and Technology(重庆科技大学计算机科学与工程学院) ; College of Computer and Information Science, School of Software, Southwest University(西南大学计算机与信息科学学院 软件学院)
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 提出KaBiN模型,结合Kaiming初始化和偏差校正,解决高维不完全张量补全中初始化不当和偏差缺失导致的优化不稳定问题。
Comments 9 pages,3 figures, 106 conferences
具有潜在时间嵌入的贝叶斯网络用于阿尔茨海默病进展的阶段感知因果建模
机构 * Alzheimer's Disease Neuroimaging Initiative(阿尔茨海默病神经影像学倡议) ; Open Access Series of Imaging Studies(开放获取影像学研究系列)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 提出BN-LTE框架,结合贝叶斯网络与潜在时间嵌入,利用AT(N)级联约束建模AD进展,在ADNI数据上优于基线,并识别出淀粉样蛋白敏感性的中期伪时间窗口。
Comments 7 pages, 5 figures
通过对比交互从零开始学习物体操作
机构 * UC San Diego(加州大学圣地亚哥分校) ; UT Austin(德克萨斯大学奥斯汀分校)
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 针对对比强化学习在交互密集操作任务中表现不佳的问题,提出交互加权重采样方法,通过保留模式边界提升多模态分段非线性可达性表示,在仿真和真实机器人空气曲棍球任务中取得显著改进。
LongRTL:基于图相似性的LLM驱动的长上下文RTL优化
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 提出一种基于图相似性的LLM驱动RTL优化框架,通过分区、优化和重构三个智能体解决长上下文RTL代码的优化问题。
Comments 7 pages, 6 figures, 5 tables, conference
条件归一化流用于前向和后向联合状态与参数估计
机构 * Department of Computer Science and Engineering University of Notre Dame(计算机科学与工程系诺特达姆大学) ; Department of Pediatrics Stanford University(儿科系斯坦福大学) ; Department of Applied and Computational Mathematics and Statistics University of Notre Dame(应用与计算数学与统计系诺特达姆大学)
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 针对非线性非高斯系统,提出基于条件归一化流的状态滤波方法,结合MLP、Transformer或Mamba-SSM生成条件嵌入,并引入最优传输动力学损失缓解过参数化,在自动驾驶和COVID-19联合估计中验证有效性。
极端条件下城市基础设施管理中人类适应的计算建模:以地铁洪水情景为例
专题命中 跨模态检索 :multi-modal(abstract)
AI总结 本研究通过将基于实例的学习理论(IBLT)整合到土木工程计算中,建立了一个模拟操作员决策过程的计算认知架构,揭示了人类适应中的非单调性和心理偏差,并通过地铁洪水情景的人机交互实验验证了模型的有效性。
TransTac: 通过紫外编码透明弹性体实现视觉-触觉模态转换
机构 * Beijing University of Posts and Telecommunications(北京邮电大学)
专题命中 跨模态检索 :cross-modal(abstract)
AI总结 提出一种透明紫外编码双目视觉触觉传感器TransTac,结合视觉观察与标记触觉重建,通过先验引导的Delaunay立体匹配算法实现鲁棒稀疏三角化,在零样本触觉图像识别上达到83.3%准确率,并显著增强跨模态对齐。
Comments Accepted at IEEE International Conference on Robotics and Automation (ICRA) 2026. 8 pages, 7 figures
ImageAuditor: 针对基于图像的检索增强生成系统的成员推理攻击
专题命中 跨模态检索 :cross-modal(abstract)
AI总结 提出首个针对基于图像的检索增强生成(IRAG)的成员推理攻击方法ImageAuditor,通过奖励引导策略优化解决跨模态检索和判别信号提取两大挑战,在仅需四次查询时AUROC超过80%。
抗体环的标记化
机构 * Harvard University(哈佛大学) ; Prescient Design, Genentech(Prescient Design,基因泰克)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 提出Igloo多模态抗体环标记器,通过对比学习编码主链二面角和序列,高效检索相似环结构,提升H3环识别性能5.9%,并集成到蛋白质语言模型中改善抗体设计。
Comments 21 pages, 7 figures, 10 tables, code available at https://github.com/prescient-design/igloo
DECKER: 跨键盘提取与识别的域不变嵌入
机构 * IIIT-Delhi(印度德里理工学院) ; Guru Gobind Singh Indraprastha University(戈克辛格印度教大学)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 针对键盘声学侧信道攻击的跨键盘、跨用户和噪声环境泛化问题,提出包含四阶段域不变击键推理框架DECKER,并构建了多维度数据集HEAR,实验表明该方法在跨键盘和跨用户场景下显著提升击键识别性能。
Comments Accepted to AsiaCCS'26
面向移动操作的动态弹性时空语义记忆与混合定位
机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院) ; Department of Systems Engineering, City University of Hong Kong(香港城市大学系统工程系) ; School of Computing, National University of Singapore(新加坡国立大学计算机学院)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 提出DREAM框架,通过在线构建时空语义体素记忆、冗余感知记忆剪枝和混合定位,实现无预建地图的动态室内移动操作,将长时任务成功率提升至55%-70%。
Comments Code, CAD model, and real-robot demonstrations are available at https://bjhyzj.github.io/dream-web
Polaris: 用于层次概念学习的耦合轨道极坐标嵌入
机构 * Indian Institute of Technology Delhi, New Delhi, India(印度理工学院德里分校,新德里,印度) ; Indian Institute of Technology Delhi, Abu Dhabi, UAE(印度理工学院德里分校,阿布扎比,阿联酋) ; KDM Lab, Dhirubhai Ambani University Gandhinagar, Gujarat, India(KDM实验室,迪鲁布希阿姆巴尼大学冈丁加尔,古吉拉特邦,印度)
专题命中 跨模态检索 :multimodal(abstract)
AI总结 提出Polaris极坐标超球面嵌入框架,通过角度和半径分离语义与层次,结合局部约束、全局正则化和不确定性感知非对称目标,在多种层次结构扩展任务中显著提升检索性能。
Comments Accepted to the 43rd International Conference on Machine Learning (ICML 2026)
一种融合序列、图和3D特征的三模态对比学习框架用于药物-靶标相互作用预测
机构 * School of Computer Science, Xiangtan University, Xiangtan 411105, China(湘潭大学计算机科学学院)
专题命中 跨模态检索 :cross-modal(abstract)
AI总结 提出TriMod-DTI框架,通过融合药物和蛋白质的1D序列、2D图和3D结构,并采用三模态对比学习策略对齐潜在空间表示,从而提升药物-靶标相互作用预测性能。
Comments 12 pages, 5 figures, ISBRA 2026