arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-10 至 2026-04-10 共收录 64 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 安全评测 17 篇

2604.08217 2026-04-10 cs.CY 79%

Co-design for Trustworthy AI: An Interpretable and Explainable Tool for Type 2 Diabetes Prediction Using Genomic Polygenic Risk Scores

可信AI的协同设计:一种用于2型糖尿病预测的可解释和可解释工具,使用基因组多基因风险评分

Ralf Beuthan, Megan Coffee, Heejin Kim, Na Yeon Kim, Pedro Kringen, Elisabeth Hildt, Haekyung Lee, Seunggeun Lee, Emilie Wiinblad Mathez, Sira Maliphol, Vadim Pak, Yuna Park, Stephan Sonnenberg, Jesmin Jahan Tithi, Magnus Westerlund, Roberto V. Zicari

专题命中 安全评测 :trustworthy(title,abstract);分类 cs.CY

AI总结 本文提出eXplainable PRS工具,通过SHAP分解基因组多基因风险评分,提升2型糖尿病预测的可解释性,并结合法律、医疗、伦理和技术鲁棒性进行协同设计,为AI系统提供伦理和法律框架。

Comments 57 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05524 2026-04-10 cs.CL cs.IR 79%

KEO: Knowledge Extraction on OMIn via Knowledge Graphs and RAG for Safety-Critical Aviation Maintenance

KEO:通过知识图谱和RAG进行OMIn的领域知识提取

Kuangshi Ai, Jonathan A. Karr, Meng Jiang, Nitesh V. Chawla, Chaoli Wang

机构 * University of Notre Dame(圣母大学)

专题命中 安全评测 :safety(title,abstract);分类 cs.CL

AI总结 KEO通过知识图谱和RAG框架提升航空安全维护中的领域知识提取与推理,实验显示其在全局理解上优于传统文本块RAG,同时保持对细粒度任务的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08089 2026-04-10 cs.SE 78%

GALA: Multimodal Graph Alignment for Bug Localization in Automated Program Repair

GALA: 多模态图对齐用于自动化程序修复中的缺陷定位

Zhuoyao Liu, Zhengran Zeng, Shu-Dong Huang, Yang Liu, Shikun Zhang, Wei Ye

专题命中 安全评测 :alignment(title,abstract)

AI总结 GALA通过多模态图对齐方法,解决GUI截图场景下自动化程序修复的缺陷定位问题,通过结构化推理提升视觉与代码的映射精度。

Comments Code available at: https://github.com/lzyyyyy666/GALA

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07363 2026-04-10 cs.LG 74%

Benchmark Shadows: Data Alignment, Parameter Footprints, and Generalization in Large Language Models

基准阴影:大型语言模型中的数据对齐、参数足迹与泛化

Hongjian Zou, Yidan Wang, Qi Ding, Yixuan Liao, Xiaoxin Chen

机构 * Vivo AI Lab, Shenzhen, China(维沃人工智能实验室,深圳,中国) Hong Kong University of Science and Technology, Hong Kong, China(香港科技大学,香港,中国)

专题命中 安全评测 :alignment(title);分类 cs.LG

AI总结 本文研究了大型语言模型中基准表现与广度能力之间的差异,通过数据干预发现数据分布影响参数适应与泛化能力,提出参数空间诊断方法揭示不同训练模式的结构特征。

Comments 28 pages, 26 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07559 2026-04-10 cs.AI 70%

Dual-Loop Control in DCVerse: Advancing Reliable Deployment of AI in Data Centers via Digital Twins

双环控制在DCVerse中的应用:通过数字孪生推进AI在数据中心的可靠部署

Qingang Zhang, Yuejun Yan, Guangyu Wu, Siew-Chien Wong, Jimin Jia, Zhaoyang Wang, Yonggang Wen

机构 * Alibaba Group(阿里巴巴集团)

专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.AI

AI总结 本文提出双环控制框架,通过数字孪生技术解决数据中心能源效率与故障风险平衡问题,实现更可靠的AI部署,实验显示能提升能效并满足服务等级协议要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07781 2026-04-10 eess.SY cs.AI cs.LG cs.SY 62%

Toward Generalizable Graph Learning for 3D Engineering AI: Explainable Workflows for CAE Mode Shape Classification and CFD Field Prediction

迈向通用的3D工程AI图学习:用于CAE模态形状分类和CFD场预测的可解释工作流程

Tong Duy Son, Kohta Sugiura, Marc Brughmans, Andrey Hense, Zhihao Liu, Amirthalakshmi Veeraraghavan, Ajinkya Bhave, Jay Masters, Paolo di Carlo, Theo Geluk

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一个通用的3D工程AI图学习框架,通过将异构工程资产转换为物理感知图表示,并利用图神经网络进行分类和预测任务,应用于CAE振动模态分类和CFD气动场预测,提高可解释性和重用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18019 2026-04-10 cs.CL cs.AI cs.SE 62%

BenchBrowser: Retrieving Evidence for Evaluating Benchmark Validity

BenchBrowser:用于评估基准有效性证据的检索

Harshita Diddee, Gregory Yauney, Swabha Swayamdipta, Daphne Ippolito

机构 * Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所) Thomas Lord Department of Computer Science, University of Southern California(南加州大学托马斯·洛德计算机科学系)

专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 BenchBrowser通过检索20个基准测试集中的相关评估项目,帮助评估者诊断基准测试在内容有效性与收敛有效性上的不足,从而弥补实践者意图与实际测试内容之间的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08455 2026-04-10 cs.AI 57%

KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation

KnowU-Bench: 向交互式、主动式和个性化移动代理评估迈进

Tongbo Chen, Zhengxi Lu, Zhan Xu, Guocheng Shao, Shaohan Zhao, Fei Tang, Yong Du, Kaitao Song, Yizhou Liu, Yuchen Yan, Wenqi Zhang, Xu Tan, Weiming Lu, Jun Xiao, Yueting Zhuang, Yongliang Shen

机构 * Zhejiang University(浙江大学) Apple(苹果公司) Tencent(腾讯)

专题命中 安全评测 :trustworthy(abstract);分类 cs.AI

AI总结 KnowU-Bench通过Android仿真环境评估个性化移动代理,涵盖42个通用GUI任务、86个个性化任务和64个主动任务,验证代理在交互中获取用户偏好和主动干预的能力,发现前沿模型在模糊指令下表现下降,揭示偏好获取和干预校准的关键瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08263 2026-04-10 cs.AI 57%

Neural-Symbolic Knowledge Tracing: Injecting Educational Knowledge into Deep Learning for Responsible Learner Modelling

神经符号知识追踪:将教育知识注入深度学习以实现负责任的学习者建模

Danial Hooshyar, Gustav Šír, Yeongwook Yang, Tommi Kärkkäinen, Raija Hämäläinen, Ekaterina Krivich, Mutlu Cukurova, Dragan Gašević, Roger Azevedo

机构 * Tallinn University(塔林大学) University of Jyväskylä(于韦斯屈莱大学) Czech Technical University(捷克技术大学) Kangwon National University(江原大学) University College London(伦敦大学学院) The University of Hong Kong(香港大学) Monash University(莫纳什大学) University of Central Florida(中佛罗里达大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出Responsible-DKT,通过整合教育符号知识提升学习者建模的性能与可解释性,实验表明其在预测准确率和时间可靠性方面优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16750 2026-04-10 cs.LG 57%

Interpretable Clinical Classification with Kolmogorov-Arnold Networks

可解释的临床分类与科拉莫戈罗夫-阿诺德网络

Alejandro Almodóvar, Patricia A. Apellániz, Alba Garrido, Fernando Fernández-Salvador, Santiago Zazo, Juan Parras

专题命中 安全评测 :trustworthy(abstract);分类 cs.LG

AI总结 本文提出基于科拉莫戈罗夫-阿诺德网络的可解释性临床分类方法,通过Logistic KAN和KAAM模型在多个公开数据集上验证了其在预测性能和临床透明度上的优势。

Comments 29 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07929 2026-04-10 cs.IR cs.AI 57%

Same Outcomes, Different Journeys: A Trace-Level Framework for Comparing Human and GUI-Agent Behavior in Production Search Systems

相同结果,不同旅程:一种基于轨迹层面的框架,用于比较人类和GUI代理在生产搜索系统中的行为

Maria Movin, Claudia Hauff, Aron Henriksson, Panagiotis Papapetrou

机构 * Spotify, Sweden(Spotify瑞典) Spotify, Netherlands(Spotify荷兰) Stockholm University, Sweden(斯德哥尔摩大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 本文提出一个基于轨迹的评估框架,比较人类和GUI代理在任务结果、努力、查询构建和界面状态导航中的行为差异,通过实验证明代理行为与人类不同,强调轨迹层面诊断的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07362 2026-04-10 cs.LG 57%

LLM-Generated Fault Scenarios for Evaluating Perception-Driven Lane Following in Autonomous Edge Systems

基于大语言模型的故障场景生成用于评估自主边缘系统中感知驱动的车道跟随

Faezeh Pasandideh, Achim Rettberg

机构 * Department of Electrical Engineering Hamm-Lippstadt University. of Applied Sciences (HSHL) Lippstadt, Germany

专题命中 安全评测 :safety(abstract);分类 cs.LG

AI总结 本文提出一种解耦的离线-在线故障注入框架,利用大语言模型生成故障场景并合成高保真传感器退化,通过预计算查找表实现边缘设备实时故障感知推理,验证了在雾条件下模型鲁棒性显著下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07054 2026-04-10 cs.CL 57%

Sell More, Play Less: Benchmarking LLM Realistic Selling Skill

多卖少玩:LLM真实销售技能基准测试

Xuanbo Su, Wenhao Hu, Haibo Su, Yunzhang Chen, Le Zhan, Yanqi Yang, Leo Huang

机构 * SF Express(顺丰速运)

专题命中 安全评测 :DPO(abstract);分类 cs.CL

AI总结 本文提出SalesLLM基准测试,通过30,074个剧本配置和1,805个多轮场景评估大语言模型的销售能力,采用自动评估流程和用户模型CustomerLM提升模拟真实性,实验显示LLM在销售任务上的表现差异显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20718 2026-04-10 cs.CV cs.AI 57%

MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models

MM-MoralBench: 一种多模态道德评估基准用于大型视觉-语言模型

Bei Yan, Jie Zhang, Zhiyuan Chen, Shiguang Shan, Xilin Chen

机构 * University of Chinese Academy of Sciences(中国科学院大学)

专题命中 安全评测 :alignment(abstract);分类 cs.AI

AI总结 为评估大型视觉-语言模型的道德对齐性,提出MM-MoralBench基准,通过多模态场景测试模型在六个道德基础上的判断与分类能力,揭示模型存在显著的道德偏见问题。

Comments Accepted by Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03884 2026-04-10 cs.AI 57%

A Unified Framework for Evaluating and Enhancing the Transparency of Explainable AI Methods via Perturbation-Gradient Consensus Attribution

基于扰动-梯度共识归因的可解释人工智能方法评估与增强统一框架

Md. Ariful Islam, Md Abrar Jahin, M. F. Mridha, Nilanjan Dey

机构 * Department of Computer Science, American International University-Bangladesh(美国国际大学-孟加拉国计算机科学系) Thomas Lord Department of Computer Science, Viterbi School of Engineering, University of Southern California(南加州大学维特比工程学院托马斯·洛德计算机科学系) Department of Computer Science and Engineering, Techno International New Town(Techno International New Town计算机科学与工程系)

专题命中 安全评测 :safety(abstract);分类 cs.AI

AI总结 本文提出多标准评估框架和PGCA方法,通过整合领域优先级动态评分方案,提升XAI在保真度、可解释性、鲁棒性、公平性和完整性方面的性能,实验显示在五个领域均取得显著优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08031 2026-04-10 cs.RO cs.CV 50%

Open-Ended Instruction Realization with LLM-Enabled Multi-Planner Scheduling in Autonomous Vehicles

基于LLM的多规划器调度的开放式指令实现用于自动驾驶车辆

Jiawei Liu, Xun Gong, Fen Fang, Muli Yang, Bohao Qu, Yunfeng Hu, Hong Chen, Xulei Yang, Qing Guo

机构 * Jilin University(吉林大学) Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局) Tongji University(同济大学) NKIARI Nankai University(南开大学) Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, MOE(教育部知识驱动人机智能工程研究中心)

专题命中 安全评测 :safety(abstract)

AI总结 本文提出一种基于大语言模型的指令实现框架,通过实时反馈调度多个基于模型预测控制的运动规划器,提高任务完成率并降低LLM查询成本,同时确保安全性和可追溯性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. AI治理与伦理 2 篇

2603.21354 2026-04-10 cs.LG cs.DC 70%

The Workload-Router-Pool Architecture for LLM Inference Optimization: A Vision Paper from the vLLM Semantic Router Project

面向LLM推理优化的负载-路由-池架构:来自vLLM语义路由项目的愿景论文

Huamin Chen, Xunzhuo Liu, Bowei He, Fuyuan Lyu, Yankai Chen, Xue Liu, Yuhan Liu, Junchen Jiang

机构 * McGill University(麦吉尔大学) University of Chicago(芝加哥大学)

专题命中 AI治理与伦理 :safety(abstract);jailbreak(abstract);分类 cs.LG

AI总结 本文提出Workload-Router-Pool架构,通过负载、路由、池三个维度优化LLM推理,结合路由策略与负载特征,解决多任务、多模态、多代理场景下的推理效率与安全性问题。

Comments Vision Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07591 2026-04-10 stat.ME cs.AI cs.CL cs.LG stat.ML 67%

From Ground Truth to Measurement: A Statistical Framework for Human Labeling

从真实数据到测量:人类标注的统计框架

Robert Chew, Stephanie Eckman, Christoph Kern, Frauke Kreuter

机构 * RTI International(RTI国际) University of Maryland(马里兰大学) LMU Munich(慕尼黑大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出统计框架,将标注过程视为测量过程,分解标注结果中的变异来源,为数据驱动的机器学习提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他安全 16 篇

2604.07375 2026-04-10 cs.CY cs.HC 79%

Assessing the Feasibility of a Video-Based Conversational Chatbot Survey for Measuring Perceived Cycling Safety: A Pilot Study in New York City

评估基于视频的对话式聊天机器人调查在测量感知骑行安全性的可行性:纽约市试点研究

Feiyang Ren, Zhaoxi Zhang, Tamir Mendel, Takahiro Yabe

专题命中 其他安全 :safety(title,abstract);分类 cs.CY

AI总结 本文提出利用大语言模型结合视频调查和对话式AI聊天机器人,评估骑行安全感知的可行性,并通过纽约市九个街区的试点调查验证方法的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07419 2026-04-10 cs.IR 78%

ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment

ReAlign:通过推理引导的细粒度对齐优化视觉文档检索

Hao Yang, Yifan Ji, Zhipeng Xu, Zhenghao Liu, Yukun Yan, Zulong Chen, Shuo Wang, Yu Gu, Ge Yu

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出ReAlign方法,利用VLM推理能力生成细粒度视觉描述作为监督信号,提升视觉文档检索性能,实验表明在不同领域数据集上均取得2%的相对提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.04833 2026-04-10 econ.GN q-fin.EC 78%

Measuring Geopolitical Alignment and Economic Growth

衡量地缘政治一致性与经济增长

Tianyu Fan

专题命中 其他安全 :alignment(title,abstract)

AI总结 本文提出了一种基于事件的地缘政治一致性的新衡量方法,并证明其影响经济增长。研究发现地缘政治一致性提升可使人均GDP增长约10%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07837 2026-04-10 cs.AI 74%

SPARD: Self-Paced Curriculum for RL Alignment via Integrating Reward Dynamics and Data Utility

SPARD:通过整合奖励动态和数据效用实现强化学习对齐的自适应课程

Xuyang Zhi, Peilun zhou, Chengqiang Lu, Hang Lv, Yiwei Liang, Rongyang Zhang, Yan Gao, YI WU, Yao Hu, Hongchao Gu, Defu Lian, Hao Wang, Enhong Chen

机构 * University of Science and Technology of China(中国科学技术大学) Xiaohongshu Inc.(小红书)

专题命中 其他安全 :alignment(title);分类 cs.AI

AI总结 SPARD通过动态调整多目标奖励权重和数据重要性,提升强化学习对齐效果,实验显示在多个基准上显著增强模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08425 2026-04-10 cs.AI cs.CL 62%

Learning Who Disagrees: Demographic Importance Weighting for Modeling Annotator Distributions with DiADEM

学习谁不一致:用于建模标注者分布的群体重要性加权

Samay U. Shetty, Tharindu Cyril Weerasooriya, Deepak Pandita, Christopher M. Homan

机构 * Rochester Institute of Technology(罗切斯特理工学院)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI

AI总结 DiADEM通过学习群体重要性权重,有效建模标注者分歧,优于现有方法,在多个基准上取得显著成果,揭示种族和年龄对标注者分歧的关键影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08368 2026-04-10 cs.LG cs.CL cs.CV 62%

SOLAR: Communication-Efficient Model Adaptation via Subspace-Oriented Latent Adapter Reparametrization

SOLAR:通过子空间导向的潜在适配器重参数化实现通信高效的模型适应

Seyed Mahmoud Sajjadi Mohammadabadi, Xiaolong Ma, Lei Yang, Feng Yan, Junshan Zhang

机构 * University of Nevada, Reno(内华达大学里诺分校) Argonne National Laboratory(阿贡国家实验室) University of Houston(休斯顿大学) University of California, Davis(加利福尼亚大学戴维斯分校)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 SOLAR通过子空间导向的潜在适配器重参数化方法,减少PEFT适配器的通信和存储成本,提升模型适应效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07729 2026-04-10 cs.AI cs.CL 62%

Emotion Concepts and their Function in a Large Language Model

情感概念及其在大语言模型中的功能

Nicholas Sofroniew, Isaac Kauvar, William Saunders, Runjin Chen, Tom Henighan, Sasha Hydrie, Craig Citro, Adam Pearce, Julius Tarng, Wes Gurnee, Joshua Batson, Sam Zimmerman, Kelley Rivoire, Kyle Fish, Chris Olah, Jack Lindsey

机构 * Anthropic

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 研究揭示大语言模型中情感概念的内部表示及其对输出的影响,探讨其在对齐行为中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.05086 2026-04-10 cs.CL cs.AI 62%

A systematic framework for generating novel experimental hypotheses from language models

从语言模型生成新颖实验假设的系统框架

Kanishka Misra, Najoung Kim

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一个系统框架,利用语言模型模拟未在文献中存在的实验结果,针对儿童语言发展中的代词动词习得和跨结构泛化问题,生成新颖未测试的假设,并设计可实验室测试的实验。

Comments Revised version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08537 2026-04-10 cs.LG q-bio.NC 57%

Meta-learning In-Context Enables Training-Free Cross Subject Brain Decoding

基于上下文的元学习实现无训练跨受试者脑解码

Mu Nan, Muquan Yu, Weijian Mai, Jacob S. Prince, Hossein Adeli, Rui Zhang, Jiahang Cao, Benjamin Becker, John A. Pyles, Margaret M. Henderson, Chunfeng Song, Nikolaus Kriegeskorte, Michael J. Tarr, Xiaoqing Hu, Andrew F. Luo

机构 * University of Hong Kong(香港大学) Shenzhen Loop Area Institute(深圳河套学院) Chinese University of Hong Kong(香港中文大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Harvard University(哈佛大学) Columbia University(哥伦比亚大学) University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 其他安全 :alignment(abstract);分类 cs.LG

AI总结 本文提出一种基于上下文的元学习方法,无需微调即可实现跨受试者的脑解码,通过上下文学习和分层推理提升解码效率与鲁棒性。

Comments Accepted to CVPR 2026, website: https://github.com/ezacngm/brainCodec

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08494 2026-04-10 cs.CV cs.CL cs.HC 57%

What They Saw, Not Just Where They Looked: Semantic Scanpath Similarity via VLMs and NLP metric

他们所见,而不仅仅是他们看的地方:通过VLMs和NLP度量的语义扫视路径相似性

Mohamed Amine Kerkouri, Marouane Tliba, Bin Wang, Aladine Chetouani, Ulas Bagci, Alessandro Bruno

机构 * Northwestern University(西北大学) Radiology, Northwestern University(西北大学放射学系)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文提出一种整合视觉语言模型的语义扫视路径相似性框架,通过控制视觉上下文生成文本描述,利用NLP度量计算语义相似性,揭示空间差异下的内容一致性。

Comments Accepted at ETRA 2026 GenAI workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08461 2026-04-10 cs.CV cs.AI 57%

OVS-DINO: Open-Vocabulary Segmentation via Structure-Aligned SAM-DINO with Language Guidance

OVS-DINO:通过结构对齐的SAM-DINO与语言引导实现开放词汇分割

Haoxi Zeng, Qiankun Liu, Yi Bin, Haiyue Zhang, Yujuan Ding, Guoqing Wang, Deqiang Ouyang, Heng Tao Shen

机构 * Tongji University(同济大学) Hong Kong Polytechnic University(香港理工大学) University of Electronic Science and Technology of China(电子科技大学) Chongqing University(重庆大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出OVS-DINO框架,通过结构对齐SAM和语言引导恢复DINO的边界敏感性,提升开放词汇分割的精度和鲁棒性。

Comments 14 pages, 12 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07612 2026-04-10 cs.SD cs.AI 57%

Towards Real-Time Human-AI Musical Co-Performance: Accompaniment Generation with Latent Diffusion Models and MAX/MSP

实时人机音乐合奏:基于潜在扩散模型和MAX/MSP的伴奏生成

Tornike Karchkhadze, Shlomo Dubnov

机构 * University of California San Diego(加州大学圣迭戈分校)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 本文提出实时人机音乐合奏框架,利用潜在扩散模型生成伴奏,结合MAX/MSP实时音频处理与Python服务器,实现低延迟的伴奏生成与评估。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏