Introducing Large Language Models into the Design Flow of Time-Sensitive Networking
将大语言模型引入时间敏感网络的设计流程
专题命中 其他安全 :safety(abstract)
AI总结 针对配置优化TSN网络的挑战,通过跨模型案例研究评估现有大语言模型能力,提出LLM辅助编排框架,介绍构建模块与管道,分析实际部署机会与局限,为评估LLM辅助TSN编排可行性提供路线图。
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
将大语言模型引入时间敏感网络的设计流程
专题命中 其他安全 :safety(abstract)
AI总结 针对配置优化TSN网络的挑战,通过跨模型案例研究评估现有大语言模型能力,提出LLM辅助编排框架,介绍构建模块与管道,分析实际部署机会与局限,为评估LLM辅助TSN编排可行性提供路线图。
V2XCrafter:学习生成跨智能体的驾驶场景
机构 * Hong Kong JC STEM Lab of Smart City(香港JC智能城市STEM实验室) ; City University of Hong Kong(香港城市大学) ; Lingnan University(岭南大学)
专题命中 其他安全 :safety(abstract)
AI总结 提出V2XCrafter框架,通过渐进式多智能体扩散模型和跨智能体注意力模块,生成跨智能体相机视角的一致可控协作驾驶场景,以增强数据并提升下游协作3D目标检测性能。
基于VLA的智能体长期记忆在开放世界任务执行中的应用
机构 * Nanjing University(南京大学) ; LimX Dynamics(LimX 动态)
专题命中 其他安全 :safety(abstract)
AI总结 本文提出ChemBot框架,通过双层记忆和MCP服务器提升复杂化学实验中的任务执行效率与安全性。
Comments Added references
面向距离的软提示学习用于多模态愉悦-唤醒估计
机构 * Graduate School of Automobile and Mobility(汽车与移动研究生院) ; Department of Automobile and IT Convergence(汽车与IT融合系)
专题命中 其他安全 :alignment(abstract)
AI总结 本文提出一种多模态框架,通过引入距离感知的软提示学习,提升多模态愉悦-唤醒估计的精度,在无约束场景中取得良好效果。
Comments 8pages
Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW), 2026, pp. 5294-5301
JoVA:联合视频音频生成的统一多模态学习
机构 * The University of Hong Kong(香港大学) ; ByteDance(字节跳动)
专题命中 其他安全 :alignment(abstract)
AI总结 JoVA通过联合自注意力机制和嘴巴区域损失,实现了高质量的视频音频生成,提升了嘴唇同步和语音质量。
Comments ECCV 2026
代理视频生成:通过工具约束的LLM规划从文本到可执行事件图
机构 * Institute of Mathematics of the Romanian Academy(罗马尼亚科学院数学研究所) ; National University of Science and Technology Politehnica Bucharest(布加勒斯特理工大学) ; Büchi Labortechnik AG(布奇实验室技术股份公司)
专题命中 其他安全 :alignment(abstract)
AI总结 本文提出了一种代理系统,通过LLM生成结构化的事件图规范,并在3D引擎中确定性执行,解决了传统视频生成的语义可靠性问题,展示了在物理真实性和语义对齐上的优越表现。
伊利诺伊州工作场所健康研究中存在不依从情况时的异质性处理效应估计:基于贝叶斯树集成方法
专题命中 其他安全 :safety(abstract)
AI总结 针对存在不依从情况的随机试验,提出贝叶斯因果森林模型以估计依从者的异质性处理效应,通过模拟验证方法有效性,并将其应用于伊利诺伊州工作场所健康研究,发现了干预对代谢参数和健康安全感知的异质性效应。
SpectraDINO:跨红外波段的RGB视觉基础模型的模态条件适配
专题命中 其他安全 :alignment(abstract)
AI总结 SpectraDINO是适配RGB视觉基础模型的跨红外波段统一骨干网络,通过分阶段蒸馏与微调技术,在7个检测和分割基准上性能优于或媲美特定模态方法。
Comments Updated with the revised model results
POINTS-Seeker:从零开始训练多模态代理搜索模型
机构 * School of Artificial Intelligence, Shanghai Jiao Tong University(上海交通大学人工智能学院) ; CMIC, Shanghai Jiao Tong University(上海交通大学CMIC) ; WeChat AI, Tencent(腾讯WeChat AI)
专题命中 其他安全 :alignment(abstract)
AI总结 本文提出POINTS-Seeker模型,通过引入代理播种机制和V-Fold压缩方案,解决长周期交互中的证据检索问题,并在六个基准测试中超越现有模型。
用于智能家庭能源管理的大语言模型
专题命中 其他安全 :safety(abstract)
AI总结 研究家庭能源管理系统中,大语言模型智能体能否为多设备家庭能源调度提供自然语言接口。通过工具调用ReAct智能体及相关数据,对三个商业模型进行基准测试,结果显示模型表现各异,能实现高调度成功率和接近最优性。
Comments 15 pages, 8 figures
隐式人机协作中新兴的学习者能动性:支持性和逆向性人工智能角色如何重塑互动
专题命中 其他安全 :safety(abstract)
AI总结 研究探讨支持性和逆向性AI角色对隐式人机创意协作中学习者能动性等方面的影响,通过让大学生分组完成任务并分析话语等,发现逆向性AI虽激发批判性但降低满意度,教育设计需平衡挑战与情感氛围。
VisTR:将可视化作为时间序列表推理的表示
专题命中 其他安全 :alignment(abstract)
AI总结 针对时间序列表推理难题,VisTR框架以可视化核心,利用其连接数据与认知,通过多模态大语言模型对齐输入,集成机制处理大数据,实现交互式可视化,经评估和案例验证了其在时间序列推理任务中的有效性和适用性。
Comments 15 pages, 10 figures
基于VLM描述比较的异常帧检测,用于提取特定专家操作和具有视频内自相似性的上下文决策场景
专题命中 其他安全 :safety(abstract)
AI总结 本文针对关键基础设施维护中专家知识传承问题,提出基于VLM描述比较检测异常帧的方法,可提取特定专家操作及上下文决策场景,在模拟实验中该方法的提取率高于传统方法,有效发现含专家知识的候选场景。
Comments 17 pages, 11 figures, 2 tables
正确为我上色:弥合感知颜色空间与文本嵌入以改进扩散生成
机构 * National Yang Ming Chiao Tung University
专题命中 其他安全 :alignment(abstract)
AI总结 研究文本到图像生成中颜色对齐问题,提出利用大语言模型消除颜色提示歧义、在文本嵌入空间指导颜色混合操作的无需训练框架,提高了颜色准确性且不影响图像质量,弥合文本语义与视觉生成差距。
Comments Accepted to ACM Multimedia 2025 (MM '25)
通过深度先验增强玻璃表面重建以提升机器人导航
机构 * Shenzhen Key Laboratory of Robotics and Computer Vision(机器人与计算机视觉深圳重点实验室) ; Southern University of Science and Technology(南方科技大学) ; CKS Robotics Institute(CKS机器人研究院)
专题命中 其他安全 :alignment(abstract)
AI总结 本文提出一种无需训练的框架,利用深度基础模型作为结构先验,结合鲁棒的局部RANSAC对齐方法,融合原始传感器深度数据,从而避免错误的玻璃测量污染,恢复准确的度量尺度,并引入新的RGB-D数据集用于玻璃区域的几何真实值。
Comments 9 pages, 8 figures, Accepted by IROS 2026
探索语音、个性与性别在人机交互中的相互作用
专题命中 其他安全 :alignment(abstract)
AI总结 研究探讨用户能否通过语音识别人工代理的外向性,并分析感知个性与用户-代理同步性之间的关系,发现女性语音在区分外向性上更有效,而男性语音则不一致。
Journal ref https://www.frontiersin.org/articles/10.3389/fcomp.2026.1855830
HOMIE:通过多模态智能增强实现以人为对象的视频个性化
机构 * Hong Kong University of Science and Technology(香港科技大学)
专题命中 其他安全 :alignment(abstract)
AI总结 研究以人为对象的视频个性化问题,提出HOMIE框架,统一处理主体间和主体内输入设置。通过更好的MLLM集成策略、自注意力中的全局多模态引导及模态参考嵌入,在多任务中达最优性能。
Comments 28 pages, 14 figures
通过主动推断构建社会现实:在结构化社会网络中建模一致性与创造力的辩证关系
专题命中 其他安全 :alignment(abstract)
AI总结 本文提出基于主动推断的多智能体模型,揭示社会现实的辩证构成,显示信息凝聚群体的内生形成、社会表征与观察分布的循环互构,以及创作传播的异质性模式。
Comments Accepted at ALIFE 2026 conference
隐藏场协调揭示去中心化协调中的无支付量子相关结构
专题命中 其他安全 :alignment(abstract)
AI总结 本文提出隐藏场协调模型,通过纠缠介导策略实现去中心化协调中的反协调,展示量子相关结构的几何分离。
MIND-CAVs:基于意图驱动自主的CAV多智能体协商与决策系统
专题命中 其他安全 :safety(abstract)
AI总结 针对当前联网自动驾驶车辆缺乏全局一致、意图感知协调决策机制的问题,提出MIND-CAVs框架,车辆将传感器观测抽象为意图表示交换,边缘智能体协商冲突意图,实验表明该框架在多车道场景中相比基线有改善。
Comments 8 pages, 5 figures, 1 table
BrainFIBRE:基于信息分解的脑微结构基础模型
机构 * National University of Singapore(新加坡国立大学)
专题命中 其他安全 :alignment(abstract)
AI总结 提出BrainFIBRE,首个脑微结构基础模型,通过自监督部分信息分解(SPID)和反事实候选构建(CCC)从NODDI图谱中解缠独特、协同和冗余信息,在多种预测任务上达到最优性能。
Comments ECCV 2026. Author name corrected in V2
利用全局和局部语义重新绑定潜在信息以进行纠缠扩散
机构 * University of West Attica(西阿提卡大学) ; VRG, FEE, Czech Technical University in Prague(布拉格捷克技术大学)
专题命中 其他安全 :alignment(abstract)
AI总结 研究针对潜在扩散模型语义监督不足问题,提出REGLUE框架,联合建模VAE图像潜在信息、局部VFM语义和全局[CLS]令牌,用轻量级卷积语义压缩器聚合特征,经实验验证该框架能提升FID并加速收敛。
Comments ECCV 2026
通过多模态持续预训练增强视觉基础模型
机构 * Institute of Trustworthy Embodied AI, Fudan University(可信具身人工智能研究院,复旦大学) ; Shanghai Innovation Institute(上海创新研究院) ; Shanghai Baosight Software Co., Ltd.(上海博视软件有限公司)
专题命中 其他安全 :alignment(abstract)
AI总结 研究通过多模态持续预训练增强视觉基础模型,提出M-CPT框架,用持续位置嵌入处理不同分辨率视觉输入,通过特征对齐目标提升视觉与文本表示一致性,实验证明该框架能提升多模态理解性能并保持标准视觉任务表现。
Comments Code is available in https://github.com/ShareLab-SII/CoMP-MM
万舞者:一种用于分钟级连贯音乐到舞蹈生成的分层框架
机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团)
专题命中 其他安全 :alignment(abstract)
AI总结 针对从音乐生成舞蹈视频的挑战,提出万舞者分层框架,解耦过程为全局关键帧规划和局部时间细化,利用音乐上下文确保连贯,通过动态帧率自适应等创新,突破时长限制,在多舞蹈类型上表现出色,达新的技术水平。
Comments project: https://humanaigc.github.io/wan-dancer-project/, code: https://github.com/Wan-Video/Wan-Dancer, modelscope: https://www.modelscope.cn/models/Wan-AI/Wan-Dancer-14B, huggingface: https://huggingface.co/Wan-AI/Wan2.2-Animate-14B
CHIA: 一个用于原则性、智能体AI驱动的硬件/软件协同设计研究的开源框架
专题命中 其他安全 :alignment(abstract)
AI总结 提出CHIA开源框架,通过有向循环图表达智能体AI驱动的协同设计流程,支持多种工具集成,实现可扩展、容错的大规模协同设计研究。
基于智能体中心动力系统视角的多智能体强化学习
专题命中 其他安全 :safety(abstract)
AI总结 提出将多智能体强化学习训练建模为耦合随机动力系统,利用动力系统理论分析智能体行为的稳定性和敏感性,以应对随机性挑战。
EmbodiedDiffusion:用于异构机器人导航的端到端可通行性引导视觉扩散
机构 * Intelligent Space Robotics Laboratory, Center for Digital Engineering, Skolkovo Institute of Science and Technology(智能空间机器人实验室,数字工程中心,斯克尔科沃科学与技术研究所)
专题命中 其他安全 :safety(abstract)
AI总结 针对自主导航中视觉可通行性估计问题,EmbodiedDiffusion框架利用无规划器合成监督等,同时预测可通行性地图与生成可行轨迹,经训练提炼语义到轻量级模型,能快速适应新平台,在多机器人室内环境中实现高效导航与轨迹生成。
Comments This work has been submitted for publication and is currently under review
MoT:用于有效代码生成的思维模块化提示
专题命中 其他安全 :alignment(abstract)
AI总结 研究针对大语言模型代码生成中现有提示技术不足,提出MoT技术,利用模块化原则分解问题,用MLR图构建推理过程,经实验对比六种基线技术,在八个基准上显著提升代码生成性能,Pass@1分数达58.1%至95.1%。
超越思维链:重写作为生成式多模态嵌入的通用接口
机构 * WeChat Vision, Tencent Inc.(腾讯微信视觉部) ; Zhejiang University(浙江大学) ; Tsinghua University(清华大学) ; Institute of Artificial Intelligence, Hefei Comprehensive National Science Center(合肥综合性国家科学中心人工智能研究院)
专题命中 其他安全 :alignment(abstract)
AI总结 针对思维链推理在检索中产生冗余和语义歧义的问题,提出重写驱动的多模态嵌入框架RIME,联合优化生成与嵌入,并通过跨模态对齐和精炼强化学习实现高效准确的检索。
Comments Accepted by ACMMM 2026
量化线性逻辑
专题命中 其他安全 :safety(abstract)
AI总结 本文提出量化序列演算,结合实数上的加法与乘法性质及序列演算修订,解决线性与模糊逻辑中加法连接词的软语义问题,并展示其在扩展残余软格中的完备性。
Comments Once 'Quantitative Linear Logic', the ML applications have been outlined more clearly and the exposition tightened. Comments welcome