Strategic Buying Agents
战略性购买智能体
机构 * Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 该研究面向自主代客购物场景,分三类信息场景设计有限购物窗口内的最优购买策略,经真实电商价格数据验证,大模型更适配场景选择而非直接购买决策。
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
战略性购买智能体
机构 * Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 该研究面向自主代客购物场景,分三类信息场景设计有限购物窗口内的最优购买策略,经真实电商价格数据验证,大模型更适配场景选择而非直接购买决策。
深度关系数据库学习模型的公平基准测试
机构 * Department of Computer Science(计算机科学系) ; Tennessee State University(田纳西州立大学) ; SAP AI Research and Innovation(SAP人工智能研究与创新) ; SAP Labs(SAP实验室)
专题命中 其他LLM :foundation model(abstract);分类 cs.AI
AI总结 研究针对关系数据库深度学习方法实验协议不一致问题,通过在五个关系数据库上进行系统基准测试,重构模型确保实验一致性,发现关系变压器方法性能最佳,多表学习有优势但高跳数收益递减。
Mnemosyne: 用于验证和修复AI生成工作流的代理事务处理
机构 * Stanford University(斯坦福大学) ; QuadriumAI
专题命中 其他LLM :LLM(abstract_cn);分类 cs.AI
AI总结 提出代理事务处理(ATP)模型,将生成动作视为不可信提案,通过确定性约束集验证后才提交,并实现运行时修复,确保状态正确性独立于生成层。
Comments 41 pages, 25 tables, 6 figures
世界模型崩溃作为相变
机构 * Emory University(埃默里大学) ; The University of Tokyo(东京大学) ; LocationMind
专题命中 其他LLM :language agent(abstract);分类 cs.AI
AI总结 研究长时域语言代理隐式世界模型中的相变现象,通过确定性任务族的大规模网格搜索揭示从解决平台到崩溃的相图,并证明世界状态保真度先于动作有效性失效。
Comments Under Review
低困惑度即重复:连续扩散语言模型中的一维自调节吸引子
机构 * Zhejiang University(浙江大学) ; Westlake University(西湖大学) ; Ant Group(蚂蚁集团)
专题命中 其他LLM :language model(abstract);分类 cs.CL
AI总结 发现连续扩散语言模型(如ELF)的低困惑度源于过度重复,提出一维吸引子机制并设计ACE方法消除重复,提升文本质量。
通过奖励门控实现CLIP的选择性测试时去偏
机构 * Department of Artificial Intelligence, Chung-Ang University(中央大学人工智能系)
专题命中 其他LLM :language model(abstract);分类 cs.CL
AI总结 提出基于强化学习的测试时自适应框架RG-TTA,根据输入对偏见的敏感性选择性应用去偏,在减少偏见的同时保持零样本性能。
Comments 15 pages, 7 figures, 11 tables
面向室内环境的模块化视觉-语言-动作机器人框架
机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) ; CMU(卡内基梅隆大学)
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。
Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing
CoStream: 组合简单行为实现可泛化的复杂操作
专题命中 其他LLM :foundation model(abstract);分类 cs.AI
AI总结 提出CoStream框架,通过组合语义、预测和反应三种简单行为,在共享SE(3)接口上实现高精度、可泛化的复杂操作,在8个真实任务中验证了其有效性。
Comments Website: https://costream-simple.github.io
Aurora 是否编码了大气结构?潜在状态分析及归因
机构 * University of Amsterdam(阿姆斯特丹大学)
专题命中 其他LLM :foundation model(abstract);分类 cs.LG
AI总结 本文通过空间池化PCA和逐层相关性传播分析Aurora模型的内部表征,发现其潜在空间主要按季节周期组织,且模型关注与三维垂直结构一致的特征,表明模型无需显式指令即可学习气象一致性和垂直结构。
Comments Accepted at the FM4Science and Sci4DL workshops at ICLR 2026
实时语音AI能听到但不倾听
机构 * Together AI ; Stanford University(斯坦福大学)
专题命中 其他LLM :prompting(abstract);分类 cs.CL
AI总结 评估四个领先实时语音系统,发现它们依赖文字而非声学线索,在情感理解上存在感知与行动脱节,提示需谨慎用于依赖语调的场景。
黑盒辅助回归:相变与极小化最优性
机构 * School of Mathematics and Statistics(数学与统计学学院)
专题命中 其他LLM :foundation model(abstract);分类 cs.LG
AI总结 研究有限标注下利用固定黑盒预测器进行非参数回归的问题,发现风险在临界半径处发生相变,并提出安全残差估计器以避免负迁移,达到极小化最优。
Comments 23 pages, 3 figures. Accepted at the 43rd International Conference on Machine Learning (ICML 2026)
Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR 306, 2026
超越拜耳:面向鲁棒自动驾驶分割的任务最优传感器协同设计
机构 * University Of Arkansas(阿肯色大学)
专题命中 其他LLM :foundation model(abstract);分类 cs.AI
AI总结 提出可微RAW到任务流水线,学习光谱滤色器阵列权重提升分割mIoU,发现光学点扩散函数协同设计为负收益,噪声优化效果微弱,增大CFA块反而有害。
因式化Gossip DiLoCo:减少DiLoCo中的阻塞通信
机构 * Pluralis Research
专题命中 其他LLM :language model(abstract);分类 cs.LG
AI总结 提出因式化Gossip DiLoCo,通过非阻塞混合与阻塞混合分解同步,在低带宽环境下提升计算利用率并保持优化稳定性。
Comments Accepted at ICML 2026. 29 pages, 7 figures
OTTER:一种用于规避毒性检测的越狱提示优化的红队系统
机构 * National Chengchi University, Taipei, Taiwan(国立中正大学,台北,台湾) ; University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)
专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL
AI总结 提出OTTER系统,通过替换少量令牌解耦表面毒性与对抗意图,在四个GPT模型上将平均攻击成功率从7.0%提升至84.0%,并首次量化分析毒性-绕过关系。
Video2Code: 通过动作感知重访从UI视频生成交互式网页
机构 * University of Waterloo(滑铁卢大学) ; Tsinghua University(清华大学) ; Zhipu AI(智谱AI) ; Beihang University(北京航空航天大学)
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 提出Video2Code方法,通过动作感知重访UI视频中的关键区域,恢复可执行的状态转换,生成HTML/CSS/JavaScript代码,提升多步交互的代码功能正确性。
Comments 31 pages, 21 figures
StepGuard: 通过单步校准保护网页导航
机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) ; School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院) ; Xiamen University(厦门大学) ; Zhejiang Lab(之江实验室) ; CSIRO(澳大利亚联邦科学与工业研究组织)
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 针对网页导航中单步脆弱性问题,提出StepGuard框架,通过动态双策略优化(DDPO)解决奖励冲突,并利用置信度引导的自适应导航反射(CANR)校准单步误差,显著提升导航与答案准确率。
Zeta: 通过坐标自适应预处理实现矩阵优化的双重白化
机构 * South China University of Technology(华南理工大学) ; AIGCode ; Hong Kong Baptist University(香港浸会大学)
专题命中 其他LLM :language model(abstract);分类 cs.LG
AI总结 针对矩阵优化中坐标尺度异质性问题,提出双重白化优化器Zeta,通过先坐标白化后谱白化的严格顺序降低正交化误差,在语言建模和视觉任务上提升收敛速度与泛化性能。
遍历顺序重要吗?Transformer语法中树遍历方法的系统研究
机构 * School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)
专题命中 其他LLM :language model(abstract);分类 cs.CL
AI总结 本文系统研究了Transformer语法中不同树遍历方法(深度优先、广度优先及新提出的产生式规则遍历)对语言建模、句法泛化和摘要生成的影响,揭示了嵌套组合与全局前瞻之间的权衡。
架构智慧:AI系统中优化治理的框架
机构 * Stanford University(斯坦福大学)
专题命中 其他LLM :language model(abstract);分类 cs.AI
AI总结 提出一种可修正的目标治理层,通过时间跨度、关系边界和不可逆性三个结构承诺,解决AI系统优化目标不当导致的失败问题。
Comments 17 pages, 2 tables, 2 figures
玻尔兹曼注意力:用于协同注意力的可学习伊辛耦合
机构 * Yonsei University(延世大学)
专题命中 其他LLM :language model(abstract);分类 cs.LG
AI总结 提出玻尔兹曼注意力,通过可学习的伊辛耦合增强注意力机制中的位置间交互,在字符级语言建模和括号匹配任务中优于标准softmax注意力,并展示了量子退火训练的有效性。
Comments 19 pages, 5 figures
设计AI支持的焦点小组:角色×模态剧本
机构 * University of California, San Diego(加州大学圣地亚哥分校)
专题命中 其他LLM :prompting(abstract);分类 cs.AI
AI总结 针对焦点小组资源密集且对引导高度敏感的问题,提出按AI角色(工具、联合主持、主持)和模态(文本、语音、具身)组织的剧本,并分析交互权衡与开放问题。
耦合振荡器网络中的同步注意力机制
机构 * University of California, Irvine(加州大学尔湾分校)
专题命中 其他LLM :language model(abstract);分类 cs.LG
AI总结 提出基于Kuramoto同步动力学的固定查询振荡器注意力机制,无需指数运算和全局归约,在物理基板上实现注意力计算,并在关键词识别和主谓一致任务上优于softmax。
由记者设计,但为读者而设?重新思考AI披露与新闻透明度
机构 * Centrum Wiskunde & Informatica(数学与信息学中心)
专题命中 其他LLM :prompting(abstract);分类 cs.AI
AI总结 研究发现,详细披露会引发透明度困境降低信任,而简短披露造成信息缺口;读者偏好用户代理型设计(如按需详情、AI比例可视化),呼吁HCI社区重新设计披露机制。
Comments Accepted to CHIWORK Workshop (Interrogating GenAI Augmentation for CHIworkers: Strategies for Professional Autonomy and Accountability)
已披露的人力资本中断与公司特定风险
专题命中 其他LLM :language model(abstract)
AI总结 该研究构建财报电话会议中已披露人力资本中断的衡量指标,发现其与公司特定风险显著相关,可预测特质波动率、下行偏差等变化及高管离职,揭示了劳动力短缺外的组织投入干扰信息。
Comments 50 pages
MatchingPolicy:具备对应感知能力的策略实现跨物体的上下文学习
机构 * Hong Kong University of Science and Technology(香港科技大学)
专题命中 其他LLM :foundation model(abstract)
AI总结 该研究提出MatchingPolicy框架,通过解耦演示-场景匹配与策略学习,结合视觉基础模型和两阶段匹配算法,在RLBench及真实操作任务上实现了跨物体的少样本泛化性能提升。
智能体社群中高阶相互作用的拓扑崩溃是集体智能的瓶颈
专题命中 其他LLM :language model(abstract)
AI总结 该研究发现AI智能体社群中高阶交互的拓扑崩溃会成为集体智能瓶颈,提出HIS和Φ指标,证实该瓶颈与模型无关,为人工社会设计提供了新方向。
ICL-SEC:迭代跨层语义错误校正
专题命中 其他LLM :language model(abstract)
AI总结 本文提出ICL-SEC框架,通过闭合物理层信道解码器与应用层语义解码器的循环,结合迭代解码与语义校正,其确认先验更新规则可大幅降低误码率,性能优于传统及非迭代方案。
强关联量子材料的基础神经网络有效哈密顿量
专题命中 其他LLM :foundation model(abstract)
AI总结 针对强关联量子材料模拟中FNQS的精度与采样成本问题,提出FNEH,可准确恢复相边界、降低计算成本,在莫尔材料中验证了其有效性。
QuISE:通过查询无关语义编辑防御视觉语言模型的排版攻击
专题命中 其他LLM :language model(abstract)
AI总结 该研究针对VLMs的排版攻击问题,提出模型无关无训练的黑盒防御方法QuISE,通过文本定位、语义替换及答案一致性判断提升防御性能,在多基准和模型上取得良好效果。
Comments 10 pages, 7 figures; includes supplementary material
RoboSeg:基于单眼在手相机的机器人操作的在线部件级语义重建
机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)
专题命中 其他LLM :language model(abstract)
AI总结 RoboSeg是无需CAD模型的部件级语义重建系统,结合VLM、TSDF融合与SAM3,实现机器人操作的部件语义索引,在24次物理试验中21次完成综合任务。