arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2607.04708 2026-07-07 econ.TH cs.AI cs.CY cs.GT cs.HC 新提交 57%

Strategic Buying Agents

战略性购买智能体

Mingyang Fu, Ming Hu

机构 * Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究面向自主代客购物场景,分三类信息场景设计有限购物窗口内的最优购买策略,经真实电商价格数据验证,大模型更适配场景选择而非直接购买决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03659 2026-07-07 cs.DB cs.AI 新提交 57%

A Fair Benchmarking of Deep Relational Database Learning Models

深度关系数据库学习模型的公平基准测试

Kazi F. Akhter, Bharath Ajendla, Manar D. Samad

机构 * Department of Computer Science(计算机科学系) Tennessee State University(田纳西州立大学) SAP AI Research and Innovation(SAP人工智能研究与创新) SAP Labs(SAP实验室)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 研究针对关系数据库深度学习方法实验协议不一致问题,通过在五个关系数据库上进行系统基准测试,重构模型确保实验一致性,发现关系变压器方法性能最佳,多表学习有优势但高跳数收益递减。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00269 2026-07-07 cs.AI 新提交 57%

Mnemosyne: Agentic Transaction Processing for Validating and Repairing AI-generated Workflows

Mnemosyne: 用于验证和修复AI生成工作流的代理事务处理

Edward Y. Chang, Longling Geng, Emily J. Chang

机构 * Stanford University(斯坦福大学) QuadriumAI

专题命中 其他LLM :LLM(abstract_cn);分类 cs.AI

AI总结 提出代理事务处理(ATP)模型,将生成动作视为不可信提案,通过确定性约束集验证后才提交,并实现运行时修复,确保状态正确性独立于生成层。

Comments 41 pages, 25 tables, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31399 2026-07-07 cs.AI 新提交 57%

World-Model Collapse as a Phase Transition

世界模型崩溃作为相变

Xinyuan Song, Zekun Cai

机构 * Emory University(埃默里大学) The University of Tokyo(东京大学) LocationMind

专题命中 其他LLM :language agent(abstract);分类 cs.AI

AI总结 研究长时域语言代理隐式世界模型中的相变现象,通过确定性任务族的大规模网格搜索揭示从解决平台到崩溃的相图,并证明世界状态保真度先于动作有效性失效。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00588 2026-07-02 cs.CL 新提交 57%

Low Perplexity is Repetition: A One-Dimensional Self-Conditioning Attractor in Continuous Diffusion LMs

低困惑度即重复:连续扩散语言模型中的一维自调节吸引子

Shuai Zhang, Zijie Chen, Hongliang He, Lun Du, Zhenzhong Lan

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Ant Group(蚂蚁集团)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 发现连续扩散语言模型(如ELF)的低困惑度源于过度重复,提出一维吸引子机制并设计ACE方法消除重复,提升文本质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00423 2026-07-02 cs.CL 新提交 57%

Selective Test-Time Debiasing for CLIP via Reward Gating

通过奖励门控实现CLIP的选择性测试时去偏

Jaeho Han, Jisoo Yang, Hyeondong Woo, Mingyu Jeon, Sunjae Yoon, Junyeong Kim

机构 * Department of Artificial Intelligence, Chung-Ang University(中央大学人工智能系)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 提出基于强化学习的测试时自适应框架RG-TTA,根据输入对偏见的敏感性选择性应用去偏,在减少偏见的同时保持零样本性能。

Comments 15 pages, 7 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31144 2026-07-01 cs.RO cs.AI 新提交 57%

A Modular Vision-Language-Action Robotics Framework for Indoor Environments

面向室内环境的模块化视觉-语言-动作机器人框架

Anindya Jana, Snehasis Banerjee, Arup Sadhu, Ranjan Dasgupta

机构 * TCS Research, Tata Consultancy Services(塔塔咨询服务公司TCS研究部) CMU(卡内基梅隆大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 提出模块化架构,集成环境建图、问题处理和导航,通过双流并行处理(语义体素建图与语言分类)实现自然语言指令驱动的自主任务执行。

Comments IEEE IROS 2025 Workshop on Generative AI for Robotics and Smart Manufacturing

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26423 2026-06-26 cs.RO cs.AI 新提交 57%

CoStream: Composing Simple Behaviors for Generalizable Complex Manipulation

CoStream: 组合简单行为实现可泛化的复杂操作

Haonan Chen, Yuxiang Ma, Stephen Tian, Xiaoshen Han, Wenlong Huang, Feiyang Wu, Yunzhu Li, Jiajun Wu, Edward H. Adelson, Yilun Du

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 提出CoStream框架,通过组合语义、预测和反应三种简单行为,在共享SE(3)接口上实现高精度、可泛化的复杂操作,在8个真实任务中验证了其有效性。

Comments Website: https://costream-simple.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26361 2026-06-26 cs.LG physics.ao-ph 新提交 57%

Does Aurora Encode Atmospheric Structure? Latent Regime Analysis and Attribution

Aurora 是否编码了大气结构?潜在状态分析及归因

Emma Kasteleyn, Ana Lucic

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 本文通过空间池化PCA和逐层相关性传播分析Aurora模型的内部表征,发现其潜在空间主要按季节周期组织,且模型关注与三维垂直结构一致的特征,表明模型无需显式指令即可学习气象一致性和垂直结构。

Comments Accepted at the FM4Science and Sci4DL workshops at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26083 2026-06-25 cs.CL eess.AS 新提交 57%

Real-Time Voice AI Hears but Does Not Listen

实时语音AI能听到但不倾听

Martijn Bartelds, Federico Bianchi, James Zou

机构 * Together AI Stanford University(斯坦福大学)

专题命中 其他LLM :prompting(abstract);分类 cs.CL

AI总结 评估四个领先实时语音系统,发现它们依赖文字而非声学线索,在情感理解上存在感知与行动脱节,提示需谨慎用于依赖语调的场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25743 2026-06-25 cs.LG 新提交 57%

Black-Box Assisted Regression: Phase Transitions and Minimax Optimality

黑盒辅助回归:相变与极小化最优性

Yan Zhou

机构 * School of Mathematics and Statistics(数学与统计学学院)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG

AI总结 研究有限标注下利用固定黑盒预测器进行非参数回归的问题,发现风险在临界半径处发生相变,并提出安全残差估计器以避免负迁移,达到极小化最优。

Comments 23 pages, 3 figures. Accepted at the 43rd International Conference on Machine Learning (ICML 2026)

Journal ref Proceedings of the 43rd International Conference on Machine Learning, PMLR 306, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24096 2026-06-24 cs.CV cs.AI 新提交 57%

Beyond Bayer: Task-Optimal Sensor Co-Design for Robust Autonomous-Driving Segmentation

超越拜耳:面向鲁棒自动驾驶分割的任务最优传感器协同设计

Reeshad Khan, John Gauch

机构 * University Of Arkansas(阿肯色大学)

专题命中 其他LLM :foundation model(abstract);分类 cs.AI

AI总结 提出可微RAW到任务流水线,学习光谱滤色器阵列权重提升分割mIoU,发现光学点扩散函数协同设计为负收益,噪声优化效果微弱,增大CFA块反而有害。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22768 2026-06-23 cs.LG cs.DC 新提交 57%

Factored Gossip DiLoCo: Reducing Blocking Communication in DiLoCo

因式化Gossip DiLoCo:减少DiLoCo中的阻塞通信

Chamin Hewa Koneputugodage, Thalaiyasingam Ajanthan, Sameera Ramasinghe, Hadi Mohaghegh Dolatabadi, Shamane Siriwardhana, Gil Avraham, Violetta Shevchenko, Karol Pajak, James Snewin, Alexander Long

机构 * Pluralis Research

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出因式化Gossip DiLoCo,通过非阻塞混合与阻塞混合分解同步,在低带宽环境下提升计算利用率并保持优化稳定性。

Comments Accepted at ICML 2026. 29 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21077 2026-06-23 cs.CR cs.CL 新提交 57%

OTTER: A Red-Teaming System for Toxicity-Evading Jailbreak Prompt Optimization

OTTER:一种用于规避毒性检测的越狱提示优化的红队系统

Jerry Wang, Hsin-Ling Hsu, Yi-Cheng Lai, Nai-Chia Chen, Fang Yu

机构 * National Chengchi University, Taipei, Taiwan(国立中正大学,台北,台湾) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 其他LLM :LLM(abstract_cn);分类 cs.CL

AI总结 提出OTTER系统,通过替换少量令牌解耦表面毒性与对抗意图,在四个GPT模型上将平均攻击成功率从7.0%提升至84.0%,并首次量化分析毒性-绕过关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20711 2026-06-23 cs.CV cs.AI 新提交 57%

Video2Code: Generating Interactive Webpages from UI Videos via Action-Aware Revisit

Video2Code: 通过动作感知重访从UI视频生成交互式网页

Mingde Xu, Zhen Yang, Yan Wang, Yu Wang, Xijun Liu, Zijun Dou, Wenyi Hong, Xiaotao Gu, Bin Xu, Jie Tang

机构 * University of Waterloo(滑铁卢大学) Tsinghua University(清华大学) Zhipu AI(智谱AI) Beihang University(北京航空航天大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 提出Video2Code方法,通过动作感知重访UI视频中的关键区域,恢复可执行的状态转换,生成HTML/CSS/JavaScript代码,提升多步交互的代码功能正确性。

Comments 31 pages, 21 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17871 2026-06-17 cs.AI 新提交 57%

StepGuard: Guarding Web Navigation via Single-Step Calibration

StepGuard: 通过单步校准保护网页导航

Zhihao Cui, Yuchen Zhang, Xiyang Sun, Yaxiong Wang, Li Zhu, Jinpeng Hu, Liu Liu, Mengjia Li, Yujiao Wu

机构 * School of Software Engineering, Xi’an Jiaotong University(西安交通大学软件工程学院) School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院) Xiamen University(厦门大学) Zhejiang Lab(之江实验室) CSIRO(澳大利亚联邦科学与工业研究组织)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 针对网页导航中单步脆弱性问题,提出StepGuard框架,通过动态双策略优化(DDPO)解决奖励冲突,并利用置信度引导的自适应导航反射(CANR)校准单步误差,显著提升导航与答案准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14187 2026-06-17 cs.LG 新提交 57%

Zeta: Dual Whitening for Matrix Optimization via Coordinate-Adaptive Preconditioning

Zeta: 通过坐标自适应预处理实现矩阵优化的双重白化

Kaiwen Chen, Shuhai Zhang, Zimo Liu, Linxiao Li, Ying Sun, Yuchen Li, Yifan Zhang, Bo Han, Mingkui Tan, Qiuwu Chen

机构 * South China University of Technology(华南理工大学) AIGCode Hong Kong Baptist University(香港浸会大学)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 针对矩阵优化中坐标尺度异质性问题,提出双重白化优化器Zeta,通过先坐标白化后谱白化的严格顺序降低正交化误差,在语言建模和视觉任务上提升收敛速度与泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16836 2026-06-16 cs.CL 新提交 57%

Does Traversal Order Matter? A Systematic Study of Tree Traversal Methods in Transformer Grammars

遍历顺序重要吗?Transformer语法中树遍历方法的系统研究

Zongru Liu, Pengyu Ji, Pengcheng Wang, Kewei Tu

机构 * School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 本文系统研究了Transformer语法中不同树遍历方法(深度优先、广度优先及新提出的产生式规则遍历)对语言建模、句法泛化和摘要生成的影响,揭示了嵌套组合与全局前瞻之间的权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16319 2026-06-16 cs.AI 新提交 57%

Architectural Wisdom: A Framework for Governing Optimization in AI Systems

架构智慧:AI系统中优化治理的框架

Edward Y. Chang

机构 * Stanford University(斯坦福大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 提出一种可修正的目标治理层,通过时间跨度、关系边界和不可逆性三个结构承诺,解决AI系统优化目标不当导致的失败问题。

Comments 17 pages, 2 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12478 2026-06-12 cs.LG cond-mat.stat-mech quant-ph 新提交 57%

Boltzmann Attention: Learnable Ising Couplings for Cooperative Attention

玻尔兹曼注意力:用于协同注意力的可学习伊辛耦合

Gilhan Kim, Daniel K. Park

机构 * Yonsei University(延世大学)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出玻尔兹曼注意力,通过可学习的伊辛耦合增强注意力机制中的位置间交互,在字符级语言建模和括号匹配任务中优于标准softmax注意力,并展示了量子退火训练的有效性。

Comments 19 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11835 2026-06-11 cs.HC cs.AI 新提交 57%

Designing AI-Supported Focus Groups: A Role x Modality Playbook

设计AI支持的焦点小组:角色×模态剧本

Zhiqing Wang, Steven Dow

机构 * University of California, San Diego(加州大学圣地亚哥分校)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 针对焦点小组资源密集且对引导高度敏感的问题,提出按AI角色(工具、联合主持、主持)和模态(文本、语音、具身)组织的剧本,并分析交互权衡与开放问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12059 2026-06-11 cs.LG cs.NE nlin.AO 新提交 57%

Attention by Synchronization in Coupled Oscillator Networks

耦合振荡器网络中的同步注意力机制

Fabio Pasqualetti, Taosha Guo

机构 * University of California, Irvine(加州大学尔湾分校)

专题命中 其他LLM :language model(abstract);分类 cs.LG

AI总结 提出基于Kuramoto同步动力学的固定查询振荡器注意力机制,无需指数运算和全局归约,在物理基板上实现注意力计算,并在关键词识别和主谓一致任务上优于softmax。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11116 2026-06-10 cs.CY cs.AI cs.HC 新提交 57%

Designed by Journalists, but Is It for Readers? Rethinking AI Disclosures and Transparency in News

由记者设计,但为读者而设?重新思考AI披露与新闻透明度

Pooja Prajod

机构 * Centrum Wiskunde & Informatica(数学与信息学中心)

专题命中 其他LLM :prompting(abstract);分类 cs.AI

AI总结 研究发现,详细披露会引发透明度困境降低信任,而简短披露造成信息缺口;读者偏好用户代理型设计(如按需详情、AI比例可视化),呼吁HCI社区重新设计披露机制。

Comments Accepted to CHIWORK Workshop (Interrogating GenAI Augmentation for CHIworkers: Strategies for Professional Autonomy and Accountability)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14859 2026-08-18 q-fin.ST 新提交 50%

Disclosed Human-Capital Disruption and Firm-Specific Risk

已披露的人力资本中断与公司特定风险

Ang Zhang

专题命中 其他LLM :language model(abstract)

AI总结 该研究构建财报电话会议中已披露人力资本中断的衡量指标,发现其与公司特定风险显著相关,可预测特质波动率、下行偏差等变化及高管离职,揭示了劳动力短缺外的组织投入干扰信息。

Comments 50 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16715 2026-08-18 cs.RO 新提交 50%

MatchingPolicy: Correspondence-Aware Policy Enables Cross-Object In-Context Learning

MatchingPolicy:具备对应感知能力的策略实现跨物体的上下文学习

Qijin She, Hanyang Yu, Zeming Li, Ping Tan

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 该研究提出MatchingPolicy框架,通过解耦演示-场景匹配与策略学习,结合视觉基础模型和两阶段匹配算法,在RLBench及真实操作任务上实现了跨物体的少样本泛化性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15519 2026-08-18 cs.SI 新提交 50%

Topological collapse of higher-order interactions bottlenecks collective intelligence in AI agent societies

智能体社群中高阶相互作用的拓扑崩溃是集体智能的瓶颈

Shuo Lu, Weicheng Meng, Aijing Yu, Kun Shao, Jian Luan, Ran He, Jian Liang

专题命中 其他LLM :language model(abstract)

AI总结 该研究发现AI智能体社群中高阶交互的拓扑崩溃会成为集体智能瓶颈,提出HIS和Φ指标,证实该瓶颈与模型无关,为人工社会设计提供了新方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15207 2026-08-18 cs.IT cs.NI math.IT 新提交 50%

ICL-SEC: Iterative Cross-Layer Semantic Error Correction

ICL-SEC:迭代跨层语义错误校正

Yirun Wang, Soung Chang Liew, Yuyang Du

专题命中 其他LLM :language model(abstract)

AI总结 本文提出ICL-SEC框架,通过闭合物理层信道解码器与应用层语义解码器的循环,结合迭代解码与语义校正,其确认先验更新规则可大幅降低误码率,性能优于传统及非迭代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14208 2026-08-17 quant-ph 新提交 50%

Foundation Neural Effective Hamiltonian for Strongly Correlated Quantum Materials

强关联量子材料的基础神经网络有效哈密顿量

Lixing Zhang, Hongjie Jiang, Di Luo

专题命中 其他LLM :foundation model(abstract)

AI总结 针对强关联量子材料模拟中FNQS的精度与采样成本问题,提出FNEH,可准确恢复相边界、降低计算成本,在莫尔材料中验证了其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13119 2026-08-14 cs.CV 新提交 50%

QuISE: Defense against Typographic Attacks on VLMs via Query-Irrelevant Semantic Editing

QuISE:通过查询无关语义编辑防御视觉语言模型的排版攻击

Shubin Lu, Jiaqi Yin, Yihao Huang

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对VLMs的排版攻击问题,提出模型无关无训练的黑盒防御方法QuISE,通过文本定位、语义替换及答案一致性判断提升防御性能,在多基准和模型上取得良好效果。

Comments 10 pages, 7 figures; includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09778 2026-08-11 cs.RO 新提交 50%

RoboSeg: Online Part-Level Semantic Reconstruction for Robotic Manipulation via a Single Eye-in-Hand Camera

RoboSeg:基于单眼在手相机的机器人操作的在线部件级语义重建

Zhaochen Lan, Mengxiang Lin

机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)

专题命中 其他LLM :language model(abstract)

AI总结 RoboSeg是无需CAD模型的部件级语义重建系统,结合VLM、TSDF融合与SAM3,实现机器人操作的部件语义索引,在24次物理试验中21次完成综合任务。

详情

展开后加载摘要…

URL PDF HTML 收藏