arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-20 至 2026-07-20 共收录 11 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 11 篇

2607.15364 2026-07-20 cs.CY 新提交 92%

On the Effectiveness of Fact Checking Information from Politically Congruent and Incongruent Large Language Models

论政治立场一致和不一致的大语言模型的事实核查信息的有效性

Jiangen He, Benjamin D Horne, Dorit Nevo

专题命中 其他LLM :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 研究政治立场一致和不一致的大语言模型事实核查信息的有效性,通过两个受试者内实验发现,LLM能显著改变对新闻标题的信任度,政治一致性在标题政治距离远时起作用,且LLM出错时也会影响信任度,揭示其纠正与歪曲信息的潜力。

Comments To Appear at ICWSM 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15977 2026-07-20 cs.CR 新提交 89%

Refusal is Not Safety! Benchmarking Latent Safety Risks of LLM-Driven Content Humorization

拒绝并非安全!评估大语言模型驱动的内容幽默化中的潜在安全风险

Yu Cui, Ruiqing Yue, Tingyu Li, Sicheng Pan, Zhuoyu Sun, Xufeng Zhang, Baohan Huang, Haibin Zhang, Cong Zuo

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract)

AI总结 研究基于LLM的内容幽默化潜在安全风险,提出HumorSafe框架评估风险传播,发现LLMs幽默化时会引入刻板印象和毒性,还提出HumorPIA攻击,揭示现有LLM安全评估在幽默化设置下的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04915 2026-07-20 cs.HC 89%

Exploring Expert Perspectives on Wearable-Triggered LLM Conversational Support for Daily Stress Management

探索专家对可穿戴触发LLM对话支持日常压力管理的视角

Poorvesh Dongre, Sameer Neupane, Priyanka Jadhav, Nikitha Donekal Chandrashekar, Christian Webb, Denis Gračanin

专题命中 其他LLM :LLM(title,title_cn)

AI总结 本文提出EmBot应用,结合可穿戴设备压力检测与LLM对话支持,通过专家访谈揭示设计中的早期紧张点和考虑因素,为日常压力管理和心理健康支持系统设计提供指导。

Journal ref IH '26: Proceedings of the 2026 ACM Interactive Health Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15684 2026-07-20 cs.SE 新提交 82%

Understanding Agent-Reactive Bugs at the Model-Harness Boundary: An Empirical Study of LLM Agent Issue Reports

理解模型-框架边界处的代理反应性错误:对大型语言模型代理问题报告的实证研究

Jingyi Chen, Songqiang Chen, Hengcheng Zhu, Jialun Cao, Jiasi Shen, Shing-Chi Cheung

专题命中 其他LLM :LLM(title,abstract)

AI总结 研究聚焦大型语言模型代理在模型-框架边界处的反应性错误,通过分析255份错误报告构建分类法,发现此类错误多为无明确测试预言的静默错误,检测和重现困难,还揭示了用户与开发者对错误归因及修复的不匹配,推动相关技术设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.07811 2026-07-20 cs.SE 版本更新 82%

CodeCoR: An LLM-Based Self-Reflective Multi-Agent Framework for Code Generation

CodeCoR:一种基于大语言模型的代码生成自反思多智能体框架

Ruwei Pan, Hongyu Zhang, Chao Liu

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究针对代码生成中语言模型无法确保代码正确性及多智能体框架工作流性能不稳健的问题,提出CodeCoR框架,通过在不同阶段修剪中间输出减少错误传播,实验证明其优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15713 2026-07-20 eess.SP cs.AI cs.LG 新提交 81%

Map as a Prompt: Learning Multi-Modal Spatial-Signal Foundation Models for Cross-scenario Wireless Localization

地图作为提示:学习用于跨场景无线定位的多模态空间信号基础模型

Yong Chu, Xun Zhou, Zenglin Xu, Hui Wang, Yue Yu

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Shanghai Academy of AI for Science(上海人工智能科学研究院) Artificial Intelligence Innovation and Incubation Institute, Fudan University(复旦大学人工智能创新与孵化院)

专题命中 其他LLM :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 针对无线定位在不同环境中面临的挑战及现有方法的局限,提出多模态基础模型SigMap,通过循环自适应掩码策略和“地图即提示”框架学习无线表示并实现跨场景适应,实验证明其性能领先且零样本泛化能力强。

Comments 17pages, 9 figures, poster in International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15948 2026-07-20 cs.SE 新提交 80%

TARS: A Theory-of-Mind Agent for Personalized In-IDE Code Comprehension

TARS:用于个性化IDE内代码理解的心理理论智能体

Leopoldo Todisco, Antonio Della Porta, Stefano Lambiase, Fabio Palomba

专题命中 其他LLM :LLM(summary_cn,abstract)

AI总结 研究针对代码理解中LLM助手的不足,提出TARS智能体,基于心理理论范式,剖析开发者特点并调整解释,通过检索增强生成联系项目文档。实验表明它能提升效率、降低认知负荷,解释更适配开发者。

Comments Accepted at ICSME 2026, Tool Demonstration and Data Showcase Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14011 2026-07-20 cs.NE cs.RO 版本更新 67%

EGO: a Recursive and Self-Referential Cognitive Architecture for Artificial General Intelligence

EGO:一种用于通用人工智能的递归和自指认知架构

Alberto Mangiante, Paolo Totaro, Domenico Ninno

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 该研究将通用人工智能视为自主自组织系统的涌现属性,介绍了基于形式E语言的EGO软件架构,它能自指并维持内部组织,实现自创生,为人工智能与生物认知理论搭建桥梁。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13921 2026-07-20 cs.PL cs.AI cs.LG 版本更新 62%

Generative Compilation: On-the-Fly Compiler Feedback as AI Generates Code

生成式编译:人工智能生成代码时的即时编译器反馈

Niels Mündler-Sasahara, Hristo Venev, Dawn Song, Martin Vechev, Jingxuan He

机构 * ETH Zurich(苏黎世联邦理工学院) Sofia University ``St. Kliment Ohridski''(索菲亚大学) University of California, Berkeley(加州大学伯克利分校)

专题命中 其他LLM :LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究针对人工智能生成代码时的问题,提出生成式编译方法,核心是sealor技术,能在生成中获取编译器反馈,在Rust编码任务中评估,减少非编译输出、提高功能正确性,使编译器在生成阶段发挥更重要作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15714 2026-07-20 cs.RO 新提交 50%

AC-VLA: Robust Out-of-Distribution Action Execution via Compositional Learning

AC-VLA:通过组合学习实现稳健的分布外动作执行

Xiaojiang Peng, Kai Peng, Jie Lu, Zheng Lian, Zitong YU, Xiaobo Wang

机构 * Shenzhen Technology University(深圳技术大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Tongji University(同济大学) Great Bay University(大湾区大学)

专题命中 其他LLM :LLM(abstract)

AI总结 研究VLA模型在分布外泛化的问题,提出AC-VLA框架,含组合学习模块和状态条件不对称掩码策略,无需修改架构可集成到VLA主干,在LIBERO和LIBERO-OOD基准测试中,该框架在组合OOD任务上有显著改进,分布内性能良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30534 2026-07-20 cs.CV 版本更新 50%

Orca: The World is in Your Mind

Orca: 世界在你心中

Yihao Wang, Yuheng Ji, Mingyu Cao, Yanqing Shen, Runze Xiao, Huaihai Lyu, Senwei Xie, Euan Liu, Klara Tian, Tianfeng Long, Yichi Zhang, Zhengliang Cai, Ruike Chen, Jifan Zhao, Ruochuan Shi, Zihan Tang, Jing Lyu, Wenxing Tan, Ningbo Zhang, Yangtao Hu, Yuming Gao, Xiansheng Chen, Junkai Zhao, Congsheng Xu, Boan Zhu, Ziqi Wang, Yupu Feng, Qiongqiong Zhang, Yingli Zhao, Yulong Ao, Shaoxuan Xie, You Liu, Guocai Yao, Leiduo Zhang, Xiaodan Liu, Yunyan Zhang, Yance Jiao, Xinyan Yang, Jiaxing Wei, Xu Liu, Tengfei Pan, Shaokai Nie, Chunlei Men, Sen Cui, Xiaojie Jin, Hongyang Li, Jianlan Luo, Yao Mu, Yunchao Wei, Jun Yan, Hang Zhao, Xiaolong Zheng, Jiaming Li, Yonghua Lin, Tiejun Huang, Zhongyuan Wang, Pengwei Wang

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 其他LLM :foundation model(abstract)

AI总结 提出Orca通用世界基础模型,通过无意识学习和有意识学习两种互补范式,从多模态世界信号中学习统一的世界潜在空间,并支持文本生成、图像预测和具身动作生成等下游任务。

Comments Project page: https://orca-wm.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏