arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-08-11 至 2026-08-11 共收录 772 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 51 篇

2608.08366 2026-08-11 cs.CV q-bio.GN 新提交 78%

VOICE: A Vision-Omics Foundation Model Integrating Direct and Retrieval-Based Prediction of In-situ Single-Cell Gene Expression

VOICE:一种融合原位单细胞基因表达直接预测与基于检索预测的视觉-组学基础模型

Xin Luo, Yicheng Tao, Haoxuan Zeng, Suyuan Wang, Chenzi Ouyang, Meiqi Zhu, Kai Liu, Shuibing Chen, Jie Liu

机构 * University of Michigan(密歇根大学) Weill Cornell Medicine(威尔康奈尔医学院)

专题命中 其他LLM :foundation model(title,abstract)

AI总结 该研究提出多模态基础模型 VOICE,通过对比学习对齐 H&E 形态与单细胞表达嵌入,融合直接回归与参考检索分支,泛化性良好且在七项指标上优于现有方法,可从 H&E 图像预测单细胞基因表达。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08881 2026-08-11 cs.AI cs.CL 新提交 73%

Theory-Guided Deception Detection: A RAG-Based Artificial Intelligence Exploration

理论引导的欺骗检测:基于检索增强生成(RAG)的人工智能探索

David M. Markowitz, Timothy R. Levine

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 该研究基于欺骗理论开发7个RAG模型,对比4个大语言模型与基线模型的欺骗判断,发现RAG模型反应偏差更低但准确率无显著差异,理论引导AI判断当前参数下不可靠,优化后或有潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08510 2026-08-11 cs.CL 新提交 70%

From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios

从语音到交互:鸡尾酒会场景下多模态系统的分析

Thai-Binh Nguyen, Zhaolin Li, Jan Niehues, Alexander Waibel

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本研究分析了CHiME-9 MCoRec任务中不同多模态系统解决鸡尾酒会场景的策略,发现最优系统实现57%相对错误减少,且高语音重叠并非性能差异的主要原因。

Comments Accepted at ICMI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08026 2026-08-11 cs.AI 新提交 70%

The Authority Expectancy Effect in Multi-User Conflict

多用户冲突中的权威预期效应

Eunna Lee

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究在Claude、Gemini、GPT、Grok四个LLMs上开展三类实验,发现社会权威信号可重构模型判断,提出并表征了具有参考依赖、证据重新解释、方向敏感性特性的权威预期效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07808 2026-08-11 cs.CR cs.AI 新提交 70%

The Anatomy of a Prompt Injection: A Component Model for Structured Analysis

提示注入的剖析:用于结构化分析的组件模型

Jeremy McHugh

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出七个组件的提示注入结构化分析模型,统一相关分类法,结合实例与CTI模式,助力标记、分析提示注入攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07541 2026-08-11 cs.CV cs.AI cs.MA 新提交 70%

NeuroPilot: An Agent-Driven Smart Pipeline for Processing, Quality Control, and Managing Neuroimages

NeuroPilot:一种用于神经影像处理、质量控制与管理的智能体驱动智能流程

Yiyao Chen, Yucheng Li, Jungong Tong, Shaoqi Wang, Kunhao Zhou, Ziquan Wei, Monica Murea, Marissa DiPiero, Tingting Dan, Guorong Wu

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出NeuroPilot多智能体系统,整合神经影像处理、质控与管理流程,在17个超12.3万受试者的队列中验证,将传统2-3个月的工作压缩至一周,提升了可扩展性与效率。

Comments 21 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08839 2026-08-11 cs.RO cs.CV 新提交 67%

SG-WAM: Text-Grounded and Spatial-aware Semantic Guidance for World-Action Models

SG-WAM:面向世界-动作模型的文本 grounded 与空间感知语义引导

Junjie He, Junfeng Li, Zhide Zhong, Haodong Yan, Ruixin Li, Yangyang Zheng, Jiaguan Zhu, Tianran Zhang, Yuqiao Du, Wen Chen, Shunbo Zhou, Haoang Li

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Ola Dimensions(奥拉维度公司)

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 针对现有世界-动作模型(WAM)存在的视频与指令语义不对齐问题,提出基于视觉-语言模型(VLM)的SG-WAM语义引导方法,通过注入文本接地且空间感知的语义前瞻,提升了WAM的指令遵循与操纵精度,经仿真和真实实验验证有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08637 2026-08-11 cs.SE 新提交 67%

Generics-Aware Fuzz Target Generation for Rust Libraries via Structured API Analysis

基于结构化API分析的Rust库泛型感知模糊测试目标生成

Yiming Chen, Kaiwen Zhang, Guanjun Liu, Xiaofeng Li, Xiaogang Dong

专题命中 其他LLM :LLM(abstract,abstract_cn)

AI总结 该研究针对Rust库模糊测试中现有工具约束处理不足导致覆盖率低的问题,提出GRAFT方法,通过结构化API分析生成可编译模糊目标,在13个Rust crate上的API覆盖率和编译成功率均优于现有工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08418 2026-08-11 cs.CV 新提交 67%

Learning Deep Modality-Shared Self-Expressiveness for Image Clustering with Textual Information

用于结合文本信息的图像聚类的深度模态共享自表达学习

Xianghan Meng, Wei He, Zhiyuan Huang, Chun-Guang Li

专题命中 其他LLM :language model(abstract,abstract_cn)

AI总结 提出DeepMORSE方法,通过模态共享自表达模型学习结合文本信息的图像聚类,在6个基准数据集上聚类性能提升超3%,且所学表示可迁移至下游任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08038 2026-08-11 cs.SE 新提交 67%

Stateful Multi-Agent LLMs for Cross-View Interface Alignment in Automotive Model-Based Systems Engineering

面向汽车基于模型的系统工程的有状态多智能体大语言模型,用于跨视图接口对齐

Aleksei Velsh, Nenad Petrovic, Alois Knoll

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 针对LLMs在汽车MBSE中引发的架构漂移问题,提出有状态多智能体验证流水线,在ADAS场景中实现97%实体可追溯性等指标,证明对抗性审核可让LLMs可靠生成零错误MBSE架构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00758 2026-08-11 cs.CY 版本更新 67%

Locating Translation as a Craft in the Age of AI Translation

带有情感的翻译:在翻译技术中中心化译者视角

Daniel Chechelnitsky, Sireesh Gururaja, Seyi Olojo, Giuseppe Attanasio, Wesley Hanwen Deng, Chrysoula Zerva, Maarten Sap

专题命中 其他LLM :large language model(abstract);language model(abstract)

AI总结 研究通过访谈19名跨11种语言和11个领域的专业译者,探讨译者在使用翻译技术时的视角、经验与担忧,强调需开发以译者需求为导向的翻译技术,而非取代人类翻译。

Comments AIES 2026, 14 pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10230 2026-08-11 physics.flu-dyn physics.comp-ph 67%

Volume penalization method for simulating flows around a rotating solid with multiple reference frame and sliding mesh

体积惩罚法用于模拟旋转固体周围的流体流动,结合多参考系和滑动网格

Ming Liu, Yosuke Hasegawa

专题命中 其他LLM :SLM(abstract,abstract_cn)

AI总结 本研究提出一种结合多参考系和滑动网格的体积惩罚法,用于模拟旋转固体周围的流体流动,并通过实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07555 2026-08-11 cs.CL cs.LG 版本更新 62%

Persistent Priors, Preserved Targets: A Stroop-Style Paradigm for Lexical Override

先验通过抑制持续存在:词汇覆盖的斯特鲁普范式

Han-yu Wang

机构 * The University of Hong Kong(香港大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.LG

AI总结 通过斯特鲁普范式实验,发现语言模型中的词汇先验在局部规则覆盖后仍持续存在,并通过激活修补定位到源位置三元组,揭示了先验是干扰起源和覆盖痕迹的共同通道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08005 2026-08-11 cs.LG 版本更新 61%

Preference Redirection via Attention Concentration: An Attack on Computer Use Agents

通过注意力集中进行偏好重定向:对计算机使用代理的一种攻击

Dominik Seip, Matthias Hein

机构 * Tübingen AI Center, University of Tübingen(图宾根大学图宾根人工智能中心)

专题命中 其他LLM :foundation model(abstract);分类 cs.LG;language model(journal_ref)

AI总结 本文提出PRAC攻击,通过重定向模型注意力操纵CUA选择过程,揭示了视觉模态的漏洞,威胁到基于开放权重模型的CUA安全。

Journal ref Conference on Language Modeling (COLM) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02078 2026-08-11 cs.CL cs.CV 版本更新 57%

CAVE: Competence-Aware Visual Boundary Evidence Alignment for Video Temporal Grounding

CAVE:面向视频时序定位的能力感知视觉边界证据对齐

Wei Jia, Zhicong Lu, Yu Chen, Xiang Wang, Shuai Li, Wenqian Lv, Jiayue Cao, Huaxing Liu

机构 * AMAP, Alibaba Group(阿里巴巴集团AMAP)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 针对视频时序定位中视觉证据与时间戳错位的问题,提出CAVE方法,通过边界证据奖励、轻量级热身及性能感知门控,在公开基准上验证了有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01043 2026-08-11 cs.CR cs.AI 版本更新 57%

Decoy Images Amplify Caption-Mediated Defenses Against Encoded Jailbreaks

诱饵图像增强针对编码越狱的字幕介导防御

Haoyu Zhang, Xiangchen Guan, Shibo Zheng, Mohammad Zandsalimy, Shanu Sushmita

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 该研究发现附加诱饵图像可降低VLMs的编码越狱攻击成功率,通过编码输入检测器门控附加诱饵,可在保留安全增益的同时控制良性弃权率,该效应在多模型、多场景下可复现。

Comments There is bug in algorithm implementation

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09778 2026-08-11 cs.RO 新提交 50%

RoboSeg: Online Part-Level Semantic Reconstruction for Robotic Manipulation via a Single Eye-in-Hand Camera

RoboSeg:基于单眼在手相机的机器人操作的在线部件级语义重建

Zhaochen Lan, Mengxiang Lin

机构 * School of Mechanical Engineering and Automation, Beihang University(北京航空航天大学机械工程及自动化学院)

专题命中 其他LLM :language model(abstract)

AI总结 RoboSeg是无需CAD模型的部件级语义重建系统,结合VLM、TSDF融合与SAM3,实现机器人操作的部件语义索引,在24次物理试验中21次完成综合任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08880 2026-08-11 cs.SE 新提交 50%

Fusing UI Structure & Semantics for Feature-Oriented App Screen Retrieval & Clustering

融合UI结构与语义的面向特征的应用屏幕检索与聚类

Arun Krishna Vajjala, Yanfu Yan, Ajay Krishna Vajjala, Shrunal Pothagoni, Denys Poshyvanyk, Kevin Moran

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对UI编程中代码与图形表示的抽象鸿沟,提出多模态神经符号嵌入技术FRAME,在三项基准测试中提升了屏幕检索与聚类的性能,可增强自动化UI设计与测试工具。

Comments 12 pages, 8 figures, 6 tables. Accepted at the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), Benevento, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07776 2026-08-11 cs.CR 新提交 50%

Can AI Write Compliant Code, and to What Extent? Evaluating SOC 2 Compliance of Claude Fable 5, Claude Opus 4.8, and Claude Opus 5 Across Four Use Cases

AI能否编写合规代码?以及在多大程度上能?评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性

Iccha Sethi, Herman Errico

专题命中 其他LLM :language model(abstract)

AI总结 该研究评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性,发现添加一句SOC 2语句可大幅提升合规率,模式匹配评分器不可靠需替换为语义检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07897 2026-08-11 cs.IT math.IT 新提交 50%

Semantic-Aided Iterative Decoding for Uplink Non-Orthogonal Transmission

用于上行非正交传输的语义辅助迭代解码

Wenjing Wei, Chentao Yue, Branka Vucetic, Yonghui Li

专题命中 其他LLM :language model(abstract)

AI总结 本文提出语义辅助迭代解码(Sem-IR)方案,结合ByT5语言模型与物理层迭代,在8dB时较无语义反馈的NOMA将块错误率降低一个数量级,性能优于TDMA。

Comments 6 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06939 2026-08-11 cs.CV 版本更新 50%

Degradation-Aware Prompt Learning with Cross-Modal Compensation for Adverse Weather Removal

面向恶劣天气去除的退化感知跨模态补偿提示学习

Wanshu Fan, Yunzhe Zhang, Yue Shen, Liyan Wang, Jing Qin, Kin-Man Lam, Cong Wang, Jinshan Pan

机构 * School of Software Engineering, Dalian University(大连大学软件工程学院) School of Mathematical Sciences, Dalian University of Technology(大连理工大学数学科学学院) The Hong Kong Polytechnic University(香港理工大学) University of California, San Francisco(加利福尼亚大学旧金山分校) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院)

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对恶劣天气导致图像退化影响视觉系统可靠性的问题,提出 DCMPC-Net 模型,通过跨模态提示补偿实现鲁棒的恶劣天气图像修复,性能优于现有最先进方法。

Comments Accepted for publication in IEEE Transactions on Image Processing. The code is available at: https://github.com/fanamber831/DCMPC-Net

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16445 2026-08-11 cs.CV 50%

CLAP: Isolating Content from Style through Contrastive Learning with Augmented Prompts

Yichao Cai, Yuhang Liu, Zhen Zhang, Javen Qinfeng Shi

机构 * Australian Institute for Machine Learning(澳大利亚机器学习研究所) University of Adelaide(阿德莱德大学)

专题命中 其他LLM :language model(abstract)

Comments Accepted as a conference paper at ECCV 2024; v7: Minor corrections to the adversarial robustness results and corresponding text. Conclusions unchanged

详情

展开后加载摘要…

URL PDF HTML 收藏