arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-17 至 2026-07-17 共收录 250 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 22 篇

2607.14157 2026-07-17 cs.LG cs.AI cs.IR cs.SY eess.SY 新提交 62%

Certified Domain Consistency for Multi-Domain Retrieval: Label-Free Per-Domain Contamination Control with Conformal Risk Guarantees

多域检索的认证域一致性:具有共形风险保证的无标签逐域污染控制

Jayakumar Manoharan

机构 * Electric Power Research Institute (EPRI)(电力研究协会)

专题命中 领域大模型 :LLM(abstract);分类 cs.AI、cs.LG

AI总结 针对多域检索中错误域证据及污染控制问题,提出C3R控制层。基于风险控制预测集构建双分割方案,认证污染预算。通过实验验证其稳定性及有效性,能减少错误权威基础,且与冻结堆栈和重排器无关。

Comments Submitted to ACM TOI

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14937 2026-07-17 cs.LG cs.AI math.DS nlin.CD 新提交 62%

A Minimal Interpretable Architecture for Zero-Shot Reconstruction of Dynamical Systems

用于动态系统零样本重建的最小可解释架构

Christoph Jürgen Hemmer, Florian Plaswig, Daniel Durstewitz

机构 * Central Institute of Mental Health, Mannheim, Germany(德国曼海姆中央精神卫生研究所) Interdisciplinary Center for Scientific Computing (IWR), Heidelberg, Germany(德国海德堡跨学科科学计算中心 (IWR)) Faculty of Physics and Astronomy, Heidelberg University, Heidelberg, Germany(德国海德堡大学物理与天文学系)

专题命中 领域大模型 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对动态系统零样本重建基础模型缺乏预测机制洞察的问题,将DynaMix简化为DynaBase,其通过简单线性混合预测,参数负载低,表现出色,还得出映射族及不同训练策略效果,揭示最小机制并协调文献观察。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14995 2026-07-17 cs.LG q-bio.QM 新提交 57%

Multimodal Semantic-Aware Contrastive Learning For False Negative Mitigation in 3D Medical Imaging

用于减轻 3D 医学成像中假阴性的多模态语义感知对比学习

Sara Ketabi, Matthias W. Wagner, Cynthia Hawkins, Uri Tabori, Birgit Betina Ertl-Wagner, Farzad Khalvati

机构 * University of Toronto(多伦多大学) The Hospital for Sick Children(病童医院) Vector Institute(向量研究所) University Hospital Augsburg(奥格斯堡大学医院)

专题命中 领域大模型 :pretraining(abstract);分类 cs.LG

AI总结 研究针对3D医学成像中假阴性问题,提出多模态语义感知对比学习框架MseaCL,通过纳入放射学报告语义相似性作指导信号,经实验验证该框架用于预训练可提升下游任务表现,如儿科脑肿瘤分子分类AUC至少增22.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14984 2026-07-17 cs.AI 新提交 57%

Demographically-Conditioned Synthetic Medical Images for Bias Mitigation and Bias Detection in Disease Classifiers

用于减轻疾病分类器偏差和检测偏差的人口统计学条件合成医学图像

Mahmoud Ibrahim, Bart Elen, Chang Sun, Gokhan Ertaylan, Michel Dumontier

机构 * Institute of Data Science, Faculty of Science and Engineering, Maastricht University(马斯特里赫特大学科学与工程学院数据科学研究所) Department of Advanced Computing Sciences, Faculty of Science and Engineering, Maastricht University(马斯特里赫特大学科学与工程学院高级计算科学系) VITO(比利时弗拉芒技术研究所)

专题命中 领域大模型 :pretraining(abstract);分类 cs.AI

AI总结 研究医学图像分类器亚组公平性审计的样本量问题,提出用人口统计学条件合成生成器减轻训练偏差、检测评估偏差。以COVID-19胸部CT分类为例,发现其在偏差减轻和检测上的作用,如预训练效果好、能再现亚组排名等。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14408 2026-07-17 cs.AI 新提交 57%

Reward-Free Evolving Agents via Pairwise Validator

通过成对验证器实现无奖励进化智能体

Minghao Liu, Yu Wang, Jiayun Wang, Wei Wei

专题命中 领域大模型 :LLM(abstract);分类 cs.AI

AI总结 研究提出用成对验证器取代标量奖励设计,集成到三个自我进化引擎中,有自适应焦点和软Elo两种变体。该方法在多智能体和两种工件基质上多数设置下达到或超全奖励基线,无需标记成本,是替代每步奖励设计的有效方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14386 2026-07-17 cs.AI 新提交 57%

CIPHER: A Decoupled Exploration-Selection Framework for Test-Time Scaling of Data Science Agents

CIPHER:用于数据科学智能体测试时扩展的解耦探索-选择框架

Maxime Heuillet, Sharadind Peddiraju

机构 * Amazon Web Services(亚马逊网络服务公司)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 研究针对数据科学任务自动化挑战,提出CIPHER智能体,通过生成和选择多初始状态实现测试时扩展,解耦生成与选择过程。经实验验证其性能超越现有技术,刻画DES框架设计空间并给出设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14287 2026-07-17 cs.CV cs.LG 新提交 57%

XCT-SAM: Sequential Parameter-Efficient Domain Adaptation of SAM for Industrial XCT Defect Segmentation

XCT-SAM:用于工业XCT缺陷分割的SAM顺序参数高效域适应

Md Mahedi Hasan, Md Mushfiqur Rahaman, Alan Pachkovskiy, Imtiaz Ahmed, Jeremy Dawson, Srinjoy Das

专题命中 领域大模型 :foundation model(abstract);分类 cs.LG

AI总结 针对增材制造X射线计算机断层扫描图像缺陷分割难题,提出XCT-SAM框架,先在合金微观结构数据集微调Conv-LoRA适配器,再转移到XCT图像,参数高效且冻结超99%模型,实验表明其性能优于基线,有效实现工业XCT缺陷分割。

Comments 10 pages, 7 figures, 3 tables. Accepted to the IAPR Workshop on Machine Vision for Industrial Inspection (MVI2), in conjunction with ICPR 2026. Code: https://github.com/Mahedi-61/XCT-SAM

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01086 2026-07-17 cs.AI cs.CR cs.DB cs.DC cs.SE 版本更新 57%

MedBeads: An AI-Native Clinical Context Graph Built from Immutable Beads and Reconstructable Clinical Links

MedBeads:面向可信医疗AI的智能体原生不可变数据基底

Takahito Nakajima

机构 * Diagnostic Imaging and Interventional Radiology, Institute of Medicine, University of Tsukuba(东京大学医学研究院诊断影像与介入放射学部) Center for Cyber Medicine Research, University of Tsukuba(东京大学计算机医学研究中心)

专题命中 领域大模型 :LLM(abstract_cn);分类 cs.AI

AI总结 针对医疗AI中电子病历与智能体间的上下文不匹配问题,提出基于Merkle有向无环图的不可变数据架构MedBeads,通过确定性图遍历替代概率检索,实现可审计、防篡改的临床上下文提供。

Comments 23 pages, 5 figures, 3 tables. Reference implementation and reproducible Docker demo available at https://github.com/medbeads/medbeads

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 知识编辑与模型理解 14 篇

2607.14197 2026-07-17 cs.AI 新提交 83%

How Artificial Intelligence LLM Engines Shape the Global Conflict Information Environment

人工智能大语言模型引擎如何塑造全球冲突信息环境

Jason Miklian

专题命中 知识编辑与模型理解 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究人工智能大语言模型引擎对全球冲突信息环境的塑造,通过向五个引擎询问28场冲突问题并分析答案及相关网站,发现可检索记录稀少会致引擎出错,存在生成引擎优化源头优化,探讨了研究意义、政策影响及未来机遇挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15175 2026-07-17 cs.CL 新提交 79%

Linear representations of grammaticality in neural language models

神经语言模型中语法性的线性表示

Jane Li, Najoung Kim

机构 * Johns Hopkins University(约翰·霍普金斯大学) Boston University(波士顿大学)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.CL

AI总结 探讨神经语言模型能否基于语法性区分字符串,通过质量均值探测研究语法性是否编码在其内部表示中,结果表明语法性在多种预训练模型中有力编码,为相关争论提供新证据及评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14791 2026-07-17 cs.AI 新提交 79%

Transcoders for Investigating Deception in Language Models

用于研究语言模型中欺骗行为的转码器

Darius Lim, Nathan Leow, Xin Wei Chia

机构 * Home Team Science & Technology Agency (HTX)(新加坡内政部科技局)

专题命中 知识编辑与模型理解 :language model(title,abstract);分类 cs.AI

AI总结 研究用转码器分析语言模型欺骗行为,通过预训练转码器的Qwen3 - 4B模型构建归因图,经特征引导和电路分析识别相关特征字典,发现欺骗源于模型内部机制,凸显转码器在监测及检测语言模型安全漏洞方面的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15218 2026-07-17 cs.AI cs.CR 新提交 77%

When Words Are Safe But Actions Kill: Probing Physical Danger Beyond Text Safety in Hidden-State Risk Space

当言语安全但行动致命:在隐藏状态风险空间中探究超越文本安全的物理危险

Weimeng Wang, Ziqiang Wang, Zihang Zhan, Chuanpu Fu, Qi Li, Ke Xu

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学)

专题命中 知识编辑与模型理解 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型中语言无害指令在现实世界中的物理危险与文本级内容危险是否相同,提出PRISM方法,通过隐藏状态方向分析等证明CD和PD可分离,PRISM在多个基准测试中表现良好,能检测物理危险而非仅依赖明确不安全措辞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14809 2026-07-17 cs.CV 新提交 71%

An LLM-Based Automatic Sportscast Solution for Robot Soccer Matches

一种基于大语言模型的机器人足球比赛自动体育解说解决方案

Francesco Petri, Michele Brienza, Daniele Nardi, Domenico Daniele Bloisi, Aldo Gangemi, Vincenzo Suriani

机构 * Sapienza University of Rome(罗马第一大学) Institute for Cognitive Sciences and Technologies (ISTC-CNR)(认知科学与技术研究所(ISTC-CNR)) International University of Rome(罗马国际大学) University of Bologna(博洛尼亚大学)

专题命中 知识编辑与模型理解 :LLM(title)

AI总结 针对机器人世界杯比赛,提出基于神经符号架构的自动体育解说方案,弥合运动跟踪与自然语言生成差距,能在直播和赛后生成统计数据与解说,适应不同机器人共享场地的联赛新动态。

Comments Poster presentation at RoboCup Symposium 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14423 2026-07-17 cs.CV eess.IV 新提交 71%

Emergent Region-Level Facial Correspondence in Frozen Vision Foundation Models

冻结视觉基础模型中新兴的区域级面部对应

Izaldein Al-Zyoud, Abdulmotaleb El Saddik

专题命中 知识编辑与模型理解 :foundation model(title)

AI总结 研究人脸区域级对应问题,利用冻结的DINOv3特征及FaRL,在真实视频上评估跨身份匹配和时间标签传播,结果表明DINOv3是区域级面部对应强大零样本表示,中间自监督特征对密集面部分析最有用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14631 2026-07-17 cs.CV cs.AI 新提交 70%

Knowing You at First Glance: Inferring Apparent Personality from Faces

一眼识你:从面部推断表面人格

Shuhuan Chen, Xiangyu Zhu, Weisong Zhao, Haichao Shi, Xiao-Yu Zhang, Zhen Lei

机构 * Institute of Automation, CAS(中国科学院自动化研究所) Institute of Information Engineering, CAS(中国科学院信息工程研究所) School of Cyber Security, UCAS(中国科学院大学网络空间安全学院) School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院) Centre for Artificial Intelligence and Robotics, Hong Kong Institute of Science & Innovation, CAS(中国科学院香港创新研究院人工智能与机器人中心) School of Computer Science and Engineering, the Faculty of Innovation Engineering, M.U.S.T(澳门科技大学创新工程学院计算机科学与工程系)

专题命中 知识编辑与模型理解 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究从面部图像推断表面人格,提出GlanceFace框架,利用视觉语言模型、语义增强模块及不确定性感知学习策略,在基于MBTI的基准测试中表现出色,揭示面部特征与人格特质关系,助力具身智能体交互策略。

Comments Accepted by The 9th Chinese Conference on Pattern Recognition and Computer Vision, PRCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14147 2026-07-17 cs.CL cs.AI cs.CR cs.LG 新提交 67%

Breaking Refusal in the First Half: A Mechanistic Study of the Prefill Jailbreak

上半场打破拒绝:预填充越狱的机制研究

Alex Kwon

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究语言模型中预填充消除拒绝的现象,通过实验定位到早期窗口,揭示拒绝是浅层响应端计算,预填充控制是通用自回归条件作用,还明确了主导机制及相关特征,指出监测器免疫特点和机制的分散性与失效表面的局部性。

Comments 31 pages, 3 figures. Code and derived artifacts: https://github.com/collapseindex/breaking-refusal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14536 2026-07-17 cs.LG 新提交 57%

Muse: Representation Geometry of Muon Beyond Normalized Momentum

缪子:超越归一化动量的μ子表示几何

Da Chang, Qiankun Shi, Lvgang Zhang, Di He, Yaoshuai Ma, Ganzhao Yuan, Yongxiang Liu

机构 * Pengcheng Laboratory(鹏城实验室) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Southern University of Science and Technology(南方科技大学) Shenzhen University of Advanced Technology(深圳先进技术大学) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 知识编辑与模型理解 :pretraining(abstract);分类 cs.LG

AI总结 研究μ子风格优化器中表示选择对优化器几何的影响,引入{\方法}族优化器,通过预训练实验及固定动量诊断发现平衡非原生表示可匹配原生表示性能,减小较短维度会改变优化效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14280 2026-07-17 cs.RO cs.LG 新提交 57%

DiMaS: Distribution Matching for Steering Vision-Language-Action Models

DiMaS:用于引导视觉-语言-动作模型的分布匹配

Pegah Khayatan, Sara Meziane, Jayneel Parekh, Matthieu Cord

机构 * ISIR, Sorbonne Université(法国国家信息与自动化研究所,索邦大学)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.LG

AI总结 研究针对基于流匹配的视觉-语言-动作模型细粒度行为控制不足的问题,提出DiMaS分布匹配引导策略,能有效控制行为,研究其泛化性并分析原因,推动了视觉运动设置下的分布匹配设计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14250 2026-07-17 cs.CL 新提交 57%

The Severance Problem: LLMs are Unaware of the Person Beyond the Prompt

分离问题:大语言模型未意识到提示之外的人

Dor Litvak, Liu Leqi

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 知识编辑与模型理解 :language model(abstract);分类 cs.CL

AI总结 研究指出个人AI助手存在不良行为,源于语言模型的“分离问题”。提出通过“分离模式”将结构化无知纳入语言模型上下文的解决方案,经实证,五个模型家族采用此模式后能减少不良行为,模型在信息缺失时会询问澄清问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14521 2026-07-17 cs.CV 新提交 50%

Uni-AdaVD: Universal Concept Erasure for Visual Generation via Orthogonal Value Decomposition

Uni-AdaVD:通过正交值分解实现视觉生成的通用概念擦除

Qifan Zhou, Yuan Wang, Yanbin Hao, Xiang Wang, Kuien Liu, Richang Hong, Meng Wang

机构 * School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机与信息工程学院) School of Cyber Science and Technology, University of Science and Technology of China(中国科学技术大学网络空间安全学院) School of Artificial Intelligence and Data Science, University of Science and Technology of China(中国科学技术大学人工智能与数据科学学院) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)

专题命中 知识编辑与模型理解 :pretraining(abstract)

AI总结 针对视觉生成模型吸收不良概念问题,提出Uni-AdaVD框架,将多模态注意力值空间作为干预空间,结合正交值分解与自适应擦除移位抑制目标语义方向,实验证明其在单多概念擦除且保留非目标先验方面性能强大,为视觉生成模型提供安全机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14442 2026-07-17 cs.CR 新提交 50%

Disclosure Divergence: Measuring Privacy Policy and Data Safety Misalignment at Scale

披露差异:大规模衡量隐私政策与数据安全的不一致性

Mst Eshita Khatun, Lamine Noureddine, Sideeq Bello, Aisha Ali-Gombe

专题命中 知识编辑与模型理解 :LLM(abstract)

AI总结 针对移动应用隐私政策与数据安全标签表述不一致问题,通过对6051款安卓应用大规模实证研究,利用基于大语言模型的框架和统一模式,测量一致性并引入风险评分,发现敏感类别受影响大,凸显披露机制差距,强调加强验证与提高透明度。

Journal ref Proceedings on Privacy Enhancing Technologies (PoPETs) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13805 2026-07-17 cs.CV 版本更新 50%

AspectCLIP: Optimizing CLIP Representation Space via Aspect-Guided Consistency Regularization

AspectCLIP:通过方面引导的一致性正则化优化CLIP表示空间

Yiyang Yao, Shanglin Liu, Jianming Lv, Chengjun Wang, Jinyi Li, Yuchan Jie, Zhihua Jin

机构 * School of Computer Science and Technology, South China University of Technology(华南理工大学计算机科学与工程学院)

专题命中 知识编辑与模型理解 :pretraining(abstract)

AI总结 研究针对图像与文本信息不对称问题,提出AspectCLIP框架,通过基于文本相似性划分样本为属性簇,在簇内应用循环一致性并限制跨簇正则化,实现更优的表示空间,在下游任务中性能超传统方法。

Comments PRCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 其他LLM 18 篇

2601.05050 2026-07-17 cs.AI econ.GN q-fin.EC 版本更新 90%

Large language models can effectively convince people to believe conspiracies

大语言模型能够有效地说服人们相信阴谋论

Thomas H. Costello, Kellin Pelrine, Matthew Kowal, Jasper Timm, Antonio A. Arechar, Jean-François Godbout, Adam Gleave, David Rand, Gordon Pennycook

机构 * Carnegie Mellon University(卡内基梅隆大学) York University(约克大学) Center for Research and Teaching in Economics(经济研究中心) MIT(麻省理工学院) Université de Montréal(蒙特利尔大学) Mila Cornell University(康奈尔大学) University of Regina(Regina大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 研究大语言模型能否有效说服人们相信阴谋论,通过四项实验发现其既能增加也能降低阴谋信念,反驳效果更佳,特定提示可降低支持阴谋论有效性,还存在信息分享上的真理不对称,有潜在技术方案减轻风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.03723 2026-07-17 cs.CL cs.AI stat.ME 版本更新 90%

Segmenting Human-LLM Co-authored Text via Change Point Detection

通过变化点检测对人类与大语言模型共同撰写的文本进行分割

Mengchu Li, Jin Zhu, Jinglai Li, Chengchun Shi

机构 * School of Mathematics University of Birmingham(数学系 英国伯明翰大学) Department of Statistics London School of Economics and Political Science(统计系 伦敦政治经济学院)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对大语言模型兴起后区分人类与LLM共同撰写文本的需求,提出类似时间序列变化点检测的算法,开发加权和广义算法,建立最优性,实验表明该方法性能优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15727 2026-07-17 cs.CR cs.AI cs.LG cs.MA cs.SE 版本更新 90%

AgentWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

ClawWorm:针对LLM代理生态系统自主传播的攻击

Yihao Zhang, Zeming Wei, Xiaokun Luan, Chengcan Wu, Zhixin Zhang, Jiangrong Wu, Haolin Wu, Huanran Chen, Jun Sun, Meng Sun

机构 * Peking University(北京大学) Sun Yat-sen University(中山大学) Wuhan University(武汉大学) Tsinghua University(清华大学) Singapore Management University(新加坡管理学院)

专题命中 其他LLM :LLM(title,title_cn);分类 cs.AI、cs.LG

AI总结 研究提出ClawWorm,首个自主传播的LLM代理框架攻击,通过单条消息实现持久化感染与多跳传播,揭示模型安全姿态差异及防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01754 2026-07-17 cs.CY cs.AI cs.CL cs.HC 版本更新 88%

Empirical evidence of Large Language Model's influence on human spoken communication

大语言模型对人类口语交流影响的实证证据

Hiromu Yakura, Ezequiel Lopez-Lopez, Levin Brinkmann, Ignacio de la Serna, Lara Kirfel, Prateek Gupta, Ivan Soraperra, Thomas F. Eisenmann, Dirk U. Wulff, Iyad Rahwan

机构 * Center for Humans and Machines(人类与机器中心) Max-Planck Institute for Human Development(人类发展马克斯·普朗克研究所) Center for Adaptive Rationality(适应性理性中心) TUD Dresden University of Technology(德累斯顿技术大学) Department of Business Analytics and Decision Science(商业分析与决策科学系) Vienna University of Economics and Business(维也纳经济与商业大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型对人类口语交流的影响,通过分析播客对话及实验发现,ChatGPT优先生成的词汇在人类自发语音中增加,人类会内化其词汇选择,揭示机器训练数据反馈至人类语言,引发对语言同质化及AI文化影响的担忧。

详情

展开后加载摘要…

URL PDF HTML 收藏
2201.04868 2026-07-17 cs.HC cs.CL cs.DB 版本更新 81%

Beyond Interestingness: Semantic and Context-Aware Natural Language Query Recommendations for Visual Data Analysis

超越趣味性:用于视觉数据分析的语义和上下文感知自然语言查询推荐

Xingbo Wang, Siyuan Li, Furui Cheng, Yong Wang, Jiang Long, Hong Lu, Huamin Qu, Ke Xu

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 针对分析师分解查询目标的挑战,研究用语义和上下文感知推荐增强自然语言接口,联合整合多种因素引导数据库探索,经多方式评估,QRec-NLI在代理比较和用户研究中表现优于基线。

Comments This is the preprint version of the paper accepted to Visual Informatics journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14113 2026-07-17 cs.CL cs.AI 新提交 81%

T5-CSBoost: Adversarial Perturbation Resistant LLM Fingerprinting

T5-CSBoost:抗对抗扰动的语言模型指纹识别

Gayan K. Kulatilleke, Mahsa Baktashmotlagh, Siamak Layeghy, Marius Portmann

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 研究针对AIGT检测器在多种干扰下准确性下降的问题,提出T5-CSBoost,通过引入辅助损失鼓励学习抗扰动风格表示,在多基准测试中达先进水平,对高强度对抗扰动鲁棒性增强,证明对比学习规范风格嵌入可构建更强大指纹识别系统。

Comments 14 pages, 3 datasets, code and data will be provided

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14106 2026-07-17 cs.CL cs.AI 新提交 81%

Token Time Continuous Diffusion for Language Modeling

用于语言建模的令牌时间连续扩散

Parikshit Bansal, Sujay Sanghavi

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究提出令牌时间连续扩散(TTCD)语言模型,其在连续空间运行,引入令牌时间概念。该模型避免多令牌并行采样,能更好建模条件生成。实验表明,在高速加速时TTCD优于离散模型,在无条件和条件生成上有优势,数独求解也有类似成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15146 2026-07-17 cs.CL cs.CY 新提交 79%

Grokipedia vs Wikipedia: An LLM-Based Audit of Political Neutrality along Ideologies

Grokipedia与维基百科:基于大语言模型的意识形态政治中立性审计

Filippos Vlahos, Guillaume Bied, Tijl De Bie

机构 * Ghent University(根特大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL

AI总结 研究对比Grokipedia与维基百科的政治中立性,通过四位大语言模型评判员,分析1394对相关文章在九个维度的中立性,发现Grokipedia中立性逊于维基百科,两者对不同意识形态政治家有不同偏向。

详情

展开后加载摘要…

URL PDF HTML 收藏