arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-08 至 2026-07-08 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 16 篇

2604.04703 2026-07-08 cs.HC 版本更新 91%

Bounded Autonomy: Controlling LLM Characters in Live Multiplayer Games

有界自主性:控制游戏中的LLM角色

Yunjia Guo, Jinghan Zhu, Siyu Wang, Haixin Qiao

专题命中 其他LLM :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出有界自主性架构,通过三种接口控制游戏中的LLM角色,使其在多人互动中保持可执行性和社会一致性,并通过实验验证其有效性。

Comments 9 pages, 5 figures, 5 tables; manuscript unchanged from v1

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05761 2026-07-08 cs.AI 新提交 90%

Synthetic Consumer Insight Generation with Large Language Models

使用大语言模型生成合成消费者洞察

Stephen L. France, Pia. A. Albinsson

机构 * Mississippi State University(密苏里州立大学) Appalachian State University(阿巴拉契亚州立大学)

专题命中 其他LLM :large language model(title,abstract);language model(title,abstract);LLM(abstract);prompting(abstract)

AI总结 研究探讨大语言模型能否为投射技术生成合成消费者数据,通过在多任务等方面测试其生成的回答,并与人类回答比较分析。结果显示二者在主题联想上有重叠但也有差异,还给出利用大语言模型生成数据的建议及对其局限性的认识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06223 2026-07-08 cs.AI 新提交 90%

Information Gain-based Rollout Policy Optimization: An Adaptive Tree-Structured Rollout Approach for Multi-Turn LLM Agents

基于信息增益的展开策略优化:一种用于多轮语言模型智能体的自适应树结构展开方法

Yijun Zhang, Fan Xu, Jiaxin Ding, Yule Xie, Shiqing Gao, Xin Ding, Haoxiang Zhang, Luoyi Fu, Xinbing Wang

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 其他LLM :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对LLM智能体长期搜索任务中展开预算分配不合理问题,提出基于信息增益的展开策略优化(IGRPO),通过按节点信息性分配预算进行树结构展开,并利用诱导教师分布指导策略优化,实验验证该方法在相同预算下优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31480 2026-07-08 cs.CL 版本更新 90%

Language Models Can Resolve Reference Compositionally, But It's Not Their Native Strength: The Case of the Personal Relation Task

语言模型可以组合性地解析指代,但这并非其天然优势:以个人关系任务为例

Bart Evelo, Meaghan Fowlie, Denis Paperno

专题命中 其他LLM :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 通过个人关系任务,比较人类与大型语言模型在外延任务(确定指称对象)和内涵任务(结构化表示意义)上的表现,发现人类更擅长外延任务而LLM更擅长内涵任务,表明缺乏指称基础是LLM模拟人类语言理解的关键缺失。

Comments A pre-MIT Press publication version. Paper accepted to Transactions of the Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.10954 2026-07-08 cs.SE cs.AI 版本更新 89%

Empirical Computation: Prompting versus Programming

经验计算:提示与编程

Eric Tang, Jing Liu, Marcel Böhme

机构 * CMU(卡内基梅隆大学) MPI-SP(马克斯·普朗克研究所)

专题命中 其他LLM :prompting(title,abstract);LLM(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 探讨经验计算(用提示让大语言模型解决问题而非编程)的挑战与机遇,呼吁软件工程界分析其特性,如正确性、属性及极限等,以将经验计算确立为软件工程领域。

Comments Accepted at ACM/IEEE ASE'26 (New Ideas and Emerging Results; NIER), 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05694 2026-07-08 stat.ML cs.LG 新提交 83%

Beyond Heuristic Tuning: Power-Calibrated LLM Watermarking

超越启发式调优:功率校准的大语言模型水印

Xiaopu Wang, Zelin He, Chengyuan Liu, Runze Li

机构 * Department of Statistics, Pennsylvania State University(统计学系,宾夕法尼亚州立大学)

专题命中 其他LLM :LLM(title,abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型水印,针对现有基于对数几率水印在可检测性和语义失真权衡及超参数选择上的问题,开发功率校准统计框架,建立相关定量关系,推导出实用参数选择程序,经实验验证可识别帕累托最优点。

Comments Accepted ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05855 2026-07-08 cs.LG cs.AI 新提交 73%

Unsupervised Anomaly Detection of Information Operations Users via Behavioral and Language Patterns

通过行为和语言模式对信息操作用户进行无监督异常检测

Sishun Liu, Sajal Halder, Ke Deng, Yan Wang, Xiuzhen Zhang

机构 * RMIT University(皇家墨尔本理工大学) Macquarie University(麦考瑞大学)

专题命中 其他LLM :LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 研究针对社交媒体网络信息操作检测难题,提出无监督方法TENSOR,利用多模态数据,通过训练时间点过程捕捉异常行为模式,并引入新证据函数调整输出,在五个真实数据集上表现优于基线。

Comments Accepted at ECML/PKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10177 2026-07-08 cs.CL cs.AI 版本更新 73%

Detoxify: A framework for abusive text transformation using LLMs

Detoxify:一个使用大语言模型进行辱骂性文本转换的框架

Rohitash Chandra, Jiyong Choi, Jayesh Sonawane

机构 * Transitional Artificial Intelligence Research Group, School of Mathematics and Statistics, UNSW(过渡人工智能研究组,数学与统计学学院,新南威尔士大学) Centre for Artificial Intelligence and Innovation, Pingla Institute(人工智能与创新中心,Pingla研究所)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究探索大语言模型在转换辱骂性文本上的有效性,提出Detoxify框架,用其转换含仇恨言论等的辱骂性文本并保留原意,评估四个大语言模型识别辱骂性文本的能力,经情感和语义分析,发现Groq与其他模型结果差异大,GPT-4o和DeepSeek有相似性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05406 2026-07-08 cs.CY cs.AI 新提交 70%

A Guiding Framework for K-12 Teachers in Creating AI-powered Learning Technologies through Vibe Coding

一个为K-12教师通过氛围编码创建人工智能驱动的学习技术的指导框架

Yukyeong Song, Seoyeon Choi, Jinhee Kim, Yeongje Kim, Lauren Weisberg, Jewoong Moon

机构 * University of Tennessee, Knoxville(田纳西大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究旨在为K-12教师通过氛围编码创建人工智能驱动的学习技术提供指导框架。提出GAIDE框架,基于设计思维和INTERACT构建,经交互分析验证及访谈定性分析,发现可提升教师人工智能素养,凸显创建式学习对专业发展的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05398 2026-07-08 cs.CL cs.CY 新提交 70%

How Personas Can Influence Agents to Play Split or Steal

角色如何影响智能体进行“分赃或偷窃”游戏

Carlos Leon, Alexandre Rodrigues, Pedro Gamito, Thomas D. Parsons

机构 * Universidade Lusófona(卢索福纳大学) Universitat de Barcelona(巴塞罗那大学) Université Paris Cité(巴黎城市大学) Computational Neuropsychology and Simulation (CNS) Laboratory(计算神经心理学与模拟(CNS)实验室) Arizona State University(亚利桑那州立大学)

专题命中 其他LLM :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究角色提示对智能体在“分赃或偷窃”游戏中行为的影响,通过智能体与虚拟人类互动实验,发现模型选择影响行为,亲社会等角色合作性强,揭示了相关互动特点,为虚拟现实研究提供基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05999 2026-07-08 cs.AI 新提交 57%

AgoraSim: A Hybrid Agent-Based Modeling Framework

AgoraSim:一个基于混合智能体的建模框架

Chung-Chi Chen

机构 * Human-Agent Ally Lab (HAA Lab)(人机协作实验室(HAA实验室)) National Institute of Informatics, Japan(日本国立信息学研究所)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 针对大语言模型智能体模拟输出易被过度解读及难与社会动态比较的问题,提出AgoraSim框架,能将文本等解析为可编辑配置,运行混合智能体群体并比较场景,通过多种接口公开,助用户检查轨迹、比较假设及识别需验证的案例。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05769 2026-07-08 cs.CV cs.AI 新提交 57%

LEGATO 2: Toward Multimodal Sheet Music Recognition and Understanding

LEGATO 2:迈向多模态乐谱识别与理解

Guang Yang, Brian Siyuan Zheng, Victoria Ebert, Noah A. Smith

机构 * Paul G. Allen School of Computer Science & Engineering, University of Washington(保罗·G·艾伦计算机科学与工程学院,华盛顿大学)

专题命中 其他LLM :language model(abstract);分类 cs.AI

AI总结 LEGATO 2提出从乐谱图像提取符号与语义知识的新流程,结合系统级分割和自回归视觉语言模型,能生成含文本的符号转录,在多数据集上优于现有技术,还能补充语言模型视觉输入,提升乐谱理解水平。

Comments 23 pages. Equal contribution: Guang Yang and Brian Siyuan Zheng

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05666 2026-07-08 cs.SE cs.AI 新提交 57%

What Do AI Agents Actually Change? An Empirical Taxonomy of Mutation Patterns in Performance-Improving Pull Requests

人工智能代理实际改变了什么?性能改进拉取请求中突变模式的实证分类法

Illia Dovhoshliubnyi, Nima Soroush, Ashkan Sami, Alexander Brownlee

机构 * Edinburgh Napier University(爱丁堡纳皮尔大学) University of Stirling(斯特林大学)

专题命中 其他LLM :LLM(abstract);分类 cs.AI

AI总结 研究聚焦人工智能编码代理这一黑箱,通过对33596个代理拉取请求中1254个性能相关差异块进行分类,发现主导的三类突变模式,揭示代理身份和目标策略对缩小基于搜索的软件工程操作空间有参考价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05774 2026-07-08 stat.ME 新提交 50%

AI-Augmented Statistical Network Estimation with Proxy Gene Embeddings

基于代理基因嵌入的人工智能增强统计网络估计

Yan Chen, Weijing Tang, Jin-Hong Du

专题命中 其他LLM :foundation model(abstract)

AI总结 研究利用现代生物医学基础模型提供的代理基因嵌入改善部分观察目标网络的潜在结构恢复,提出PLANE模型,结合两种信息源,经分析得出网络嵌入权重的最优选择,模拟等验证其能提升潜在恢复等效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05883 2026-07-08 cs.RO 新提交 50%

DexTele: A Dual-Arm Dexterous Teleoperation System Based on Motion Retargeting and Adaptive Force Control

DexTele:一种基于运动重定向和自适应力控制的双臂灵巧遥操作系统

Yuanchuan Lai, Qing Gao, Ziyan Liang, Xianfeng Cheng, Junjie Hu, Zhaojie Ju

机构 * School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳)) School of Computing, University of Portsmouth(计算学院,朴茨茅斯大学)

专题命中 其他LLM :language model(abstract)

AI总结 研究针对双臂灵巧遥操作中运动重定向和抓取的挑战,提出DexTele系统,通过视觉运动重定向模块和自适应抓取模块,结合运动图编码器、视觉语言模型等技术,实现多平台精确运动重定向与柔顺抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05253 2026-07-08 cs.CV 新提交 50%

Repurposing CLIP to Localize at Pixel Level

复用CLIP实现像素级定位

Jiaxiang Fang, Shiqiang Ma, Jing Wang, Siyu Chen, Fei Guo, Shengfeng He

机构 * School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Advanced Technology Center Beijing AI Laboratory(北京人工智能先进技术中心) School of Computing and Information Systems, Singapore Management University(新加坡管理大学计算与信息系统学院)

专题命中 其他LLM :language model(abstract)

AI总结 针对CLIP全局特征偏差导致难以适配像素级预测的问题,提出CLIPix框架,结合抗噪校正与定位嵌入策略,保留CLIP泛化性,在PASCAL、COCO上取得最优像素级定位性能。

Comments Accepted by IEEE TMM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏