arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 730 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 730 篇

2608.08880 2026-08-11 cs.SE 新提交 50%

Fusing UI Structure & Semantics for Feature-Oriented App Screen Retrieval & Clustering

融合UI结构与语义的面向特征的应用屏幕检索与聚类

Arun Krishna Vajjala, Yanfu Yan, Ajay Krishna Vajjala, Shrunal Pothagoni, Denys Poshyvanyk, Kevin Moran

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对UI编程中代码与图形表示的抽象鸿沟,提出多模态神经符号嵌入技术FRAME,在三项基准测试中提升了屏幕检索与聚类的性能,可增强自动化UI设计与测试工具。

Comments 12 pages, 8 figures, 6 tables. Accepted at the 42nd IEEE International Conference on Software Maintenance and Evolution (ICSME 2026), Benevento, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07776 2026-08-11 cs.CR 新提交 50%

Can AI Write Compliant Code, and to What Extent? Evaluating SOC 2 Compliance of Claude Fable 5, Claude Opus 4.8, and Claude Opus 5 Across Four Use Cases

AI能否编写合规代码?以及在多大程度上能?评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性

Iccha Sethi, Herman Errico

专题命中 其他LLM :language model(abstract)

AI总结 该研究评估Claude Fable 5、Claude Opus 4.8和Claude Opus 5在四个用例中的SOC 2合规性,发现添加一句SOC 2语句可大幅提升合规率,模式匹配评分器不可靠需替换为语义检查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07897 2026-08-11 cs.IT math.IT 新提交 50%

Semantic-Aided Iterative Decoding for Uplink Non-Orthogonal Transmission

用于上行非正交传输的语义辅助迭代解码

Wenjing Wei, Chentao Yue, Branka Vucetic, Yonghui Li

专题命中 其他LLM :language model(abstract)

AI总结 本文提出语义辅助迭代解码(Sem-IR)方案,结合ByT5语言模型与物理层迭代,在8dB时较无语义反馈的NOMA将块错误率降低一个数量级,性能优于TDMA。

Comments 6 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06913 2026-08-10 cs.CV 新提交 50%

MuST-VAD: Mutual Structured Learning for Video Anomaly Detection

MuST-VAD:用于视频异常检测的互结构化学习

Satoshi Hashimoto, Hitoshi Nishimura, Mori Kurokawa

专题命中 其他LLM :language model(abstract)

AI总结 MuST-VAD是用于弱监督视频异常检测的互结构化学习框架,通过检测器与LVLM的双向知识交换,在UCF-Crime数据集上显著提升了检测精度,AP优于现有最优方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04100 2026-08-06 hep-ph hep-ex hep-th 新提交 50%

Language-Guided Hypotheses Generation for Sparse SMEFT Analyses

用于稀疏SMEFT分析的语言引导假设生成

Ahmed Hammad, Veronica Sanz

专题命中 其他LLM :language model(abstract)

AI总结 研究解决稀疏SMEFT分析中算符假设选择难题,提出开源llm4smeft框架,结合微调语言模型与检索增强生成,可本地运行且能生成候选算符及费希尔信息。

Comments 34 pages, 2 figures and 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03329 2026-08-05 cs.SE 新提交 50%

Making AI Visible, Not Vanished: How AI Policies Reshape Developer Experience on GitHub

让AI可见而非消失:AI政策如何重塑GitHub上的开发者体验

Yunqi Chen, Thomas Zimmermann, Bianca Trinkenreich

专题命中 其他LLM :prompting(abstract)

AI总结 本研究通过分析29624个GitHub代码库,提出TRACE框架,发现AI治理主要规范而非禁止AI辅助开发,强调透明度与责任性的政策效果更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02994 2026-08-05 physics.optics 新提交 50%

Chiral optics without chiral matter

无手性物质的手性光学

Jingxuan Wei

专题命中 其他LLM :prompting(abstract)

AI总结 该研究打破手性光-物质相互作用需依赖结构手性材料的传统认知,揭示非手性各向异性系统可产生手性光学效应,拓展了手性光学应用的技术路径。

Comments 1 Figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00463 2026-08-04 cs.CV cs.MM cs.SD 新提交 50%

Scene2Sound: Auditory-Grounded Soundscape Generation for 3D Gaussian Worlds

Scene2Sound:面向3D高斯世界的听觉锚定声景生成

Masaki Yoshida, Ren Togo, Takahiro Ogawa, Miki Haseyama

机构 * Hokkaido University(北海道大学)

专题命中 其他LLM :language model(abstract)

AI总结 Scene2Sound是一个无训练框架,通过听觉锚定和高斯集匹配为3D高斯世界生成空间一致的声景,在保留音频质量的同时解决了现有方法空间不一致的问题,经实验和用户研究验证有效。

Comments 14 pages. Project page: https://masaki-lmd.github.io/scene2sound/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28827 2026-08-03 cs.CY 新提交 50%

Hidden Errors in Big Data: The Case of Property Records

大数据中的隐藏错误:以房产记录为例

Evelyn Smith, Emma Harvey, Jacob Goldin, Daniel E. Ho

专题命中 其他LLM :prompting(abstract)

AI总结 本文审计两个中介房产数据集,发现其存在1-2%售价偏差、12-15%覆盖错误等问题,错报高度一致,会影响财产税累退性估计,凸显开放行政数据的重要性。

Comments To appear in Proceedings of the Ninth AAAI/ACM Conference on AI, Ethics, and Society (AIES-26), Malmö, Sweden, October 12-14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28352 2026-07-31 physics.ed-ph 新提交 50%

Studying Circular Motion with an AI-Generated Smartphone Physics Lab

用AI生成的智能手机物理实验室研究圆周运动

Josep Ll. Suñer, Francisco M. Muñoz-Pérez, Juan C. Castro-Palacio, Juan A. Monsoriu, Martín Monteiro, Cecilia Stari, Arturo C. Martí

专题命中 其他LLM :prompting(abstract)

AI总结 本文通过向AI助手自然语言提示生成无代码定制化浏览器转动实验室,结合旋转平台研究两种圆周运动,并用Tracker视频分析验证测量结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27139 2026-07-30 cs.CV 新提交 50%

SeasonStereo: Robust Dense Stereo Matching for Multi-Date Satellite Imagery via Generative AI

SeasonStereo:基于生成式AI的多日期卫星图像鲁棒密集立体匹配

Álvaro Díaz-Laureano, Roger Marí, Elías Masquil, Pablo Arias, Gabriele Facciolo

机构 * Eurecat(欧罗卡特技术中心) IIE, Facultad de Ingeniería, Universidad de la República(乌拉圭共和国大学工程学院IIE) Universitat Pompeu Fabra(庞培法布拉大学) Université Paris-Saclay(巴黎萨克雷大学) CNRS(法国国家科学研究中心) ENS Paris-Saclay(巴黎萨克雷高等师范学校) Institut Universitaire de France(法国大学研究院)

专题命中 其他LLM :foundation model(abstract)

AI总结 SeasonStereo框架利用带可控季节外观变化的合成图像对训练并结合基础模型零样本几何先验,实现低成本、高精度的多日期卫星图像密集立体匹配,支持大规模三维重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25115 2026-07-29 q-bio.BM 新提交 50%

Persistent Manifold Learning of Protein Properties

蛋白质性质的持久流形学习

Xingjian Xu, Zhe Su, Guo-Wei Wei, Chunmei Wang

专题命中 其他LLM :language model(abstract)

AI总结 该研究针对生物分子结合预测难题,提出持久流形学习框架,利用边界诱导图拉普拉斯算子提取信息,结合相关模型表示与梯度提升决策树,在金属蛋白-配体和蛋白质-蛋白质基准测试中表现优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23931 2026-07-28 cs.CY 新提交 50%

State-dependent error correlations shape voting thresholds in committees of AI agents

状态依赖误差相关性塑造人工智能代理委员会中的投票阈值

Haifeng Li, Mo Hai

专题命中 其他LLM :language model(abstract)

AI总结 研究人工智能代理委员会投票阈值,结合萨赫 - 斯蒂格利茨筛选与误差依赖性,通过齐次可交换高斯 - copula模型及对大量投票数据的估计,发现考虑依赖关系可提升相关系数、降低损失,改进投票阈值选择。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23774 2026-07-28 cs.SE 新提交 50%

Semantic-Enhanced Automatic Refinement of Architecture Recovery Results Using LLMs

使用大语言模型进行语义增强的架构恢复结果自动优化

Yiran Zhang, Chengwei Liu, Yuqiang Sun, Zhengzi Xu, Weisong Sun, Wenke Li, Wuxia Jin, Yang Liu

专题命中 其他LLM :LLM(abstract)

AI总结 研究旨在简化架构恢复流程,提出Semref框架结合大语言模型与依赖分析自动优化架构,经在9个项目和10个工具上测试,采用5个指标评估,结果表明该框架提高了恢复架构的准确性。

Comments Accepted by ICSE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23606 2026-07-28 cs.SD eess.AS 新提交 50%

Improving Zero-Shot Phonetic Classification through Language-Agnostic Articulatory Features

通过语言无关的发音特征改进零样本语音分类

Ryo Magoshi, Jaeyoung Lee, Shinsuke Sakai, Tatsuya Kawahara

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究生院) NTT, Inc.(日本电信电话公司)

专题命中 其他LLM :foundation model(abstract)

AI总结 研究针对语音到国际音标转录中标签不准确问题进行零样本语音分类评估,提出基于连续发音特征向量的分类方法,该方法优于离散标记法,且采用最佳时间聚合可提升分类效果,尤其对稀有音素和特定语音分类。

Comments Accepted at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20713 2026-07-24 cs.CR cs.SE 新提交 50%

Security Vulnerability Patterns in AI-Generated Code: A Cross-Model Comparative Study

人工智能生成代码中的安全漏洞模式:跨模型比较研究

Shanna M. Kahn, John D. Hastings

专题命中 其他LLM :LLM(abstract)

AI总结 研究基于大语言模型的编码工具生成的自动化脚本安全风险,通过跨模型收集代码并审查漏洞,发现风险与任务类别有关,各模型漏洞情况相似,组织应思考是否不经审查就部署此类自动化代码。

Comments 9 pages, 9 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19513 2026-07-23 math.RA math.RT 新提交 50%

Constructing a complex Lie algebra isomorphic to its complex conjugate but not definable over reals

构建一个同构于其复共轭但不能在实数域上定义的复李代数

Mikhail Borovoi, Willem A. de Graaf, Robert M. Guralnick

专题命中 其他LLM :LLM(abstract)

AI总结 该研究利用特定想法及计算,构建出一个10维复两步幂零李代数,它同构于自身复共轭却无法在实数域定义。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17827 2026-07-21 econ.GN q-fin.EC 新提交 50%

A Gate-and-Menu Theory of Collective Tourism Brand Value

集体旅游品牌价值的门与菜单理论

Johan Fourie

专题命中 其他LLM :language model(abstract)

AI总结 研究集体旅游品牌价值,将目的地建模为门与菜单,用奥曼 - 沙普利核算分配品牌价值,发现分散管理者对门质量维护不足,还通过语言模型测量框架结构并举例说明品牌内污染排序。

Comments 32 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17970 2026-07-21 cs.RO 新提交 50%

MEVION: Low-Cost Open-Source Data Collection System for Powerful and High-Speed Dual-Arm Manipulation

MEVION:用于强大高速双臂操作的低成本开源数据收集系统

Kento Kawaharazuka, Yoshiki Obinata, Hirokazu Ishida, Jihoon Oh, Temma Suzuki, Shintaro Inoue, Keita Yoneda, Ayumu Iwata, Kei Okada

机构 * The University of Tokyo(东京大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 在开发机器人基础模型竞争激烈的背景下,针对ALOHA产生高力和速度能力有限的问题,开发了低成本开源的MEVION双臂机器人数据收集系统,介绍其结构、性能,证明其能为特定任务收集数据及支持相关运动生成。

Comments Accepted to IEEE Robotics and Automation Practice, website: https://haraduka.github.io/mevion-hardware/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16219 2026-07-21 cs.CY 新提交 50%

MDAF: A Multi-Dimensional Annotation Framework for Automated Foreign Policy Analysis

MDAF:一种用于自动外交政策分析的多维注释框架

Songruowen Ma, Songting Ding, Fangyin Zhou, Jörg Friedrichs

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对政府网站外交政策文本未被充分利用的问题,提出MDAF框架,集成大语言模型工作流程,应用于五眼联盟国家与中国相关文本,实现文本识别、信息提取和事件分类自动化,支持跨国比较等,为外交政策分析等做贡献。

Comments 32 pages, 9 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15714 2026-07-20 cs.RO 新提交 50%

AC-VLA: Robust Out-of-Distribution Action Execution via Compositional Learning

AC-VLA:通过组合学习实现稳健的分布外动作执行

Xiaojiang Peng, Kai Peng, Jie Lu, Zheng Lian, Zitong YU, Xiaobo Wang

机构 * Shenzhen Technology University(深圳技术大学) Shenzhen University of Advanced Technology(深圳先进技术大学) Tongji University(同济大学) Great Bay University(大湾区大学)

专题命中 其他LLM :LLM(abstract)

AI总结 研究VLA模型在分布外泛化的问题,提出AC-VLA框架,含组合学习模块和状态条件不对称掩码策略,无需修改架构可集成到VLA主干,在LIBERO和LIBERO-OOD基准测试中,该框架在组合OOD任务上有显著改进,分布内性能良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14588 2026-07-17 cs.HC 新提交 50%

Conversational Tactile Data Interfaces: Co-Designing Accessible Data Experiences with Blind Users Using Refreshable Tactile Displays and Conversational AI

对话式触觉数据接口:使用可刷新触觉显示器和对话式人工智能与盲人用户共同设计无障碍数据体验

Samuel Reinders, Munazza Zaib, Bongshin Lee, Ingrid Zukerman, Matthew Butler, Thien Autran, Sascha Cowley, Francois Jacobs, Lizhen Qu, Kim Marriott

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对盲人或视力低下者数据可视化问题,通过与盲人共同设计师协同设计,创建结合可刷新触觉显示器与对话代理的CTDI(Graphy系统),贡献设计知识与建议,得出分层展示等关键发现。

Comments Accepted to be presented at IEEE VIS 2026 and published in IEEE TVCG

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14357 2026-07-17 cs.GT cs.MA econ.TH 新提交 50%

When Is Delegated Play Truthful? Within-Range Regret and the Trilemma of Aligned Delegation

委托策略何时是真实的?范围内遗憾与对齐委托的三难困境

Taksch Dube

专题命中 其他LLM :language model(abstract)

AI总结 研究广告商和用户委托代理的最优诚实描述问题,核心方法是基于代理的范围内遗憾,主要贡献是统一特定拍卖自动出价结果、确定语言模型诱导代理假设成立条件,揭示护栏三难困境及生产模型诚实报告存在未认领剩余等情况。

Comments 31 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13930 2026-07-16 nucl-th astro-ph.HE physics.comp-ph 新提交 50%

NNStar: An end-to-end AI agent for nuclear matter and neutron star physics

NNStar:用于核物质和中子星物理的端到端人工智能代理

Yao Ma, Yong-Liang Ma, Jia-Ying Xiong

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对核物质和中子星物理中约束致密物质状态方程需处理大量数据及高维耦合空间微调难的问题,提出NNStar这一端到端人工智能代理,可自动化工作流程,为相关观测分析提供新的AI驱动框架。

Comments 14 pages; comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12647 2026-07-15 eess.AS 新提交 50%

Investigating the Integration of Spatial Information in Foundation-Model-Based Speaker Diarization

研究基于基础模型的说话人聚类中空间信息的整合

Marc Deegen, Adrian Meise, Reinhold Haeb-Umbach

专题命中 其他LLM :foundation model(abstract)

AI总结 研究基于基础模型的说话人聚类中空间信息整合,比较波束形成器与基础模型级联、多通道基础模型、基于提取空间特征对下游网络条件设定三种方法,发现条件设定法性能最佳且能消除相关错误,是有竞争力的方法。

Comments Accepted at IWAENC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11111 2026-07-14 cs.SE 新提交 50%

Know Before Fix: QA-Driven Repository Knowledge Acquisition for Software Issue Resolution

修复前先了解:用于软件问题解决的基于问答的仓库知识获取

Haotian Lin, Silin Chen, Xiaodong Gu, Yuling Shi, Chengxi Pan, Jiaqi Ge, Mengfan Li, Jianghong Huang, Mengchieh Chuang, Beijun Shen, Haibing Guan

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对基于大语言模型的编码代理解决软件问题易因仓库理解不足出错的问题,提出ACQUIRE框架,通过问答驱动在修复前获取仓库知识,经两阶段解耦知识获取与补丁生成,实验证明该框架能提升问题解决准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10736 2026-07-14 cs.CY 新提交 50%

Robo-Reporters: Evaluating Autonomous AI Agents as Algorithmic Gatekeepers in Computational Journalism

机器人记者:评估作为计算新闻学中算法把关人的自主人工智能代理

Obada Kraishan, Kulsawasd Jitkajornwanich, Kerk Kee

专题命中 其他LLM :language model(abstract)

AI总结 研究对比四种人工智能代理架构在新闻任务中的表现,通过200个对照实验,发现架构对任务时长和计算策略有显著影响,多智能体协作准确率最高,整体式架构有特定信息源拒绝率,还揭示了透明度方面差异,为新闻编辑室提供架构选择指导。

Comments 12 pages, 4 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10684 2026-07-14 cs.CV 新提交 50%

HyperBank: A Differentiable Bank of Classical Priors for Few-Shot Spheroid Microscopy Segmentation

HyperBank:用于少样本球体显微镜分割的可微经典先验库

M. Průšek, A. Novozámský, F. Šroubek, T. Volfová, V. Svobodová Pavlíčková, S. Rimpelová

机构 * The Czech Academy of Sciences, Institute of Information Theory and Automation(捷克科学院,信息理论与自动化研究所) Czech Technical University in Prague, Faculty of Nuclear Sciences and Physical Engineering(布拉格捷克技术大学,核科学与物理工程学院) University of Chemistry and Technology Prague, Department of Biochemistry and Microbiology(布拉格化学与技术大学,生物化学与微生物学系) Charles University, Faculty of Science, BIOCEV(查理大学,科学学院,BIOCEV)

专题命中 其他LLM :foundation model(abstract)

AI总结 研究少样本球体分割问题,提出可微经典图像处理算子库HyperBank,通过在支持图像上拟合并在验证图像上评估,发现其在小簇、对比度驱动数据上有竞争力,且能揭示少样本信号分布及受支持集形态学影响。

Comments Accepted for publication in the IEEE Xplore ICIP 2026 Workshop Proceedings, Computational Optical Microscopy Satellite Workshop of the 2026 IEEE International Conference on Image Processing (ICIP), Tampere, Finland

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09900 2026-07-14 cs.SE 新提交 50%

AfterVibe: What Remains When the Conversation Ends

AfterVibe:对话结束后留下了什么

Matteo Paltenghi, Satish Chandra

专题命中 其他LLM :LLM(abstract)

AI总结 AfterVibe框架从vibe编码会话恢复自然语言规范,用语言模型提取规范并经再生测试验证,在72个项目上评估发现其恢复的规范抽象且强,优于人工描述,可迭代加强,意味着规范或成人工审查主要工件和记录来源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08912 2026-07-13 cs.HC 新提交 50%

MemeBuddy: Dialog-Style Audio Representations for Engaging Non-Visual Meme Experiences

MemeBuddy:用于引人入胜的非视觉表情包体验的对话式音频表示

Chirag Bhansali, Vikas Ashok, Hae-Na Lee

专题命中 其他LLM :LLM(abstract)

AI总结 研究针对盲人用户无法充分理解表情包的问题,提出MemeBuddy系统,将表情包建模为对话,结合文本与多模态大语言模型隐含知识生成音频表示。用户研究表明,该方式能提升盲人用户参与度与满意度,且理解能力相当。

详情

展开后加载摘要…

URL PDF HTML 收藏