arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 10469 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 工作流自动化 10469 篇

2607.22525 2026-07-27 cs.AI 新提交 57%

Explainable Reinforcement Learning for assisting Air Traffic Controllers

用于协助空中交通管制员的可解释强化学习

Anduel Mehmeti, Gabriella Gigante, Salvatore Venticinque

机构 * Department of Engineering, University of Campania "Luigi Vanvitelli"(工程学院,坎帕尼亚"路易吉·范维蒂利"大学) CIRA(CIRA研究院)

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 探索可解释性技术在强化学习算法中的应用,以协助空中交通管制员。用强化学习算法在简化ATC环境训练智能体决策避禁飞区路线,采用显著性图作为初步可解释性方法,为智能体决策提供关键输入特征见解。

Comments 11 pages (10-page paper plus 1 cover/citation page), 4 figures, 1 table; published in AINA 2025

Journal ref In: L. Barolli (ed.), Advanced Information Networking and Applications (AINA 2025), Lecture Notes on Data Engineering and Communications Technologies, vol. 250, pp. 148-157, Springer, Cham (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22406 2026-07-27 cs.SE 新提交 57%

Vibe Coding: An Experiment with Test-Driven Development

Vibe编码:一项测试驱动开发的实验

Moritz Mock, Barbara Russo

专题命中 工作流自动化 :agentic(abstract);分类 cs.SE

AI总结 研究探索人类与CLLMs通过vibe编码对等协作,设计四个交互模型并实现相应TDD工作流程。通过实验发现交互模型选择取决于开发目标,智能工作流程利于快速开发但有复杂性,协作工作流程产生更高质量测试套件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22115 2026-07-27 cs.DB cs.AI 新提交 57%

Benchmarking Text-to-SQL under Role-Based Access Control

基于角色的访问控制下的文本到SQL基准测试

Yang Fei, Yangfan Jiang, Yin Yang, Xiaokui Xiao

机构 * National University of Singapore(新加坡国立大学) Hamad Bin Khalifa University(哈马德·本·卡西姆大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究基于角色的访问控制下文本到SQL的基准测试问题,提出含现实RBAC约束的综合基准测试框架,通过大语言模型辅助工作流程及人工审核等增强基准,应用该框架研究发现部分高分系统在有访问约束时性能因RBAC违规而大幅下降。

Comments Accepted at ACM SIGMOD 2027

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21881 2026-07-27 cs.CV cs.LG eess.IV 新提交 57%

Farmland Extent and Visible Boundary Mapping from 1 m NAIP Imagery Using Residual U-Net and Text-Prompted SAM 3 Refinement

使用残差U-Net和文本提示的SAM 3细化从1米分辨率的NAIP图像中绘制农田范围和可见边界

Mohammadreza Narimani, Vikram Anand, Parastoo Farajpoor

机构 * Department of Biological and Agricultural Engineering, University of California, Davis(加利福尼亚大学戴维斯分校生物与农业工程系) Del Norte High School(德尔诺特高中)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究利用残差U-Net和文本提示的SAM 3细化从1米分辨率的NAIP图像绘制农田范围和可见边界,通过特定标注、训练和融合方法,提升了模型在困难补丁上的表现,生成语义农田范围层,为农业监测提供支持。

Comments 12 pages, 7 figures, 3 tables. Preprint submitted to Taylor & Francis. Code: https://github.com/MohammadrezaNarimaniUCDavis/NAIP_Farmland_ResSAM Dataset: https://doi.org/10.5281/zenodo.21519912

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21757 2026-07-27 cs.CY cs.AI cs.HC 新提交 57%

Co-design of LLM-based preference agents: participation may drive overtrust

基于大语言模型的偏好智能体协同设计:参与可能导致过度信任

Michael J. Fell

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 研究探讨大语言模型模拟人类偏好引发的问题,通过12名参与者在家庭能源领域协同设计个人偏好智能体的定性研究,发现参与和过程透明度或成“过度信任引擎”,并将此发展为参与式偏好智能体设计核心机制。

Comments 43 pages (18 main text plus supplementary material), 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21652 2026-07-27 cs.SE 新提交 57%

Vibe Coding in Software Development: A Multivocal Literature Review

软件开发中的氛围编码:多视角文献综述

Shahbaz Siddeeq, Muhammad Waseem, Kai-Kristian Kemell, Mika Saari, Jussi Rasku, Pekka Abrahamsson

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 该研究对2022年至2025年10月的文献进行多视角综述,探讨软件开发中氛围编码实践。通过分析47篇文献发现其是迭代流程,开发者工作转变,短期生产力有提升,不同应用场景证据强弱有别,此为整合两类文献的首次综述并提出未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30551 2026-07-27 quant-ph cs.LG physics.chem-ph 57%

Bridging the NISQ and Fault-Tolerant Regimes: Generative-ML-Assisted Quantum Selected CI for Molecular Simulations

桥接NISQ与容错量子计算:基于生成式机器学习的量子选组态相互作用用于分子模拟

Anurag K. S. V.

机构 * Qclairvoyance Quantum Labs(Qclairvoyance量子实验室) Centre for Quantum Technologies(量子技术中心) The University of Arizona(亚利桑那大学) Department of Chemistry, Indian Institute of Technology Bombay(印度理工学院孟买化学系)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 提出混合量子-经典工作流,通过线性标度CNOT UCCSD ansatz和受限玻尔兹曼机生成子空间模型,解决量子采样对角化中的结构低效问题,实现更高效经济的药物发现模拟。

Comments arXiv admin comment: This version has been removed by arXiv administrators as the submitter did not have the rights to agree to the license at the time of submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25582 2026-07-27 cs.LG 版本更新 57%

Safe In-Context Reinforcement Learning

安全的上下文强化学习

Amir Moeini, Minjae Kwon, Alper Kamil Bozkurt, Yuichi Motai, Rohan Chandra, Lu Feng, Shangtong Zhang

机构 * University of Virginia(弗吉尼亚大学) Virginia Commonwealth University(弗吉尼亚 Commonwealth 大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 提出SCARED方法,在无参数更新的上下文强化学习适应过程中,通过精确惩罚对偶法在约束马尔可夫决策过程框架下保证安全,实现奖励最大化与成本约束。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21307 2026-07-24 cs.LO cs.AI cs.ET 新提交 57%

Scaling Up Formal Representation of Clinical Trial Protocols in Ensemble Logic Using LLMs: A Preliminary Study

使用大语言模型在集成逻辑中扩大临床试验协议的形式化表示:一项初步研究

Yan Huang, Xubing Hao, Xiaojin Li, Rashmie Abeysinghe, Xiaoqian Jiang, Licong Cui, Guo-Qiang Zhang

机构 * McGovern Medical School(麦戈文医学学院) McWilliams School of Biomedical Informatics(麦克威廉斯生物医学信息学学院) The University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究针对临床试验协议依赖非结构化文本阻碍自动化推理等问题,引入CT-TEL工作流程,利用大语言模型将叙述性临床协议转为TEL公式,通过反向翻译评估保真度,为协议映射到可计算逻辑及临床试验模拟提供初步证据。

Comments Proceedings of the 2026 American Medical Informatics Association Symposium, to appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20592 2026-07-24 cs.LG 新提交 57%

STeMP: Spatio-Temporal Modelling Protocol

STeMP:时空建模协议

Jan Linnenbrink, Jakub Nowosad, Marvin Ludwig, Anna Frederike Jablotschkin, Fabian Schumacher, Teja Kattenborn, Hanna Meyer

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 研究针对时空建模缺乏标准协议的问题,提出STeMP协议,通过标准化报告助于理解模型功能并在建模过程中提供指导,涵盖概述、模型和预测三部分,配套R包及网络应用,可辅助填写协议并返回警告,鼓励社区参与。

Comments 3 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27775 2026-07-23 cond-mat.mtrl-sci cs.LG 版本更新 57%

Data-Efficient Indentation Size Effect Correction in Steels Using Machine Learning and Physics-Constrained Neural Network

利用机器学习和物理引导增强的高效 indentation 尺寸效应校正方法用于钢材料

Radmir Karamov, Tagir Karamov

机构 * Center for Material Technologies(材料技术中心) Skolkovo Institute of Science and Technology(斯克尔科沃科学与技术研究所) Center for Petroleum Science and Engineering(石油科学与工程中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文通过物理引导特征工程和增强技术,利用小数据集预测钢材料参考硬度,采用非线性模型实现高效 indentation 尺寸效应校正,验证了该方法在钢材料中的可行性。

Comments Preprint, 25 pages, 8 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22214 2026-07-23 cs.LG 版本更新 57%

Interpretable Deep Learning Paradigm for Airborne Transient Electromagnetic Inversion

用于航空瞬变电磁反演的可解释深度学习范式

Shuang Wang, Xuben Wang, Fei Deng, Peifan Jiang, Lifeng Mao

机构 * Key Laboratory of Earth Exploration and Information Techniques, Ministry of Education, College of Geophysics, Chengdu University of Technology(地球探测与信息处理重点实验室,教育部,成都理工大学地球物理学院) College of Computer Science and Cyber Security, Chengdu University of Technology(计算机科学与网络安全学院,成都理工大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 针对航空瞬变电磁数据处理与反演难题,提出基于解缠表示学习的统一可解释深度学习范式,将数据分解为噪声和信号因子,纳入物理约束,能直接用噪声数据准确重建地下电结构,建立了新的反演范式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19300 2026-07-22 cs.AI cs.GT 新提交 57%

LLM Detection as an Intervention: Downstream Impact under Strategic User Behavior

作为一种干预手段的大语言模型检测:战略用户行为下的下游影响

Meena Jagadeesan, Tatsunori Hashimoto, Jon Kleinberg

机构 * Stanford University(斯坦福大学) University of Pennsylvania(宾夕法尼亚大学) Cornell University(康奈尔大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究LLM检测对下游指标的影响,开发程式化模型捕捉用户策略行为。发现不完善的检测器会扭曲LLM使用及输出质量,导致用户增加使用量且输出质量可能降低,还呈现“先升后降”检测模式,揭示了检测干预的失效模式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19022 2026-07-22 cs.SE 新提交 57%

From Collaboration to Regulation: Characterizing Governance Practice in Three Deep Learning Open Source Communities

从协作到规范:刻画三个深度学习开源社区的治理实践

Ruiqiao Qiu, Wenhao Yang, Minghui Zhou

专题命中 工作流自动化 :workflow(abstract);分类 cs.SE

AI总结 研究三个深度学习开源社区治理实践,用制度分析与发展框架分析文档与提交记录,识别规则主题、治理功能,发现操作与结构规则特点不同,最终为成熟大规模OSS项目得出33条可操作治理实践。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18704 2026-07-22 cs.SD cs.AI 新提交 57%

What the Waveform Knows: Transparent-first Speech and Audio Intelligence with Caption Studio

波形知道什么:使用字幕工作室实现透明优先的语音和音频智能

Cheng Siong Chin, Jianhua Zhang, Mohan Venkateshkumar

机构 * Faculty of Science, Agriculture, and Engineering, Newcastle University Singapore(新加坡纽卡斯尔大学科学、农业与工程学院) School of Information and Control Engineering, Qingdao University of Technology(青岛理工大学信息与控制工程学院) Department of EEE, Amrita School of Engineering, Amrita Vishwa Vidyapeetham(阿姆瑞塔工程学院电气与电子工程系,阿姆瑞塔大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究借助字幕工作室平台实现透明优先的语音和音频智能。核心方法是构建基于FastAPI的三层架构系统。主要贡献为提出透明优先框架,明确指标性质,提升语音分析的可追溯性、可解释性与可靠性,还介绍了相关系统架构等内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19198 2026-07-22 cond-mat.mtrl-sci cs.LG physics.comp-ph 新提交 57%

ATLAS: A Foundation Neural Sampler for Amorphous Materials

ATLAS:一种用于非晶材料的基础神经采样器

Mouyang Cheng, Denis Blessing, Botao Yu, Gerhard Neumann, Mingda Li, Carles Domingo-Enrich, Yuanqi Du

机构 * Microsoft Research New England(微软研究院新英格兰分部) Center for Computational Science and Engineering(计算科学与工程中心) MIT(麻省理工学院) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Department of Materials Science and Engineering(材料科学与工程系) Department of Computer Science and Engineering(计算机科学与工程系) OSU(俄亥俄州立大学)

专题命中 工作流自动化 :agent(abstract);分类 cs.LG

AI总结 研究针对非晶材料能量景观难采样问题,提出ATLAS神经采样器,由等变图神经网络参数化,能跨系统泛化,利用扩散过程时间反转估计热力学量。在多种系统中验证有效性,还通过预训练降低逆设计成本,结合大语言模型搜索高熵金属玻璃,确立其为基础模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22324 2026-07-22 cs.LG cs.MA 版本更新 57%

Automatic Construction of Clinical Scoring Systems with LLM Agents

基于LLM代理的临床评分系统自动构建

Silas Ruhrberg Estévez, Christopher Chiu, Mihaela van der Schaar

机构 * DAMTP, University of Cambridge, Cambridge, UK(剑桥大学 DAMTP 实验室,剑桥,英国)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 提出AgentScore方法,利用大语言模型进行语义引导的规则搜索与验证,自动构建符合临床部署约束的加权评分系统,在多个任务上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17086 2026-07-22 econ.GN cs.AI cs.CY q-fin.EC stat.AP 版本更新 57%

Global Automation Atlas

全球自动化图谱

Prashant Garg, Tommaso Crosta, Jasmin Baier

机构 * Imperial College London(伦敦帝国学院) Bocconi University(博科尼大学) University of Oxford(牛津大学)

专题命中 工作流自动化 :planning(abstract);分类 cs.AI

AI总结 本文提出了一种基于任务和国家特定的方法,用于全球范围内分类自动化暴露,以区分劳动力替代和增强自动化,相关技术渠道以及人工智能的物质作用。研究涵盖了124个国家,生成了覆盖全球99%人口和GDP的233万个任务-国家标签。

Comments 78 pages, 6 figures, 5 Extended Data figures. Substantially revised and expanded. Data and code: https://automationatlas.org/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18026 2026-07-22 eess.IV cs.LG q-bio.QM 版本更新 57%

Democratizing Advanced High-Throughput Imaging via Cross-Instrument Deep Learning-Enabled Modality Transfer

基于深度学习的独立显微镜模态转换用于高通量成像

Dominik Panek, Carina Rząca, Maksymilian Szczypior, Joanna Sorysz, Krzysztof Misztal, Zbigniew Baster, Zenon Rajfur

机构 * Doctoral School of Exact and Natural Sciences, Jagiellonian University(雅盖隆大学精确与自然科学博士学院) Department of Molecular and Interfacial Biophysics, Faculty of Physics, Astronomy and Applied Computer Science, Jagiellonian University(物理、天文学与应用计算机科学学院分子与界面生物物理学系) Undergraduate program in Biophysics, Faculty of Physics, Astronomy and Applied Computer Science, Jagiellonian University(物理、天文学与应用计算机科学学院生物物理本科生项目) Undergraduate program in Biomedical Engineering, Faculty of Electrical Engineering, Automatics, Computer Science and Biomedical Engineering, AGH University of Science and Technology(AGH科技大学电气工程、自动化、计算机科学和生物医学工程学院生物医学工程本科生项目) Division of Computational Mathematics, Faculty of Mathematics and Computer Science, Jagiellonian University(雅盖隆大学数学与计算机科学学院计算数学系) Laboratory for Cell and Tissue Engineering, Department of Biomedical Engineering, Eindhoven University of Technology(埃因霍温理工大学生物医学工程系细胞与组织工程实验室)

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 本文提出一种深度学习方法,实现不同显微镜间的模态转换,提升低质量图像的结构相似性和信号保真度,从而提高高通量成像效率。

Comments 18 Pages, 6 Figures, 1 Table, 4 pages Supplementary Materials

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07053 2026-07-22 cs.AI cs.SY eess.SY 版本更新 57%

Animating Petascale Time-varying Data on Commodity Hardware with LLM-assisted Scripting

在消费级硬件上利用LLM辅助脚本动画化exascale时变数据

Ishrat Jahan Eliza, Xuan Huang, Aashish Panta, Alper Sahistan, Zhimin Li, Amy A. Gooch, Valerio Pascucci

机构 * University of Utah(犹他大学) Vanderbilt University(范德比大学) ViSOAR LLC

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文提出一个用户友好的框架,用于在消费级工作站上生成exascale时变数据的3D动画,通过通用动画描述符、高效数据访问、定制渲染系统和LLM辅助交互接口,使非可视化专家科学家能快速生成高质量动画。

Comments ©2026 IEEE. Personal use of this material is permitted. 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses. N.B. Due to the limitation "The abstract field cannot be longer than 1,920 characters", the abstract here is shorter than that in the original PDF file

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17679 2026-07-21 stat.ME cs.LG stat.ML 新提交 57%

Equality, Equity, and Causality in Fairness Research: A Commentary on Cheng (2026)

公平性研究中的平等、公平与因果关系:对程(2026年)的评论

Youmi Suk

专题命中 工作流自动化 :workflow(abstract);分类 cs.LG

AI总结 对程关于心理测量学与人工智能/机器学习公平性比较的文章作评论,探讨平等与公平区别及因果关系在公平性研究中的作用,扩展其讨论,为心理测量学和人工智能/机器学习社区未来公平性研究指明方向。

Comments Invited commentary on Cheng (2026), Psychometrika, doi:10.1017/psy.2026.10110; submitted to Psychometrika

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17940 2026-07-21 cs.CY cs.AI 新提交 57%

The Aura in the Machine: Genealogy and the Status of the Work of Art in the Generative Era

机器中的灵光:谱系学与生成时代艺术作品的地位

Giorgio Presti

专题命中 工作流自动化 :agent(abstract);分类 cs.AI

AI总结 该文探讨生成式人工智能,通过生成艺术谱系揭示其与历史的关联,提出生成系统分类法,识别相关风险并给出应对,阐述艺术家角色转变,引入算法重复等概念,还通过两方面考察支持论点,探讨生成时代艺术作品地位等问题。

Comments Submitted to Minds and Machines on 08 Jul 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17070 2026-07-21 cs.AI 新提交 57%

Bridging the Information Gap: Semantic Densification and Hindsight Distillation for Cold-Start Prediction

弥合信息差距:冷启动预测的语义致密化与事后蒸馏

Hao Duong Le, Yifei Gao, Huan Li, Lun Jiang, Chen Bai, Ke Xing, Chen Zhang

机构 * Tsinghua University(清华大学) Meituan(美团)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 针对电子商务平台新用户冷启动预测难题,SemRaD框架利用结构化语义推理管道和事后感知蒸馏网络,有效弥合信息差距,提升了LTV和CVR,减少训练数据用量,在工业数据集和在线测试中均取得良好效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16202 2026-07-21 cs.AI 新提交 57%

Democratizing AI with Small Language Models: Structured Benchmarking and Parameter-Efficient Fine-Tuning for Local Deployment

通过小语言模型实现人工智能民主化:面向本地部署的结构化基准测试和参数高效微调

Daniel Cersosimo

机构 * Binghamton University(宾汉姆顿大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究在硬件和治理约束下人工智能民主化问题,通过对九个小语言模型在特定基准测试上控制评估,采用共享参数高效微调管道,得出有序工作流程让部分低于3B的模型可成为结构化小众工作负载本地专家的结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02947 2026-07-21 econ.GN cs.CL q-fin.EC 版本更新 57%

FOI-O: A global ontology and verification framework for Freedom of Information process modelling

FOI-O:新西兰首个用于信息自由流程建模的本体与验证方法包

Dylan A Mordaunt

机构 * Faculty of Health, Education and Psychology, Victoria University of Wellington(维多利亚大学健康、教育与心理学学院) College of Medicine and Public Health, Flinders University(弗林德斯大学医学院和公共卫生学院) Centre for Health Policy, The University of Melbourne(墨尔本大学健康政策中心)

专题命中 工作流自动化 :workflow(abstract);分类 cs.CL

AI总结 针对公共信息请求记录混杂多类数据的问题,提出FOI-O可复用流程建模与验证框架,基于新西兰相关法案实现首个验证配置文件,提供多类标准化语义与流程工具资产。

Comments 22 pages, 4 figures, 9 tables, ancillary supplement; revised manuscript with expanded provenance, versioning, and navigation documentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04438 2026-07-21 cs.CV cs.AI cs.HC cs.MA cs.MM 版本更新 57%

ResearchStudio-Reel: Automate the Last Mile of Research from Paper to Poster, Video, and Blog

ResearchStudio-Reel:实现从论文到海报、视频和博客的研究最后一公里自动化

Lingao Xiao, Yalun Dai, Yangyu Huang, Qihao Zhao, Wenshan Wu, Hugo He, Ruishuo Chen, Jin Jiang, Qianli Ma, Jiahuan Zhang, Xin Zhang, Ying Xin, Yang Ou, Yan Xia, Scarlett Li, Longbo Huang, Zhipeng Zhang, Yang He, Yap Kim Hui, Yan Lu

机构 * Microsoft Research(微软研究院) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Westlake University(西湖大学) CFAR, A*STAR(计算科学与工程研究所,新加坡科技研究局)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 研究传播自动化困难,以往方法有局限。该研究提出将最后一公里构建为技能组合,实例化ResearchStudio-Reel,包括共享提取器、可编辑生成器和交互式收敛层,能产出多种可编辑工件,效果优于现有系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01224 2026-07-21 cs.CL 版本更新 57%

Lost in the Tower of Babel: The Adverse Effects of Incidental Multilingualism in LLMs

迷失在巴别塔中:LLMs中偶然多语言主义的负面影响

Anjishnu Mukherjee, Chutong Meng, Antonios Anastasopoulos

机构 * Department of Computer Science(计算机科学系) George Mason University(乔治·马歇尔大学)

专题命中 工作流自动化 :agentic(abstract);分类 cs.CL

AI总结 本文指出当前多语言NLP陷入偶然多语言主义的脆弱且误导性范式,导致模型在多语言情境中表现不均、脆弱且不透明,需转向设计驱动的多语言主义。

Comments Published as a conference paper at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23101 2026-07-21 cs.LG 版本更新 57%

SpecXMaster Technical Report

SpecXMaster 技术报告

Yutang Ge, Yaning Cui, Hanzheng Li, Jun-Jie Wang, Fanjie Xu, Jinhan Dong, Yongqi Jin, Dongxu Cui, Peng Jin, Guojiang Zhao, Hengxing Cai, Tianci Yangfeng, Xueqing Chen, Hongshuai Wang, Rong Zhu, Linfeng Zhang, Xiaohong Ji, Zhifeng Gao

机构 * DP Technology

专题命中 工作流自动化 :agentic(abstract);分类 cs.LG

AI总结 SpecXMaster 通过代理强化学习实现NMR光谱自动解析,解决传统人工解读的偏差和误差问题,提升有机化学领域光谱分析效率。

Comments Technical report from DP Technology.22 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00306 2026-07-21 cs.CY cs.AI cs.HC 57%

The Generative AI Paradox: GenAI and the Erosion of Trust, the Corrosion of Information Verification, and the Demise of Truth

生成AI悖论:生成AI与信任的侵蚀、信息验证的腐蚀以及真理的消亡

Emilio Ferrara

机构 * Thomas Lord Department of Computer Science, University of Southern California (USC)(汤姆斯·劳德计算机科学系,南加州大学) Information Sciences Institute (ISI), University of Southern California (USC)(信息科学研究所,南加州大学)

专题命中 工作流自动化 :workflow(abstract);分类 cs.AI

AI总结 本文探讨生成AI带来的信任危机,提出合成现实的分层结构,并强调其对社会认知基础的侵蚀,呼吁建立互补的缓解措施以应对AI带来的挑战。

Journal ref Future Internet, 18(2), 73, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05743 2026-07-21 cs.AI cs.CY 版本更新 57%

Artificially intelligent agents in the social and behavioral sciences: A history and outlook

社会与行为科学中的人工智能代理:历史与展望

Petter Holme, Milena Tsvetkova

机构 * Department of Computer Science, Aalto University(阿尔托大学计算机科学系) Center for Computational Social Science, Kobe University(大阪大学计算社会科学中心) Department of Methodology, London School of Economics and Political Science(伦敦政治经济学院方法论系)

专题命中 工作流自动化 :agentic(abstract);分类 cs.AI

AI总结 回顾人工智能代理在社会与行为科学中的历史发展与当前趋势,涵盖从可编程计算机到社会模拟、大语言模型实验等,强调其在科学过程中的作用及带来的变化,如社会系统科学兴起等,凸显与相关技术紧密相连。

详情

展开后加载摘要…

URL PDF HTML 收藏