arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-01 至 2026-06-01 共收录 187 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. Agent评测 25 篇

2511.05875 2026-06-01 cs.HC cs.AI cs.CV 57%

Towards a Humanized Social-Media Ecosystem: AI-Augmented HCI Design Patterns for Safety, Agency & Well-Being

迈向人性化的社交媒体生态系统:面向安全、自主与福祉的AI增强人机交互设计模式

Mohd Ruhul Ameen, Akif Islam

机构 * College of Engineering(工程学院) Computer Sciences Marshall University Huntington, WV, USA(计算机科学马歇尔大学亨廷顿州威斯康星州) Department of Computer Science(计算机科学系) Engineering University of Rajshahi Rajshahi 6205, Bangladesh(工程 Rajshahi 大学 Rajshahi 6205 巴基斯坦)

专题命中 Agent评测 :agent(abstract);分类 cs.AI

AI总结 提出Human-Layer AI(HL-AI)框架,通过浏览器端用户拥有的可解释中介,在不依赖平台合作的情况下赋予用户实时控制权,实现内容重写、完整性检测、信息流定制、行为中断和恢复模式等五种设计模式,以提升社交媒体安全性与用户福祉。

Comments 6 pages, 5 tables, 7 figures, and 2 algorithm tables. Accepted at International Conference on Signal Processing, Information, Communication and Systems (SPICSCON 2025)

Journal ref 2025 IEEE International Conference on Signal Processing, Information, Communication and Systems (SPICSCON)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30829 2026-06-01 cs.CV 50%

LegSegNet: A Public Deep Learning System for Lower Extremity CT Tissue Segmentation and Quantification

LegSegNet:用于下肢CT组织分割与量化的公共深度学习系统

Yuwen Chen, Yaqian Chen, Roy Colglazier, Haoyu Dong, Hanxue Gu, Maciej A. Mazurowski, Kevin W. Southerland

机构 * Department of Electrical and Computer Engineering, Duke University(杜克大学电气与计算机工程系) Department of Biostatistics & Bioinformatics, Duke University(杜克大学生物统计与生物信息学系) Department of Radiology, Duke University(杜克大学放射学系) Department of Computer Science, Duke University(杜克大学计算机科学系) Department of Surgery, Duke University(杜克大学外科系)

专题命中 Agent评测 :workflow(abstract)

AI总结 提出LegSegNet深度学习系统,实现下肢CT中骨骼、肌肉、皮下脂肪和肌间/肌内脂肪的自动分割与量化,在测试集上平均Dice达89.31,是首个公开的端到端系统。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27994 2026-06-01 cs.RO 50%

Dreaming Across Towns: Semantic Rollout and Town-Adversarial Regularization for Zero-Shot Held-Out-Town Fixed-Route Driving in CARLA

跨城镇驾驶:面向CARLA零样本未见城镇固定路线驾驶的语义展开与城镇对抗正则化

Feeza Khan Khanzada, Jaerock Kwon

机构 * Department of Electrical and Computer Engineering, University of Michigan–Dearborn(密歇根大学迪尔伯恩分校电子与计算机工程系)

专题命中 Agent评测 :agent(abstract)

AI总结 提出一种结合未来语义预测与城镇对抗正则化的训练方法,在仅使用Town05和Town06训练的情况下,提升CARLA驾驶代理在未见城镇Town03和Town04上的零样本迁移性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16682 2026-06-01 cs.CV 50%

SAW-Bench: Learning Situated Awareness in the Real World

SAW-Bench:在现实世界中学习情境感知

Chuhan Li, Rilyn Han, Joy Hsu, Yongyuan Liang, Rajiv Dhawan, Jiajun Wu, Ming-Hsuan Yang, Xin Eric Wang

机构 * University of California, Santa Barbara(加州大学圣芭芭拉分校) Yale University(耶鲁大学) Stanford University(斯坦福大学) University of Maryland, College Park(马里兰大学学院市分校) Amazon(亚马逊) University of California, Merced(加州大学默塞德分校)

专题命中 Agent评测 :agent(abstract)

AI总结 提出SAW-Bench基准,通过自录视频和问答对评估多模态基础模型的以观察者为中心的情境感知能力,揭示人类与模型间的显著性能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他Agent 3 篇

2605.31509 2026-06-01 cs.LG cs.AI 81%

Skill Reuse as Compression in Agentic RL

智能体强化学习中的技能重用作为压缩

Zhikun Xu, Yu Feng, Jacob Dineen, Taiwei Shi, Jieyu Zhao, Ben Zhou

机构 * Arizona State University(亚利桑那州立大学) University of Pennsylvania(宾夕法尼亚大学) University of Southern California(南加州大学)

专题命中 其他Agent :agentic(title,abstract);分类 cs.AI、cs.LG

AI总结 提出ReuseRL方法,基于最小描述长度原则将成功轨迹压缩为可重用技能字典,并通过分割代价惩罚低效编码行为,在多个环境中提升分布内和分布外成功率。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31275 2026-06-01 cs.HC cs.AI 57%

Personalized to Persuade: The Effects of Contextualization and Warmth on Trust and Reliance in Conversational AI

个性化以说服:情境化和温暖对对话式AI中信任与依赖的影响

Mert Yazan, Suzan Verberne, Frederik Bungaran Ishak Situmeang

机构 * Amsterdam University of Applied Sciences(阿姆斯特丹应用科学大学) University of Leiden(莱顿大学)

专题命中 其他Agent :AI agent(abstract);分类 cs.AI

AI总结 通过2x2被试间实验(N=380),研究情境化与对话温暖如何交互影响AI助手在反驳专家建议时的说服力与用户依赖,发现情境化降低说服力但与温暖结合通过交叉交互恢复,且AI素养解耦信任与行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.31104 2026-06-01 cs.HC 50%

Extending the UXR Point of View Playbook: Triangulating Insights in Complex Developer Domains

扩展UXR观点剧本:在复杂开发者领域中的三角验证洞察

Sarah Kianfar

专题命中 其他Agent :AI agent(abstract)

AI总结 本文通过云开发者工具的多方法研究,提出扩展UXR观点剧本,引入三张新卡片(范式转变、可解释性即信任、摩擦成本),以三角验证定性和定量数据,形成高置信度观点。

详情

展开后加载摘要…

URL PDF HTML 收藏