arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of California, San Diego(加州大学圣迭戈分校)

2026-07-21 至 2026-07-21 共收录 6
2607.18147 2026-07-21 eess.SY cs.AI cs.SY 新提交

LLMs and Agentic AI Systems for Smart Grids: A Tutorial on Architectures and Applications

用于智能电网的大语言模型和智能AI系统:架构与应用教程

Daniela Rojas, Abdulwahab Albassam, Aidan G. Leung, Jett Ngo, Ryan Luo, Peter R. Quawas, Junpyung Kim, Kangkai Liang, Mansi Nanavati, Jonathan Mai, Meng-Chi Tsai, Yun-Tong Tsai, Yize Chen, Yuanyuan Shi

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣迭戈分校电气与计算机工程系) Department of Electrical and Computer Engineering, University of Alberta(阿尔伯塔大学电气与计算机工程系)

AI总结 研究智能电网中LLMs和智能AI系统,提出基于求解器的设计原则,通过提示策略等构建模块及四个案例研究实例化该原则,比较不同方案,还提出四组评估框架,明确了各部分分工。

Comments 28 pages, 11 figures, 6 tables; plus supplementary material. Review/tutorial article

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18100 2026-07-21 cs.AI 新提交

Can We Break LLMs Out of Self-Loops? Fine-Grained Reasoning Control with Activation Steering

我们能否使大语言模型摆脱自我循环?通过激活引导实现细粒度推理控制

Sheldon Yu, Tong Yu, Xunyi Jiang, Rohan Surana, Gagan Mundada, Sungchul Kim, Lina Yao, Julian McAuley, Junda Wu

机构 * UC San Diego(加州大学圣地亚哥分校) Adobe Research(Adobe研究院) University of New South Wales(新南威尔士大学)

AI总结 研究大语言模型推理过程不可控问题,提出SOPHIA方法,通过将推理轨迹视为潜在状态序列,构建引导向量库,在推理时进行干预,可检测并防止自我循环,提升推理质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17538 2026-07-21 cs.AR cs.CL cs.DB cs.ET cs.IR 新提交

D-NOVA: In-Storage Retrieval Accelerator via Dual-Bound 3D NAND-Optimized Similarity Search with Vector Adaptation

D-NOVA:通过具有向量适配的双边界3D NAND优化相似性搜索实现存储内检索加速器

Chang Eun Song, Sumukh Pinge, Tianqi Zhang, Sung Eun Kim, Tajana S. Rosing, Mingu Kang

机构 * University of California, San Diego(加州大学圣地亚哥分校)

AI总结 研究针对RAG密集向量检索性能瓶颈,提出软硬件协同设计的存储内检索加速器D-NOVA。通过深度嵌入搜索功能、采用新距离度量及引入适配器,实现高效检索,相比CPU和现有加速器有显著性能和能效提升,展现全存储向量搜索加速RAG的潜力。

Comments Accepted at the 59th IEEE/ACM International Symposium on Microarchitecture (MICRO 2026), Athens, Greece. Chang Eun Song and Sumukh Pinge are co-first authors and contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17283 2026-07-21 cs.AI cs.LG 新提交

Lossless but Not Free: An Empirical Anatomy of Speculative Decoding on Consumer Hardware

无损但不免费:消费级硬件上推测性解码的实证剖析

Param Chordiya

机构 * University of California, San Diego(加利福尼亚大学圣地亚哥分校)

AI总结 研究大语言模型单流自回归解码受内存带宽限制问题,核心方法是推测性解码,通过小草稿模型与目标模型配合及拒绝采样规则重构计算。在苹果硅笔记本上实证研究五种配置,验证分布等效性,揭示加速与减速原因,表明该方法在特定条件下才有效。

Comments 15 pages, 5 figures, 4 tables. Code, benchmark harness, and all result artifacts: https://github.com/ParamChordiya/speculative_decoding_engine

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16922 2026-07-21 cs.CV 新提交

Pedestrian Archetypes Extension -- More Pedestrian Models for Autonomous Vehicle Safety Testing

行人原型扩展——用于自动驾驶车辆安全测试的更多行人模型

Taorui Huang, Namita Gaidhani, Ritvik Bansal, S M Jubaer, Regina Lim, Rhett Zhao, Gavin Rafael Selin, Sunnie Deng Gao, Hasnain N Syed

机构 * Stanford University(斯坦福大学) University of California San Diego(加利福尼亚大学圣地亚哥分校) University of Washington(华盛顿大学)

AI总结 研究在行人原型基础上,通过注释YouTube行车记录仪视频,识别出7种新的行人原型,介绍其行为,阐述与旧原型差异并提供视频证据,为自动驾驶车辆安全测试提供更多行人模型。

Comments Extended version of Pedestrian Archetypes paper (published in IEEE IV 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14473 2026-07-21 cs.CL cs.AI 版本更新

Does RAG Know When Retrieval Is Wrong? Diagnosing Context Compliance under Knowledge Conflict

RAG 能知道检索错误吗?知识冲突下的上下文合规性诊断

Yihang Chen, Pin Qian, Su Wang, Sipeng Zhang, Huan Xu, Shuhuai Lin, Xinpeng Wei

机构 * Georgia Institute of Technology(佐治亚理工学院) Carnegie Mellon University(卡内基梅隆大学) University of California San Diego(加州大学圣地亚哥分校)

AI总结 提出上下文驱动分解(CDD)方法,在推理时探测并干预检索增强生成中的上下文与参数知识冲突,揭示上下文合规性模式并提升鲁棒性。

Comments Preprint. 3 figures, 3 tables. Diagnostic study of context compliance in RAG under knowledge conflict; closed-API evaluations (Gemini-2.5-Flash and Claude family)

详情

展开后加载摘要…

URL PDF HTML 收藏