arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Washington(华盛顿大学)

2026-04-23 至 2026-04-23 共收录 3
2604.20021 2026-04-23 cs.LG cs.CL

Continuous Semantic Caching for Low-Cost LLM Serving

连续语义缓存用于低成本大语言模型服务

Baran Atalar, Xutong Liu, Jinhang Zuo, Siwei Wang, Wei Chen, Carlee Joe-Wong

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Washington Tacoma(华盛顿大学塔科马分校) City University of Hong Kong(香港城市大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文提出连续语义缓存框架,通过动态ε-网离散化与核岭回归,解决连续查询空间下的缓存优化问题,降低计算和切换开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19932 2026-04-23 cs.CL cs.HC

"Newspaper Eat" Means "Not Tasty": A Taxonomy and Benchmark for Coded Language in Real-World Chinese Online Reviews

‘Newspaper Eat’意味着‘不美味’:一种实世界中文在线评论中编码语言的分类和基准

Ruyuan Wan, Changye Li, Ting-Hao 'Kenneth' Huang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) University of Washington(华盛顿大学)

AI总结 本文提出CodedLang数据集,包含7744条中文Google地图评论,包含900条带有跨度标注的编码语言评论。通过七类分类法捕捉常见编码策略,如发音、拼写和跨语言替代。测试语言模型在编码语言检测、分类和评论评分预测中的表现,发现即使强模型也难以识别和理解编码语言。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21652 2026-04-23 cs.AI cs.CL

AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite

AstaBench:通过科学研究套件严格评估AI代理

Jonathan Bragg, Mike D'Arcy, Nishant Balepur, Dan Bareket, Bhavana Dalvi, Sergey Feldman, Dany Haddad, Jena D. Hwang, Peter Jansen, Varsha Kishore, Bodhisattwa Prasad Majumder, Aakanksha Naik, Sigal Rahamimov, Kyle Richardson, Amanpreet Singh, Harshit Surana, Aryeh Tiktinsky, Rosni Vasu, Guy Wiener, Chloe Anastasiades, Stefan Candra, Jason Dunkelberger, Dan Emery, Rob Evans, Malachi Hamada, Regan Huff, Rodney Kinney, Matt Latzke, Jaron Lochner, Ruben Lozano-Aguilera, Cecile Nguyen, Smita Rao, Amber Tanaka, Brooke Vlahos, Peter Clark, Doug Downey, Yoav Goldberg, Ashish Sabharwal, Daniel S. Weld

机构 * Asta Team, Allen Institute for AI(Asta团队,人工智能研究所) University of Maryland(马里兰大学) University of Arizona(亚利桑那大学) University of Zurich(苏黎世大学) Bar-Ilan University(巴伊兰大学) University of Washington(华盛顿大学)

AI总结 本文提出AstaBench,通过2400多个科学问题全面评估AI代理能力,提供生产级搜索工具和九种科学优化的代理类,揭示AI在科学研究辅助方面仍存在显著差距。

Comments Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏