SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning
SafeMCP:基于环境接地前瞻推理的LLM智能体防御主动功率调节
Lichao Wang, Zhaoxing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai
机构
*
Beijing Institute of Technology(北京理工大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
The Sword, Shield, and Achilles' Heel: Characterizing the Linguistic Inductive Bias of Large Language Models for Spatial Reasoning in Navigation Planning
剑、盾与阿喀琉斯之踵:大型语言模型在导航规划中空间推理的语言归纳偏置特征化
Xudong Zhang, Jian Yang, Shengkai Wang, Jiangpeng Tian, Shaowen Chen, Xian Wei, Ke Li, Xiong You
机构
*
East China Normal University(东华大学)
;
Information Engineering University(信息工程大学)
;
Zhengzhou University(郑州大学)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院 Gallagher 学校)
;
LLM Department, Hunyuan Team, Tencent(腾讯 Hunyuan 团队 LLM 部门)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
The Chinese University of Hong Kong(香港中文大学)
Loong: A Human-Like Long Document Translation Agent with Observe-and-Act Adaptive Context Selection
Loong: 一种类人长文档翻译代理,具有观察与行动的适应性上下文选择
Yutong Wang, Xuebo Liu, Derek F. Wong, Zhilin Li, Rongqing Jiang, Min Zhang, Shimin Tao, Daimeng Wei, Min Zhang
机构
*
Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳研究院)
;
NLP 2 CT Lab, Department of Computer and Information Science, University of Macau(澳门大学计算机与信息科学学院自然语言处理与CT实验室)
;
Huawei Translation Services Center(华为翻译服务中心)
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation
APEX-Searcher: 通过子目标细化信用分配以增强智能体检索增强生成
Kun Chen, Qingchao Kong, Zhao Feifei, Wenji Mao
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部)
;
Wenge Technology Co., Ltd(Wenger科技有限公司)
机构
*
Case Western Reserve University, Cleveland, OH, USA(凯斯西储大学)
;
Kean University, Union, NJ, USA(凯恩大学)
;
The Ohio State University, Columbus, OH, USA(俄亥俄州立大学)
;
Fudan University, Shanghai, China(复旦大学)
;
Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室)
;
The University of Hong Kong, Hong Kong, China(香港大学)
;
North Carolina State University, Raleigh, NC, USA(北卡罗来纳州立大学)
Strict Subgoal Execution: Reliable Long-Horizon Planning in Hierarchical Reinforcement Learning
严格子目标执行:在分层强化学习中的可靠长 horizon 规划
Jaebak Hwang, Sanghyeon Lee, Jeongmo Kim, Seungyul Han
机构
*
Graduate School of Artificial Intelligence(人工智能研究生院)
;
Ulsan National Institute of Science and Technology (UNIST)(釜山国立科学与技术研究所)
;
Ulsan, South Korea(韩国釜山)
RoadmapBench: Evaluating Long-Horizon Agentic Software Development Across Version Upgrades
RoadmapBench: 评估跨版本升级的长期代理软件开发
Xinbo Xu, Ruihan Yang, Haiyang Shen, Wendong Xu, Bofei Gao, Ruoyu Wu, Kean Shi, Weichu Xie, Xuanzhong Chen, Ming Wu, Jason Zeng, Michael Heinrich, Elvis Zhang, Liang Chen, Kuan Li, Baobao Chang
机构
*
UniPat AI
;
Peking University(北京大学)
;
Fudan University(复旦大学)
;
The University of Hong Kong(香港大学)
;
Tsinghua University(清华大学)
;
G Labs(0G实验室)
;
Pipeline Lab(Pipeline实验室)
CommentsV2 of the article: - Added AdaLN-zero - Added table comparing JEPA-WMs with baselines with std translating per-seed variability only, no variability across epochs - Reordered figures in main body of the paper V3: added data scaling experiments, theoretical appendix section on autoregressive rollout, acceptance at TMLR
Empowering VLMs for Few-Shot Multimodal Time Series Classification via Tailored Agentic Reasoning
通过定制代理推理增强VLMs在少样本多模态时间序列分类中的能力
Lin Li, Jiawei Huang, Qihao Quan, Dan Li, Boxin Li, Xiao Zhang, Erli Meng, Wenjie Feng, Jian Lou, See-Kiong Ng
机构
*
Sun Yat-sen University(中山大学)
;
Xiaomi Corporation(小米公司)
;
University of Science and Technology of China(中国科学技术大学)
;
National University of Singapore(新加坡国立大学)
Helping Customers in Distress: An LLM-powered Agent that Converses, Probes, and Routes
帮助陷入困境的客户:一个基于LLM的代理,能够对话、探测和分流
Alankar Atreya, Stefan Sylvius Wanger, Devesh Batra, Robert Hankache, Cristovao Iglesias, Patrick Sinclair, Giulio Pelosio, Michael McMillan, Greig A. Cowan, Raad Khraishi