Survive at All Costs: Exploring LLM's Risky Behaviors under Survival Pressure
在生存压力下:探索LLM的冒险行为
Yida Lu, Jianwei Fang, Xuyang Shao, Zixuan Chen, Shiyao Cui, Shanshan Bian, Guangyao Su, Pei Ke, Han Qiu, Minlie Huang
机构
*
The Conversational AI (CoAI) group, DCST, Tsinghua University(清华大学智能对话AI小组,DCST,清华大学)
;
China Unicom Software Research Institute(中国联合软件研究所)
;
University of Electronic Science and Technology of China(电子科技大学)
;
Institute for Network Sciences and Cyberspace, Tsinghua University(清华大学网络科学与网络空间研究院)
专题命中
评测与基准
:LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
Felix Draxler, Justus Will, Farrin Marouf Sofian, Theofanis Karaletsos, Sameer Singh, Stephan Mandt
机构
*
Department of Computer Science, University of California, Irvine(加州大学伊维特分校计算机科学系)
;
Chan-Zuckerberg Initiative(张博士基金会)
;
Pyramidal AI(金字塔人工智能)
;
Computer Science & AI in Science Institute, University of California, Irvine(加州大学伊维特分校计算机科学与科学人工智能研究所)
EchoMind: An Interrelated Multi-level Benchmark for Evaluating Empathetic Speech Language Models
EchoMind: 一种相互关联的多级基准,用于评估共情语音语言模型
Li Zhou, Lutong Yu, You Lyu, Yihang Lin, Zefeng Zhao, Junyi Ao, Yuhao Zhang, Benyou Wang, Haizhou Li
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Shenzhen Research Institute of Big Data(深圳大数据研究院)
;
Shenzhen Loop Area Institute(深圳河套学院)
SinhaLegal: A Benchmark Corpus for Information Extraction and Analysis in Sinhala Legislative Texts
SinhaLegal:用于僧伽罗语立法文本信息提取与分析的基准语料库
Minduli Lasandi, Nevidu Jayatilleke
机构
*
School of Computing, Informatics Institute of Technology(计算学院,信息学院技术研究所)
;
Department of Computer Science & Engineering, University of Moratuwa(计算机科学与工程系,莫图瓦大学)
专题命中
评测与基准
:language model(abstract,comments);small language model(abstract);分类 cs.CL
GhostEI-Bench: Do Mobile Agents Resilience to Environmental Injection in Dynamic On-Device Environments?
GhostEI-Bench: 移动代理在动态设备环境中的环境注入鲁棒性研究
Chiyu Chen, Xinhao Song, Yunkai Chai, Yang Yao, Haodong Zhao, Lijun Li, Jie Li, Yan Teng, Gongshen Liu, Yingchun Wang
机构
*
Shanghai Jiao Tong University, School of Computer Science(上海交通大学计算机科学学院)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
The University of Hong Kong(香港大学)
机构
*
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
BenchCouncil (International Open Benchmark Council)(Benchmark委员会)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Artificial Intelligence and Data Science, Hebei University of Technology(河北工业大学人工智能与数据科学学院)
专题命中
评测与基准
:large language model(abstract);language model(abstract);分类 cs.CL
ORMOT: A Dataset and Framework for Omnidirectional Referring Multi-Object Tracking
ORMOT: 一个用于全方位参照多目标跟踪的数据集和框架
Sijia Chen, Zihan Zhou, Yanqiu Yu, En Yu, Wenbing Tao
机构
*
State Key Laboratory of Multispectral Information Intelligent Processing Technology, School of Artificial Intelligence and Automation, Huazhong University of Science and Technology(多谱信息智能处理技术国家重点实验室,人工智能与自动化学院,华中科技大学)