arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Zhejiang University(浙江大学)

2026-07-30 至 2026-07-30 共收录 4
2607.01240 2026-07-30 cs.CL cs.AI 版本更新

Prompt Framing Distorts Count Based Evaluation of LLM Error Detection: Evidence from Numeric Anchoring

提示框架扭曲了基于计数的LLM错误检测评估:来自数字锚定的证据

Dekun Yang

机构 * Zhejiang University(浙江大学)

AI总结 本文发现基于计数的F1分数可能因提示中的数字锚定而虚高,与跨度定位能力脱节,提出ErrorBench压力测试协议,并建议评估时应避免预置错误计数并报告跨度感知指标。

Comments 15 pages, 6 figures, 12 tables. Preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11007 2026-07-30 cs.AI cs.CL 版本更新

AdaMARP: An Adaptive Multi-Agent Interaction Framework for General Immersive Role-Playing

AdaMARP: 一种自适应多智能体交互框架用于通用沉浸式角色扮演

Zhenhua Xu, Dongsheng Chen, Shuo Wang, Jian Li, Chengjie Wang, Meng Han, Yabiao Wang

机构 * Zhejiang University(浙江大学) Tencent Youtu Lab(腾讯优图实验室)

AI总结 AdaMARP提出了一种自适应多智能体交互框架,通过沉浸式信息格式和显式场景管理器提升角色扮演的沉浸感和适应性,实验表明其在角色一致性、环境基础性和场景转换等方面优于现有系统。

Comments ACL2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.16038 2026-07-30 cs.CL 版本更新

ChineseBERT: Chinese Pretraining Enhanced by Glyph and Pinyin Information

ChineseBERT:通过字形和拼音信息增强的中文预训练模型

Zijun Sun, Xiaoya Li, Xiaofei Sun, Yuxian Meng, Guoyin Wang, Xiang Ao, Qing He, Fei Wu, Jiwei Li

机构 * Zhejiang University(浙江大学) Key Lab of Intelligent Information Processing of Chinese Academy of Sciences(中国科学院智能信息处理重点实验室)

AI总结 研究针对中文预训练模型忽略字形和拼音信息的问题,提出ChineseBERT,将二者纳入预训练,在大规模语料库上训练后,在多种中文NLP任务中性能显著提升,取得新SOTA,代码和模型已公开。

Comments To appear at ACL2021

详情

展开后加载摘要…

URL PDF HTML 收藏
1911.02855 2026-07-30 cs.CL 版本更新

Dice Loss for Data-imbalanced NLP Tasks

数据不平衡自然语言处理任务的骰子损失

Xiaoya Li, Xiaofei Sun, Yuxian Meng, Guoyin Wang, Junjun Liang, Fei Wu, Jiwei Li

机构 * Department of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术系)

AI总结 针对数据不平衡的自然语言处理任务,提出用基于索伦森 - 戴斯系数或特沃斯基指数的骰子损失取代交叉熵目标,并给训练示例关联动态权重,在多种任务上显著提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏