arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Columbia University(哥伦比亚大学)

2026-04-28 至 2026-04-28 共收录 3
2509.03525 2026-04-28 cs.CL cs.AI eess.AS

Speech-Based Cognitive Screening: A Systematic Evaluation of LLM Adaptation Strategies

基于语音的认知筛查:大型语言模型适应策略的系统评估

Fatemeh Taherinezhad, Mohamad Javad Momeni Nezhad, Sepehr Karimi, Sina Rashidi, Ali Zolnour, Maryam Dadkhah, Yasaman Haghbin, Hossein AzadMaleki, Maryam Zolnoori

机构 * Columbia University Irving Medical Center(哥伦比亚大学伊文思医疗中心) School of Nursing, Columbia University(哥伦比亚大学护理学院)

AI总结 本文系统评估了大型语言模型在痴呆症检测中的适应策略,发现上下文学习、推理增强提示和参数高效微调等方法对模型性能有显著影响,展示了适配模型在语音筛查中的有效性。

Journal ref https://ai.jmir.org/2026/1/e82608

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.24038 2026-04-28 cs.AI cs.CL cs.SE

AgentPulse: A Continuous Multi-Signal Framework for Evaluating AI Agents in Deployment

AgentPulse:一个连续多信号框架用于评估AI代理在部署中的表现

Yuxuan Gao, Megan Wang, Yi Ling Yu

机构 * University of Pennsylvania(宾夕法尼亚大学) Columbia University(哥伦比亚大学) OpenMesh AI

AI总结 本文提出AgentPulse框架,通过18种实时信号评估50个AI代理在10种工作负载中的表现,揭示部署中的采纳、维护和体验信息,强调其作为方法论而非真实排名的价值。

Comments 19 pages, 5 figures, 9 tables. Preprint under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16637 2026-04-28 cs.CL cs.AI cs.LG

SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation

SSR-Zero:用于机器翻译的简单自我奖励强化学习

Wenjie Yang, Mao Zheng, Mingyang Song, Zheng Li, Sitong Wang

机构 * Tencent Hunyuan(腾讯文元) Columbia University(哥伦比亚大学)

AI总结 本文提出SSR-Zero框架,通过自评奖励实现无参考、在线训练,优于现有MT特定LLM和通用LLM,在英中翻译任务中表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏