arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

Cisco(思科)

2026-05-14 至 2026-05-14 共收录 2
2605.13695 2026-05-14 cs.CL cs.AI

RTLC -- Research, Teach-to-Learn, Critique: A three-stage prompting paradigm inspired by the Feynman Learning Technique that lifts LLM-as-judge accuracy on JudgeBench with no fine-tuning

RTLC -- 研究、教以学、批判:一种受费曼学习技术启发的三阶段提示范式,无需微调即可提升LLM-as-judge在JudgeBench上的准确性

Andrea Morandi

机构 * Cisco(思科)

AI总结 RTLC通过三阶段提示方法提升LLM在JudgeBench上的准确性,无需微调或外部工具,其核心方法包括研究、教以学和批判三个阶段,显著提升客观正确性评分的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21345 2026-05-14 cs.AI cs.CL

Evaluating AI Meeting Summaries with a Reusable Cross-Domain Pipeline

用可重用的跨领域管道评估AI会议摘要

Philip Zhong, Don Wang, Jason Zhang

机构 * Cisco Systems, Inc.(思科系统公司)

AI总结 本文提出一个可重用的跨领域管道,用于评估AI会议摘要,通过结构化真实数据构建、固定候选生成、基于声明评分等方法,在114次会议上验证了不同模型的性能,发现gpt-5.1在保留性上表现更优。

Comments AI Application Feature Quality Evaluation (28 pages total)

详情

展开后加载摘要…

URL PDF HTML 收藏