arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-16 至 2026-03-16 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 8 篇

2603.12717 2026-03-16 cs.RO cs.AI cs.LG 86%

Altered Thoughts, Altered Actions: Probing Chain-of-Thought Vulnerabilities in VLA Robotic Manipulation

改变的思维,改变的行为:探测VLA机器人操作中的链式思维漏洞

Tuan Duong Trinh, Naveed Akhtar, Basim Azam

专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨VLA模型中链式思维的脆弱性,发现仅篡改推理轨迹中的物体名称即可显著降低任务成功率,而其他篡改方式影响较小,表明动作解码器依赖实体引用完整性而非推理质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02435 2026-03-16 cs.AI cs.LG 62%

VL-KGE: Vision-Language Models Meet Knowledge Graph Embeddings

VL-KGE:视觉-语言模型与知识图谱嵌入的结合

Athanasios Efthymiou, Stevan Rudinac, Monika Kackovic, Nachoem Wijnberg, Marcel Worring

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出VL-KGE框架,结合视觉-语言模型的跨模态对齐与结构关系建模,提升多模态知识图谱的链接预测性能。

Comments Published in Proceedings of the ACM Web Conference 2026 (WWW '26). This arXiv version includes extended supplementary material

Journal ref In Proceedings of the ACM Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07490 2026-03-16 cs.CL cs.LG 62%

Mask-Enhanced Autoregressive Prediction: Pay Less Attention to Learn More

增强的自回归预测:少关注多学习

Xialie Zhuang, Zhikai Jia, Jianjin Li, Zhenyu Zhang, Li Shen, Zheng Cao, Shiwei Liu

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本文提出MEAP方法,通过整合MLM与NTP提升上下文检索能力,实验显示其在关键信息检索和长上下文推理任务中表现优异,且在常识推理任务中不逊色。

Comments 17 pages,7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12826 2026-03-16 cs.CL 57%

Rethinking Multiple-Choice Questions for RLVR: Unlocking Potential via Distractor Design

重新思考用于RLVR的多项选择题:通过干扰项设计解锁潜力

Xu Guo, Qiming Ge, Jian Tong, Kedi Chen, Jin Zhang, Xiaogui Yang, Xuan Gao, Haijun Lv, Zhihui Lu, Yicheng Zou, Qipeng Guo

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Fudan University(复旦大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文研究了干扰项设计对RLVR的影响,发现选项数量不匹配和强干扰项能有效减少随机猜测,提出IDC框架提升干扰项质量,实验表明在多个基准上显著提升了RLVR训练效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12813 2026-03-16 cs.AI 57%

Context is all you need: Towards autonomous model-based process design using agentic AI in flowsheet simulations

上下文即一切:利用流表模拟中的代理AI实现自主的基于模型的过程设计

Pascal Schäfer, Lukas J. Krinke, Martin Wlotzka, Norbert Asprion

机构 * BASF SE(巴斯夫股份有限公司) RWTH Aachen University(亚琛工业大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出一种代理AI框架,利用先进LLM在工业流表模拟环境中辅助过程设计,通过分解任务实现工程知识与代码生成的协同,展示了在反应分离、压力 swing 蒸馏和异构azeotropic 蒸馏中的应用效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17288 2026-03-16 cs.CL eess.AS 57%

Triple X: A LLM-Based Multilingual Speech Recognition System for the INTERSPEECH2025 MLC-SLM Challenge

三X:一种基于LLM的多语言语音识别系统,用于INTERSPEECH2025 MLC-SLM挑战

Miaomiao Gao, Xiaoxiao Xiang, Yiwen Guo

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出Triple X系统,通过创新的编码器-适配器-LLM架构优化多语言对话场景的语音识别准确率,采用多阶段训练策略提升多语言识别性能,实验结果显示在开发和测试集上取得竞争力的词错误率表现。

Comments Accepted By Interspeech 2025 MLC-SLM workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15509 2026-03-16 cs.HC cs.CL 57%

Representing data in words: A context engineering approach

用词语表示数据:一种上下文工程方法

Amandine M. Caut, Amy Rouillard, Beimnet Zenebe, Matthias Green, Ágúst Pálmason Morthens, David J. T. Sumpter

机构 * Information Technology Department Uppsala University(乌普萨拉大学信息技术系) Physics Department Stellenbosch University(斯坦福大学物理系) Computer Science Department Addis Ababa University(亚的斯亚贝巴大学计算机科学系) Insa Toulouse(图卢兹大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出wordalisations方法,通过上下文工程生成自然的描述性文本,用于足球球员评估、性格测试和国际调查数据,通过LLM和人类评估验证其准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12600 2026-03-16 cs.HC 50%

How GenAI Mentor Configurations Shape Early Collaborative Dynamics: A Classroom Comparison of Individual and Shared Agents

生成式人工智能导师配置如何塑造早期协作动态:个体与共享代理的课堂比较

Siyu Zha, Weijing Liu, Fei Qin, Jie Cao, Yanjin Wang, Yujia Liu, Kaiyi Zhang, Jiangtao Gong, Yingqing Xu

专题命中 其他推理 :reasoning(abstract)

AI总结 研究探讨了生成式人工智能配置对课堂协作调节的影响,发现共享AI促进收敛性协作,而个体AI则导致更分散的互动模式,需教师更多干预。

Comments 26 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏