arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-13 至 2026-03-13 共收录 8 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 8 篇

2603.12176 2026-03-13 cs.CV cs.AI 79%

BehaviorVLM: Unified Finetuning-Free Behavioral Understanding with Vision-Language Reasoning

BehaviorVLM: 无需微调的统一行为理解与视觉-语言推理

Jingyang Ke, Weihan Li, Amartya Pradhan, Jeffrey Markowitz, Anqi Wu

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 BehaviorVLM通过无需微调的视觉-语言框架,实现了姿态估计和行为理解的统一,利用详细推理步骤减少人工标注,提升多动物行为分析的可扩展性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12038 2026-03-13 cs.LG cs.AI 73%

Slow-Fast Inference: Training-Free Inference Acceleration via Within-Sentence Support Stability

慢-快推理:通过句内支持稳定性实现无需训练的推理加速

Xingyu Xie, Zhaochen Yu, Yue Liao, Tao Wang, Kim-Chuan Toh, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) ByteDance(字节跳动)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 SFI通过利用句内支持稳定性,将生成过程分为快速低成本步骤和偶尔的密集注意力慢步骤,从而提高解码吞吐量并保持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11950 2026-03-13 cs.AI cs.LG 62%

Learning Transferable Sensor Models via Language-Informed Pretraining

通过语言引导预训练学习可迁移的传感器模型

Yuliang Chen, Arvind Pillai, Yu Yvonne Wu, Tess Z. Griffin, Lisa Marsch, Michael V. Heinz, Nicholas C. Jacobson, Andrew Campbell

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 SLIP通过语言引导预训练学习可迁移的传感器模型,整合对比对齐与传感器条件标注,支持不同时间分辨率和输入长度,实现跨领域任务的高效性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11682 2026-03-13 cs.LG cs.AI 62%

Entropy-Preserving Reinforcement Learning

熵保持强化学习

Aleksei Petrenko, Ben Lipkin, Kevin Chen, Erik Wijmans, Marco Cusumano-Towner, Raja Giryes, Philipp Krähenbühl

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出熵保持强化学习方法,通过监控和控制熵来维持探索多样性,提升策略性能和可训练性。

Comments Published at ICLR 2026

Journal ref Proceedings of the International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.21599 2026-03-13 cs.IR cs.AI cs.LG 62%

Refine-POI: Reinforcement Fine-Tuned Large Language Models for Next Point-of-Interest Recommendation

Refine-POI: 通过强化微调优化大型语言模型用于下一步兴趣点推荐

Peibo Li, Shuang Ao, Hao Xue, Yang Song, Maarten de Rijke, Johan Barthélemy, Tomasz Bednarz, Flora D. Salim

专题命中 其他推理 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Refine-POI通过拓扑感知ID生成和强化微调,解决LLMs在POI推荐中的语义连续性和top-k推荐问题,提升推荐准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11948 2026-03-13 cs.NI 50%

Kraken*: Architecting Generative, Semantic, and Goal-Oriented Network Management for 6G Wireless Systems

Kraken*:为6G无线系统构建生成、语义和目标导向的网络管理

Ian F. Akyildiz, Tuğçe Bilen

专题命中 其他推理 :reasoning(abstract)

AI总结 Kraken*通过整合语义通信、生成式推理和目标导向优化,为6G无线系统提供生成、语义和目标导向的网络管理架构,推动向知识原生6G系统演进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11920 2026-03-13 cs.NI 50%

The Network That Thinks: Kraken* and the Dawn of Cognitive 6G

会思考的网络:Kraken* 与认知6G的黎明

Ian F. Akyildiz, Tuğçe Bilen

专题命中 其他推理 :reasoning(abstract)

AI总结 Kraken是一种面向6G的智能网络架构,通过语义通信、生成推理和目标优化实现集体智能,提升自动驾驶、XR服务和基础设施监控的效率与响应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06965 2026-03-13 cs.CV 50%

MedMO: Grounding and Understanding Multimodal Large Language Model for Medical Images

MedMO:为医学图像构建和理解多模态大语言模型

Ankan Deria, Komal Kumar, Adinath Madhavrao Dukre, Eran Segal, Salman Khan, Imran Razzak

专题命中 其他推理 :reasoning(abstract)

AI总结 MedMO是一种基于通用MLLM架构构建的医学多模态基础模型,通过多阶段训练提升跨模态和任务的性能,超越现有开源基线,在医学图像识别和报告生成中取得显著提升。

Comments 21 pages, 6 figures and 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏